- Información general
- Automatización de IU
- Acerca del paquete de actividades de automatización de IU
- Aplicaciones y tecnologías automatizadas con UI Automation
- Compatibilidad de proyectos
- UI-ANA-016: Introducir URL para abrir el navegador
- UI-ANA-017: ContinueOnError verdadero
- UI-ANA-018: enumerar actividades de OCR / imagen
- UI-DBP-006: uso del contenedor
- UI-DBP-013: uso incorrecto de la automatización de Excel
- UI-DBP-030: uso de variables prohibidas en selectores
- UI-DBP-031: verificación de actividad
- UI-PRR-001: Simular clic
- UI-PRR-002: Simular tipo
- UI-PRR-003: uso incorrecto de aplicación abierta
- UI-PRR-004: retrasos codificados
- UI-REL-001: Idx grande en selectores
- UI-SEC-004: datos de correo electrónico del selector
- UI-SEC-010: Restricciones de aplicaciones / URL
- UI-USG-011: atributos no permitidos
- UX-SEC-010: restricciones de aplicaciones / URL
- UX-DBP-029: uso no seguro de contraseña
- UI-PST-001: nivel de registro de auditoría en la configuración del proyecto
- Herramienta de migración del navegador de UiPath
- Recorte de región
- Grabadora de Computer Vision
- Acerca de la automatización de imágenes y texto
- Actividades con el ratón y el teclado
- Ejemplo de uso de la automatización de ratón y teclado
- Actividades de texto
- Ejemplo de uso de la automatización de texto
- Actividades de OCR
- Actividades de imagen
- Ejemplo de uso de la automatización de OCR y la automatización de imágenes
- Índice de actividades
- Activar
- Base de anclaje
- Asociar navegador
- Asociar ventana
- Bloquear entrada de usuario
- Aviso
- Comprobar
- Clic
- Clic en imagen
- Desencadenador de clic de imagen
- Clic en texto OCR
- Clic en el texto
- Desencadenador de clic
- Cerrar aplicación
- Cerrar pestaña
- Cerrar ventana
- Anclaje consciente de contexto
- Copiar texto seleccionado
- Desencadenador de cambio del atributo del elemento
- Elemento existente
- Ámbito del elemento
- Desencadenador de cambio de estado de elemento
- Exportar el árbol de la IU
- Extraer datos estructurados
- Buscar elementos secundarios
- Buscar elemento
- Buscar imagen
- Buscar coincidencias de imágenes
- Buscar texto OCR
- Buscar elemento relativo
- Buscar posición de texto
- Obtener ventana activa
- Obtener antecesor
- Obtener atributo
- Obtener información de atributo
- Obtener a partir del portapapeles
- Obtener texto completo
- Obtener texto OCR
- Obtener contraseña
- Obtener posición
- Obtener elemento de origen
- Obtener texto
- Obtener texto visible
- Volver
- Avanzar
- Ir a inicio
- Google Cloud Vision OCR
- Ocultar ventana
- Resaltar
- Desencadenador de tecla de acceso rápido
- Mantener el puntero
- Mantener el puntero en imagen
- Mantener el puntero sobre texto OCR
- Mantener el puntero en el texto
- Imagen existente
- Indicar en pantalla
- Insertar código .NET
- Inject Js Script
- Invocar método de ActiveX
- Desencadenador de pulsación de tecla
- Cargar imagen
- Maximizar ventana
- Microsoft Azure Computer Vision OCR
- Microsoft OCR
- Microsoft Project Oxford Online OCR
- Minimizar ventana
- Supervisar eventos
- Desencadenador del ratón
- Mover ventana
- Ir a
- Texto OCR existente
- Apariencia en elemento
- Fuga en elemento
- Apariencia en imagen
- Fuga en imagen
- Abrir aplicación
- Abrir navegador
- Actualizar navegador
- Reproducir evento de usuario
- Restaurar ventana
- Guardar imagen
- Seleccionar elemento
- Seleccionar varios elementos
- Enviar tecla de acceso rápido
- Establecer región de recorte
- Establecer foco
- Establecer texto
- Establecer en portapapeles
- Establecer atributo web
- Mostrar ventana
- Iniciar proceso
- Desencadenador del sistema
- Realizar captura
- Tesseract OCR
- Texto existente
- Información sobre herramientas
- Escribir en
- Escribir Texto Seguro
- Utilizar primer plano
- Esperar a atributo
- Esperar a fuga de elemento
- Esperar a fuga de imagen
- Comprobación de accesibilidad
- Desencadenador de eventos de aplicación
- Bloquear entrada de usuario
- Marcar/Desmarcar
- Comprobar estado de aplicación
- Comprobar elemento
- Clic
- Clic desencadenador de eventos
- Arrastrar y soltar
- Ámbito del elemento
- Extraer datos de tabla
- Buscar elementos
- Para cada elemento de interfaz de usuario
- Obtener datos del navegador
- Obtener Portapapeles
- Obtener texto
- Obtener URL
- Ir a URL
- Resaltar
- Mantener el puntero
- Inject Js Script
- Atajos del teclado
- Desencadenador de eventos de pulsación de tecla
- Desplazamiento del ratón
- Navegar por el navegador
- Guardar imagen
- Seleccionar elemento
- Establecer datos del navegador
- Configurar el portapapeles
- Establecer servidor de CV
- Establecer navegador de Runtime
- Establecer foco
- Establecer la configuración del proyecto
- Establecer texto
- Realizar captura
- Escribir en
- Desbloquear entrada de usuario
- Operación de ventana
- Transacción de llamada
- Clic en imagen en pantalla
- Hacer clic en botón de barra de herramientas
- Expandir tabla jerárquica ALV
- Expandir árbol ALV
- Expandir árbol
- Lectura de barra de estado
- Inicio de sesión en SAP
- Inicio de sesión en SAP
- Desencadenador de cambio de atributos de sesión de SAP
- Seleccionar fechas en el calendario
- Seleccionar elemento de menú
- Ámbito de la celda de la tabla
- Transacción de llamada
- Clic en imagen en pantalla
- Hacer clic en botón de barra de herramientas
- Expandir tabla jerárquica ALV
- Expandir árbol ALV
- Expandir árbol
- Lectura de barra de estado
- Inicio de sesión en SAP
- Inicio de sesión en SAP
- Seleccionar fechas en el calendario
- Seleccionar elemento de menú
- Ámbito de la celda de la tabla
- Realizar búsquedas en el navegador y recuperar resultados mediante las API de automatización de IU
- Exploración web
- Buscar imágenes
- Hacer clic en imágenes
- Eventos de desencadenador y supervisor
- Crear y anular archivos
- Páginas HTML: extraer y manipular información
- Manipulación de ventana
- Selección de lista automatizada
- Buscar y manipular elementos de ventana
- Gestionar automatización de texto
- Cargar y procesar imágenes
- Gestionar acciones activadas por el ratón
- Automatizar tiempo de ejecución de aplicación
- Ejecución automática de una aplicación local
- Navegación de explorador
- Automatización web
- Ejemplo de ámbito de desencadenador
- Habilitar soporte de automatización de IU en DevExpress
- Computer Vision Local Server
- Automatización móvil
- Notas relacionadas
- Acerca de la arquitectura de automatización de dispositivos móviles
- Compatibilidad de proyectos
- Obtener tipos de registro
- Obtener registros
- Obtener origen de la página
- Obtener la orientación del dispositivo
- Obtener identificador de sesión
- Instalar aplicación
- Administrar aplicación actual
- Administrar otras aplicaciones
- Abrir enlace profundo
- Abrir URL
- Conexión de dispositivo móvil
- Deslizamiento direccional
- Patrón de dibujo
- Pase de dedo posicional
- Pulse un botón del hardware
- Establecer orientación del dispositivo
- Realizar captura
- Tomar parte de la captura de pantalla
- Elemento existente
- Ejecutar comando
- Obtener atributo
- Obtener elemento seleccionado
- Obtener texto
- Establecer elemento seleccionado
- Establecer texto
- Deslizamiento
- Pulsar
- Escribir Texto
- Primeros pasos con las API de automatización móvil
- Gestionar cuadros de diálogo emergentes en automatizaciones móviles
- Creating variables from selector attributes
- Creación de flujos de trabajo de automatización móvil
- Utilizar automatización móvil para una aplicación de banca móvil
- Automatización para aplicaciones React Native
- Terminal
- Notas relacionadas
- Acerca del paquete de actividades de Terminal
- Compatibilidad de proyectos
- Mejores prácticas
- Buscar texto
- Obtener color de la posición
- Obtener la posición del cursor
- Obtener campo
- Obtener campo en posición
- Obtener área de pantalla
- Obtener texto
- Obtener texto en posición
- Mover cursor
- Mover cursor al texto
- Enviar tecla de control
- Teclas de envío
- Teclas de envío seguras
- Establecer campo
- Configurar campo en posición
- Sesión del terminal
- Esperar texto de campo
- Esperar a que la pantalla esté lista
- Esperar texto en pantalla
- Esperar texto en posición
- API de automatización codificadas de terminal
Notas de la versión v26.10 para actividades de automatización de IU, versiones 26.10.x.
v26.10.3
Fecha de lanzamiento: 21 de agosto de 2026
UI Explorer multiplataforma
UI Explorer, la herramienta utilizada para indicar elementos de IU y generar selectores durante la creación de Automatización de IU, ahora está disponible como herramienta multiplataforma. Anteriormente, esta capacidad solo estaba disponible en Windows, lo que dejaba a los usuarios en macOS sin una forma de inspeccionar o ajustar los selectores. La nueva herramienta ofrece la misma experiencia en todas las versiones de Studio, ya sea que estés creando automatizaciones de Windows, macOS o multiplataforma.
Para obtener más información, consulta la página UI Explorer.
Cada actividad de automatización de IU que se dirige a un elemento de IU ahora expone dos comandos adicionales en el menú contextual Expandir propiedades de destino , lo que facilita el movimiento de objetivos entre actividades y el nuevo UI Explorer:
- Copiar destino al portapapeles : copia el destino unificado de la actividad, para que pueda pegarse en la tarjeta Editar elemento de UI Explorer .
- Pegar destino del portapapeles : pega un destino unificado previamente indicado en UI Explorer.
Automatización SAP
-
Se ha añadido Extraer datos para soporte de SAP WebGUI y se ha mejorado el comportamiento de solicitud repetible de tabla/árbol.
-
Los selectores de archivos programables ahora están siempre habilitados en SAP GUI para Java. Al automatizar, SAP ahora abre sus cuadros de diálogo de selector de archivos programable en lugar de los nativos. Esto aporta las siguientes mejoras:
-
Los cuadros de diálogo programables están diseñados para la automatización y no mantienen ocupada la sesión SAP. Las acciones que abren un selector de archivos a través de selectores de SAP con el método de entrada Simular, o a través de actividades específicas de SAP, ya no se detienen esperando a que se desbloquee la sesión de scripting. Pasos de configuración complicados, como habilitar "Aplicar tiempo de espera duro de SAP" y establecer "Continuar en caso de error" en Verdadero, ya no son necesarios.
-
Sus selectores son más resistentes a las actualizaciones del cliente SAP, lo que hace que las automatizaciones sean más fiables con el tiempo.
ADVERTENCIA:Debido a que el tipo de diálogo cambia, los flujos de trabajo existentes que automatizan los selectores de archivos SAP deben actualizarse para apuntar a los nuevos diálogos.
-
Opciones de instalación de la extensión del navegador expandida para macOS
A partir de UiPath Assistant 2026.0.200 STS, los usuarios de macOS pueden instalar y gestionar las extensiones del navegador para Chrome, Edge y Safari utilizando los siguientes métodos de instalación:
- Usuario actual
- Todos los usuarios
- Póliza de grupo en línea
- Política de grupo sin conexión
- Usuario actual (solo host de mensajería nativo)
- Todos los usuarios (solo host de mensajería nativo)
Esta mejora proporciona una mayor flexibilidad para la implementación de extensiones y acerca la experiencia de macOS a la de Studio Desktop. Para obtener más información, consulta la documentación de la extensión de Chrome en macOS y la extensión de Safari .
Corrección de errores
- Se ha corregido una incidencia en la experiencia clásica de automatización de IU por la que editar el selector de ventanas para una pantalla de repositorio de objetos con la opción Actualizar el selector de ventanas en objetos secundarios habilitada no actualizaba el selector de ventanas para los objetos secundarios.
v26.10.2
Fecha de lanzamiento: 10 de agosto de 2026
Soporte de UI Automation para agentes de codificación
Las mejoras para los agentes de codificación en Automatización de IU incluyen:
Mejoras en el selector y la orientación:
- Se han implementado selectores semánticos para agentes de codificación, lo que permite la identificación de elementos utilizando descripciones en lenguaje natural y análisis visual cuando los métodos basados en DOM no están disponibles.
- Se ha añadido soporte de agente de codificación para aplicaciones SAP GUI para Java .
- Se ha añadido la validación de la configuración de destino para los agentes de codificación, lo que ayuda a garantizar que las definiciones de destino sean precisas antes de su uso.
- Se han actualizado los objetivos difusos para deshabilitar
check:textde forma predeterminada para las actividades Escribir en, Establecer texto, Obtener texto y Seleccionar elemento , mejorando la fiabilidad de la orientación de elementos.
Mejoras en la línea de comandos:
- Se ha ampliado el conjunto de comandos
uip rpa uia interact sapconexpand-tree,select-dates-in-calendare interaccionesclick-picture-on-screen. - Se ha añadido un nuevo comando
uip rpa uia target-anchorable preview-textpara obtener una vista previa del texto que devolvería una actividad Obtener texto para una definición anclable de destino. - Se ha mejorado el comando
uip rpa uia target-anchorable resolve-defaultspara admitir el elementonamey los atributosdescriptionpara una identificación más precisa. - Se ha mejorado la experiencia de la interfaz de línea de comandos (CLI) en macOS con la inspección de permisos del sistema y un nuevo comando
uip rpa uia permissionspara verificar o solicitar los permisos necesarios (Accesibilidad y Grabación de pantalla).
UI Automation Modern
- Se ha adoptado el nuevo widget de editor de código habilitado para JS para la propiedad Código de script de la actividad Insertar Script Js . El widget está disponible solo en proyectos de Windows, a partir de Studio Desktop 26.0.198. El soporte de Studio Web aún no está implementado.
- Se ha ampliado el seguimiento de la actividad de Automatización de IU para capturar los detalles de consumo de las actividades semánticas y ScreenPlay. El seguimiento de ejecución está deshabilitado de forma predeterminada y puede habilitarse a través de la configuración del proyecto Automatización de IU Moderna > Registro de UiPath Robot > Habilitar seguimiento de actividad . Los datos de seguimiento se cargan en Orchestrator solo para trabajos fallidos.
Árbol de IU del asistente de selección
- Se ha añadido un botón Habilitar Computer Vision directamente en el panel Árbol de IU . La pestaña Elementos del CV ahora está siempre visible cuando una aplicación está en el ámbito y se están seleccionando elementos. Cuando Computer Vision está deshabilitado, el panel muestra un estado procesable con un botón Habilitar Computer Vision que activa CV, realiza una captura de pantalla y crea el árbol de elementos CV automáticamente.
Corrección de errores
- Se ha corregido una incidencia por la que aparecía un cuadro de diálogo de autenticación de proxy ("Iniciar sesión para acceder a este sitio") durante la indicación de elementos con actividades de automatización de IU moderna, lo que evitaba que los usuarios indicaran elementos de IU detrás del cuadro de diálogo.
v26.10.1
Fecha de lanzamiento: 21 de julio de 2026
Asistente de selección
- Se ha añadido soporte para configurar puntos de desplazamiento directamente desde el asistente de selección, a través de un nuevo botón en el panel de expansión de destino. Al actualizar un punto de desplazamiento, el destino asociado se selecciona y resalta automáticamente para proporcionar comentarios visuales inmediatos.
- Se ha actualizado el selector del marco de IU preferido para que aparezca como un botón de menú compacto en la barra de acción, con abreviaturas e iconos de estrategia (Auto/AA/UIA).
- Se ha mejorado el rendimiento del asistente de selección , reduciendo la detección de cambios y la sobrecarga de renderizado al pasar el ratón por encima, la selección de elementos y las interacciones de diseño.
Soporte de UI Automation para agentes de codificación
- Se ha añadido soporte de orientación de Computer Vision (CV), lo que permite a los agentes de codificación configurar métodos de orientación basados en CV para elementos de IU.
- Descubrimiento mejorado de elementos basado en agentes con capacidades de análisis de imagen y semántico . Cuando un DOM de navegador o aplicación no está disponible, los agentes ahora pueden identificar elementos de IU utilizando información visual y descripciones en lenguaje natural.
- Diagnóstico visual mejorado al generar capturas de pantalla anotadas que resaltan los elementos identificados, además de nuevos límites de tamaño de captura de pantalla para controlar los costes de imagen y token.
- Se ha añadido soporte para validar las configuraciones de destino y anclaje a través de las herramientas de automatización de IU, lo que ayuda a garantizar que las definiciones de destino sean precisas antes de su uso.
Mejoras
- Se ha ampliado la API de resaltado de UI Automation con una opción de Relleno que representa un rectángulo de color sólido sobre un elemento de destino, lo que permite a los flujos de trabajo ocultar información confidencial o resaltar varias regiones de la pantalla antes de realizar capturas de pantalla.
v26.10.0
Fecha de lanzamiento: 24 de junio de 2026
UIAutomation de agente
Selectores semánticos
Los selectores semánticos ahora admiten dos métodos de búsqueda: modelo de objeto de documento (DOM) e imagen. El modo DOM es el predeterminado para las aplicaciones web y coincide con los elementos utilizando información extraída del DOM de la aplicación. El modo de imagen es un nuevo método de búsqueda, y el predeterminado para aplicaciones no web, que utiliza la imagen de pantalla visible y las capacidades de conexión a tierra de imagen de los modelos multimodales modernos para comprender el contenido visible como lo haría un humano. Admite cualquier tipo de descripciones, incluidas las descripciones visuales (donde el método DOM generalmente fallaría).
Puedes elegir el modelo utilizado para cada método de búsqueda en el menú desplegable Modelo en Configuración del proyecto > Automatización de IU > Selector semántico. el modo DOM admite Gemini 2.5 Flash y PathMini; El modo de imagen utiliza PathMini.
Para obtener más información, consulta Buscar métodos.
Actividades semánticas
Ahora puedes impulsar las actividades de semántica de automatización de IU con tu propia suscripción de modelo lingüístico de gran tamaño en lugar de la suscripción gestionada por UiPath. Puedes configurar tu modelo en Automatización de IU > Actividades semánticas en la pestaña de configuraciones de LLM de AI Trust Layer, utilizando uno de los modelos compatibles. Para conocer los pasos de configuración, consulta Actividades semánticas Configuración de traer tu propio modelo.
Ahora puedes establecer valores predeterminados en el nivel de proyecto para las actividades semánticas (el modelo predeterminado para cada actividad y el modo de extracción para Extraer datos de IU (vista previa)) en Configuración del proyecto > Automatización de IU moderna > Actividades semánticas. Estos valores predeterminados se aplican tanto durante las experiencias de tiempo de diseño de Studio, como las ejecuciones de selección y prueba, como en el runtime. Para obtener los valores predeterminados en el nivel de proyecto, consulta Configuración del proyecto moderno de automatización de IU.
La actualización del paquete de actividades de automatización de IU cambia el modelo predeterminado para las actividades semánticas (excluyendo Cerrar ventana emergente) a PathMini. Para conocer los pasos de configuración, consulta Actividades semánticas Configuración de traer tu propio modelo. Para obtener los valores predeterminados en el nivel de proyecto, consulta Configuración del proyecto moderno de automatización de IU.
ScreenPlay
- Compatibilidad con SecureString y ScreenPlayImage en flujos de trabajo codificados : los flujos de trabajo codificados de ScreenPlay ahora manejan dos tipos de argumentos adicionales:
SecureString, para pasar valores de cadena confidenciales sin exponerlos en texto sin formato, yScreenPlayImage, para incluir una captura de pantalla directamente en la solicitud de ScreenPlay para dar el contexto visual adicional del modelo. Anteriormente, los flujos de trabajo codificados no tenían un manejo nativo para estos tipos; este cambio los lleva a la paridad con los flujos de trabajo de código bajo. - SpanId de seguimiento distribuido : ScreenPlay ahora añade un encabezado
X-UIPATH-SEMANTIC-SPAN-IDa las llamadas HTTP que realiza a los servicios de backend, como el proxy semántico y la puerta de enlace de LLM. El identificador de intervalo permite correlacionar una sola ejecución de ScreenPlay y sus solicitudes de extremo a extremo en todos los servicios, mejorando la observabilidad y la solución de problemas. - Modo de conexión de instancia de aplicación : ScreenPlay ahora admite el modo de conexión de ventana de instancia de aplicación en la actividad Usar aplicación/navegador. Las actividades internas buscan en toda la instancia de la aplicación (todas las ventanas principales y secundarias, alertas y ventanas emergentes) en lugar de una sola ventana, y ScreenPlay captura y registra los seguimientos correctamente en todas ellas, además del soporte de Ventana única existente.
- Archivo de seguimiento HTML actualizado : el archivo de seguimiento HTML de ScreenPlay tiene un diseño visual actualizado. La salida del visor de seguimiento ahora tiene un diseño y un estilo actualizados que hacen que los seguimientos de ejecución sean más fáciles de leer y navegar, alineados con los estándares de diseño actuales de UiPath.
Extraer datos de IU (vista previa)
Extraer datos de IU es una nueva actividad semántica impulsada por IA para extraer datos empresariales estructurados de cualquier pantalla de aplicación. Defines las estructuras de datos personalizadas que deseas capturar y recuperarlas como objetos empresariales, trabajando en todas las tecnologías de interfaz de usuario en lugar de estar limitado a un solo tipo de diseño. La actividad captura de forma predeterminada los datos del formulario web cuando hay un formulario presente, y también admite la extracción de campos personalizados a través de solicitudes personalizadas.
La actividad ahora gestiona los resultados "no encontrados" de forma coherente. Anteriormente, lanzaba una excepción cuando no se podía encontrar ninguna respuesta para ninguna consulta, pero devolvía cadenas vacías cuando solo faltaba un subconjunto de respuestas. Ahora, cuando no se puede encontrar un valor, se devuelve como null, lo que ofrece una forma única y predecible de detectar y gestionar los datos que faltan en todos los escenarios de extracción.
Extraer datos de IU es una actividad de vista previa: un laboratorio experimental para la extracción semántica de IU impulsada por esquemas. No está destinado a alcanzar la disponibilidad general como actividad independiente; esta funcionalidad se integrará en las capacidades de extracción de datos de ScreenPlay. Los usuarios que adopten Extraer datos de IU durante la vista previa deben planificar una eventual migración a ScreenPlay.
Healing Agent
Cuando Healing Agent no puede recuperar una actividad, los registros del robot ahora incluyen el motivo del fallo. El motivo aparece en los registros del robot en Orchestrator, para que puedas ver por qué una recuperación no se ha realizado correctamente sin inspeccionar los registros internos. Por ejemplo, una entrada de registro podría decir "Healing Agent no pudo recuperar la actividad. La autorreparación está deshabilitada".
Soporte de UI Automation para agentes de codificación
La versión 26.10.0 lleva la automatización de IU a los agentes de codificación de IA. Ahora puedes pedir a un agente, como Claude Code, Cursor, GitHub Copilot, que cree y mantenga la automatización de IU en lenguaje sencillo, e impulsará aplicaciones reales, generará selectores fiables y los registrará en el repositorio de objetos de tu proyecto en tu nombre.
Este soporte se envía como un conjunto de habilidades de agente empaquetadas junto con las actividades y respaldado por la interfaz de línea de comandos uip rpa uia . Las habilidades funcionan en las mismas superficies que las propias actividades: escritorio, web y aplicaciones SAP.
Se incluyen tres habilidades:
- Configurar un destino (
uia-configure-target): apunta el agente a una pantalla y los elementos que te interesan ("configura el botón Enviar en la página de pago"). Captura la aplicación activa, localiza cada elemento, genera un selector fiable, registra la pantalla y los elementos en el repositorio de objetos y verifica cada uno con una captura de pantalla antes de devolver los ID de referencia que tu flujo de trabajo puede utilizar. - Interactuar con una aplicación activa (
uia-interact): pide al agente que interactúe con una aplicación en ejecución: haz clic, escribe, lee valores, rellena formularios, navega por menús, extrae tablas o realiza capturas de pantalla. Útil para explorar una aplicación antes de automatizarla o para confirmar que un cambio se comporta como se espera. - Mejorar un selector (
uia-improve-selector): corrige, endurece o recupera un selector a partir de datos de runtime. Consulta Inteligencia del selector a continuación.
Las habilidades se envían en el repositorio de habilidades de uipath-rpa.
Inteligencia de selector (uia-improve-selector)
La inteligencia del selector es el motor de razonamiento detrás de la habilidad uia-improve-selector . Diagnostica por qué falló un selector y lo reescribe, sin editar manualmente el XML.
Los selectores se interrumpen cuando cambia una aplicación: se cambia el nombre de un atributo, se cambia un ID generado automáticamente, se mueve un diseño. La inteligencia del selector permite a un agente de codificación diagnosticar y reescribir un selector para que tu automatización siga funcionando, sin que tengas que editar manualmente el frágil XML del selector.
Funciona en dos modos:
- Recuperar : el selector ha dejado de funcionar ("elemento no encontrado", un fallo de runtime). El agente lo reescribe con el estado actual de la aplicación para que coincida de nuevo con el elemento.
- Mejorar : el selector sigue funcionando, pero es frágil, porque se basa en la posición, un ID generado automáticamente o un valor que refleja el contenido cambiante. El agente produce una versión más robusta que se dirige al mismo elemento.
Usa Mejorar de forma proactiva cuando revises un selector recién generado y notes que depende de un ID generado o índice posicional. Usa Recuperar de forma reactiva cuando un trabajo unattended falla y tienes los datos de runtime.
Qué lo hace fiable:
- Impulsado por datos de runtime. Funciona desde una aplicación activa o desde los datos capturados en el momento del fallo, por lo que un selector que se estropea en un robot desatendido puede recuperarse más tarde, en una máquina diferente, incluso cuando la aplicación ya no se está ejecutando.
- Consciente de la actividad. El agente sabe, por ejemplo, que un objetivo Obtener texto no debe apoyarse en el texto que debe leer, y que un objetivo Comprobar no debe depender de si la casilla está marcada actualmente. Cada reescritura sigue las reglas que mantienen un selector estable para su uso específico.
- Validado, no adivinado. Cada selector de candidatos se comprueba y se puntúa antes de que se escriba nada. Si el primer intento no se mantiene, el agente lo refina automáticamente y vuelve a intentarlo, luego mantiene el resultado más fuerte.
- Explicado. Cuando se recupera un selector, obtienes una causa raíz de una línea (por qué se rompió) y la estrategia utilizada para que sea duradero, para que puedas confiar en el cambio de un vistazo.
Automatización de Chromium
Hemos añadido Chromium Automation, un nuevo método de automatización del navegador que controla Chrome y Edge directamente a través del protocolo Chrome DevTools (CDP). UiPath inicia y gestiona la sesión del navegador internamente: no hay que instalar extensiones del navegador ni descargar binarios de WebDriver o mantener sincronizados con la versión de tu navegador.
Hay dos nuevas opciones disponibles en el menú desplegable Modo de automatización del navegador en la actividad Usar aplicación/navegador , y en Configuración del proyecto > Automatización de IU moderna > Aplicación/navegador:
- Automatización de Chromium : ideal para desarrollo, depuración y automatización unattended con un navegador visible
- Chromium Automation Headless : lo mejor para la automatización unattended en servidores y procesos CI/CD
Chromium Automation funciona con Chrome, Edge y todos los navegadores basados en Chromium. Firefox y Safari no son compatibles con este método; para ellos, sigue utilizando la Extensión del navegador o WebDriver.
Automatización de Oracle
Automatización de IU ahora admite la automatización de aplicaciones Oracle Fusion en las interfaces Oracle ADF (Application Development Framework) y Oracle Redwood (Oracle JET). Un nuevo enfoque de identificación muestra atributos de selector estables para cada tecnología, por lo que las automatizaciones siguen siendo fiables a pesar de la naturaleza dinámica de estas interfaces, y la gama completa de actividades de automatización de IU se puede utilizar en las pantallas de Oracle Fusion.
Para obtener más información, consulta Oracle Fusion Automation.
Automatización de IU de macOS
- Soporte mejorado para controles basados en menús de macOS en actividades Seleccionar elemento . Ahora puedes utilizar Seleccionar elemento con los controles
AXPopUpButtonyAXMenuButton, lo que permite una interacción fiable con elementos de IU desplegables y basados en menús que requieren abrir una ventana emergente para acceder a sus elementos. - Se ha añadido soporte para acciones de triple clic . Esta capacidad está disponible en:
- Windows y macOS utilizando eventos de hardware
- Windows y macOS con ChromiumAPI
- Se ha añadido soporte para acciones de arrastre del ratón en macOS.
UI Automation Modern
-
Se ha habilitado la característica Capturar elementos en el repositorio de objetos en proyectos multiplataforma.
-
La actividad Establecer navegador de runtime ahora puede resolver el navegador del sistema predeterminado en runtime en proyectos multiplataforma. Una nueva opción Usar navegador predeterminado del sistema permite seleccionar entre el navegador predeterminado del sistema o un navegador específico:
- Proyectos de Windows: Chrome, Edge, Firefox
- Proyectos multiplataforma: Chrome, Edge, Safari
El nombre para mostrar de la actividad ahora refleja el navegador seleccionado (valor literal, Navegador del sistema predeterminado o una expresión truncada).
-
Se ha añadido la actividad Comprobación de accesibilidad que permite a los usuarios realizar pruebas de accesibilidad en instancias de Test Manager dentro de Test Cloud. Esta actividad carga una página del navegador web y realiza comprobaciones de accesibilidad según el estándar WCAG 2.1 (o superior). Ejemplos de comprobaciones de accesibilidad incluyen DOM y accesibilidad visual, relación de contraste, etiquetas alt, orden de tabulación, roles ARIA inadecuados.
Editor de selector avanzado
-
Se han añadido controles de zoom al Editor de selector avanzado y al Asistente de selección, lo que te permite ampliar o reducir entre un 80 % y un 110 % utilizando las opciones +, - y Restablecer .
-
Se ha añadido soporte que distingue entre mayúsculas y minúsculas para los atributos en el Editor de selector avanzado.
-
Se ha añadido una opción Editar destino a Usar aplicación/navegador, exponiendo:
- Selector de ventanas
- Propiedades de la aplicación (como la URL del navegador, los argumentos del navegador, la ruta de la aplicación, los argumentos de la aplicación y el directorio de trabajo)
- La opción de Actualizar el selector de ventanas en actividades secundarias. Esto permite que cualquier cambio realizado en el Selector de ventanas de la pantalla se aplique automáticamente a todos los elementos secundarios.
-
El Editor de selector avanzado ahora se puede utilizar para editar selectores de ventana además de los selectores de elementos de IU.
-
En el panel Árbol de IU de UI Explorer, se ha añadido un conmutador para mostrar u ocultar propiedades con valores vacíos en las secciones Compatible con selector y Otros , lo que ayuda a mostrar solo información relevante.
-
Se ha añadido una opción Filtrar propiedades al panel Árbol de la IU , que permite filtrar las propiedades del nodo seleccionado por nombre tanto en la sección Compatible con el selector como en Otros .
Mejoras
- Selectores de accesibilidad activa optimizados para mejorar el rendimiento de Extraer datos de tabla para tablas grandes.
Corrección de errores
-
Para los nodos de tipo enlace, el texto no se recuperaba y la ruta del árbol se generaba utilizando el ID de SAP interno. Con esta corrección, se utiliza el texto de nodo adecuado. Esto afectaba a la actividad Expandir árbol de SAP .
-
Se ha corregido una incidencia por la que los selectores no se podían identificar al interactuar con vistas HTML en la aplicación CAMBIO Cosmic (una aplicación de atención médica basada en Java que utiliza JxBrowser).
-
Se ha corregido una incidencia por la que la actividad multiplataforma Escribir en dejaba de responder en las máquinas virtuales de Automation Cloud Robot.
-
Se ha corregido la captura nativa para glifos y caracteres japoneses.
-
Se ha corregido una incidencia por la que las extensiones de Java seguían informándose como instaladas después de desinstalarlas.
Correcciones, añadidas el 11 de agosto de 2026
Las siguientes entradas de ScreenPlay se omitieron del anuncio original v26.10.0 y se aplican a la versión v26.10.0.
Selección de modelo ampliada para ScreenPlay
El menú desplegable Modelo en la actividad ScreenPlay ahora ofrece una gama más amplia de modelos de Screen Agent, añadiendo GPT-5.4, GPT-5.4 mini, GPT-5.5, Gemini 3.0 Vista previa de Flash y Ruta Mini. Los modelos añadidos son más capaces y más rápidos que los disponibles anteriormente, y son los que más contribuyen a la reducción de la latencia de ejecución en esta versión en comparación con la versión 25.10 GA. Path Mini es un modelo basado en Qwen ajustado por UiPath para la comprensión de pantalla y la interacción de la IU, alojado y servido por UiPath en su propia infraestructura en la nube, y es la opción más rápida de la selección.
La selección completa es:
Nivel básico:
- Screen Agent (con Path Mini)
- Screen Agent (con Gemini 2.5 Flash)
- Screen Agent (con Versión preliminar de Gemini 3.0 Flash)
- Screen Agent (con GPT-4.1 mini)
- Screen Agent (con GPT-5 mini)
- Screen Agent (con GPT-5.4 mini)
Nivel estándar:
- Screen Agent (con GPT-4.1)
- Screen Agent (con GPT-5)
- Screen Agent (con GPT-5.4)
- Screen Agent (con GPT-5.5)
- OpenAI: operador
- Anthropic: uso del ordenador
Para conocer las características de cada modelo, consulta ScreenPlay.
Nuevo modelo predeterminado para ScreenPlay
El modelo predeterminado para la actividad ScreenPlay ha cambiado de Screen Agent (con Gemini 2.5 Flash) a Screen Agent (con GPT-5.4). GPT-5.4 es un modelo de nivel Estándar, mientras que Gemini 2.5 Flash es un modelo de nivel Básico. Las automatizaciones existentes mantienen el modelo con el que se configuraron; el nuevo valor predeterminado se aplica a las actividades de ScreenPlay recién añadidas.
Ejecución de ScreenPlay más allá del ámbito indicado
ScreenPlay ya no se limita a la aplicación o ventana aprobada como su ámbito. Ahora puede funcionar en varias pestañas del navegador y varias aplicaciones dentro de la misma tarea.
Correcciones de ejecución de ScreenPlay
Esta versión incluye correcciones en la fiabilidad de ejecución de ScreenPlay.
- v26.10.3
- UI Explorer multiplataforma
- Automatización SAP
- Opciones de instalación de la extensión del navegador expandida para macOS
- Corrección de errores
- v26.10.2
- Soporte de UI Automation para agentes de codificación
- UI Automation Modern
- Árbol de IU del asistente de selección
- Corrección de errores
- v26.10.1
- Asistente de selección
- Soporte de UI Automation para agentes de codificación
- Mejoras
- v26.10.0
- UIAutomation de agente
- Healing Agent
- Soporte de UI Automation para agentes de codificación
- Automatización de Chromium
- Automatización de Oracle
- Automatización de IU de macOS
- UI Automation Modern
- Editor de selector avanzado
- Mejoras
- Corrección de errores
- Correcciones, añadidas el 11 de agosto de 2026