- Información general
- Automatización de IU
- Acerca del paquete de actividades de automatización de IU
- Aplicaciones y tecnologías automatizadas con UI Automation
- Compatibilidad de proyectos
- UI-ANA-016: Introducir URL para abrir el navegador
- UI-ANA-017: ContinueOnError verdadero
- UI-ANA-018: enumerar actividades de OCR / imagen
- UI-DBP-006: uso del contenedor
- UI-DBP-013: uso incorrecto de la automatización de Excel
- UI-DBP-030: uso de variables prohibidas en selectores
- UI-DBP-031: verificación de actividad
- UI-PRR-001: Simular clic
- UI-PRR-002: Simular tipo
- UI-PRR-003: uso incorrecto de aplicación abierta
- UI-PRR-004: retrasos codificados
- UI-REL-001: Idx grande en selectores
- UI-SEC-004: datos de correo electrónico del selector
- UI-SEC-010: Restricciones de aplicaciones / URL
- UI-USG-011: atributos no permitidos
- UX-SEC-010: restricciones de aplicaciones / URL
- UX-DBP-029: uso no seguro de contraseña
- UI-PST-001: nivel de registro de auditoría en la configuración del proyecto
- Herramienta de migración del navegador de UiPath
- Recorte de región
- Grabadora de Computer Vision
- Acerca de la automatización de imágenes y texto
- Actividades con el ratón y el teclado
- Ejemplo de uso de la automatización de ratón y teclado
- Actividades de texto
- Ejemplo de uso de la automatización de texto
- Actividades de OCR
- Actividades de imagen
- Ejemplo de uso de la automatización de OCR y la automatización de imágenes
- Índice de actividades
- Activar
- Base de anclaje
- Asociar navegador
- Asociar ventana
- Bloquear entrada de usuario
- Aviso
- Comprobar
- Clic
- Clic en imagen
- Desencadenador de clic de imagen
- Clic en texto OCR
- Clic en el texto
- Desencadenador de clic
- Cerrar aplicación
- Cerrar pestaña
- Cerrar ventana
- Anclaje consciente de contexto
- Copiar texto seleccionado
- Desencadenador de cambio del atributo del elemento
- Elemento existente
- Ámbito del elemento
- Desencadenador de cambio de estado de elemento
- Exportar el árbol de la IU
- Extraer datos estructurados
- Buscar elementos secundarios
- Buscar elemento
- Buscar imagen
- Buscar coincidencias de imágenes
- Buscar texto OCR
- Buscar elemento relativo
- Buscar posición de texto
- Obtener ventana activa
- Obtener antecesor
- Obtener atributo
- Obtener información de atributo
- Obtener a partir del portapapeles
- Obtener texto completo
- Obtener texto OCR
- Obtener contraseña
- Obtener posición
- Obtener elemento de origen
- Obtener texto
- Obtener texto visible
- Volver
- Avanzar
- Ir a inicio
- Google Cloud Vision OCR
- Ocultar ventana
- Resaltar
- Desencadenador de tecla de acceso rápido
- Mantener el puntero
- Mantener el puntero en imagen
- Mantener el puntero sobre texto OCR
- Mantener el puntero en el texto
- Imagen existente
- Indicar en pantalla
- Insertar código .NET
- Inject Js Script
- Invocar método de ActiveX
- Desencadenador de pulsación de tecla
- Cargar imagen
- Maximizar ventana
- Microsoft Azure Computer Vision OCR
- Microsoft OCR
- Microsoft Project Oxford Online OCR
- Minimizar ventana
- Supervisar eventos
- Desencadenador del ratón
- Mover ventana
- Ir a
- Texto OCR existente
- Apariencia en elemento
- Fuga en elemento
- Apariencia en imagen
- Fuga en imagen
- Abrir aplicación
- Abrir navegador
- Actualizar navegador
- Reproducir evento de usuario
- Restaurar ventana
- Guardar imagen
- Seleccionar elemento
- Seleccionar varios elementos
- Enviar tecla de acceso rápido
- Establecer región de recorte
- Establecer foco
- Establecer texto
- Establecer en portapapeles
- Establecer atributo web
- Mostrar ventana
- Iniciar proceso
- Desencadenador del sistema
- Realizar captura
- Tesseract OCR
- Texto existente
- Información sobre herramientas
- Escribir en
- Escribir Texto Seguro
- Utilizar primer plano
- Esperar a atributo
- Esperar a fuga de elemento
- Esperar a fuga de imagen
- Comprobación de accesibilidad
- Desencadenador de eventos de aplicación
- Bloquear entrada de usuario
- Marcar/Desmarcar
- Comprobar estado de aplicación
- Comprobar elemento
- Clic
- Clic desencadenador de eventos
- Arrastrar y soltar
- Ámbito del elemento
- Extraer datos de tabla
- Buscar elementos
- Para cada elemento de interfaz de usuario
- Obtener datos del navegador
- Obtener Portapapeles
- Obtener texto
- Obtener URL
- Ir a URL
- Resaltar
- Mantener el puntero
- Inject Js Script
- Atajos del teclado
- Desencadenador de eventos de pulsación de tecla
- Desplazamiento del ratón
- Navegar por el navegador
- Guardar imagen
- Seleccionar elemento
- Establecer datos del navegador
- Configurar el portapapeles
- Establecer servidor de CV
- Establecer navegador de Runtime
- Establecer foco
- Establecer la configuración del proyecto
- Establecer texto
- Realizar captura
- Escribir en
- Desbloquear entrada de usuario
- Modo de automatización del navegador
- Operación de ventana
- Transacción de llamada
- Clic en imagen en pantalla
- Hacer clic en botón de barra de herramientas
- Expandir tabla jerárquica ALV
- Expandir árbol ALV
- Expandir árbol
- Lectura de barra de estado
- Inicio de sesión en SAP
- Inicio de sesión en SAP
- Desencadenador de cambio de atributos de sesión de SAP
- Seleccionar fechas en el calendario
- Seleccionar elemento de menú
- Ámbito de la celda de la tabla
- Transacción de llamada
- Clic en imagen en pantalla
- Hacer clic en botón de barra de herramientas
- Expandir tabla jerárquica ALV
- Expandir árbol ALV
- Expandir árbol
- Lectura de barra de estado
- Inicio de sesión en SAP
- Inicio de sesión en SAP
- Seleccionar fechas en el calendario
- Seleccionar elemento de menú
- Ámbito de la celda de la tabla
- Realizar búsquedas en el navegador y recuperar resultados mediante las API de automatización de IU
- Exploración web
- Buscar imágenes
- Hacer clic en imágenes
- Eventos de desencadenador y supervisor
- Crear y anular archivos
- Páginas HTML: extraer y manipular información
- Manipulación de ventana
- Selección de lista automatizada
- Buscar y manipular elementos de ventana
- Gestionar automatización de texto
- Cargar y procesar imágenes
- Gestionar acciones activadas por el ratón
- Automatizar tiempo de ejecución de aplicación
- Ejecución automática de una aplicación local
- Navegación de explorador
- Automatización web
- Ejemplo de ámbito de desencadenador
- Habilitar soporte de automatización de IU en DevExpress
- Computer Vision Local Server
- Automatización móvil
- Notas relacionadas
- Acerca de la arquitectura de automatización de dispositivos móviles
- Compatibilidad de proyectos
- Obtener tipos de registro
- Obtener registros
- Obtener origen de la página
- Obtener la orientación del dispositivo
- Obtener identificador de sesión
- Instalar aplicación
- Administrar aplicación actual
- Administrar otras aplicaciones
- Abrir enlace profundo
- Abrir URL
- Conexión de dispositivo móvil
- Deslizamiento direccional
- Patrón de dibujo
- Pase de dedo posicional
- Pulse un botón del hardware
- Establecer orientación del dispositivo
- Realizar captura
- Tomar parte de la captura de pantalla
- Elemento existente
- Ejecutar comando
- Obtener atributo
- Obtener elemento seleccionado
- Obtener texto
- Establecer elemento seleccionado
- Establecer texto
- Deslizamiento
- Pulsar
- Escribir Texto
- Primeros pasos con las API de automatización móvil
- Gestionar cuadros de diálogo emergentes en automatizaciones móviles
- Creating variables from selector attributes
- Creación de flujos de trabajo de automatización móvil
- Utilizar automatización móvil para una aplicación de banca móvil
- Automatización para aplicaciones React Native
- Terminal
- Notas relacionadas
- Acerca del paquete de actividades de Terminal
- Compatibilidad de proyectos
- Mejores prácticas
- Buscar texto
- Obtener color de la posición
- Obtener la posición del cursor
- Obtener campo
- Obtener campo en posición
- Obtener área de pantalla
- Obtener texto
- Obtener texto en posición
- Mover cursor
- Mover cursor al texto
- Enviar tecla de control
- Teclas de envío
- Teclas de envío seguras
- Establecer campo
- Configurar campo en posición
- Sesión del terminal
- Esperar texto de campo
- Esperar a que la pantalla esté lista
- Esperar texto en pantalla
- Esperar texto en posición
- API de automatización codificadas de terminal
Descripción general de los métodos de automatización del navegador disponibles en UiPath (extensión del navegador, WebDriver y automatización de Chromium) y cómo elegir entre ellos.
UiPath admite varios métodos para automatizar navegadores, cada uno adecuado para diferentes entornos de implementación y objetivos de navegador. La configuración del Modo de automatización del navegador te permite elegir qué método utilizar, ya sea para un ámbito de flujo de trabajo específico a través de la actividad Usar aplicación/navegador , o como predeterminado en todo el proyecto en Configuración del proyecto moderno de automatización de IU > Aplicación/navegador.
Métodos de automatización
UiPath proporciona tres métodos de automatización subyacentes, expuestos como cinco modos:
La extensión del navegador inyecta la extensión UiPath en el navegador para interactuar con las páginas web directamente. Requiere que se instale la extensión, pero proporciona la cobertura de automatización más rica y es compatible con los cuatro principales navegadores compatibles: Chrome, Edge, Firefox, Safari.
WebDriver utiliza el protocolo W3C WebDriver para abrir y controlar una sesión de navegador dedicada a través de un binario de controlador específico del navegador (chromedriver, msedgedriver, geckodriver). Funciona sin la extensión UiPath y es compatible con los cuatro navegadores principales. Una variante headless ejecuta el navegador sin una ventana visible.
Chromium Automation utiliza el protocolo Chrome DevTools (CDP) para controlar los navegadores basados en Chromium directamente, sin necesidad de descargar extensiones ni controladores. Es la más sencilla de configurar en Chrome y Edge. También está disponible una variante headless.
Modos disponibles
Extensión del Explorador
Utiliza la extensión del navegador UiPath para automatizar el navegador de destino. La extensión inyecta scripts en las páginas web para interactuar con la página e informa de la información del elemento al Robot.
- Requiere: extensión del navegador UiPath instalada y habilitada en el perfil del navegador de destino
- Navegadores compatibles: Chrome, Edge, Firefox, Safari
- Ventana del navegador: visible
Este es el modo predeterminado. Elígelo para la automatización estándar attended o unattended donde el navegador se ejecuta en la misma máquina que el robot y es posible la instalación de la extensión.
Para automatizar páginas en modo de incógnito (privado), abre chrome://extensions, localiza la extensión de UiPath y habilita Permitir en incógnito y Permitir acceso a URL de archivo.
WebDriver con GUI
Abre una nueva sesión de navegador visible controlada por el protocolo W3C WebDriver. UiPath se comunica con el navegador a través de un servidor WebDriver específico del navegador.
- Requiere: binario de WebDriver compatible con la versión del navegador instalada
- Navegadores compatibles: Chrome, Edge, Firefox
- Ventana del navegador: visible
WebDriver crea un nuevo user-data-dir para cada sesión y no puede conectarse a una instancia del navegador ya abierta en el escritorio del usuario. Esto hace que WebDriver no sea adecuado para la automatización attended. Para la automatización unattended esto no es una limitación.
WebDriver Headless
Igual que WebDriver con GUI, pero el navegador se ejecuta sin una ventana visible.
- Requiere: binario de WebDriver compatible con la versión del navegador instalada
- Navegadores compatibles: Chrome, Edge, Firefox
- Ventana del navegador: ninguna (sin interfaz gráfica)
Algunas operaciones que requieren una ventana visible, como arrastrar y soltar nativo o la simulación del ratón de hardware, no se admiten en el modo headless.
Al igual que WebDriver con GUI, este modo crea un nuevo user-data-dir y no puede conectarse a un navegador ya abierto. Se debe descargar un binario de WebDriver compatible en runtime. El modo de incógnito es compatible sin configuración adicional.
Automatización de Chromium
Utiliza el protocolo Chrome DevTools (CDP) para controlar el navegador directamente. No se requiere la instalación de extensiones ni binarios de WebDriver: UiPath inicia y gestiona la sesión del navegador internamente.
- Requiere: proceso del navegador iniciado con el marcador
--remote-debugging-port=0 - Navegadores compatibles: Chrome, Edge y todos los navegadores basados en Chromium
- Ventana del navegador: visible
Elige este modo para la configuración más sencilla en Chrome o Edge. No es compatible con Firefox o Safari.
Chromium Automation crea un nuevo user-data-dir para cada sesión y no puede conectarse a una instancia del navegador ya abierta en el escritorio del usuario. Esto lo hace inadecuado para la automatización attended. Para la automatización unattended esto no es una limitación.
El modo de incógnito es compatible sin configuración adicional.
Automatización de Chromium Headless
Igual que Chromium Automation, pero el navegador se ejecuta sin una ventana visible.
- Requiere: proceso del navegador iniciado con el marcador
--remote-debugging-port=0 - Navegadores compatibles: Chrome, Edge y todos los navegadores basados en Chromium
- Ventana del navegador: ninguna (sin interfaz gráfica)
Este modo combina la configuración de configuración cero con la ejecución headless, lo que lo hace adecuado para la automatización unattended en servidores o procesos CI/CD.
Al igual que la automatización de Chromium, este modo crea un nuevo user-data-dir y se bloquea cuando la política de grupo DeveloperToolsAvailability se establece en 2. El modo de incógnito es compatible sin configuración adicional.
Comparación
Requisitos de configuración
De qué depende cada modo antes de poder ejecutarse.
| Mode | Extensión requerida | Se requiere WebDriver | Desatendido | Configuración adicional |
|---|---|---|---|---|
| Extensión del Explorador | ✅ | ❌ | ❌ | Instalar la extensión de UiPath |
| WebDriver con GUI | ❌ | ✅ | ❌ | Descargar binario de WebDriver |
| WebDriver Headless | ❌ | ✅ | ✅ | Descargar binario de WebDriver |
| Automatización de Chromium | ❌ | ❌ | ❌ | Iniciar navegador con la marca --remote-debugging-port=0 |
| Automatización de Chromium Headless | ❌ | ❌ | ✅ | Iniciar navegador con la marca --remote-debugging-port=0 |
Capacidades
Lo que admite cada modo una vez que se está ejecutando.
| Mode | Automatización atendida | Incógnito (sin configuración) | Navegadores compatibles |
|---|---|---|---|
| Extensión del Explorador | ✅ | ❌ | Chrome, Edge, Firefox, Safari |
| WebDriver con GUI | ❌ | ✅ | Chrome, Edge, Firefox |
| WebDriver Headless | ❌ | ✅ | Chrome, Edge, Firefox |
| Automatización de Chromium | ❌ | ✅ | Chrome, Edge, basado en Chromium |
| Automatización de Chromium Headless | ❌ | ✅ | Chrome, Edge, basado en Chromium |
Elegir un modo
| Escenario | Modo recomendado |
|---|---|
| Automatización de escritorio estándar, se puede instalar la extensión | Extensión del Explorador |
| Automatización attended (funciona con el navegador ya abierto del usuario) | Extensión del Explorador |
| La extensión no se puede instalar, el navegador debe estar visible | WebDriver con GUI |
| La extensión no se puede instalar, no hay visualización disponible | WebDriver Headless |
| Chrome o Edge, la configuración más sencilla posible | Automatización de Chromium |
| Unattended o automatización de servidor en Chrome/Edge, sin visualización | Automatización de Chromium Headless |
| Firefox o Safari sin extensión | WebDriver con GUI o WebDriver Headless |
DeveloperToolsAvailability La política de grupo restringe las herramientas de desarrollador | Extensión del navegador o WebDriver |
Configurar el modo
Para una actividad específica
- Añade una actividad Usar aplicación/navegador a tu flujo de trabajo.
- En el panel Propiedades , localiza Modo de automatización del navegador.
- Selecciona el modo deseado en el menú desplegable.
Resultado: el modo seleccionado se aplica a cada actividad de automatización de IU en el ámbito de este contenedor Usar aplicación/navegador .
Como valor predeterminado del proyecto
- Abre la Configuración del proyecto desde el icono del engranaje en el panel Proyecto .
- Ve a Automatización de IU moderna > Aplicación/navegador.
- Establece el modo de automatización del navegador en tu valor predeterminado preferido.
- Selecciona Guardar.
Resultado: las nuevas actividades Utilizar aplicación/navegador añadidas al proyecto utilizan el modo seleccionado a menos que se anule en una actividad específica.
La configuración a nivel de actividad tiene prioridad sobre el valor predeterminado del proyecto dentro de su ámbito.
La propiedad Modo de automatización del navegador para la actividad Usar aplicación/navegador y la configuración del proyecto en Automatización de IU moderna > Aplicación/navegador están disponibles a partir de UIAutomation v26.10.0.
Limitaciones
- Los modos de automatización de Chromium solo admiten navegadores basados en Chromium. Su uso con Firefox o Safari devuelve un error; no se produce ninguna alternativa automática.
- Los modos headless no admiten operaciones que dependan de una ventana visible o de la representación en el sistema operativo, como arrastrar y soltar con el ratón o ciertas operaciones de captura de pantalla.
- WebDriver y Chromium Automation crean un nuevo
user-data-dirpara cada sesión. No pueden conectarse a un navegador ya abierto en el escritorio del usuario, lo que los hace inadecuados para la automatización attended. Esto no es una limitación para la automatización unattended. - Las sesiones de WebDriver y Chromium Automation utilizan un perfil de navegador aislado. Las extensiones, las contraseñas guardadas y las cookies de sesión de usuario del perfil del navegador predeterminado no están disponibles.
- WebDriver requiere que se descargue un binario específico del navegador (
chromedriver,msedgedriverogeckodriver) en tiempo de ejecución y se mantenga compatible con la versión del navegador instalada. La extensión del navegador y la automatización de Chromium no tienen tal dependencia binaria externa. - La automatización de Chromium se bloquea cuando la política de grupo DeveloperToolsAvailability se establece en
2(No permitir el uso de las herramientas de desarrollador). Utiliza la extensión del navegador o WebDriver en entornos en los que se aplique esta política. - La extensión del navegador requiere una configuración manual adicional para automatizar páginas en modo de incógnito: el usuario debe abrir chrome://extensions, localizar la extensión de UiPath y habilitar Permitir en incógnito y Permitir acceso a las URL de archivo. WebDriver y Chromium Automation admiten el modo de incógnito sin ninguna configuración adicional.
- Métodos de automatización
- Modos disponibles
- Extensión del Explorador
- WebDriver con GUI
- WebDriver Headless
- Automatización de Chromium
- Automatización de Chromium Headless
- Comparación
- Requisitos de configuración
- Capacidades
- Elegir un modo
- Configurar el modo
- Para una actividad específica
- Como valor predeterminado del proyecto
- Limitaciones