- Visão geral
- Automação de Interface Gráfica
- Sobre o pacote de atividades UIAutomation
- Aplicativos e tecnologias automatizados com a Automação de Interface Gráfica
- Compatibilidade do projeto
- UI-ANA-016 - Extrair URL de navegador aberto
- UI-ANA-017 - ContinuarComErro verdadeiro
- UI-ANA-018 - Listar atividades de OCR/Imagem
- UI-DBP-006 - Uso do contêiner
- UI-DBP-013 - Uso Incorreto da Automação do Excel
- UI-DBP-030 - Uso de variáveis proibidas em seletores
- UI-DBP-031 - Verificação de atividades
- UI-PRR-001 - Simular clique
- UI-PRR-002 - Simular Digitação
- UI-PRR-003 - Uso incorreto do aplicativo aberto
- UI-PRR-004 - Atrasos Embutidos em Código
- UI-REL-001 - Idx grande em Seletores
- UI-SEC-004 - Dados de e-mail do seletor
- UI-SEC-010 — restrições de app/URL
- UI-USG-011 - Atributos não permitidos
- UX-SEC-010 — restrições de app/URL
- UX-DBP-029 - Uso de senha não segura
- UI-PST-001 - Nível de log de auditoria nas configurações do projeto
- Ferramenta de Migração de Navegador do UiPath
- Região do Recorte
- Computer Vision Recorder
- Índice de atividades
- Ativar
- Anchor Base
- Anexar Navegador
- Anexar Janela
- Block User Input
- Texto Explicativo
- Marcar
- Click
- Clicar na Imagem
- Click Image Trigger
- Click OCR Text
- Clicar no Texto
- Click Trigger
- Close Application
- Fechar Guia
- Close Window
- Context Aware Anchor
- Copy Selected Text
- Element Attribute Change Trigger
- Element Exists
- Element Scope
- Element State Change Trigger
- Export UI Tree
- Extrair Dados Estruturados
- Find Children
- Localizar Elemento
- Localizar Imagem
- Find Image Matches
- Find OCR Text Position
- Localizar Elemento Relativo
- Find Text Position
- Get Active Window
- Get Ancestor
- Get Attribute
- Get Event Info
- Get From Clipboard
- Obter Texto Completo
- Get OCR Text
- Get Password
- Get Position
- Get Source Element
- Get Text
- Obter Texto Visível
- Voltar
- Avançar
- Ir para a Página Inicial
- Google Cloud Vision OCR
- Hide Window
- Highlight
- Hotkey Trigger
- Hover
- Focalizar Imagem
- Hover OCR Text
- Focalizar Texto
- Imagem Existe
- Indicate On Screen
- Inject .NET Code
- Inject Js Script
- Invoke ActiveX Method
- Key Press Trigger
- Carregar Imagem
- Maximize Window
- Microsoft Azure Computer Vision OCR
- Microsoft OCR
- Microsoft Project Oxford Online OCR
- Minimize Window
- Monitorar eventos
- Mouse Trigger
- Move Window
- Navegar Para
- OCR Text Exists
- On Element Appear
- On Element Vanish
- Aparecer Na Imagem
- Desaparecer Na Imagem
- Abrir Aplicativo
- Abrir Navegador
- Atualizar Navegador
- Replay User Event
- Restore Window
- Save Image
- Select Item
- Select Multiple Items
- Enviar Tecla de Acesso
- Set Clipping Region
- Set Focus
- Set Text
- Set To Clipboard
- Set Web Attribute
- Show Window
- Iniciar Processo
- System Trigger
- Take Screenshot
- Tesseract OCR
- Texto Existe
- Dica de ferramenta
- Type Into
- Digitar Texto Seguro
- Use Foreground
- Wait Attribute
- Esperar Elemento Desaparecer
- Aguardar Imagem Desaparecer
- Verificação de acessibilidade
- Application event trigger
- Block User Input
- Check/Uncheck
- Check App State
- Check Element
- Click
- Click Event Trigger
- Drag and Drop
- Element Scope
- Extract Table Data
- Localizar elementos
- For Each UI Element
- Get Browser Data
- Obter Área de Transferência
- Get Text
- Get URL
- Go To URL
- Highlight
- Hover
- Inject Js Script
- Keyboard Shortcuts
- Keypress Event Trigger
- Mouse Scroll
- Navigate Browser
- Save Image
- Select Item
- Set Browser Data
- Definir Área de Transferência
- Definir servidor CV
- Set Runtime Browser
- Set Focus
- Definir configuração do projeto
- Set Text
- Take Screenshot
- Type Into
- Unblock User Input
- Window operation
- Realize pesquisa no navegador e recupere resultados usando APIs de Automação de interface gráfica
- Navegação na Web
- Localizar imagens
- Clicar em imagens
- Disparar e monitorar eventos
- Criar e substituir arquivos
- Páginas HTML: extrair e manipular informações
- Manipulação de janelas
- Seleção automatizada de listas
- Localizar e manipular elementos de janela
- Gerenciar automação de texto
- Carregar e processar imagens
- Gerenciar ações ativadas pelo mouse
- Automatizar o runtime de aplicativos
- Execução automatizada de um aplicativo local
- Navegação em navegador
- Automação da Web
- Exemplo de escopo de disparador
- Habilitar o suporte de Automação de Interface Gráfica no DevExpress
- Computer Vision Local Server
- Automação Móvel
- Notas de versão
- Sobre a arquitetura de automação de dispositivos móveis
- Compatibilidade do projeto
- Get Log Types
- Get Logs
- Get Page Source
- Get Device Orientation
- Get Session Identifier
- Instalar Aplicativo
- Gerenciar Aplicativo Atual
- Manage Other App
- Open DeepLink
- Abrir URL
- Mobile Device Connection
- Deslizar Direcional
- Padrão de Desenho
- Positional Swipe
- Press Hardware Button
- Set Device Orientation
- Take Screenshot
- Obter parte da captura de tela
- Element Exists
- Execute Command
- Get Attribute
- Get Selected Item
- Get Text
- Set Selected Item
- Set Text
- Deslizar
- Tap
- Type Text
- Terminal
- Notas de versão
- Sobre o pacote de atividades Terminal
- Compatibilidade do projeto
- Melhores práticas
- Find Text
- Get Color At Position
- Get Cursor Position
- Get Field
- Obter Campo na Posição
- Obter Área da Tela
- Get Text
- Obter Texto na Posição
- Mover Cursor
- Mover cursor para o texto
- Enviar Tecla de Controle
- Send Keys
- Send Keys Secure
- Set Field
- Definir Campo na Posição
- Terminal Session
- Aguardar Texto do Campo
- Wait Screen Ready
- Aguardar Texto da Tela
- Aguardar Texto na Posição
- APIs de automação codificadas em terminais
Notas de versão v26.10 para atividades UIAutomation, versões 26.10.x.
v26.10.2
Data de lançamento: 10 de agosto de 2026
Suporte à Automação de Interface Gráfica para agentes de codificação
As melhorias para codificar agentes na Automação de Interface Gráfica incluem:
Melhorias no seletor e na segmentação:
- Implementados seletores semânticos para agentes de codificação, permitindo a identificação de elementos usando descrições em linguagem natural e análise visual quando os métodos baseados em DOM não estão disponíveis.
- Adicionado suporte de agente de codificação para aplicativos SAP GUI para Java .
- Adicionada validação da configuração de destino para agentes de codificação, ajudando a garantir que as definições de destino sejam precisas antes do uso.
- Atualizados destinos difusos para desabilitar
check:textpor padrão para as atividades Type Into, Set Text, Get Text e Select Item , melhorando a confiabilidade da segmentação de elementos.
Melhorias na linha de comando:
- Expandido o conjunto de comando
uip rpa uia interact sapcom interaçõesexpand-tree,select-dates-in-calendareclick-picture-on-screen. - Adicionado um
uip rpa uia target-anchorable preview-textcomando para visualizar o texto que uma atividade Get Text retornaria para uma definição anexável de destino. - Aprimorado o comando
uip rpa uia target-anchorable resolve-defaultspara suportar os atributosnameedescriptionpara uma identificação mais precisa. - Melhorada a experiência da interface de linha de comando (CLI) no macOS com inspeção de permissões do sistema e um novo comando
uip rpa uia permissionspara verificar ou solicitar as permissões necessárias (Acessibilidade e Gravação de tela).
Automação de Interface Gráfica Moderna
- Adotou o novo widget de editor de código habilitado para JS para a propriedade Código do Script da atividade Inject Js Script . O widget está disponível apenas em projetos do Windows, a partir do Studio Desktop 26.0.198. O suporte do Studio Web ainda não foi implementado.
- Rastreamento de atividade UI Automation expandido para capturar detalhes de consumo para Atividades semânticas e ScreenPlay. O rastreamento de execução está desabilitado por padrão e pode ser habilitado por meio da configuração do projeto Automação de interface gráfica Moderna > Registro em log do robô > Habilitar rastreamento de atividades . Os dados de rastreamento são carregados no Orchestrator apenas para trabalhos com falha.
Árvore de Interface Gráfica de Auxiliar de Seleção
- Adicionado um botão Habilitar Computer Vision diretamente no painel Árvore de Interface Gráfica . A guia Elementos do CV agora fica sempre visível quando um aplicativo está no escopo e os elementos estão sendo selecionados. Quando o Computer Vision está desabilitado, o painel mostra um estado acionável com um botão Habilitar Computer Vision que ativa o CV, captura uma captura de tela e cria a árvore de elementos CV automaticamente.
Correções de bugs
- Corrigido um problema no qual uma caixa de diálogo de autenticação de proxy ("Faça login para acessar este site") aparecia durante a indicação de elementos com atividades de Automação de interface gráfica moderna, impedindo que os usuários indicassem elementos de interface gráfica por trás da caixa de diálogo.
v26.10.1
Data de lançamento: 21 de julho de 2026
Ajudante de seleção
- Adicionado suporte para configurar pontos de deslocamento diretamente do Auxiliar de Seleção, por meio de um novo botão no painel de expansão de destino. Ao atualizar um ponto de deslocamento, o destino associado é automaticamente selecionado e destacado para fornecer feedback visual imediato.
- Atualizado o seletor de estrutura de interface gráfica preferido para aparecer como um botão de menu compacto na barra de ação, com abreviações e ícones de estratégia (Auto/AA/UIA).
- Desempenho aprimorado do Auxiliar de seleção , reduzindo a detecção de alterações e a sobrecarga de renderização durante o foco, seleção de elementos e interações de layout.
Suporte à Automação de Interface Gráfica para agentes de codificação
- Adicionado suporte à segmentação do Computer Vision (CV), permitindo que agentes de codificação configurem métodos de segmentação baseados em CV para elementos de interface gráfica.
- Descoberta aprimorada de elementos baseados em agentes com recursos de imagem e análise semântica . Quando um navegador ou DOM de aplicativo está indisponível, os agentes agora podem identificar elementos de interface gráfica usando informações visuais e descrições em linguagem natural.
- Diagnóstico visual aprimorado gerando capturas de tela anotadas que destacam elementos identificados, além de novos limites do tamanho da captura de tela para controlar os custos da imagem e token.
- Adicionado suporte para validar as configurações de destino e âncora por meio de ferramentas UI Automation, ajudando a garantir que as definições de segmentação sejam precisas antes do uso.
Melhorias
- Estendida a API de destaque da Automação de Interface Gráfica com uma opção Preenchimento que renderiza um retângulo de cor sólida sobre um elemento de destino, permitindo que os fluxos de trabalho ocultem informações confidenciais ou realcem várias regiões da tela antes de capturar a tela.
v26.10.0
Data de lançamento: 24 de junho de 2026
UIAutomation por agente
Seletores semânticos
Os seletores semânticos agora são compatíveis com dois métodos de localização: Modelo de objeto de documento (DOM) e Imagem. O modo DOM é o padrão para aplicativos da Web e corresponde elementos usando informações extraídas do aplicativo DOM. O modo de imagem é um novo método de localização e o padrão para aplicativos não web, que usa a imagem visível da tela e os recursos de fundamentação de imagem de modelos multimodais modernos para entender o conteúdo visível como um humano faria. É compatível com qualquer tipo de descrição, inclusive descrições visuais (onde o método DOM geralmente falharia).
Você pode escolher o modelo usado para cada método de localização no menu suspenso Modelo em Configurações do projeto > Automação de interface gráfica > Seletor semântico. O modo DOM suporta Gemini 2.5 Flash e PathMini; O modo de imagem usa PathMini.
Para obter mais informações, consulte Métodos de localização.
Atividades semânticas
Agora, você pode aprimorar as atividades semânticas da Automação de interface gráfica com sua própria assinatura de modelo de linguagem grande, em vez da assinatura gerenciada pela UiPath. Você pode configurar seu modelo em Automação de interface gráfica > Atividades semânticas na guia Configurações de LLM da AI Trust Layer, usando um dos modelos compatíveis. Para as etapas de configuração, consulte Configuração do traga-seu-próprio-modelo das atividades semânticas.
Você agora pode definir padrões no nível do projeto para atividades Semânticas — o modelo padrão para cada atividade e o modo de extração para Extract UI Data (Pré-visualização) — em Configurações do Projeto > Automação de Interface Gráfica Moderna > Atividades Semânticas. Esses padrões aplicam-se durante experiências de design no Studio, como seleção e execuções de teste, e em runtime. Para os padrões no nível do projeto, consulte Configurações de projeto moderno de automação de interface gráfica.
A atualização do pacote Atividades de Automação de Interface Gráfica altera o modelo padrão das atividades Semânticas (excluindo Close Popup) para PathMini. Para as etapas de configuração, consulte Configuração do traga-seu-próprio-modelo das atividades semânticas. Para os padrões no nível do projeto, consulte Configurações de projeto moderno de automação de interface gráfica.
ScreenPlay
- Suporte para SecureString e ScreenPlayImage em fluxos de trabalho codificados — Os fluxos de trabalho codificados do ScreenPlay agora lidam com dois tipos de argumentos adicionais:
SecureString, para passar valores de string confidenciais sem expô-los em texto simples, eScreenPlayImage, para incluir uma captura de tela diretamente no prompt do ScreenPlay para fornecer o contexto visual adicional do modelo. Anteriormente, os fluxos de trabalho codificados não tinham tratamento nativo para esses tipos; essa alteração os traz à paridade com fluxos de trabalho de pouco código. - Rastreamento distribuído AppId — O ScreenPlay agora adiciona um cabeçalho
X-UIPATH-SEMANTIC-SPAN-IDàs chamadas HTTP que faz para serviços de back-end, como o Semantic Proxy e o LLM Gateway. O identificador de intervalo permite que uma única execução do ScreenPlay e suas solicitações sejam correlacionadas de ponta a ponta em todos os serviços, melhorando a observabilidade e a solução de problemas. - Modo de anexação de instância do aplicativo — o ScreenPlay agora é compatível com o modo de anexação de janela de instância do aplicativo na atividade Use Application/Browser. As atividades internas pesquisam em toda a instância do aplicativo — todas as janelas pai e filho, alertas e pop-ups — em vez de uma única janela, e o ScreenPlay captura e registra traces corretamente em todas elas, além do suporte existente à Janela única.
- Arquivo de trace HTML atualizado — O arquivo de trace HTML do ScreenPlay tem um design visual atualizado. A saída do visualizador de trace agora tem um layout e um estilo atualizados que tornam os traces de execução mais fáceis de ler e navegar, alinhados com os padrões de design atuais da UiPath.
Extrair Dados da IU (Visualização)
Extract UI Data é uma nova atividade semântica com IA para extrair dados de negócios estruturados de qualquer tela de aplicativo. Você define as estruturas de dados personalizadas que deseja capturar e recuperá-las como objetos de negócios, trabalhando em tecnologias de interface gráfica em vez de se limitar a um único tipo de layout. A atividade tem como padrão capturar dados do formulário da web quando um formulário está presente e também é compatível com a extração de campos personalizados por meio de prompts personalizados.
A atividade agora lida com resultados "não encontrados" de forma consistente. Anteriormente, ele gerava uma exceção quando nenhuma resposta podia ser encontrada para qualquer consulta, mas retornava strings vazias quando apenas um subconjunto de respostas estava ausente. Agora, quando um valor não pode ser encontrado, ele é retornado como null, fornecendo uma maneira única e previsível de detectar e lidar com dados ausentes em todos os cenários de extração.
Extract UI Data é uma atividade de visualização — um laboratório experimental para extração de interface gráfica semântica e orientada por esquema. Não se destina a atingir a Disponibilidade Geral como uma atividade autônoma; essa funcionalidade será incorporada pelos recursos de extração de dados do ScreenPlay. Os usuários que adotam Extract UI Data durante a visualização devem planejar uma determinado migração para o ScreenPlay.
Agente de Recuperação
Quando o Healing Agent não pode recuperar uma atividade, os logs do Robot agora incluem o motivo da falha. O motivo aparece nos logs do robô no Orchestrator para que você possa ver por que uma recuperação não foi bem-sucedida sem inspecionar os logs internos. Por exemplo, uma entrada de log pode ler "O Healing Agent não pôde recuperar a atividade. A autocorreção está desabilitada."
Suporte à Automação de Interface Gráfica para agentes de codificação
A versão 26.10.0 traz a automação de interface gráfica para agentes de codificação de IA. Agora você pode pedir a um agente — como o Claude Code, Cursor, GitHub Copilot — para criar e manter a automação de interface gráfica em linguagem simples e ele direcionará aplicativos reais, gerará seletores confiáveis e os registrará no Repositório de Objetos do seu projeto em seu nome.
Esse suporte é enviado como um conjunto de habilidades de agente empacotadas junto com as atividades e suportadas pela interface de linha de uip rpa uia . As habilidades funcionam nas mesmas superfícies que as próprias atividades — aplicativos de desktop, Web e SAP.
Três habilidades estão incluídas:
- Configurar um destino (
uia-configure-target) — Aponte o agente para uma tela e os elementos com os quais você se preocupa ("configure o botão Enviar na página de check-out"). Ele captura o aplicativo ao vivo, localiza cada elemento, gera um seletor confiável, registra a tela e os elementos no Repositório de Objetos e verifica cada um em uma captura de tela antes de retornar os IDs de referência que seu fluxo de trabalho pode usar. - Interagir com um aplicativo ao vivo (
uia-interact) — Peça ao agente para interagir com um aplicativo em execução — clique, digite, leia valores, preencha formulários, navegue pelos menus, extraia tabelas ou faça capturas de tela. Útil para explorar um aplicativo antes de automatizá-lo ou para confirmar se uma alteração comporta-se conforme o esperado. - Melhorar um seletor (
uia-improve-selector) — Corrigir, proteger ou recuperar um seletor de dados de runtime. Consulte Inteligência de seletor abaixo.
As habilidades são enviadas no repositório de habilidades uipath-rpa.
Inteligência do seletor (uia-improve-selector)
A inteligência do seletor é o mecanismo de raciocínio por trás da habilidade uia-improve-selector . Diagnostica por que um seletor falhou e o reescreve — sem editar manualmente o XML.
Os seletores quebram quando um aplicativo é alterado — um atributo é renomeado, um ID gerado automaticamente muda, um layout é movido. A inteligência do seletor permite que um agente de codificação diagnostique e reescreva um seletor para que sua automação continue em execução, sem que você edite manualmente o XML do seletor frágeis.
Funciona em dois modos:
- Recuperar — o seletor parou de funcionar ("elemento não encontrado", uma falha de runtime). O agente regrava-o no estado atual do aplicativo para que ele corresponda novamente ao elemento.
- Melhorar — o seletor ainda funciona, mas é frágeis, porque se baseia na posição, um ID gerado automaticamente ou um valor que reflete a mudança de conteúdo. O agente produz uma versão mais robusta que tem como alvo o mesmo elemento.
Use Melhorar proativamente quando você revisar um seletor recém-gerado e perceber que ele depende de um ID ou índice posicional gerado. Use Recuperar reativamente quando um trabalho não assistido falhar e você tiver os dados do runtime.
O que o torna confiável:
- Orientado por dados de runtime. Ele funciona a partir de um aplicativo ao vivo ou a partir de dados capturados no momento da falha — para que um seletor que falhou em um robô não assistido possa ser recuperado posteriormente, em uma máquina diferente, mesmo quando o aplicativo não estiver mais em execução.
- Sensível a atividades. O agente sabe, por exemplo, que um destino Get Text não deve apoiar-se no texto que deve ler, e que um destino Check não deve depender de a caixa estar marcada no momento. Cada regravação segue as regras que mantêm um seletor estável para seu uso específico.
- Validado, não adivinhou. Cada seletor de candidatos é verificado e pontuado antes que qualquer coisa seja escrita de volta. Se a primeira tentativa não persistir, o agente a refina automaticamente, tente novamente e, em seguida, mantenha o resultado mais forte.
- Explicado. Quando um seletor é recuperado, você recebe uma causa raiz de uma linha (por que ele falhou) e a estratégia usada para torná-lo estável — para que você possa confiar na alteração instantaneamente.
Automação do Chromium
Adicionamos a Automação do Chromium, um novo método de automação de navegador que controla o Chrome e o Edge diretamente por meio do Protocolo Chrome DevTools (CDP). A UiPath inicia e gerencia a sessão do navegador internamente — nenhuma extensão de navegador a instalar e nenhum binário do WebDriver para baixar ou manter sincronizado com a versão do seu navegador.
Duas novas opções estão disponíveis no menu suspenso Modo de automação do navegador na atividade Use Application/Browser e em Configurações do projeto > Automação de interface gráfica Moderna > Aplicativo/Navegador:
- Automação do Chromium — Melhor para desenvolvimento, depuração, automação unattended com um navegador visível
- Automação do Chromium em modo headless – Melhor para automação unattended em servidores e pipelines de CI/CD
A Automação do Chromium funciona com Chrome, Edge e todos os navegadores baseados no Chromium. Firefox e Safari não são compatíveis com esse método — para eles, continue usando a Extensão de navegador ou o WebDriver.
Automação do Oracle
A Automação de Interface Gráfica agora é compatível com a automação de Aplicativos Oracle Fusion nas interfaces do Oracle AAD (Framework de Desenvolvimento de Aplicativo) e do Oracle Redboard (Oracle JET). Uma nova abordagem de identificação revela atributos de seletores estáveis para cada tecnologia, permitindo que as automações permaneçam confiáveis, apesar da natureza dinâmica dessas interfaces, e a gama completa de atividades de Automação de Interface Gráfica possa ser usada em telas do Oracle Fusion.
Para obter mais informações, consulte Automação do Oracle Fusion.
Automaçāo da interface gráfica do macOS
- Suporte aprimorado para controles baseados em menu do macOS nas atividades Select Item . Agora você pode usar o Selecionar item com controles
AXPopUpButtoneAXMenuButton, permitindo uma interação confiável com lista suspensa e elementos de interface gráfica baseados em menu que exigem a abertura de um pop-up para acessar seus itens. - Adicionado suporte para ações de clique triplo . Essa capacidade está disponível em:
- Windows e macOS usando eventos de hardware
- Windows e macOS usando ChromiumAPI
- Adicionado suporte para ações de arrastar do mouse no macOS.
Automação de Interface Gráfica Moderna
-
Habilitou a funcionalidade Capturar Elementos no Repositório de Objetos em projetos multiplataforma.
-
A atividade Set Runtime Browser agora pode resolver o navegador padrão do sistema no runtime em projetos multiplataforma. Uma nova opção Usar navegador padrão do sistema permite selecionar entre o navegador padrão do sistema ou um navegador específico:
- Projetos do Windows: Chrome, Edge, Firefox
- Projetos multiplataforma: Chrome, Edge, Safari
O nome de exibição da atividade agora reflete o navegador selecionado (valor literal, Navegador padrão do sistema ou uma expressão truncada).
-
Adicionada a atividade Accessibility Check , que permite que os usuários realizem testes de acessibilidade em instâncias do Test Manager dentro do Test Cloud. Essa atividade carrega uma página de navegador da web e executa verificações de acessibilidade de acordo com o padrão WCAG 2.1 (ou superior). Exemplos de verificações de acessibilidade incluem DOM e acessibilidade visual, taxa de contraste, tags alt, ordem de tabulação, funções Aria inadequadas.
Editor de Seletor Avançado
-
Adicionados controles de zoom ao Editor de seletor avançado e Auxiliar de seleção, permitindo que você aumente ou diminua o zoom entre 80% e 110% usando as opções +, - e Redefinir .
-
Adicionado suporte à diferenciação de maiúsculas e minúsculas para atributos no Editor de Seletores Avançados.
-
Adicionada uma opção Editar destino a Use Application/Browser, expondo:
- Seletor de janela
- Propriedades do aplicativo (como URL do navegador, argumentos do navegador, caminho do aplicativo, argumentos do aplicativo e diretório de trabalho)
- A opção para Atualizar o seletor de janela em atividades filhas. Isso permite que quaisquer alterações feitas no Seletor de Janela da tela sejam aplicadas automaticamente a todos os elementos filhos.
-
O Editor Avançado de Seletores agora pode ser usado para editar seletores de Janela além de Seletores de elementos de UI.
-
No painel Árvore de UI do UI Explorer, adicionada uma alternância para mostrar ou ocultar propriedades com valores vazios nas seções Seletor compatível e Outros(s) , ajudando a exibir apenas informações relevantes.
-
Adicionada uma opção Filtrar propriedades ao painel Árvore da Interface Gráfica , permitindo a filtragem de propriedades para o nó selecionado por nome nas seções Seletor compatível e Outros(s) .
Melhorias
- Seletores de acessibilidade ativa otimizados para melhorar o desempenho de Extrair dados de tabela para tabelas grandes.
Correções de bugs
-
Para nós do tipo link, o texto não era recuperado e o caminho da árvore era gerado usando o id interno do SAP. Com essa correção, o texto do nó apropriado é usado. Isso afetava a atividade SAP Expand Tree .
-
Corrigido um problema em que os seletores não podiam ser identificados ao interagir com exibições HTML no aplicativo CAMBIO Cosmic (um aplicativo de saúde baseado em Java usando JxBrowser).
-
Corrigido um problema em que a atividade Type Into multiplataforma não respondia em VMs de robôs do Automation Cloud.
-
Corrigida captura nativa para glifo e caracteres japonês.
-
Corrigido um problema no qual as extensões Java continuavam a ser relatadas como instaladas após desinstalá-las.
Correções, adicionada em 11 de agosto de 2026
As seguintes entradas do ScreenPlay foram omitidas do anúncio original v26.10.0 e se aplicam à versão v26.10.0.
Seleção de modelos expandida para o ScreenPlay
O menu suspenso Modelo na atividade ScreenPlay agora oferece uma gama mais ampla de modelos de Screen Agent, adicionando GPT-5.4, GPT-5.4 mini, GPT-5.5, Gemini 3.0 Flash Preview e Path Mini. Os modelos adicionados são mais capazes e mais rápidos do que os disponíveis anteriormente e são os maiores colaboradores da latência de execução reduzida nesta versão em comparação com a versão 25.10 GA. O Path Mini é um modelo baseado em Qwen ajustado pela UiPath para compreensão de tela e interação de interface gráfica, hospedado e servido pela UiPath em sua própria infraestrutura de nuvem, e é a opção mais rápida na seleção.
A seleção completa é:
Nível básico:
- Screen Agent (usando Path Mini)
- Screen Agent (usando Gemini 2.5 Flash)
- Screen Agent (usando a visualização do Gemini 3.0 Flash)
- Screen Agent (usando GPT-4.1 mini)
- Screen Agent (usando GPT-5 mini)
- Screen Agent (com GPT-5.4 mini)
Nível padrão:
- Screen Agent (usando GPT-4.1)
- Screen Agent (usando GPT-5)
- Screen Agent (com GPT-5.4)
- Screen Agent (com GPT-5.5)
- OpenAI - Operator
- Anthropic - Computer Use
Para as características de cada modelo, consulte ScreenPlay.
Novo modelo padrão do ScreenPlay
O modelo padrão para a atividade ScreenPlay alterado de Screen Agent (usando Gemini 2.5 Flash) para Screen Agent (usando GPT-5.4). O GPT-5.4 é um modelo de nível padrão, enquanto o Gemini 2.5 Flash é um modelo de nível básico. As automações existentes mantêm o modelo com o qual foram configuradas; o novo padrão se aplica a atividades ScreenPlay recém-adicionadas.
Execução do ScreenPlay além do escopo indicado
O ScreenPlay não está mais confinado ao aplicativo ou à janela passada como seu escopo. Agora, ela pode funcionar em várias guias do navegador e vários aplicativos dentro da mesma tarefa.
Correções de execução do ScreenPlay
Essa versão inclui correções na confiabilidade de execução do ScreenPlay.
- v26.10.2
- Suporte à Automação de Interface Gráfica para agentes de codificação
- Automação de Interface Gráfica Moderna
- Árvore de Interface Gráfica de Auxiliar de Seleção
- Correções de bugs
- v26.10.1
- Ajudante de seleção
- Suporte à Automação de Interface Gráfica para agentes de codificação
- Melhorias
- v26.10.0
- UIAutomation por agente
- Agente de Recuperação
- Suporte à Automação de Interface Gráfica para agentes de codificação
- Automação do Chromium
- Automação do Oracle
- Automaçāo da interface gráfica do macOS
- Automação de Interface Gráfica Moderna
- Editor de Seletor Avançado
- Melhorias
- Correções de bugs
- Correções, adicionada em 11 de agosto de 2026