- Vue d'ensemble (Overview)
- Automatisation de l'interface utilisateur
- À propos du package d'activités UIAutomation
- Applications et technologies automatisées avec UI Automation
- Compatibilité du projet
- UI-ANA-016 - Extraire l'URL ouverte du navigateur
- UI-ANA-017 - ContinuerSurErreur (ContinueOnError) True
- UI-ANA-018 - Répertorier les activités d'OCR/d'image
- UI-DBP-006 - Utilisation du conteneur
- UI-DBP-013 - Utilisation abusive de l’automatisation Excel
- UI-DBP-030 - Utilisation de variables interdites dans les sélecteurs
- UI-DBP-031 : Vérification de l’activité
- UI-PRR-001 - Simuler un clic
- UI-PRR-002 - Type de simulation
- UI-PRR-003 - Ouverture d'une utilisation abusive de l'application
- UI-PRR-004 - Délais codés en dur
- UI-REL-001 - Idx volumineux dans les sélecteurs
- UI-SEC-004 - Données d’e-mail du sélecteur
- UI-SEC-010 - Restrictions d'applications/d'URL
- UI-USG-011 - Attributs non autorisés
- UX-SEC-010 - Restrictions d'applications/d'URL
- UX-DBP-029 - Utilisation d'un mot de passe non sécurisé
- UI-PST-001 - Niveau du journal d'audit dans les paramètres du projet
- Outil de migration de navigateur UiPath
- À propos des éléments d'interface utilisateur
- Propriétés des activités de l'interface utilisateur
- Exemple d'utilisation des méthodes de saisie
- Méthodes de sortie ou de capture de données d'écran
- Exemple d'utilisation de méthodes de sortie ou de capture de données d'écran
- Génération de tables à partir de données non structurées
- Capture relative de données
- Zone de détourage
- Enregistreur de Computer Vision
- À propos de l'automatisation des images et des textes
- Activités liées à la souris et au clavier
- Exemple d'utilisation de l'automatisation de la souris et du clavier
- Les activités de type texte
- Exemple d'utilisation d'automatisation de texte
- Activités de type OCR
- Activités de type image
- Exemple d'utilisation de l'automatisation d'image et d'OCR
- Index des activités
- Activer (Activate)
- Base d'ancrage (Anchor Base)
- Lier à un navigateur (Attach Browser)
- Lier à une fenêtre (Attach Window)
- Block User Input
- Légende (Callout)
- Vérifier (Check)
- Cliquer (Click)
- Cliquer sur l'image (Click Image)
- Déclencheur de clic image (Click Image Trigger)
- Cliquer sur le texte OCR (Click OCR Text)
- Cliquer sur le texte (Click Text)
- Déclencheur de clic (Click Trigger)
- Fermer l'application (Close Application)
- Fermer l'onglet (Close Tab)
- Fermer la fenêtre (Close Window)
- Context Aware Anchor
- Copier le texte sélectionné (Copy Selected Text)
- Element Attribute Change Trigger
- Élément existant (Element Exists)
- Étendue de l'élément (Element Scope)
- Element State Change Trigger
- Export UI Tree
- Extraire les données structurées (Extract Structured Data)
- Rechercher les enfants (Find Children)
- Rechercher l'élément (Find Element)
- Rechercher l'image (Find Image)
- Rechercher les correspondances de l'image (Find Image Matches)
- Rechercher une position de texte OCR (Find OCR Text Position)
- Rechercher l'élément relatif (Find Relative Element)
- Rechercher la position du texte (Find Text Position)
- Obtenir la fenêtre active (Get Active Window)
- Obtenir l'ancêtre (Get Ancestor)
- Obtenir l'attribut (Get Attribute)
- Obtenir les infos de l'événement (Get Event Info)
- Récupérer du presse-papiers (Get From Clipboard)
- Obtenir le texte complet (Get Full Text)
- Obtenir le texte OCR (Get OCR Text)
- Récupérer le mot de passe (Get Password)
- Obtenir la position (Get Position)
- Obtenir l'élément source (Get Source Element)
- Obtenir le texte (Get Text)
- Obtenir le texte visible (Get Visible Text)
- Revenir en arrière (Go Back)
- Avancer (Go Forward)
- Accéder à l'accueil (Go Home)
- Google Cloud Vision OCR
- Masquer la fenêtre (Hide Window)
- Mettre en surbrillance (Highlight)
- Déclencheur de raccourci (Hotkey Trigger)
- Pointer (Hover)
- Pointer sur l'image (Hover Image)
- Pointer sur le texte OCR (Hover OCR Text)
- Pointer sur le texte (Hover Text)
- Image existante (Image Exists)
- Indiquer sur l'écran (Indicate On Screen)
- Injecter du code .NET
- Inject Js Script
- Invoquer la méthode ActiveX
- Déclencheur de pression de touche (Key Press Trigger)
- Charger l'image (Load Image)
- Agrandir la fenêtre (Maximize Window)
- Microsoft Azure ComputerVision OCR
- Reconnaissance optique des caractères Microsoft (Microsoft OCR)
- Microsoft Project Oxford Online OCR
- Réduire la fenêtre (Minimize Window)
- Surveiller les événements (Monitor Events)
- Déclencheur de souris (Mouse Trigger)
- Déplacer la fenêtre (Move Window)
- Accéder à (Navigate To)
- Texte OCR existant (OCR Text Exists)
- Sur affichage de l'élément (On Element Appear)
- Sur disparition de l'élément (On Element Vanish)
- Sur apparition de l'image (On Image Appear)
- Sur disparition de l'image (On Image Vanish)
- Ouvrir l'application (Open Application)
- Ouvrir le navigateur (Open Browser)
- Actualiser le navigateur (Refresh Browser)
- Relire l'événement utilisateur (Replay User Event)
- Restaurer la fenêtre (Restore Window)
- Enregistrer l'image (Save Image)
- Sélectionner l'élément (Select Item)
- Sélectionner plusieurs éléments (Select Multiple Items)
- Envoyer le raccourci (Send Hotkey)
- Définir la zone de détourage (Set Clipping Region)
- Définir le focus (Set Focus)
- Définir le texte (Set Text)
- Placer dans le presse-papiers (Set To Clipboard)
- Définir l'attribut Web (Set Web Attribute)
- Afficher la fenêtre (Show Window)
- Déclencher le processus (Start Process)
- Déclencheur système (System Trigger)
- Prendre une capture d'écran (Take Screenshot)
- Tesseract OCR
- Texte existant (Text Exists)
- Info-bulle
- Saisir dans (Type Into)
- Saisir un texte sécurisé (Type Secure Text)
- Utiliser le premier plan
- Attendre un attribut (Wait Attribute)
- Attendre que l'élément disparaisse (Wait Element Vanish)
- Attendre que l'image disparaisse (Wait Image Vanish)
- Vérification de l’accessibilité
- Application event trigger
- Block User Input
- Check/Uncheck
- Check App State
- Check Element
- Cliquer (Click)
- Click Event Trigger
- Glisser et déposer
- Étendue de l'élément (Element Scope)
- Extract Table Data
- Find Elements
- For Each UiElement
- Get Browser Data
- Get Clipboard (Obtenir le Presse-papiers)
- Obtenir le texte (Get Text)
- Get URL
- Go To URL
- Mettre en surbrillance (Highlight)
- Pointer (Hover)
- Inject Js Script
- Raccourcis clavier
- Keypress Event Trigger
- Mouse scroll
- Navigate Browser
- Enregistrer l'image (Save Image)
- Sélectionner l'élément (Select Item)
- Set Browser Data
- Set Clipboard (Définir le Presse-papiers)
- Définir CV Server
- Définir le navigateur du runtime (Set Runtime Browser)
- Définir le focus (Set Focus)
- Définir les paramètres du projet
- Définir le texte (Set Text)
- Prendre une capture d'écran (Take Screenshot)
- Saisir dans (Type Into)
- Unblock User Input
- Window operation
- Joindre
- Vérifier (Check)
- Cliquer (Click)
- Glisser et déposer
- Extraire des données
- Obtenir l'attribut (Get Attribute)
- ObtenirEnfants
- ObtenirCibleRuntime
- GetText
- Get URL
- GoToUrl
- Mettre en surbrillance (Highlight)
- Pointer (Hover)
- IsEnabled
- Raccourci clavier
- Mouse scroll
- Ouvrir
- Sélectionner l'élément (Select Item)
- Prendre une capture d'écran (Take Screenshot)
- Saisir dans (Type Into)
- ÉtatAttente
- Effectuez une recherche par navigateur et récupérez les résultats à l'aide des API UI Automation
- Navigation sur le Web
- Rechercher des images
- Cliquer sur des images
- Déclencher et surveiller des événements
- Créer et remplacer des fichiers
- Pages HTML : extraire et manipuler des informations
- Manipulation des fenêtres
- Sélection de liste automatisée
- Rechercher et manipuler des éléments de fenêtre
- Gérer l'automatisation du texte
- Charger et traiter des images
- Gérer les actions activées par la souris
- Automatiser l'exécution des applications
- Exécution automatisée d'une application locale
- Navigation avec le navigateur
- Automatisation Web
- Exemple de fonctionnalités du déclencheur
- Activer la prise en charge d’UI Automation dans DevExpress
- Computer Vision Local Server
- Automatisation mobile
- Notes de publication
- À propos de l'architecture d'automatisation des appareils mobiles
- Compatibilité du projet
- Get Log Types
- Get Logs
- Get Page Source
- Get Device Orientation
- Get Session Identifier
- Installer l'application
- Gérer l'application actuelle
- Gérer une autre application
- Ouvrir DeepLink
- Ouvrir l'URL
- Mobile Device Connection
- Balayer directionnel
- Dessiner un modèle
- Positional Swipe
- Press Hardware Button
- Set Device Orientation
- Prendre une capture d'écran (Take Screenshot)
- Prendre une partie de capture d'écran
- Élément existant (Element Exists)
- Execute Command
- Obtenir l'attribut (Get Attribute)
- Get Selected Item
- Obtenir le texte (Get Text)
- Set Selected Item
- Définir le texte (Set Text)
- Balayer
- Tap
- Saisir texte
- Premiers pas avec les API d’automatisation mobile
- Gestion des boîtes de dialogue contextuelles dans les automatisations mobiles
- Creating variables from selector attributes
- Créer des workflows d'automatisation mobile
- Utiliser l’automatisation mobile pour les applications de banque mobile
- Automatisation pour les applications React Native
- Terminal
- Notes de publication
- À propos du package d'activités Terminal
- Compatibilité du projet
- Meilleures pratiques
- Rechercher un texte (Find Text)
- Get Color At Position
- Obtenir la position du curseur (Get Cursor Position)
- Obtenir le champ (Get Field)
- Obtenir le champ en position (Get Field at Position)
- Accéder à la zone d'écran (Get Screen Area)
- Obtenir le texte (Get Text)
- Obtenir le texte en position (Get Text at Position)
- Déplacer le curseur (Move Cursor)
- Move Cursor to Text
- Envoyer la touche Contrôle (Send Control Key)
- Envoyer les touches (Send Keys)
- Envoyer les touches en toute sécurité (Send Keys Secure)
- Définir le champ (Set Field)
- Définir le champ en position (Set Field at Position)
- Session de terminal (Terminal Session)
- Attendre le texte de champ (Wait Field Text)
- Wait Screen Ready
- Attendre le texte d'écran (Wait Screen Text)
- Attendre le texte en position (Wait Text at Position)
- API d'automatisation codée par terminal
notes de version v26.10 pour les activités UI Automation, versions 26.10.x.
Version {26.10.3
Date de publication: 21 août 2026
Multiplate-forme UI Explorer
UI Explorer, the tool used for indicating UI elements and generating selectors during UI Automation authoring, is now available as a cross-platform tool. Previously, this capability was only available on Windows, leaving users on macOS without a way to inspect or tune selectors. The new tool brings the same experience across all Studio flavors whether you're building Windows, macOS, or cross-platform automations.
Pour plus d'informations, consultez la page UI Explorer .
Chaque activité UI Automation qui cible un élément d'IU expose désormais deux commandes supplémentaires dans le menu contextuel Développer les propriétés de la cible , ce qui facilite le déplacement des cibles entre les activités et le nouvel UI Explorer:
- Copier la cible dans le presse-papiers - Copie la cible unifiée de l’activité afin qu’elle puisse être collée dans la carte Modifier l’élément d’ UI Explorer .
- Coller la cible à partir du presse-papiers - Colle une cible unifiée précédemment indiquée dans UI Explorer.
Automatisation SAP
-
Ajout des données d'extraction pour la prise en charge de SAP WebGUI et amélioration du comportement des requêtes répétables des tables/arborescences.
-
Les sélecteurs de fichiers scriptables sont désormais toujours activés dans SAP GUI pour Java. Lors de l'automatisation, SAP ouvre désormais ses boîtes de dialogue de sélecteur de fichiers scriptables au lieu des boîtes de dialogue natives. Cela apporte les améliorations suivantes:
-
Les boîtes de dialogue scriptables sont conçues pour l'automatisation et ne restent pas actives dans la session SAP. Les actions qui ouvrent un sélecteur de fichiers via les sélecteurs SAP avec la méthode d’entrée Simuler ou via des activités spécifiques à SAP ne s’arrêtent plus en attendant le déblocage de la session de script. Étapes de configuration complexes, telles que l'activation de « Appliquer un délai d’attente strict» et en définissant « Continuer en cas d'erreur »; sur Vrai ne sont plus nécessaires.
-
Leurs sélecteurs sont plus résilients aux mises à jour du client SAP, ce qui rend les automatisations plus fiables au fil du temps.
Avertissement :Étant donné que le type de boîte de dialogue change, les workflows existants qui automatisent les sélecteurs de fichiers SAP doivent être mis à jour pour cibler les nouvelles boîtes de dialogue.
-
Options d’installation étendues de l’extension de navigateur pour macOS
À partir de UiPath Assistant 2026.0.200 STS, les utilisateurs de macOS peuvent installer et gérer les extensions de navigateur pour Chrome, Edge et Safari à l’aide des méthodes d’installation suivantes:
- Utilisateur actuel
- Tous les utilisateurs (All Users)
- Stratégie de groupe en ligne
- Stratégie de groupe hors ligne
- Utilisateur actuel (Hôte de messagerie natif uniquement)
- Tous les utilisateurs (hôte de messagerie natif uniquement)
Cette amélioration offre une plus grande flexibilité pour le déploiement des extensions et rapproche l'expérience macOS de Studio Desktop. Pour plus d’informations, consultez la documentation de l’extension Chrome sur macOS et de l’extension Safari .
Résolution de bogues
- Correction d’un problème dans l’expérience UIAutomation classique dans laquelle la modification du sélecteur de fenêtre pour un écran Référentiel d’objets avec l’option Mettre à jour le sélecteur de fenêtre dans les objets enfants activée ne mettait pas à jour le sélecteur de fenêtre pour les objets enfants.
Version {26.10.2
Date de publication: 10 août 2026
Prise en charge d'UI Automation pour le codage des agents
Les améliorations apportées au codage des agents dans UIAutomation incluent:
Améliorations apportées au sélecteur et au ciblage:
- Implémentation de sélecteurs sémantiques pour coder les agents, permettant l’identification d’éléments à l’aide de descriptions en langage naturel et d’une analyse visuelle lorsque les méthodes basées sur DOM ne sont pas disponibles.
- Ajout de la prise en charge des agents de codage pour les applications SAP GUI pour Java .
- Ajout de la validation de la configuration de la cible pour le codage des agents, ce qui aide à garantir que les définitions de ciblage sont précises avant utilisation.
- Mise à jour des cibles approximatives pour désactiver
check:textpar défaut pour les activités Saisir dans, Définir le texte, Obtenir le texte et Sélectionner un élément , améliorant la fiabilité du ciblage des éléments.
Améliorations des lignes de commande:
- Développement de l’ensemble de commandes
uip rpa uia interact sapavec les interactionsexpand-tree,select-dates-in-calendaretclick-picture-on-screen. - Ajout d’une nouvelle commande
uip rpa uia target-anchorable preview-textpour prévisualiser le texte renvoyé par une activité Obtenir le texte pour une définition ancrer la cible. - Amélioration de la commande
uip rpa uia target-anchorable resolve-defaultsafin de prendre en charge les attributsnameetdescriptionpour une identification plus précise. - Amélioration de l'expérience de l'interface de ligne de commande sur macOS avec l'inspection des autorisations système et une nouvelle commande
uip rpa uia permissionspour vérifier ou demander les autorisations nécessaires (accessibilité et enregistrement d'écran).
UI Automation Modern
- Adopté le nouveau widget d'éditeur de code compatible JS pour la propriété CodeScript de l’activité Injecter JavaScript . Le widget est disponible uniquement sur les projets Windows, à partir de Studio Desktop 26.0.198. La prise en charge de Studio Web n’est pas encore implémentée.
- Traçage des activités UI Automation étendu pour capturer les détails de la consommation pour les activités sémantiques et ScreenPlay. Le traçage de l'exécution est désactivé par défaut et peut être activé via le paramètre de projet UI Automation Modern > Journalisation de Robot > Activer le traçage de l'activité . Les données de traçage sont téléchargées vers Orchestrator uniquement pour les tâches ayant échoué.
Arborescence de l’IU de l’assistant de sélection
- Ajout d'un bouton Activer Computer Vision directement dans le panneau Arborescence de l'interface utilisateur . L’onglet Éléments CV est désormais toujours visible lorsqu’une application se trouve dans l’étendue et que des éléments sont en cours de sélection. Lorsque Computer Vision est désactivé, le panneau affiche un état exploitable avec un bouton Activer Computer Vision qui active CV, capture une capture d'écran et crée automatiquement l'arborescence d'éléments CV.
Résolution de bogues
- Correction d’un problème où une boîte de dialogue d’authentification de proxy (« Se connecter pour accéder à ce site») apparaissait lors de l’indication de l’élément avec les activités UI Automation modernes, empêchant les utilisateurs d’indiquer les éléments d’IU derrière la boîte de dialogue.
Version {26.10.1
Date de publication: 21 juillet 2026
Assistant de sélection
- Ajout de la prise en charge de la configuration des points de décalage directement à partir de l’ assistant de sélection, via un nouveau bouton sur le panneau d’expansion cible. Lors de la mise à jour d'un point de décalage, la cible associée est automatiquement sélectionnée et mise en surbrillance afin de fournir des commentaires visuels immédiats.
- Mise à jour du sélecteur d’ infrastructure d’interface utilisateur préféré afin qu’il apparaisse sous laforme d’un bouton de menu compact dans la barre d’action, avec des abréviations destratégieetdes icônes.
- Amélioration des performances de l’assistant de sélection , réduisant la détection des modifications et les frais généraux pendant le survol, la sélection d’éléments et les interactions de mise en page.
Prise en charge d'UI Automation pour le codage des agents
- Ajout de la prise en charge du ciblage Computer Vision, permettant aux Agents de codage de configurer des méthodes de ciblage basées sur CV pour les éléments d'IU.
- Découverte d’éléments améliorée basée sur l’agent avec des capacités d’analyse d’image et sémantique . Lorsqu'un navigateur ou une application DOM n'est pas disponible, les agents peuvent désormais identifier les éléments d'IU à l'aide d'informations visuelles et de descriptions en langage naturel.
- Amélioration des diagnostics visuels en générant des captures d’écran annotées qui mettent en évidence les éléments identifiés, ainsi que de nouvelles capacités de capture d’écran pour contrôler les coûts d’image et de jetons.
- Ajout de la prise en charge de la validation des configurations des cibles et des ancres via l'outil UI Automation, ce qui aide à garantir que les définitions de ciblage sont précises avant utilisation.
Améliorations
- Extension de l’ API de mise en surbrillance UI Automation avec une option Remplissage qui restitue un rectangle de couleur solide sur un élément cible, permettant aux workflows de masquer les informations sensibles ou de mettre en surbrillance plusieurs régions de l’écran avant de capturer des captures d’écran.
Version {26.10.0
Date de publication: 24 juin 2026
UIAutomation agentique
Sélecteurs sémantiques
Les sélecteurs sémantiques prennent désormais en charge deux méthodes de recherche: Modèle d’objet document et Image. Le mode DOM est le mode par défaut pour les applications Web et correspond aux éléments en utilisant des informations extraites du DOM d’application. Le mode image est une nouvelle méthode de recherche, et la valeur par défaut pour les applications non Web, qui utilise l'image visible à l'écran et les capacités d'ancrage de l'image des modèles multimodal modernes pour comprendre le contenu visible comme le ferait un être humain. Il prend en charge tous les types de descriptions, descriptions visuelles incluses (où la méthode DOM échoue généralement).
Vous pouvez choisir le modèle utilisé pour chaque méthode de recherche dans la liste déroulante Modèle de Paramètres du projet > UI Automation > Sélecteur sémantique. Le mode DOM prend en charge Gemini 2.5 Flash et Pathmini; Le mode image utilise Pathmini.
Pour plus d’informations, consultez la section Méthodes de recherche.
Activités sémantiques
Vous pouvez désormais alimenter les activités UI Automation Semantic avec votre propre abonnement de modèle de langage au lieu de l'abonnement géré par UiPath. Vous pouvez configurer votre modèle dans UI Automation > Activités sémantiques dans l’onglet Configurations LLM d’AI Trust Layer, à l’aide de l’un des modèles pris en charge. Pour les étapes de configuration, reportez-vous à la section Configuration des activités sémantiques « Apportez-votre-propre-modèle ».
Vous pouvez désormais définir les valeurs par défaut au niveau du projet pour les activités sémantiques — le modèle par défaut pour chaque activité et le mode d’extraction pour Extraire les données d’IU (Aperçu) — sous Paramètres du projet > UI Automation Modern > Activités sémantiques. Ces valeurs par défaut s'appliquent à la fois lors des expériences de conception de Studio, telles que la sélection et l'exécution des tests, ainsi que lors de l'exécution. Pour les valeurs par défaut au niveau du projet, reportez-vous à Paramètres du projet moderne UI Automation.
La mise à jour du package d’activités UIAutomation modifie le modèle par défaut pour les activités sémantiques (à l’exception de Fermer la fenêtre contextuelle) en Pathmini. Pour les étapes de configuration, reportez-vous à la section Configuration des activités sémantiques « Apportez-votre-propre-modèle ». Pour les valeurs par défaut au niveau du projet, reportez-vous à Paramètres du projet moderne UI Automation.
ScreenPlay
- Prise en charge de SecureString et de ScreenPlayImage dans les workflows codés - Les workflows codés ScreenPlay gèrent désormais deux types d'arguments supplémentaires:
SecureStringpour transmettre des valeurs de chaîne sensibles sans les exposer dans le texte brut, etScreenPlayImagepour inclure une capture d'écran directement dans l'invite ScreenPlay à donner le contexte visuel supplémentaire du modèle. Auparavant, les workflows codés n'avaient pas de gestion native pour ces types; ce changement les place dans la parité avec les workflows low-code. - Traçage distribué SpanId - ScreenPlay ajoute désormais un en-tête
X-UIPATH-SEMANTIC-SPAN-IDaux appels HTTP qu'il effectue aux services backend, tels que Semantic Proxy et LLM Gateway. L’identificateur d’étendue permet à une seule exécution ScreenPlay et à ses requêtes d’être corrélées de bout en bout entre les services, améliorant l’observabilité et le dépannage. - Mode d'attachement d'instance d'application - ScreenPlay prend désormais en charge le mode d'attachement de fenêtre d'instance d'application sur l'activité Utiliser l'application/le navigateur. Les activités internes effectuent une recherche dans l'ensemble de l'instance d'application - toutes les fenêtres parents et enfants, les alertes et les fenêtres contextuelles - au lieu d'une seule fenêtre, et ScreenPlay capture et enregistre correctement les traces dans toutes, en plus de la prise en charge de la fenêtre unique existante.
- Fichier de traçage HTML rafraîchi - Le fichier de traçage HTML ScreenPlay a une conception visuelle rafraîchie. La sortie de la visionneuse de traçage dispose désormais d'une mise en page et d'un style mis à jour qui facilitent la lecture et la navigation, alignés sur les normes de conception UiPath actuelles.
Extraire les données d’IU (Aperçu)
Extraire les données d’IU est une nouvelle activité sémantique optimisée par l’IA permettant d’extraire des données métier structurées à partir de n’importe quel écran d’application. Vous définissez les structures de données personnalisées que vous souhaitez capturer et les récupérer en tant qu'objets métier en utilisant différentes technologies d'interface utilisateur plutôt que de vous limiter à un seul type de mise en page. L’activité capture par défaut les données des formulaires web lorsqu’un formulaire est présent et prend également en charge l’extraction des champs personnalisés via des invites personnalisées.
L’activité gère désormais les résultats « introuvables» de manière cohérente. Auparavant, elle générait une exception lorsqu'aucune réponse n'était trouvée pour une requête, mais renvoyait des chaînes vides lorsqu'un sous-ensemble de réponses était manquant. Désormais, lorsqu'une valeur est introuvable, elle est renvoyée sous la forme null, offrant un moyen unique et prévisible de détecter et de gérer les données manquantes dans tous les scénarios d'extraction.
L’activité d’extraction des données d’IU est une nouvelle activité en aperçu — une plateforme expérimentale pour l’extraction de l’interface utilisateur sémantique basée sur des schémas. Il n'est pas destiné à atteindre la disponibilité générale en tant qu'activité autonome; cette fonctionnalité sera intégrée aux capacités d'extraction de données de ScreenPlay. Les utilisateurs adoptant Extraire les données d’IU lors de la prévisualisation doivent planifier une migration éventuelle vers ScreenPlay.
Healing Agent
Lorsque Healing Agent ne peut pas récupérer une activité, les journaux du Robot incluent désormais la raison de l'échec. La raison apparaît dans les journaux du Robot dans Orchestrator, vous pouvez donc voir pourquoi une récupération n'a pas réussi sans inspecter les journaux internes. Par exemple, une entrée de journal peut indiquer « Healing Agent n'a pas pu récupérer l'activité. La réparation automatique est désactivée.»
Prise en charge d'UI Automation pour le codage des agents
La version 26.10.0 apporte l'automatisation de l'interface utilisateur aux agents de codage d'IA. Vous pouvez désormais demander à un agent, tel que Claude Code, Cursor, GitHub Copilot, de créer et de gérer UI Automation en langage simple. Cela générera des applications réelles, générera des sélecteurs fiables et les enregistrera dans le référentiel d’objets de votre projet en votre nom.
Cette prise en charge est fournie sous la forme d'un ensemble de compétences d'agent regroupées avec les activités et soutenues par l'interface de uip rpa uia ligne de commande. Les compétences fonctionnent sur les mêmes interfaces que les activités, par exemple les applications de bureau, Web et SAP.
Trois compétences sont incluses:
- Configurer une cible (
uia-configure-target) — Pointez l'agent sur un écran et les éléments qui vous intéressent (« configurez le bouton Soumettre sur la page d'extraction»). Elle capture l'application en direct, localise chaque élément, génère un sélecteur fiable, enregistre l'écran et les éléments dans le référentiel d'objets et vérifie chacun par rapport à une capture d'écran avant de transmettre les ID de référence que votre workflow peut utiliser. - Interagir avec une application en direct (
uia-interact) — Demandez à l'agent d'interagir avec une application en cours d'exécution - cliquez, saisissez, lisez des valeurs, remplissez des formulaires, naviguez dans les menus, extrayez des tables ou prenez des captures d'écran. Utile pour explorer une application avant de l'automatiser ou pour confirmer qu'une modification se comporte comme prévu. - Améliorer un sélecteur (
uia-improve-selector): corrigez, renforcez ou récupérez un sélecteur à partir des données d’exécution. Consultez la section Renseignements sur les sélecteurs ci-dessous.
Les compétences sont fournies dans le référentiel de compétences uipath-rpa.
Renseignements sur les sélecteurs
L'intelligence du sélecteur est le moteur de raisonnement derrière la compétence uia-improve-selector . Il diagnostique la raison pour laquelle un sélecteur a échoué et le réécrit sans modifier manuellement le XML.
Les sélecteurs s'interrompent lorsqu'une application change: un attribut est renommé, un ID généré automatiquement change, une mise en page est déplacée. L’intelligence du sélecteur permet à un agent de codage de diagnostiquer et de réécrire un sélecteur pour que votre automatisation se poursuit sans que vous ayez à modifier manuellement le sélecteur XML.
Il fonctionne avec deux modes:
- Récupérer — le sélecteur a cessé de fonctionner (« élément introuvable» échec du runtime). L’agent le réécrit par rapport à l’état actuel de l’application afin qu’il corresponde à nouveau à l’élément.
- Améliorer : le sélecteur fonctionne toujours, mais il est fragile, car il s'appuie sur la position, un ID généré automatiquement ou une valeur qui reflète l'évolution du contenu. L’agent produit une version plus robuste qui cible le même élément.
Utilisez Améliorer de manière proactive lorsque vous examinez un sélecteur nouvellement généré et remarquez qu'il s'appuie sur un ID ou un index de position généré. Utilisez Récupérer de manière réactive lorsqu'une tâche Unattended échoue et que vous disposez des données du runtime.
Ce qui le rend fiable:
- Exploité par les données de runtime. Il fonctionne à partir d'une application en direct ou de données capturées au moment de l'échec – de sorte qu'un sélecteur qui a déclenché un robot non assisté peut être récupéré ultérieurement, sur une machine différente, même lorsque l'application n'est plus en cours d'exécution.
- Sensible à l'activité. L'agent sait, par exemple, qu'une cible Obtenir le texte ne doit pas s'appuyer sur le texte qu'elle est destinée à lire et qu'une cible Vérifier ne doit pas dépendre du fait que la case est actuellement cochée. Chaque réécriture suit les règles qui maintiennent un sélecteur stable pour son utilisation spécifique.
- Validé, non deviné. Chaque sélecteur de candidat est vérifié et noté avant que tout ce qui est écrit en retour. Si la première tentative ne tient pas, l’agent l’affinera automatiquement et réessayera, puis conservera le résultat le plus réussi.
- Explique. Lorsqu'un sélecteur est récupéré, vous obtenez une cause profonde d'une ligne (la raison pour laquelle il s'est interrompu) et la stratégie utilisée pour le rendre permanent afin que vous puissiez avoir confiance dans la modification en un coup d'œil.
Automatisation Chromium
Nous avons ajouté Chromium Automation, une nouvelle méthode d'automatisation du navigateur qui contrôle Chrome et Edge directement via le protocole CDP Chrome. UiPath se lance et gère la session de navigateur en interne — aucune extension de navigateur à installer et aucun binaire WebDriver à télécharger ou à synchroniser avec la version de votre navigateur.
Deux nouvelles options sont disponibles dans la liste déroulante Mode d’automatisation du navigateur de l’activité Utiliser l’application/le navigateur et dans Paramètres du projet > UI Automation Modern > Application/Navigateur:
- Automatisation Chromium - Idéal pour le développement, le débogage et l’automatisation Unattended avec un navigateur visible
- Chromium Automation Headless : idéal pour l'automatisation Unattended sur les serveurs et les pipelines CI/CD
Chromium Automation fonctionne avec Chrome, Edge et tous les navigateurs basés sur Chromium. Firefox et Safari ne sont pas pris en charge par cette méthode. Pour ceux-ci, continuez à utiliser l’extension navigateur ou WebDriver.
Automatisation Oracle
UI Automation prend désormais en charge l'automatisation des applications de fusion Oracle sur les interfaces Oracle ADF (Infrastructure de développement d'applications) et Oracle Redboard (Oracle JET). Une nouvelle approche d’identification fait apparaître des attributs de sélecteur stables pour chaque technologie afin que les automatisations restent fiables malgré la nature dynamique de ces interfaces, et que l’ensemble des activités UI Automation puisse être utilisé sur les écrans Oracle Fusion.
Pour de plus amples informations, consultez Automatisation Oracle Fusion.
macOS UI Automation
- Prise en charge améliorée des contrôles basés sur des menus macOS dans les activités Sélectionner l’élément . Vous pouvez désormais utiliser Sélectionner l'élément avec les contrôles
AXPopUpButtonetAXMenuButton, ce qui permet une interaction fiable avec les éléments d'IU basés sur des listes déroulantes et des menus qui nécessitent l'ouverture d'une fenêtre contextuelle pour accéder à leurs éléments. - Ajout de la prise en charge des actions de triple-clic . Cette fonctionnalité est disponible sur:
- Windows et macOS: événements matériels
- Windows et macOS utilisant ChromiumAPI
- Ajout de la prise en charge des actions de déplacement de la souris sur macOS.
UI Automation Modern
-
Activez la fonctionnalité Capturer des éléments dans le référentiel d’objets dans les projets multiplate-forme.
-
L'activité Définir le navigateur du runtime peut désormais résoudre le navigateur système par défaut au moment du runtime dans les projets multiplateformes. Une nouvelle option Utiliser le navigateur système par défaut permet de choisir entre le navigateur par défaut système ou un navigateur spécifique:
- Projets Windows: Chrome, Edge, Firefox
- Projets inter-plateformes: Chrome, Edge, Safari
Le nom d’affichage de l’activité reflète désormais le navigateur sélectionné (valeur littérale, navigateur système par défaut ou expression tronquée).
-
Ajout de l'activité Contrôle d'accessibilité qui permet aux utilisateurs d'effectuer des tests d'accessibilité dans les instances Test Manager au sein de Test Cloud. Cette activité charge une page de navigateur Web et effectue des vérifications d'accessibilité conformément à la norme WCAG 2.1 (ou supérieure). Voici quelques exemples de vérifications de l’accessibilité: DOM et l’accessibilité visuelle, le taux de contraste, les balises alternatives, l’ordre des onglets, les rôles AIA incorrects.
Éditeur de sélecteur avancé
-
Ajout de commandes de zoom à l’ éditeur de sélecteur avancé et à l’assistant de sélection, vous permettant d’effectuer un zoom avant ou arrière entre 80 % et 110 % à l’aide des options +, - et Réinitialiser .
-
Ajout de la prise en charge de la casse pour les attributs dans l' Éditeur de sélecteur avancé.
-
Ajout d’une option Modifier la cible pour Utiliser l’application/le navigateur exposant:
- Sélecteur de fenêtre
- Propriétés de l’application (telles que l’URL du navigateur, les arguments du navigateur, le chemin d’accès à l’application, les arguments de l’application et le répertoire de travail)
- L'option permettant de Mettre à jour le sélecteur de fenêtre dans les activités enfants. Cela permet que toute modification apportée au sélecteur de fenêtre de l'écran soit automatiquement appliquée à tous les éléments enfants.
-
L’ éditeur de sélecteur avancé peut désormais être utilisé pour modifier les sélecteurs de fenêtre en plus des sélecteurs d’éléments d’IU.
-
Dans le panneau Arborescence de l’IU d’ UI Explorer, ajout d’un bouton bascule pour afficher ou masquer les propriétés avec des valeurs vides dans les sections Compatible avec le sélecteur et Autre(s) , permettant d’afficher uniquement les informations pertinentes.
-
Ajout d’une option Filtrer les propriétés au panneau Arborescence de l’IU , permettant le filtrage des propriétés du nœud sélectionné par nom dans les sections Compatible avec le sélecteur et Autre(s) .
Améliorations
- Sélecteurs Active Accessibility optimisés afin d’améliorer les performances d’extraction des données de table pour les tables de grande taille.
Résolution de bogues
-
Pour les nœuds de type Lien, le texte n'était pas récupéré et le chemin d'arborescence était généré à l'aide de l'ID SAP interne. Avec ce correctif, le texte de nœud approprié est utilisé. Cela affectait l’activité SAP Développer l’arborescence .
-
Correction d'un problème dans lequel les sélecteurs ne pouvaient pas être identifiés lors de l'interaction avec les vues HTML dans l'application CAMBIO Cosactivités (une application de santé basée sur Java utilisant JxBrowser).
-
Correction d'un problème dans lequel l'activité multiplate-forme Saisir dans ne répond plus sur les machines virtuelles Automation Cloud Robot.
-
Correction de la capture native pour les glyphes et les caractères japonais.
-
Correction d'un problème dans lequel les extensions Java continuaient à être signalées comme installées après leur désinstallation.
Corrections, ajoutées le 11 août 2026
Les entrées ScreenPlay suivantes ont été omises dans l'annonce d'origine v26.10.0 et s'appliquent à la version v26.10.0.
Sélection de modèles étendue pour ScreenPlay
La liste déroulante Modèle de l'activité ScreenPlay offre désormais une plus large gamme de modèles Screen Agent, en ajoutant GPT-5.4, GPT-5.4 mini, GPT-5.5, Gemini 3.0 Aperçu rapide et Chemin Mini. Les modèles ajoutés sont plus capables et plus rapides que ceux précédemment disponibles, et sont le plus grand contributeur à la réduction de la latence d'exécution dans cette version par rapport à la version GA 25.10. Chemin Mini est un modèle basé sur Qwen affiné par UiPath pour la compréhension de l'écran et l'interaction de l'interface utilisateur, hébergé et servi par UiPath sur sa propre infrastructure cloud, et est l'option la plus rapide de la sélection.
La sélection complète est la suivante:
Niveau de base:
- Screen Agent (utilise Path Mini)
- Screen Agent (utilise Gemini Flash 2.5)
- Screen Agent (utilise Gemini Flash 3.0)
- Screen Agent (utilise GPT-4.1 mini)
- Screen Agent (utilise GPT-5 mini)
- Screen Agent (utilise GPT-5.4 mini)
Niveau standard:
- Screen Agent (utilise GPT-4.1)
- Screen Agent (utilise GPT-5)
- Screen Agent (utilise GPT-5.4)
- Screen Agent (utilise GPT-5.5)
- OpenAI - Opérateur
- Anthropic - Utilisation sur ordinateur
Pour les caractéristiques de chaque modèle, reportez-vous à ScreenPlay.
Nouveau modèle par défaut pour ScreenPlay
Le modèle par défaut pour l'activité ScreenPlay est passé de Screen Agent (utilisant Gemini 2.5 Flash) à Screen Agent (utilisant GPT-5.4). GPT-5.4 est un modèle de niveau Standard, tandis que Gemini 2.5 Flash est un modèle de niveau Basique. Les automatisations existantes conservent le modèle avec lequel elles ont été configurées; la nouvelle valeur par défaut s'applique aux activités ScreenPlay nouvellement ajoutées.
Exécution de ScreenPlay au-delà de l’étendue indiquée
ScreenPlay n’est plus limité à l’application ou à la fenêtre transmise comme son étendue. Il peut désormais fonctionner dans plusieurs onglets de navigateur et plusieurs applications au sein d’une même tâche.
Corrections d'exécution de ScreenPlay
Cette version inclut des correctifs pour la fiabilité de l'exécution de ScreenPlay.
- Version {26.10.3
- Multiplate-forme UI Explorer
- Automatisation SAP
- Options d’installation étendues de l’extension de navigateur pour macOS
- Résolution de bogues
- Version {26.10.2
- Prise en charge d'UI Automation pour le codage des agents
- UI Automation Modern
- Arborescence de l’IU de l’assistant de sélection
- Résolution de bogues
- Version {26.10.1
- Assistant de sélection
- Prise en charge d'UI Automation pour le codage des agents
- Améliorations
- Version {26.10.0
- UIAutomation agentique
- Healing Agent
- Prise en charge d'UI Automation pour le codage des agents
- Automatisation Chromium
- Automatisation Oracle
- macOS UI Automation
- UI Automation Modern
- Éditeur de sélecteur avancé
- Améliorations
- Résolution de bogues
- Corrections, ajoutées le 11 août 2026