- Überblick
- UI-Automatisierung (UI Automation)
- Über das UIAutomation-Aktivitätspaket
- Mit UI-Automatisierung automatisierte Anwendungen und Technologien
- Projektkompatibilität
- UI-ANA-016 – URL zum Öffnen eines Browsers abrufen
- UI-ANA-017 – ContinueOnError True
- UI-ANA-018 – OCR-/Bildaktivitäten auflisten
- UI-DBP-006 – Containernutzung
- UI-DBP-013 – Falscher Gebrauch von Excel-Automatisierung
- UI-DBP-030 – Verwendung unzulässiger Variablen in Selektoren
- UI-DBP-031 – Aktivitätsverifizierung
- UI-PRR-001 – Klick simulieren
- UI-PRR-002 – Typ simulieren
- UI-PRR-003 – Offener Anwendungsmissbrauch
- UI-PRR-004 – Hartcodierte Verzögerungen
- UI-REL-001 – Große IDX in Selektoren
- UI-SEC-004 – Selektor-E-Mail-Daten
- UI-SEC-010 – App-/URL-Einschränkungen
- UI-USG-011 – Nicht zulässige Attribute
- UX-SEC-010 – App-/URL-Einschränkungen
- UX-DBP-029 – Unsichere Kennwortnutzung
- UI-PST-001 – Prüfungsprotokollebene in Projekteinstellungen
- UiPath-Browsermigrationstool
- Clippingbereich
- Computer Vision Recorder
- Aktivitätenindex
- Aktivieren (Activate)
- Ankerbasis (Anchor Base)
- Browser anhängen (Attach Browser)
- Fenster anhängen (Attach Window)
- Benutzeingabe blockieren (Block User Input)
- Textfeld (Callout)
- Prüfen (Check)
- Klicken (Click)
- Bild anklicken (Click Image)
- Bild-Trigger anklicken (Click Image Trigger)
- OCR-Text anklicken (Click OCR Text)
- Text anklicken (Click Text)
- Trigger anklicken (Click Trigger)
- Anwendung schließen (Close Application)
- Registerkarte schließen (Close Tab)
- Fenster schließen (Close Window)
- Kontextbewusster Anker
- Ausgewählten Text kopieren (Copy Selected Text)
- Element Attribute Change Trigger
- Element vorhanden (Element Exists)
- Elementumfang (Element Scope)
- Element State Change Trigger
- Export UI Tree
- Strukturierte Daten extrahieren (Extract Structured Data)
- Untergeordnete Elemente finden (Find Children)
- Element finden (Find Element)
- Bild finden (Find Image)
- Bildübereinstimmung finden (Find Image Matches)
- OCR-Textposition finden (Find OCR Text Position)
- Relatives Element finden (Find Relative Element)
- Textposition finden (Find Text Position)
- Aktives Fenster abrufen (Get Active Window)
- Vorgänger-Element erhalten (Get Ancestor)
- Attribut erhalten (Get Attribute)
- Ereignisinfo erhalten (Get Event Info)
- Aus Zwischenablage erhalten (Get From Clipboard)
- Volltext erhalten (Get Full Text)
- OCR-Text erhalten (Get OCR Text)
- Passwort erhalten (Get Password)
- Position erhalten (Get Position)
- Quellelement erhalten (Get Source Element)
- Text erhalten (Get Text)
- Sichtbaren Text erhalten (Get Visible Text)
- Zurück (Go Back)
- Weiter (Go Forward)
- Zur Startseite (Go Home)
- Google Cloud Vision OCR
- Fenster ausblenden (Hide Window)
- Markieren (Highlight)
- Hotkey-Trigger (Hotkey Trigger)
- Darauf zeigen (Hover)
- Auf Bild zeigen (Hover Image)
- Auf OCR-Text zeigen (Hover OCR Text)
- Text beim Darauf zeigen (Hover Text)
- Bild vorhanden (Image Exists)
- Auf Bildschirm anzeigen (Indicate On Screen)
- .NET-Code einfügen
- Inject Js Script
- ActiveX-Methode aufrufen
- Tastendruck-Trigger (Key Press Trigger)
- Bild laden (Load Image)
- Fenster maximieren (Maximize Window)
- Microsoft Azure ComputerVision OCR
- Microsoft OCR
- Microsoft Project Oxford Online OCR
- Fenster minimieren (Minimize Window)
- Ereignisse überwachen (Monitor Events)
- Maus-Trigger (Mouse Trigger)
- Fenster verschieben (Move Window)
- Navigieren zu (Navigate To)
- OCR-Text vorhanden (OCR Text Exists)
- Auf Element erscheinen (On Element Appear)
- Auf Element verschwinden (On Element Vanish)
- Auf Bild erscheinen (On Image Appear)
- Auf Bild verschwinden (On Image Vanish)
- Anwendung öffnen (Open Application)
- Browser öffnen (Open Browser)
- Browser aktualisieren (Refresh Browser)
- Benutzerereignis wiedergeben (Replay User Event)
- Fenster wiederherstellen (Restore Window)
- Bild speichern (Save Image)
- Objekt auswählen (Select Item)
- Mehrere Objekte auswählen (Select Multiple Items)
- Hotkey senden (Send Hotkey)
- Ausschneidebereich einstellen (Set Clipping Region)
- Fokus legen auf (Set Focus)
- Text einstellen (Set Text)
- Auf Zwischenablage setzen (Set To Clipboard)
- Web-Attribut setzen (Set Web Attribute)
- Fenster anzeigen (Show Window)
- Prozess starten (Start Process)
- System-Trigger (System Trigger)
- Screenshot anfertigen (Take Screenshot)
- Tesseract OCR
- Text vorhanden (Text Exists)
- Tooltip
- Eingeben in (Type Into)
- Sicheren Text eingeben (Type Secure Text)
- Vordergrund verwenden
- Attribut abwarten (Wait Attribute)
- Warten, bis Element verschwindet (Wait Element Vanish)
- Warten, bis Bild verschwindet (Wait Image Vanish)
- Prüfung der Barrierefreiheit
- Application event trigger
- Benutzeingabe blockieren (Block User Input)
- Check/Uncheck
- Check App State
- Check Element
- Klicken (Click)
- Click Event Trigger
- Ziehen und Ablegen
- Elementumfang (Element Scope)
- Extract Table Data
- Find Elements
- For Each UI Element
- Get Browser Data
- Clipboard abrufen
- Text erhalten (Get Text)
- Get URL
- Zu URL wechseln
- Markieren (Highlight)
- Darauf zeigen (Hover)
- Inject Js Script
- Tastenkombinationen
- Keypress Event Trigger
- Mouse Scroll
- Navigate Browser
- Bild speichern (Save Image)
- Objekt auswählen (Select Item)
- Set Browser Data
- Clipboard festlegen
- Legen Sie den CV-Server fest
- Set Runtime Browser
- Fokus legen auf (Set Focus)
- Projekteinstellung festlegen
- Text einstellen (Set Text)
- Screenshot anfertigen (Take Screenshot)
- Eingeben in (Type Into)
- Unblock User Input
- Browser-Automatisierungsmodus
- Window operation
- Anhängen
- Prüfen (Check)
- Klicken (Click)
- Ziehen und Ablegen
- Daten extrahieren
- Attribut erhalten (Get Attribute)
- GetChildren
- GetRuntimeTarget
- GetText
- Get URL
- GoToUrl
- Markieren (Highlight)
- Darauf zeigen (Hover)
- IsEnabled
- Tastaturkürzel (Keyboard Shortcut)
- Mouse Scroll
- Offen
- Objekt auswählen (Select Item)
- Screenshot anfertigen (Take Screenshot)
- Eingeben in (Type Into)
- Wartestatus
- Führen Sie eine Browsersuche durch und rufen Sie Ergebnisse mithilfe von UIAutomation-APIs ab
- Web-Browsing
- Finden von Bildern
- Klicken auf Bilder
- Auslösen und Überwachen von Ereignissen
- Erstellen und Überschreiben von Dateien
- HTML-Seiten: Extrahieren und Bearbeiten von Informationen
- Bearbeiten von Fenstern
- Automatisierte Listenauswahl
- Finden und Bearbeiten von Fensterelementen
- Verwalten der Textautomatisierung
- Laden und Verarbeiten von Bildern
- Verwalten von mausaktivierten Aktionen
- Automatisieren der Anwendungslaufzeit
- Automatisierte Ausführung einer lokalen Anwendung
- Browsernavigation
- Web-Automatisierung
- Beispiel für Trigger Scope
- Aktivieren der Unterstützung für die UI-Automatisierung in DevExpress
- Computer Vision Local Server
- Mobile Automation
- Versionshinweise
- Über die Architektur der Automatisierung von Mobilgeräten
- Projektkompatibilität
- Get Log Types
- Get Logs
- Get Page Source
- Get Device Orientation
- Get Session Identifier
- Install App
- Manage Current App
- Manage Other App
- DeepLink öffnen
- Open URL
- Mobile Device Connection
- Richtungswechsel
- Muster zeichnen
- Positional Swipe
- Press Hardware Button
- Set Device Orientation
- Screenshot anfertigen (Take Screenshot)
- Take Screenshot Part
- Element vorhanden (Element Exists)
- Execute Command
- Attribut erhalten (Get Attribute)
- Get Selected Item
- Text erhalten (Get Text)
- Set Selected Item
- Text einstellen (Set Text)
- Wischen
- Tap
- Type Text
- Terminal
- Versionshinweise
- Über das Terminal-Aktivitätspaket
- Projektkompatibilität
- Best Practices
- Find Text
- Get Color At Position
- Get Cursor Position
- Feld erhalten (Get Field)
- Feld an Position erhalten (Get Field at Position)
- Bildschirmbereich erhalten (Get Screen Area)
- Text erhalten (Get Text)
- Text an Position erhalten (Get Text at Position)
- Cursor bewegen (Move Cursor)
- Move Cursor to Text
- Strg-Taste senden (Send Control Key)
- Tasten senden (Send Keys)
- Sichere Tasten senden (Send Keys Secure)
- Feld setzen (Set Field)
- Feld an Position setzen (Set Field at Position)
- Terminalsitzung (Terminal Session)
- Warte auf Feldtext (Wait Field Text)
- Wait Screen Ready
- Warte auf Bildschirmtext (Wait Screen Text)
- Warte auf Text an Position (Wait Text at Position)
- Terminalcodierte Automatisierungs-APIs
Übersicht über die in UiPath verfügbaren Browserautomatisierungsmethoden – Browsererweiterung, WebDriver und Chromium-Automatisierung – und wie Sie zwischen ihnen wählen können.
UiPath unterstützt mehrere Methoden zur Automatisierung von Browsern, die jeweils für unterschiedliche Bereitstellungsumgebungen und Browserziele geeignet sind. Mit der Einstellung Browserautomatisierungsmodus können Sie auswählen, welche Methode verwendet werden soll – entweder für einen bestimmten Workflow-Scope über die Aktivität Use Application/Browser oder als projektweiter Standard in UI Automation Modern-Projekteinstellungen > Application/Browser.
Automatisierungsmethoden
UiPath bietet drei zugrunde liegende Automatisierungsmethoden, die in fünf Modi verfügbar gemacht werden:
Die Browsererweiterung fügt die UiPath-Erweiterung in den Browser ein, um direkt mit Webseiten zu interagieren. Es erfordert die Installation der Erweiterung, bietet jedoch die umfangreichste Automatisierungsabdeckung und ist mit allen vier wichtigen unterstützten Browsern kompatibel: Chrome, Edge, Firefox, Safari.
WebDriver verwendet das W3C WebDriver-Protokoll, um eine dedizierte Browsersitzung über eine browserspezifische Treiber-Binärdatei (chromedriver, msedgedriver, geckodriver) zu öffnen und zu steuern. Es funktioniert ohne die UiPath-Erweiterung und unterstützt alle vier wichtigen Browser. Eine Headless-Variante führt den Browser ohne sichtbares Fenster aus.
Die Chromium-Automatisierung verwendet das Chrome DevTools Protocol (CDP), um Chromium-basierte Browser direkt zu steuern, ohne dass eine Erweiterung oder ein Treiber heruntergeladen werden muss. Die Konfiguration ist mit Chrome und Edge am einfachsten. Eine Headless-Variante ist auch verfügbar.
Verfügbare Modi
Browsererweiterung
Verwendet die UiPath-Browsererweiterung, um den Zielbrowser zu automatisieren. Die Erweiterung fügt Skripts in Webseiten ein, um mit der Seite zu interagieren, und meldet Elementinformationen an den Roboter zurück.
- Erfordert: Die UiPath-Browsererweiterung ist im Zielbrowserprofil installiert und aktiviert
- Unterstützte Browser: Chrome, Edge, Firefox, Safari
- Browserfenster: Sichtbar
Dies ist der Standardmodus. Wählen Sie ihn für eine standardmäßige beaufsichtigte oder unbeaufsichtigte Automatisierung, bei der der Browser auf derselben Maschine wie der Roboter ausgeführt wird und die Installation der Erweiterung möglich ist.
Um Seiten im Inkognito-Modus (privat) zu automatisieren, öffnen Sie chrome://extensions, suchen Sie die UiPath-Erweiterung und aktivieren Sie In Inkognito zulassen sowie Zugriff auf Datei-URLs zulassen.
WebDriver mit GUI
Öffnet eine neue, sichtbare Browsersitzung, die vom W3C WebDriver-Protokoll gesteuert wird. UiPath kommuniziert mit dem Browser über einen browserspezifischen WebDriver-Server.
- Erfordert: WebDriver-Binärdatei, die mit der installierten Browserversion kompatibel ist
- Unterstützte Browser: Chrome, Edge, Firefox
- Browserfenster: Sichtbar
WebDriver erstellt für jede Sitzung ein neues user-data-dir und kann keine Verbindung mit einer Browserinstanz herstellen, die bereits auf dem Desktop des Benutzers geöffnet ist. Deshalb ist WebDriver für die Attended-Automatisierung ungeeignet. Für die Unattended-Automatisierung ist dies keine Einschränkung.
WebDriver monitorlos
Wie WebDriver mit GUI, aber der Browser wird ohne sichtbares Fenster ausgeführt.
- Erfordert: WebDriver-Binärdatei, die mit der installierten Browserversion kompatibel ist
- Unterstützte Browser: Chrome, Edge, Firefox
- Browserfenster: Keines (headless)
Einige Vorgänge, die ein sichtbares Fenster erfordern – wie natives Drag-and-Drop oder eine Hardware-Maus-Simulation – werden im Headless-Modus nicht unterstützt.
Wie WebDriver mit GUI erstellt dieser Modus ein neues user-data-dir und kann keine Verbindung mit einem bereits geöffneten Browser herstellen. Eine kompatible WebDriver-Binärdatei muss zur Laufzeit heruntergeladen werden. Der Inkognito-Modus wird ohne zusätzliche Konfiguration unterstützt.
Chromium-Automatisierung
Verwendet das Chrome DevTools Protocol (CDP), um den Browser direkt zu steuern. Es ist keine Erweiterungsinstallation oder WebDriver-Binärdatei erforderlich – UiPath startet und verwaltet die Browsersitzung intern.
- Erfordert: Browserprozess, der mit dem Flag
--remote-debugging-port=0gestartet wird - Unterstützte Browser: Chrome, Edge und alle Chromium-basierten Browser
- Browserfenster: Sichtbar
Wählen Sie diesen Modus für das einfachste Setup in Chrome oder Edge. Es unterstützt weder Firefox noch Safari.
Chromium-Automatisierung erstellt für jede Sitzung eine neue user-data-dir und kann keine Verbindung mit einer Browserinstanz herstellen, die bereits auf dem Desktop des Benutzers geöffnet ist. Deshalb ist es für eine beaufsichtigte Automatisierung ungeeignet. Für die Unattended-Automatisierung ist dies keine Einschränkung.
Der Inkognito-Modus wird ohne zusätzliche Konfiguration unterstützt.
Chromium-Automatisierung monitorlos
Wie Chromium-Automatisierung, aber der Browser wird ohne sichtbares Fenster ausgeführt.
- Erfordert: Browserprozess, der mit dem Flag
--remote-debugging-port=0gestartet wird - Unterstützte Browser: Chrome, Edge und alle Chromium-basierten Browser
- Browserfenster: Keines (headless)
Dieser Modus kombiniert die Einrichtung ohne Konfiguration mit der monitorlosen Ausführung, wodurch er sich gut für die unbeaufsichtigte Automatisierung auf Servern oder CI/CD-Pipelines eignet.
Wie Chromium-Automatisierung erstellt dieser Modus ein neues user-data-dir und wird blockiert, wenn die Gruppenrichtlinie DeveloperToolsAvailability auf 2 festgelegt ist. Der Inkognito-Modus wird ohne zusätzliche Konfiguration unterstützt.
Vergleich
Setup-Anforderungen
Wovon jeder Modus abhängt, bevor er ausgeführt werden kann.
| Mode | Erweiterung erforderlich | WebDriver erforderlich | Headless | Zusätzliches Setup |
|---|---|---|---|---|
| Browsererweiterung | ✅ | ❌ | ❌ | UiPath-Erweiterung installieren |
| WebDriver mit GUI | ❌ | ✅ | ❌ | Laden Sie die WebDriver-Binärdatei herunter |
| WebDriver monitorlos | ❌ | ✅ | ✅ | Laden Sie die WebDriver-Binärdatei herunter |
| Chromium-Automatisierung | ❌ | ❌ | ❌ | Starten Sie den Browser mit dem Flag --remote-debugging-port=0 |
| Chromium-Automatisierung monitorlos | ❌ | ❌ | ✅ | Starten Sie den Browser mit dem Flag --remote-debugging-port=0 |
Capabilities
Was jeder Modus unterstützt, wenn er ausgeführt wird.
| Mode | Beaufsichtigte Automatisierung | Inkognito (keine Konfiguration) | Unterstützte Browser |
|---|---|---|---|
| Browsererweiterung | ✅ | ❌ | Chrome, Edge, Firefox, Safari |
| WebDriver mit GUI | ❌ | ✅ | Chrome, Edge, Firefox |
| WebDriver monitorlos | ❌ | ✅ | Chrome, Edge, Firefox |
| Chromium-Automatisierung | ❌ | ✅ | Chrome, Edge, Chromium-basiert |
| Chromium-Automatisierung monitorlos | ❌ | ✅ | Chrome, Edge, Chromium-basiert |
Auswählen eines Modus
| Szenario | Empfohlener Modus |
|---|---|
| Standardmäßige Desktopautomatisierung, Erweiterung kann installiert werden | Browsererweiterung |
| Beaufsichtigte Automatisierung (Arbeiten mit dem bereits geöffneten Browser des Benutzers) | Browsererweiterung |
| Erweiterung kann nicht installiert werden, Browser muss sichtbar sein | WebDriver mit GUI |
| Erweiterung kann nicht installiert werden, keine Anzeige verfügbar | WebDriver monitorlos |
| Chrome oder Edge, einfachste Einrichtung | Chromium-Automatisierung |
| Unattended- oder Serverautomatisierung in Chrome/Edge, keine Anzeige | Chromium-Automatisierung monitorlos |
| Firefox oder Safari ohne Erweiterung | WebDriver mit GUI oder WebDriver Headless |
DeveloperToolsAvailability Gruppenrichtlinie schränkt Entwicklertools ein | Browsererweiterung oder WebDriver |
Konfigurieren Sie den Modus
Für eine bestimmte Aktivität
- Fügen Sie Ihrem Workflow eine Use Application/Browser- Aktivität hinzu.
- Suchen Sie im Eigenschaftenbereich den Browser-Automatisierungsmodus.
- Wählen Sie den gewünschten Modus aus der Dropdownliste aus.
Ergebnis: Der ausgewählte Modus gilt für jede UI-Automatisierungsaktivität, die auf diesen Use Application/Browser- Container beschränkt ist.
Als Projektstandard
- Öffnen Sie die Projekteinstellungen über das Zahnradsymbol im Projektbereich .
- Wechseln Sie zu UI Automation Modern > Application/Browser.
- Legen Sie den Browser-Automatisierungsmodus auf Ihren bevorzugten Standard fest.
- Wählen Sie Speichern.
Ergebnis: Neue Use Application/Browser- Aktivitäten, die dem Projekt hinzugefügt wurden, verwenden den ausgewählten Modus, sofern er nicht für eine bestimmte Aktivität überschrieben wird.
Die Einstellung auf Aktivitätsebene hat Vorrang vor der Standardeinstellung des Projekts innerhalb ihres Scope.
Die Eigenschaft Browser-Automatisierungsmodus für die Aktivität Use Application/Browser und die Projekteinstellung in UI Automation Modern > Application/Browser sind ab UIAutomation v26.10.0 verfügbar.
Einschränkungen
- Die Chromium-Automatisierungsmodi unterstützen nur Chromium-basierte Browser. Ihre Verwendung mit Firefox oder Safari gibt einen Fehler zurück; Es erfolgt kein automatisches Fallback.
- Headless-Modi unterstützen keine Vorgänge, die von einem sichtbaren Fenster oder Rendering auf Betriebssystemebene abhängen, wie z. B. Drag-and-Drop mit der Hardware-Maus oder bestimmte Screenshot-Vorgänge.
- WebDriver- und Chromium-Automatisierungen erstellen für jede Sitzung ein neues
user-data-dir. Sie können keine Verbindung zu einem Browser herstellen, der bereits auf dem Desktop des Benutzers geöffnet ist, wodurch sie für die Attended-Automatisierung ungeeignet sind. Dies ist keine Einschränkung für die Unattended-Automatisierung. - WebDriver- und Chromium-Automatisierungssitzungen verwenden ein isoliertes Browserprofil. Erweiterungen, gespeicherte Kennwörter und Benutzersitzungs-Cookies aus dem Standardbrowserprofil sind nicht verfügbar.
- WebDriver erfordert, dass eine browserspezifische Binärdatei (
chromedriver,msedgedriverodergeckodriver) zur Laufzeit heruntergeladen wird und mit der installierten Browserversion kompatibel bleibt. Die Browsererweiterung und die Chromium-Automatisierung haben keine solche externe binäre Abhängigkeit. - Chromium-Automatisierung wird blockiert, wenn die Gruppenrichtlinie DeveloperToolsAvailability auf
2(Verwendung der Entwicklertools nicht zulassen) festgelegt ist. Verwenden Sie die Browsererweiterung oder WebDriver in Umgebungen, in denen diese Richtlinie erzwungen wird. - Die Browsererweiterung erfordert eine zusätzliche manuelle Einrichtung, um Seiten im Inkognito-Modus zu automatisieren: Der Benutzer muss chrome://extensions öffnen, die UiPath-Erweiterung suchen und In Inkognito zulassen sowie Zugriff auf Datei-URLs zulassen aktivieren. WebDriver- und Chromium-Automatisierungen unterstützen den Inkognito-Modus ohne zusätzliche Konfiguration.
- Automatisierungsmethoden
- Verfügbare Modi
- Browsererweiterung
- WebDriver mit GUI
- WebDriver monitorlos
- Chromium-Automatisierung
- Chromium-Automatisierung monitorlos
- Vergleich
- Setup-Anforderungen
- Capabilities
- Auswählen eines Modus
- Konfigurieren Sie den Modus
- Für eine bestimmte Aktivität
- Als Projektstandard
- Einschränkungen