- Überblick
- UI-Automatisierung (UI Automation)
- Über das UIAutomation-Aktivitätspaket
- Mit UI-Automatisierung automatisierte Anwendungen und Technologien
- Projektkompatibilität
- UI-ANA-016 – URL zum Öffnen eines Browsers abrufen
- UI-ANA-017 – ContinueOnError True
- UI-ANA-018 – OCR-/Bildaktivitäten auflisten
- UI-DBP-006 – Containernutzung
- UI-DBP-013 – Falscher Gebrauch von Excel-Automatisierung
- UI-DBP-030 – Verwendung unzulässiger Variablen in Selektoren
- UI-DBP-031 – Aktivitätsverifizierung
- UI-PRR-001 – Klick simulieren
- UI-PRR-002 – Typ simulieren
- UI-PRR-003 – Offener Anwendungsmissbrauch
- UI-PRR-004 – Hartcodierte Verzögerungen
- UI-REL-001 – Große IDX in Selektoren
- UI-SEC-004 – Selektor-E-Mail-Daten
- UI-SEC-010 – App-/URL-Einschränkungen
- UI-USG-011 – Nicht zulässige Attribute
- UX-SEC-010 – App-/URL-Einschränkungen
- UX-DBP-029 – Unsichere Kennwortnutzung
- UI-PST-001 – Prüfungsprotokollebene in Projekteinstellungen
- UiPath-Browsermigrationstool
- Clippingbereich
- Computer Vision Recorder
- Aktivitätenindex
- Aktivieren (Activate)
- Ankerbasis (Anchor Base)
- Browser anhängen (Attach Browser)
- Fenster anhängen (Attach Window)
- Benutzeingabe blockieren (Block User Input)
- Textfeld (Callout)
- Prüfen (Check)
- Klicken (Click)
- Bild anklicken (Click Image)
- Bild-Trigger anklicken (Click Image Trigger)
- OCR-Text anklicken (Click OCR Text)
- Text anklicken (Click Text)
- Trigger anklicken (Click Trigger)
- Anwendung schließen (Close Application)
- Registerkarte schließen (Close Tab)
- Fenster schließen (Close Window)
- Kontextbewusster Anker
- Ausgewählten Text kopieren (Copy Selected Text)
- Element Attribute Change Trigger
- Element vorhanden (Element Exists)
- Elementumfang (Element Scope)
- Element State Change Trigger
- Export UI Tree
- Strukturierte Daten extrahieren (Extract Structured Data)
- Untergeordnete Elemente finden (Find Children)
- Element finden (Find Element)
- Bild finden (Find Image)
- Bildübereinstimmung finden (Find Image Matches)
- OCR-Textposition finden (Find OCR Text Position)
- Relatives Element finden (Find Relative Element)
- Textposition finden (Find Text Position)
- Aktives Fenster abrufen (Get Active Window)
- Vorgänger-Element erhalten (Get Ancestor)
- Attribut erhalten (Get Attribute)
- Ereignisinfo erhalten (Get Event Info)
- Aus Zwischenablage erhalten (Get From Clipboard)
- Volltext erhalten (Get Full Text)
- OCR-Text erhalten (Get OCR Text)
- Passwort erhalten (Get Password)
- Position erhalten (Get Position)
- Quellelement erhalten (Get Source Element)
- Text erhalten (Get Text)
- Sichtbaren Text erhalten (Get Visible Text)
- Zurück (Go Back)
- Weiter (Go Forward)
- Zur Startseite (Go Home)
- Google Cloud Vision OCR
- Fenster ausblenden (Hide Window)
- Markieren (Highlight)
- Hotkey-Trigger (Hotkey Trigger)
- Darauf zeigen (Hover)
- Auf Bild zeigen (Hover Image)
- Auf OCR-Text zeigen (Hover OCR Text)
- Text beim Darauf zeigen (Hover Text)
- Bild vorhanden (Image Exists)
- Auf Bildschirm anzeigen (Indicate On Screen)
- .NET-Code einfügen
- Inject Js Script
- ActiveX-Methode aufrufen
- Tastendruck-Trigger (Key Press Trigger)
- Bild laden (Load Image)
- Fenster maximieren (Maximize Window)
- Microsoft Azure ComputerVision OCR
- Microsoft OCR
- Microsoft Project Oxford Online OCR
- Fenster minimieren (Minimize Window)
- Ereignisse überwachen (Monitor Events)
- Maus-Trigger (Mouse Trigger)
- Fenster verschieben (Move Window)
- Navigieren zu (Navigate To)
- OCR-Text vorhanden (OCR Text Exists)
- Auf Element erscheinen (On Element Appear)
- Auf Element verschwinden (On Element Vanish)
- Auf Bild erscheinen (On Image Appear)
- Auf Bild verschwinden (On Image Vanish)
- Anwendung öffnen (Open Application)
- Browser öffnen (Open Browser)
- Browser aktualisieren (Refresh Browser)
- Benutzerereignis wiedergeben (Replay User Event)
- Fenster wiederherstellen (Restore Window)
- Bild speichern (Save Image)
- Objekt auswählen (Select Item)
- Mehrere Objekte auswählen (Select Multiple Items)
- Hotkey senden (Send Hotkey)
- Ausschneidebereich einstellen (Set Clipping Region)
- Fokus legen auf (Set Focus)
- Text einstellen (Set Text)
- Auf Zwischenablage setzen (Set To Clipboard)
- Web-Attribut setzen (Set Web Attribute)
- Fenster anzeigen (Show Window)
- Prozess starten (Start Process)
- System-Trigger (System Trigger)
- Screenshot anfertigen (Take Screenshot)
- Tesseract OCR
- Text vorhanden (Text Exists)
- Tooltip
- Eingeben in (Type Into)
- Sicheren Text eingeben (Type Secure Text)
- Vordergrund verwenden
- Attribut abwarten (Wait Attribute)
- Warten, bis Element verschwindet (Wait Element Vanish)
- Warten, bis Bild verschwindet (Wait Image Vanish)
- Prüfung der Barrierefreiheit
- Application event trigger
- Benutzeingabe blockieren (Block User Input)
- Check/Uncheck
- Check App State
- Check Element
- Klicken (Click)
- Click Event Trigger
- Ziehen und Ablegen
- Elementumfang (Element Scope)
- Extract Table Data
- Find Elements
- For Each UI Element
- Get Browser Data
- Clipboard abrufen
- Text erhalten (Get Text)
- Get URL
- Zu URL wechseln
- Markieren (Highlight)
- Darauf zeigen (Hover)
- Inject Js Script
- Tastenkombinationen
- Keypress Event Trigger
- Mouse Scroll
- Navigate Browser
- Bild speichern (Save Image)
- Objekt auswählen (Select Item)
- Set Browser Data
- Clipboard festlegen
- Legen Sie den CV-Server fest
- Set Runtime Browser
- Fokus legen auf (Set Focus)
- Projekteinstellung festlegen
- Text einstellen (Set Text)
- Screenshot anfertigen (Take Screenshot)
- Eingeben in (Type Into)
- Unblock User Input
- Window operation
- Anhängen
- Prüfen (Check)
- Klicken (Click)
- Ziehen und Ablegen
- Daten extrahieren
- Attribut erhalten (Get Attribute)
- GetChildren
- GetRuntimeTarget
- GetText
- Get URL
- GoToUrl
- Markieren (Highlight)
- Darauf zeigen (Hover)
- IsEnabled
- Tastaturkürzel (Keyboard Shortcut)
- Mouse Scroll
- Offen
- Objekt auswählen (Select Item)
- Screenshot anfertigen (Take Screenshot)
- Eingeben in (Type Into)
- Wartestatus
- Führen Sie eine Browsersuche durch und rufen Sie Ergebnisse mithilfe von UIAutomation-APIs ab
- Web-Browsing
- Finden von Bildern
- Klicken auf Bilder
- Auslösen und Überwachen von Ereignissen
- Erstellen und Überschreiben von Dateien
- HTML-Seiten: Extrahieren und Bearbeiten von Informationen
- Bearbeiten von Fenstern
- Automatisierte Listenauswahl
- Finden und Bearbeiten von Fensterelementen
- Verwalten der Textautomatisierung
- Laden und Verarbeiten von Bildern
- Verwalten von mausaktivierten Aktionen
- Automatisieren der Anwendungslaufzeit
- Automatisierte Ausführung einer lokalen Anwendung
- Browsernavigation
- Web-Automatisierung
- Beispiel für Trigger Scope
- Aktivieren der Unterstützung für die UI-Automatisierung in DevExpress
- Computer Vision Local Server
- Mobile Automation
- Versionshinweise
- Über die Architektur der Automatisierung von Mobilgeräten
- Projektkompatibilität
- Get Log Types
- Get Logs
- Get Page Source
- Get Device Orientation
- Get Session Identifier
- Install App
- Manage Current App
- Manage Other App
- DeepLink öffnen
- Open URL
- Mobile Device Connection
- Richtungswechsel
- Muster zeichnen
- Positional Swipe
- Press Hardware Button
- Set Device Orientation
- Screenshot anfertigen (Take Screenshot)
- Take Screenshot Part
- Element vorhanden (Element Exists)
- Execute Command
- Attribut erhalten (Get Attribute)
- Get Selected Item
- Text erhalten (Get Text)
- Set Selected Item
- Text einstellen (Set Text)
- Wischen
- Tap
- Type Text
- Terminal
- Versionshinweise
- Über das Terminal-Aktivitätspaket
- Projektkompatibilität
- Best Practices
- Find Text
- Get Color At Position
- Get Cursor Position
- Feld erhalten (Get Field)
- Feld an Position erhalten (Get Field at Position)
- Bildschirmbereich erhalten (Get Screen Area)
- Text erhalten (Get Text)
- Text an Position erhalten (Get Text at Position)
- Cursor bewegen (Move Cursor)
- Move Cursor to Text
- Strg-Taste senden (Send Control Key)
- Tasten senden (Send Keys)
- Sichere Tasten senden (Send Keys Secure)
- Feld setzen (Set Field)
- Feld an Position setzen (Set Field at Position)
- Terminalsitzung (Terminal Session)
- Warte auf Feldtext (Wait Field Text)
- Wait Screen Ready
- Warte auf Bildschirmtext (Wait Screen Text)
- Warte auf Text an Position (Wait Text at Position)
- Terminalcodierte Automatisierungs-APIs
Chromium-Automatisierungsunterstützung für die Browserautomatisierung in UI Automation, wie sie funktioniert, welche Browser sie unterstützt und was sie benötigt.
Chromium-Automatisierung ist eine Browser-Automatisierungsmethode, die Chrome, Edge und andere Chromium-basierte Browser über das Chrome DevTools Protocol (CDP) steuert – dasselbe Protokoll, das die integrierten Entwicklertools des Browsers verwenden. Gängige Automatisierungsaufgaben wie das Öffnen des Browsers, das Navigieren, das Klicken auf Elemente, das Eingeben von Text und das Erkunden des DOM werden durch Senden von CDP-Befehlen an den Browser ausgeführt.
Im Gegensatz zur Browser-Erweiterungsmethode muss bei der Chromium-Automatisierung die UiPath-Browsererweiterung nicht installiert werden. Im Gegensatz zum WebDriver-Protokoll muss keine browserspezifische Treiber-Binärdatei (wie chromedriver oder msedgedriver) heruntergeladen und mit der Browserversion synchronisiert werden. UiPath startet und verwaltet die Browsersitzung intern, sodass die Chromium-Automatisierung sofort auf jeder Maschine funktioniert, auf der ein unterstützter Browser installiert ist.
Wie UiPath es implementiert
Wenn ein Workflow Chromium-Automatisierung verwendet, startet UiPath den Zielbrowser mit aktiviertem Remote-Debugging (das --remote-debugging-port=0 -Startflag) und stellt über CDP eine Verbindung damit her. Die gesamte nachfolgende Automatisierung – Elementsuche, Interaktion und DOM-Prüfung – wird über diese Verbindung durchgeführt.
Chromium-Automatisierung führt die Unterstützung für die monitorlose Browserautomatisierung ein, bei der der Browser ohne sichtbares Fenster ausgeführt wird. Er kann auch mit einem sichtbaren Browserfenster für die Entwicklung, das Debuggen und Attended-Szenarien ausgeführt werden. Beide werden als separate Modi verfügbar gemacht (siehe Konfigurationsschritte).
Unterstützte Browser
Die Chromium-Automatisierung unterstützt Chromium-basierte Browser:
- Google Chrome
- Microsoft Edge
- Andere Chromium-basierte Browser
Mozilla Firefox und Apple Safari werden von dieser Methode nicht unterstützt, da CDP spezifisch für Chromium ist. Für diese Browser sind die Browsererweiterung und das WebDriver-Protokoll die verfügbaren Automatisierungsmethoden.
Anforderungen
- Ein unterstützter Chromium-basierter Browser, der auf der Maschine installiert ist.
- Keine UiPath-Browsererweiterung.
- Keine ausführbare WebDriver-Datei.
Der Browser muss mit dem Flag --remote-debugging-port=0 starten können. Dies wird blockiert, wenn die Gruppenrichtlinie DeveloperToolsAvailability auf 2 (Verwendung der Entwicklertools nicht zulassen) festgelegt ist – siehe Bekannte Probleme und Einschränkungen.
Sitzungen und Selektoren
- Neue Sitzung pro Ausführung – Chromium-Automatisierung öffnet eine neue, isolierte Browsersitzung mit einer eigenen
user-data-dir. Es kann nicht an eine Browserinstanz angehängt werden, die bereits auf dem Desktop des Benutzers geöffnet ist. Erweiterungen, gespeicherte Kennwörter und Sitzungs-Cookies aus dem Standardbrowserprofil sind in der Sitzung nicht verfügbar. - Inkognito – Der private (Inkognito-)Modus wird ohne zusätzliche Konfiguration unterstützt.
- Selektoren – Für die Chromium-Automatisierung generierte Selektoren sind mit den von den anderen Browser-Automatisierungsmethoden verwendeten Selektoren kompatibel, sodass Sie Ihre Automatisierung auf die gleiche Weise erstellen und validieren können. Chromium-Automatisierungsaktivitäten können innerhalb und außerhalb der Container „Use Application/Browser“ ausgeführt werden.
Da die Chromium-Automatisierung immer eine neue Sitzung startet und das Benutzerprofil nicht wiederverwendet, eignet sie sich am besten für die Unattended-Automatisierung. Die Browser-Erweiterungsmethode ist die empfohlene Option für die Attended Automatisierung, bei der Sie mit dem bereits geöffneten Browser des Benutzers arbeiten müssen. Einen vollständigen Vergleich der Methoden finden Sie unter Browserautomatisierungsmodus .