- Überblick
- Document Understanding-Prozess
- Schnellstart-Tutorials
- Framework-Komponenten
- Übersicht zur Dokumentklassifizierung
- „Klassifizierer konfigurieren“-Assistent von Classify Document Scope
- Schlüsselwortbasierte Classifier (Keyword Based Classifier)
- Intelligenter Schlüsselwortklassifizierer
- FlexiCapture Classifier
- Machine Learning Classifier
- Dokumentklassifizierung – verwandte Aktivitäten
- Datenverbrauch
- ML-Pakete
- Pipelines
- Dokumentmanager
- OCR-Dienste
- Document Understanding – in der Automation Suite bereitgestellt
- Installieren und verwenden
- First Run Experience
- UiPathDocumentOCR bereitstellen
- Ein out-of-the-box ML-Paket bereitstellen
- Offline-Pakete 2022.10.0
- Offline-Pakete 2022.10.2
- Offlinepakete 2022.10.4
- Offline-Pakete 2022.10.6
- Offlinepakete 2022.10.8
- Offlinepakete 2022.10.9
- Offlinepakete 2022.10.10
- Offlinepakete 2022.10.11
- Offlinepakete 2022.10.12
- Offlinepakete 2022.10.13
- Offlinepakete 2022.10.14
- Offlinepakete 2022.10.14+patch1
- Offlinepakete 2022.10.15
- Verwenden von Document Manager
- Framework verwenden
- Document Understanding – im eigenständigen AI Center bereitgestellt
- Deep Learning
- Lizenzierung
- Referenzen
- UiPath.Abbyy.Activities
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Aktivitäten (UiPath.IntelligentOCR.Activities)
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.Omnipage.Activities
- UiPath.PDF.Aktivitäten (UiPath.PDF.Activities)
Zweck des Intelligent Keyword Classifier
The Intelligent Keyword Classifier is a classifier that uses the word vector it learns from files of certain document types to perform document classification.
Der Algorithmus basiert auf dem Konzept der Wiederholung von Inhalten für den gleichen Dokumenttyp und beginnt mit der Annahme, dass Dokumenttypen eine Reihe von Wörtern haben, die normalerweise in diesen Dokumenttypen vorkommen, wodurch eine Vektorähnlichkeitsberechnung möglich ist.
Beim Klassifizieren einer Datei in einen Dokumenttyp führt der Intelligent Keyword Classifier folgende Aktionen aus:
- Er findet den nächsten Wortvektor, dem eine Datei ähnlicher ist,
- Er meldet den Dokumenttyp mit der höchsten Bewertung für die zugrundeliegenden übereinstimmenden Hauptwörter.
Der Intelligent Keyword Classifier verfügt auch über Funktionen zur Aufteilung von Dateien, was bedeutet, dass er mehr als eine Klasse für eine bestimmte Datei bei separaten Seitenbereichen melden kann.
Einsatzbereich
Dieser Klassifizierer eignet sich, wenn:
- Ihre Dateien einen oder mehrere Dokumenttypen in einer einzelnen Datei enthalten.
- Ihre Dokumenttypen sich relativ einfach durch den Inhalt unterscheiden lassen.
Spezielle Anforderungen
Sie müssen Ihren Automation Cloud Document Understanding API-Schlüssel verwenden oder Ihre eigene Instanz des Intelligent Keyword Classifier im lokalen AI Center hosten, um diesen Klassifizierer zu verwenden.
Wie trainiert wird
Platzieren Sie die Aktivität Intelligent Keyword Classifier Trainer in einen Train Classifiers Scope und konfigurieren Sie sie entsprechend.
We cannot enforce training file consistency across parallel trainings at the activity level. Two possible solutions for this issue are provided by Document Understanding Process. Both consist of traffic control:
- Dateien sperren (standardmäßig im Prozess implementiert): Geben Sie der Datei die Dateierweiterung
.lock, ändern und speichern Sie die Datei und benennen Sie die Datei dann erneut um, indem Sie die Erweiterung.lockwieder entfernen. - Eine spezielle Warteschlange manuell einrichten: Erstellen Sie eine leere Warteschlange im Orchestrator und integrieren Sie Ihre beiden Aktivitäten aus dem Projekt.
For more information on how to train a Classifier, check this page that describes the process of using the Manage Learning wizard.
Weitere Informationen
Learn more about Intelligent Keyword Classifier, by following this link.