document-understanding
2021.10
false
Guide de l'utilisateur de Document Understanding
- Démarrage
- Composants de l'infrastructure
- Vue d’ensemble de classification de document
- Assistant de configuration des classifieurs de l'activité Classer l'étendue du document (Classify Document Scope)
- Keyword Based Classifier
- Intelligent Keyword Classifier
- FlexiCapture Classifier
- Machine Learning Classifier
- Activités liées à la classification des documents
- Vue d’ensemble de l'entraînement de la classification des documents
- Assistant de configuration des classifieurs (Configure Classifiers Wizard) de l'activité Tester l'étendue des classifieurs (Train Classifier Scope)
- Machine Learning Classifier Trainer
- Activités liées à l'entraînement de la classification des documents
- Vue d’ensemble de l’extraction des données
- Assistant de configuration des extracteurs (Configure Extractors Wizard) de l'activité Étendue de l'extraction de données (Data Extraction Scope)
- Regex Based Extractor
- Form Extractor
- Extracteur de formulaires intelligents
- Extracteur d'apprentissage automatique
- FlexiCapture Extractor
- Activités liées à l'extraction de données
- Paquets ML
- Pipelines
- Data Manager
- Services OCR
- Document Understanding déployé dans Automation Suite
- Document Understanding déployé dans une version AI Center autonome
- Apprentissage profond
- Licences
- Référence (Reference)
- UiPath.Abbyy.Activities
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
Important :
La localisation du contenu nouvellement publié peut prendre 1 à 2 semaines avant d’être disponible.
Un moteur OCR est utilisé dans le composant de numérisation pour identifier le texte d'un fichier lorsque le contenu natif n'est pas disponible.
Voici une sélection de moteurs OCR parmi lesquels vous pouvez choisir, selon vos besoins, tout au long de l'infrastructure Document Understanding.
| Moteur OCR | Pack d'activités | Format des journaux de débogage dans le dossier des journaux | Rapports de confiance |
|---|---|---|---|
| UiPath Document OCR | UiPath.OCR.Activities | `${date:format=yyyy-MM-dd | ✅ |
| OmniPage OCR | UiPath.OmniPage.Activities | `${date:format=yyyy-MM-dd | ✅ |
| Google Cloud Vision OCR | UiPath.UIAutomation.Activities | `${date:format=yyyy-MM-dd | ❌ si DetectionMode est défini sur TextDetection (par défaut) ✅ si DetectionMode est défini sur DocumentTextDetection |
| Microsoft Azure ComputerVision OCR | UiPath.UIAutomation.Activities | `${date:format=yyyy-MM-dd | ❌ si UseReadAPI n'est pas sélectionné (par défaut) ✅ si UtiliserAPILecture est sélectionné |
| Reconnaissance optique des caractères Microsoft (Microsoft OCR) | UiPath.UIAutomation.Activities | `${date:format=yyyy-MM-dd | ❌ |
| Tesseract OCR | UiPath.UIAutomation.Activities | `${date:format=yyyy-MM-dd | ✅ |
| Abbyy Document OCR | UiPath.AbbyyEmbedded.Activities | `${date:format=yyyy-MM-dd | ✅ |
Remarque :
Lors du débogage des erreurs, vous pouvez toujours visiter le dossier des journaux (logs folder) et vérifier les fichiers journaux OCR pertinents. Pour en savoir plus sur la journalisation, cliquez ici.
Important :
Abbyy OCR and Abbyy Cloud OCR are not available in Document Understanding wizards.