- Vue d'ensemble (Overview)
- Processus Document Understanding
- Didacticiels de démarrage rapide
- Composants de l'infrastructure
- Présentation de la numérisation
- Moteurs OCR
- Activités liées à la numérisation
- Vue d’ensemble de l'entraînement de la classification des documents
- Assistant de configuration des classifieurs (Configure Classifiers Wizard) de l'activité Tester l'étendue des classifieurs (Train Classifier Scope)
- Machine Learning Classifier Trainer
- Activités liées à l'entraînement de la classification des documents
- Paquets ML
- Pipelines
- Data Manager
- Services OCR
- Document Understanding déployé dans Automation Suite
- Document Understanding déployé dans une version AI Center autonome
- Apprentissage profond
- Créer un modèle de ML hautement performant
- Licences
- Référence (Reference)
- UiPath.Abbyy.Activities
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
Ce qu'est la numérisation
La numérisation est le processus d'obtention d'un texte lisible par une machine à partir d'un fichier entrant donné. Elle rend possible la compréhension de son contenu par un robot et permet à ce dernier d'agir en conséquence. Il s'agit de la première étape appliquée aux fichiers qui doivent être traités via l'infrastructure Document Understanding.
L'étape de numérisation a deux sorties :
- le texte du fichier traité, stocké dans une variable chaîne, et
- le modèle d'objet document de ce fichier – objet JSON contenant des informations de base telles que le nom, le type de contenu, la longueur du texte, le nombre de pages ainsi que des informations détaillées telles que la rotation des pages, la langue détectée, le contenu et les coordonnées de chaque mot identifié dans le fichier.
Dans l'infrastructure de traitement de document, la numérisation est effectuée à l'aide de l'activité Numériser le document (Digitize Document).
Ce que la numérisation n'est pas
Bien que liée, l'étape de numérisation se distingue de l'OCR.
Dans de nombreux cas, les fichiers à traiter sont des fichiers PDF natifs (non numérisés) qui peuvent être lus par programmation par le robot sans appliquer l'OCR.
Quand l'OCR est utilisée dans la numérisation
The Digitize Document activity requires, as part of its configuration, the selection of an OCR engine — so that, at need, it can be used, but only executes OCR on
- les fichiers images
- les formats d'images pris en charge sont .png, .gif, .jpe, .jpg, .jpeg, .tiff, .tif, .bmp
- pour les fichiers TIFF multipages, l'OCR est appliqué pour chaque page
- pages PDF qui
- ne présentent aucun contenu lisible par machine
- contiennent des images qui couvrent une zone significative de la page.
L'OCR est également toujours appliqué si l'activité Numériser le document (Digitize Document) est configurée avec l'indicateur ForceApplyOCR défini sur True (Vrai). Cette option est généralement recommandée pour les cas d'utilisation dans lesquels un important pourcentage de fichiers semble contenir du contenu natif, mais que le contenu lu de manière native ne correspond pas à ce qu'un utilisateur peut voir dans ces fichiers.
Comment choisir votre moteur OCR
As each use case has its own particularities, it is strongly recommended to test all available OCR Engines with different settings, to determine which one works best for your project. Another recommendation is to pay particular attention to the OCR engine arguments, such as Profile, Scale, Language etc. (may vary from one engine to another), so that you can identify the best settings for each use case.