activities
latest
false
- Vue d'ensemble (Overview)
- Document Processing Contracts
- Notes de publication
- À propos des contrats de traitement de documents
- Classe Zone
- Interface ActivitéIPersisted
- Classe PrettyBoxConverter
- Interface ActivitéIClassifier
- Interface FournisseurIClassifieurCapacités
- Classe TypeDocumentClassifieur
- Classe RésultatClassifieur
- Classe ActivitéCodeClassifieur
- Classe ActivitéClassifieurNatif
- Classe ActivitéClassifieurCodeAsync
- Classe CapacitéClassifieurTypeDocument
- Classe ActivitéExtracteurCodeAsync
- Classe ActivitéExtracteurCode
- Classe ExtracteurTypeDocument
- Classe ExtracteurDocumentTypeCapacités
- Classe ExtracteurChampCapacités
- Classe ActivitéExtracteurNatif
- Classe ExtracteurRésultat
- Interface FournisseurICapabilities
- Interface ActivitéIExtractor
- Classe ChargeUtileExtracteur
- Énumération PrioritéActionDocument
- Classe DocumentActionData
- Énumération StatutActionDocument
- Énumération TypeActionDocument
- Classe DocumentClassificationActionData
- Classe DocumentValidationActionData
- Classe DonnéesUtilisateur
- Classe Documents
- Classe RésultatDivisionDocument
- Classe ExtensionDom
- Classe Page
- Classe SectionPage
- Classe Polygone
- Classe ConvertisseurPolygones
- Classe de métadonnées
- Classe GroupeMot
- Classe Mot
- Énumération SourceTraitement
- Classe CelluleRésultatsTable
- Classe ValeurTableRésultats
- Classe InformationsColonnesTableRésultats
- Classe TableRésultats
- Énumération Rotation
- Énumération TypeSection
- Énumération TypeGroupeMot
- ProjectionTexteIDocument Interface
- Classe RésultatClassification
- Classe RésultatExtraction
- Classe ResultatsDocument
- Classe ResultatsLimitesDocument
- Classe ResultatsDonnéesPoint
- Classe RésultatsValeur
- Classe ResultatsContenuRéference
- Classe ResultatsValeurJetons
- Classe ResultatsChampDérivé
- Énumération ResultatsSourceDonnées
- Classe ResultatsConstantes
- Classe ChampValeurSimple
- Classe ValeurChampTable
- Classe GroupeDocument
- Classe DocumentTaxonomie
- Classe TypeDocument
- Classe Champ
- Énumération TypeChamp
- Classe InfoLangage
- Classe SaisieMétadonnées
- Énumération TypeTexte
- Classe TypeFieldTypeField Class
- Interface ActivitéISuivi
- ITrainableActivity Interface
- Interface ActivitéClassifieurITrainable
- Interface ActivitéExtracteurITrainable
- Classe ActivitéFormationClassifieurCodeAsync
- Classe ActivitéFormationClassifieurCode
- Classe ActivitéFormationClassifieurNatif
- Classe ActivitéFormationExtracteurCodeAsync
- Classe ActivitéFormationExtracteurCode
- Classe ActivitéFormationExtracteurNative
- Numériseur de Document Understanding
- Document Understanding ML
- Serveur local OCR Document Understanding
- Document Understanding
- Notes de publication
- À propos du package d’activités Document Understanding
- Compatibilité du projet
- Définir le mot de passe du PDF
- Merge PDFs
- Get PDF Page Count
- Extraire le texte PDF (Extract PDF Text)
- Extract PDF Images
- Extract PDF Page Range
- Extraire les données du document
- Create Validation Task and Wait
- Attendre la tâche de validation et reprendre
- Create Validation Task
- Classer un document (Classify Document)
- Créer une tâche de validation de classification (Create Classification Validation Task)
- Créer une tâche de validation de classification et attendre (Create Classification Validation Task and Wait)
- Attendre la tâche de validation de la classification et reprendre
- IntelligentOCR
- Notes de publication
- À propos du package d'activités IntelligentOCR
- Compatibilité du projet
- Configuration de l'authentification
- Load Taxonomy
- Digitize Document
- Classify Document Scope
- Keyword Based Classifier
- Classifieur de projet Document Understanding (Document Understanding Project Classifier)
- Intelligent Keyword Classifier
- Create Document Classification Action
- Attendre l'action de classification du document et reprendre
- Tester l'étendue des classifieurs
- Outil d'entraînement de classifieur basé sur des mots-clés
- Intelligent Keyword Classifier Trainer
- Data Extraction Scope
- Extracteur de projet Document Understanding (Document Understanding Project Extractor)
- Regex Based Extractor
- Form Extractor
- Extracteur de formulaires intelligents
- Present Validation Station
- Create Document Validation Action
- Wait For Document Validation Action And Resume
- Tester l'étendue des extracteurs
- Export Extraction Results
- Valider manuellement des documents numérisés
- Extraction de données basée sur des ancres à l'aide de l'Extracteur de formulaires intelligent
- Station de validation
- Services ML
- OCR
- Contrats OCR
- Notes de publication
- À propos des contrats OCR
- Compatibilité du projet
- Interface ActivitéIOCR
- Classe OCRCodeAsync
- Classe ActivitéCodeOCR
- Classe ActivitéOCRNatif
- Classe Caractère
- Classe RésultatOCR
- Classe Mot
- Énumération StylesPolice
- Énumération RotationOCR
- Classe OCRCapabilities
- Classe BaseCaptureOCR
- Classe UsineCaptureOCR
- Classe BaseContrôleCapture
- Énumération UtilisationCaptureMoteur
- ScrapeEngineBase
- Classe ScrapeEngineFactory
- Classe ScrapeEngineProvider
- OmniPage
- PDF
- [Non listé] Abbyy
- Notes de publication
- À propos du package d'activités Abbyy
- Compatibilité du projet
- Reconnaissance optique des caractères ABBYY (ABBYY OCR)
- Reconnaissance optique des caractères ABBYY Cloud (ABBYY Cloud OCR)
- FlexiCapture Classifier
- FlexiCapture Extractor
- FlexiCapture Scope
- Classer un document (Classify Document)
- Traiter le document (Process Document)
- Valider le document (Validate Document)
- Exporter le document (Export Document)
- Obtenir le champ (Get Field)
- Obtenir la table (Get Table)
- Prepare Validation Station Data
- [Non listé] Abbyy intégré
Valider manuellement des documents numérisés
Important :
Veuillez noter que ce contenu a été localisé en partie à l’aide de la traduction automatique.
Activités Document Understanding
Last updated 29 oct. 2024
Valider manuellement des documents numérisés
L'exemple ci-dessous explique comment extraire manuellement les données d'une image et présenter la sortie dans un fichier séparé. Il présente des activités telles que Numériser le document ou Présenter la station de validation. Vous pouvez trouver ces activités dans le package UiPath.IntelligentOCR.Activities .
Remarque : ce workflow utilise une ancienne version du package UiPath.IntelligentOCR.Activities .
Steps:
- Ouvrez Studio et créez un nouveau Processus nommé par défaut Principal.
Remarque : assurez-vous d'ajouter tous les fichiers nécessaires (fichiers
.json
et toutes les images) dans le dossier du projet. - Ajoutez un conteneur Séquence dans le concepteur de workflow et créez les variables indiquées dans le tableau suivant :
Tableau 1. Variables à créer Nom de variable
Types de variables
Valeur par défaut
Text
Chaîne de caractères (string)
DOM
UiPath.DocumentProcessing.Contracts.Dom.Document
Data
UiPath.DocumentProcessing.Contracts.Taxonomy.DocumentTaxonomy
DocumentTaxonomy
UiPath.DocumentProcessing.Contracts.Taxonomy.DocumentTaxonomy
TaxonomyJSON
Chaîne de caractères (string)
HumanValidated
UiPath.DocumentProcessing.Contracts.Results.ExtractionResult
- Ajoutez une activité Lire le fichier texte (Read Text File) dans la séquence.
- Dans le panneau Propriétés, ajoutez le chemin du fichier, en l'occurrence
"taxonomy.json"
, dans le champ CheminClasseur. - Ajoutez la variable
TaxonomyJSON
dans le champ Condition.
- Dans le panneau Propriétés, ajoutez le chemin du fichier, en l'occurrence
- Ajoutez une activité Affecter (Assign) après l’activité Lire le fichier texte (Read Text File).
- Ajoutez la variable
Data
dans le champ À et l'expressionDocumentTaxonomy.Deserialize(TaxonomyJSON)
dans le champ Valeur . Cette activité crée la taxonomie pour l'extraction.
- Ajoutez la variable
- Ajoutez une activité Numériser le document (Digitize Document) après l’activité Affecter (Assign).
- Dans le panneau Propriétés, ajoutez la valeur
1
dans le champ LigneTableau. - Ajoutez l’expression
"Input\Invoice01.tif"
dans le champ Chemin d'accès au document. - Ajoutez la variable
DOM
dans le champ DocumentObjectModel . - Ajoutez la variable
Text
dans le champ TexteDocument.
- Dans le panneau Propriétés, ajoutez la valeur
- Ajoutez un moteur Google OCR dans l’activité Numériser le document (Digitize Document).
- Dans le panneau Propriétés, ajoutez la variable
Image
dans le champ Image. - Cochez la case de l'option Extraire les mots (ExtractWords) . Cette option extrait la position à l'écran de tous les mots détectés.
- Indiquez l'expression
"eng"
dans le champ Langue. - Sélectionnez l'option
Legacy
dans la liste déroulante Profil. - Ajoutez la valeur
2
dans le champ Échelle.
- Dans le panneau Propriétés, ajoutez la variable
- Ajoutez une activité Présenter la station de validation (Present Validation Station) après l’activité Numériser le document (Digitize Document).
- Dans le panneau Propriétés , ajoutez la variable
DOM
dans le champ ModèleObjetDocument . - Ajoutez l’expression
"Input\Invoice01.tif"
dans le champ Chemin d'accès au document. - Ajoutez la variable
Text
dans le champ TexteDocument. - Ajoutez la variable
Data
dans le champ Texte. - Ajoutez la variable
HumanValidated
dans le champ ValidatedExtractionResults .
- Dans le panneau Propriétés , ajoutez la variable
- Ajoutez une activité Pour chaque (For Each) sous l’activité Présenter la station de validation (Present Validation Station).
- Dans le panneau Propriétés, sélectionnez l'option
UiPath.DocumentProcessing.Contracts.Results.ResultsDataPoint
dans la liste déroulante TypeArgument. - Ajoutez l’expression
HumanValidated.ResultsDocument.Fields
dans le champ Valeur.
- Dans le panneau Propriétés, sélectionnez l'option
- Ajoutez une activité Log Message (Log Message ) dans le corps de l’activité For Each .
- Sélectionnez l'option
Info
dans la liste déroulante Niveau. - Indiquez l'expression
item.FieldName
dans le champ Message.
- Sélectionnez l'option
- Faites glisser une activité Message du journal (Log Message) sous l’activité Message du journal précédente.
- Sélectionnez l’option
Info
dans la liste déroulante Niveau. - Indiquez l'expression
item.Values(0).Value.ToString
dans le champ Message.
- Sélectionnez l’option
- Ajouter une activité Écrire une ligne (Write Line) sous l’activité Message du journal (Log Message).
- Ajoutez la valeur
""
dans le champ Texte.
- Ajoutez la valeur
- Exécutez le processus. Le robot utilise les activités IntelligentOCR pour traiter manuellement les données et présenter les résultats.
Accédez au lien suivant pour télécharger l’exemple en tant que fichier
ZIP
: Exemple.