- Vue d'ensemble (Overview)
- Document Processing Contracts
- À propos des contrats de traitement de documents
- Classe Zone
- Interface ActivitéIPersisted
- Classe PrettyBoxConverter
- Interface ActivitéIClassifier
- Interface FournisseurIClassifieurCapacités
- Classe TypeDocumentClassifieur
- Classe RésultatClassifieur
- Classe ActivitéCodeClassifieur
- Classe ActivitéClassifieurNatif
- Classe ActivitéClassifieurCodeAsync
- Classe CapacitéClassifieurTypeDocument
- Classe ActivitéExtracteurCodeAsync
- Classe ActivitéExtracteurCode
- Classe ExtracteurTypeDocument
- Classe ExtracteurDocumentTypeCapacités
- Classe ExtracteurChampCapacités
- Classe ActivitéExtracteurNatif
- Classe ExtracteurRésultat
- Interface FournisseurICapabilities
- Interface ActivitéIExtractor
- Classe ChargeUtileExtracteur
- Énumération PrioritéActionDocument
- Classe DocumentActionData
- Énumération StatutActionDocument
- Énumération TypeActionDocument
- Classe DocumentClassificationActionData
- Classe DocumentValidationActionData
- Classe DonnéesUtilisateur
- Classe Documents
- Classe RésultatDivisionDocument
- Classe ExtensionDom
- Classe Page
- Classe SectionPage
- Classe Polygone
- Classe ConvertisseurPolygones
- Classe de métadonnées
- Classe GroupeMot
- Classe Mot
- Énumération SourceTraitement
- Classe CelluleRésultatsTable
- Classe ValeurTableRésultats
- Classe InformationsColonnesTableRésultats
- Classe TableRésultats
- Énumération Rotation
- Énumération TypeSection
- Énumération TypeGroupeMot
- ProjectionTexteIDocument Interface
- Classe RésultatClassification
- Classe RésultatExtraction
- Classe ResultatsDocument
- Classe ResultatsLimitesDocument
- Classe ResultatsDonnéesPoint
- Classe RésultatsValeur
- Classe ResultatsContenuRéference
- Classe ResultatsValeurJetons
- Classe ResultatsChampDérivé
- Énumération ResultatsSourceDonnées
- Classe ResultatsConstantes
- Classe ChampValeurSimple
- Classe ValeurChampTable
- Classe GroupeDocument
- Classe DocumentTaxonomie
- Classe TypeDocument
- Classe Champ
- Énumération TypeChamp
- Classe InfoLangage
- Classe SaisieMétadonnées
- Énumération TypeTexte
- Classe TypeFieldTypeField Class
- Interface ActivitéISuivi
- ITrainableActivity Interface
- Interface ActivitéClassifieurITrainable
- Interface ActivitéExtracteurITrainable
- Classe ActivitéFormationClassifieurCodeAsync
- Classe ActivitéFormationClassifieurCode
- Classe ActivitéFormationClassifieurNatif
- Classe ActivitéFormationExtracteurCodeAsync
- Classe ActivitéFormationExtracteurCode
- Classe ActivitéFormationExtracteurNative
- Numériseur de Document Understanding
- Document Understanding ML
- Serveur local OCR Document Understanding
- Processus Document Understanding : modèle Studio
- Activités Document Understanding
- À propos du package Document Understanding Digitizer
- Compatibilité du Projet
- Définir le mot de passe du PDF
- Merge PDFs
- Get PDF Page Count
- Extraire le texte PDF (Extract PDF Text)
- Extract PDF Images
- Extract PDF Page Range
- Extraire les données du document
- Create Validation Task and Wait
- Attendre la tâche de validation et reprendre
- Create Validation Task
- Classer un document (Classify Document)
- Créer une tâche de validation de classification (Create Classification Validation Task)
- Créer une tâche de validation de classification et attendre (Create Classification Validation Task and Wait)
- Attendre la tâche de validation de la classification et reprendre
- IntelligentOCR
- À propos du package d'activités IntelligentOCR
- Compatibilité du Projet
- Load Taxonomy
- Digitize Document
- Classify Document Scope
- Keyword Based Classifier
- Intelligent Keyword Classifier
- Present Classification Station
- Create Document Classification Action
- Wait For Document Classification Action And Resume
- Tester l'étendue des classifieurs
- Outil d'entraînement de classifieur basé sur des mots-clés
- Intelligent Keyword Classifier Trainer
- Data Extraction Scope
- Regex Based Extractor
- Form Extractor
- Extracteur de formulaires intelligents
- Present Validation Station
- Create Document Validation Action
- Wait For Document Validation Action And Resume
- Tester l'étendue des extracteurs
- Export Extraction Results
- Services ML
- OCR
- Contrats OCR
- Notes de publication
- À propos des contrats OCR
- Compatibilité du Projet
- Interface ActivitéIOCR
- Classe OCRCodeAsync
- Classe ActivitéCodeOCR
- Classe ActivitéOCRNatif
- Classe Caractère
- Classe RésultatOCR
- Classe Mot
- Énumération StylesPolice
- Énumération RotationOCR
- Classe OCRCapabilities
- Classe BaseCaptureOCR
- Classe UsineCaptureOCR
- Classe BaseContrôleCapture
- Énumération UtilisationCaptureMoteur
- ScrapeEngineBase
- Classe ScrapeEngineFactory
- Classe ScrapeEngineProvider
- OmniPage
- PDF
- [Non listé] Abbyy
- Notes de publication
- À propos du package d'activités Abbyy
- Compatibilité du Projet
- Reconnaissance optique des caractères ABBYY (ABBYY OCR)
- Reconnaissance optique des caractères ABBYY Cloud (ABBYY Cloud OCR)
- FlexiCapture Classifier
- FlexiCapture Extractor
- FlexiCapture Scope
- Classer un document (Classify Document)
- Traiter le document (Process Document)
- Valider le document (Validate Document)
- Exporter le document (Export Document)
- Obtenir le champ (Get Field)
- Obtenir la table (Get Table)
- Prepare Validation Station Data
- [Non listé] Abbyy intégré
Station de validation
L'extraction et la validation des données peuvent être amusantes et faciles lorsque vous utilisez l'assistant de la station de validation (Validation Station). Vous trouverez ci-dessous des détails sur la création d'un workflow qui inclut des activités telles que Numériser le document ( Digitize Document), Étendue de l'extraction de données ( Data Extraction Scope) et Présenter la station de validation (Present Validation Station).
Vous pouvez utiliser ces activités lorsque vous avez besoin d'automatiser l'extraction et la validation de données à partir de documents du même type. Les factures ou les bons de commande conviennent parfaitement à ce type de tâches.
Le workflow ci-dessous se concentre sur l'utilisation de l'activité Numériser le document sur une facture, suivie de la validation des informations à l'aide de l'activité Présenter la station de validation . Le moteur OCR choisi pour ce workflow est UiPath Document OCR , mais n'hésitez pas à le remplacer par l'un de nos autres moteurs OCR.
La taxonomie est également simple, créée sur la base du document Facture (Invoice) utilisé. Voici plus de détails sur la création de votre taxonomie.
Création du workflow
Voici comment le processus d'automatisation peut être créé :
- Ouvrez Studio et créez un nouveau Processus nommé par défaut Principal.
- Faites glisser un conteneur Séquence vers le concepteur de workflow.
-
Sélectionnez le conteneur Sequence et créez la variable suivante :
Nom de variable
Types de variables
Valeur par défaut
taxonomy
DocumentTaxonomy
-
Faites glisser une activité Charger la taxonomie dans le conteneur Sequence .
- Ajoutez la variable
taxonomy
dans le champ Texte.
- Ajoutez la variable
-
Faites glisser une activité For Each sous l'activité For Each Row.
- Ajoutez l’expression
doc
dans le champ NomFichier. - Ajoutez l’expression
directory.GetFiles("TestData\InputDocs\")
dans le champ Ligne. - Dans le panneau Propriétés, sélectionnez l'option String dans la liste déroulante TypeArgument.
- Ajoutez l’expression
-
Sélectionnez le conteneur Body de l’activité For Each et créez la variable suivante :
Nom de variable
Types de variables
Valeur par défaut
docName
ValeurGénérique
dom
Document
text
Chaîne de caractères (string)
extractionResults
RésultatExtraction
validatedResults
RésultatExtraction
-
Ajoutez une activité Attribuer (Assign) dans le conteneur Sequence.
- Ajoutez la variable
docName
dans le champ À. - Ajoutez l’expression
System.IO.Path.GetFileNameWithoutExtension(doc)
dans le champ Valeur.
- Ajoutez la variable
-
Ajoutez une activité Write Line sous l’activité Assign.
- Ajoutez l'expression
"Digitizing "+docName
dans le champ Texte.
- Ajoutez l'expression
-
Ajoutez une activité Digitize Document sous l'activité Write Line .
- Définissez CheminDocument sur
doc
. - Ajoutez la variable
text
dans le champ TexteDocument. - Ajoutez la variable
dom
dans le champ DocumentObjectModel .
- Définissez CheminDocument sur
- Faites glisser un moteur OCR dans l'activité Numériser le document . UiPath Document OCR est utilisé pour cet exemple.
-
Ajoutez une activité Write Line sous l’activité Digitize Document .
- Ajoutez l'expression
docName+" was digitized."
dans le champ Texte.
- Ajoutez l'expression
-
Placez une activité Write Line sous l'activité Write Line précédente.
- Ajoutez l'expression
"Opening the Validation Station"
dans le champ Texte.
- Ajoutez l'expression
- Faites glisser une activité If sous l'activité Write Line.
- Ajoutez un conteneur Sequence dans la section Essayer (Essayer).
-
Ajoutez une activité Present Validation Station dans le conteneur Sequence .
- Ajoutez
doc
comme valeur dans le champ CheminDocument . - Ajoutez la variable
text
dans le champ TexteDocument. - Ajoutez la variable
dom
dans le champ ModeObjetDocument . - Ajoutez la variable
taxonomy
dans le champ Texte. - Ajoutez la variable
extractedResults
dans le champ AutomaticExtractionResults . - Ajoutez la variable
validatedResults
dans le champ ValidatedExtractionResults .
- Ajoutez
- Ajoutez une activité Write Text File sous l’activité Present Validation Station .
- Exécutez le processus. Le robot extrait automatiquement les données, classe les documents, extrait des champs spécifiques, prépare les données pour la validation et affiche les documents extraits.
Téléchargez un exemple ici.
Utilisation de la Station de validation
L'exécution du workflow ouvre l'assistant Station de validation . Ici, vous pouvez vérifier les informations extraites ou les extraire vous-même en utilisant les options Jetons ou Zone personnalisée . Si vous définissez un champ dans la taxonomie comme multivaleur, plusieurs valeurs peuvent être extraites pour ce champ. Cela peut être utile pour les documents avec plusieurs adresses, des devises différentes, etc.
Voyons comment basculer entre les options Jetons ( Tokens ) ou Zone personnalisée ( Custom Area) .
Voici un exemple d’ajout d’une valeur supplémentaire à un champ.
Vous trouverez plus d'informations sur l'utilisation et la personnalisation de la Station de validation ici.