- Vue d'ensemble (Overview)
- Processus Document Understanding
- Didacticiels de démarrage rapide
- Extraction des données depuis des reçus
- Factures réentraînées avec un champ supplémentaire
- Extraire des données depuis des formulaires
- Composants de l'infrastructure
- Vue d’ensemble de l'entraînement de la classification des documents
- Assistant de configuration des classifieurs (Configure Classifiers Wizard) de l'activité Tester l'étendue des classifieurs (Train Classifier Scope)
- Machine Learning Classifier Trainer
- Activités liées à l'entraînement de la classification des documents
- Paquets ML
- Pipelines
- Data Manager
- Services OCR
- Document Understanding déployé dans Automation Suite
- Document Understanding déployé dans une version AI Center autonome
- Apprentissage profond
- Créer un modèle de ML hautement performant
- Licences
- Référence (Reference)
- UiPath.Abbyy.Activities
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
Le but de cette page est d'aider les nouveaux utilisateurs à se familiariser avec Document Understanding.
For scalable production deployments, we strongly recommend using the Document Understanding Process available in UiPath Studio under the Templates section.
This quickstart guides you through the steps required to extract information from W-9 forms using the Intelligent Form Extractor. The W-9 forms are used as an example, but the procedure is similar for other types of documents where the data is structured.
En partant de zéro, voici les étapes à suivre :
- Créer un processus vierge
- Installer les packages d'activités requis
- Créer une taxonomie
- Numériser le document
- Extraire les données à l'aide de l'Extracteur de formulaires intelligents (Intelligent Form Extractor)
- Valider les résultats à l'aide de la Station de validation (Validation Station)
- Export Extraction Results
Voyons maintenant chaque étape en détail.
1. Créer un processus vierge
Lancer UiPath Studio.
Dans le mode backstage ACCUEIL (HOME), cliquez sur Traiter (Process) pour créer un nouveau projet.
La fenêtre Nouveau processus vierge (New Blank Process) s'affiche. Dans cette fenêtre, entrez un nom pour le nouveau projet. Si vous le souhaitez, vous pouvez également ajouter une description pour trier plus facilement vos projets.
Cliquez sur Créer (Create). Le nouveau projet est ouvert dans Studio.
2. Installer les packages d'activités requis
À partir du bouton Gérer les packages (Manage Packages) du ruban, outre les packages d'activités de base (UiPath.Excel.Activities, UiPath.Mail.Activities, UiPath.System.Activities, UiPath.UIAutomation.Activities) qui sont ajoutés au projet par défaut, installez les packages d'activités suivants :
3. Créer une taxonomie
Une fois les packages installés, répertoriez les champs obligatoires. Nous ferons l'extraction de données pour les champs ci-dessous :
- 1_Name -
Text - 2_BusinessName -
Text - 3a_Individual -
Boolean - 3b_CCorp -
Boolean - 3c_SCorp -
Boolean - 3d_Partnership -
Boolean - 3e_TrustEstate -
Boolean - 3f_LLC -
Boolean - 3f_LLC TaxClassification -
Boolean - 3g_Other -
Boolean - 3g_AutreDétail -
Boolean - 5_Address -
Text - 6_CityStateZip -
Text - 7_AcctNumber -
Text - TIN_SSN -
Text - TIN_ETN -
Text - Certification_Signature -
Boolean - Certification_SignatureDate -
Date
Open Taxonomy Manager and create a group named "Structured Documents", a category named "Lending Forms", and a document type named "W-9". Create above listed fields with user friendly names along with respective data types.
4. Numériser le document
Dans le fichier Main.xaml , ajoutez une activité Ajouter une taxonomie et créez une variable pour la sortie de taxonomie.
Ajoutez une activité Numériser le document avec UiPath Document OCR. Fournissez la propriété d'entrée Chemin du document et créez des variables de sortie pour Texte du document et Modèle d'objet document.
N'oubliez pas d'ajouter la clé API Document Understanding dans l'activité UiPath Document OCR.
5. Extraire les données à l'aide de l'Extracteur de formulaires intelligents (Intelligent Form Extractor)
Ajoutez une activité Étendue de l'extraction de données (Data Extraction Scope) et renseignez les propriétés.
Faites glisser et déposez l' Extracteur de formulaires intelligents à l'intérieur. Le point de terminaison doit être rempli automatiquement avec le point de terminaison de l'Extracteur de formulaires intelligents, à savoir https://du.uipath.com/svc/intelligentforms. Fournissez la clé d’API Document Understanding.
Une fois cela fait, pour créer un nouveau modèle, cliquez sur Gérer les modèles (Manage Templates) > Créer un modèle (Create Template). Une fenêtre contextuelle s'ouvre.
Sous Type de document (Document type), sélectionnez le type de document W-9 créé précédemment.
Sous Nom du document (Document name), saisissez un nom pour votre modèle.
Sous Modèle de document (PDF natif si possible), joignez un document modèle dans lequel vous allez mapper les positions des champs.
Sous Moteur OCR, sélectionnez à nouveau UiPath Document OCR. Comme avant, le point de terminaison doit être rempli automatiquement, à savoir https://du.uipath.com/ocr, et il vous suffit de fournir la clé API.
Cliquez sur Configurer (Configure) pour passer à l'étape suivante. La fenêtre contextuelle du gestionnaire de modèles (Template Manager) s'ouvre.
Here, we will need to select the areas where we want Intelligent Form Extractor to search for our fields. Configure them by following the steps detailed here. You also have the option of using anchors for your fields. More information on anchors here.
Vous devriez vous retrouver avec quelque chose comme ça :
Cliquez sur Enregistrer (Save). Dans cet écran, vous pouvez définir les champs manuscrits ou de signature, le cas échéant. Vous pouvez également définir des synonymes pour les champs booléens. Fermez la fenêtre une fois que vous avez terminé.
L'étape suivante consiste à configurer l'Extracteur, ce qui signifie que l'Extracteur de formulaires intelligents (Intelligent Form Extractor) traite tous les documents de type W-9.
6. Valider les résultats à l'aide de la Station de validation (Validation Station)
Pour vérifier les résultats via la Station de validation, glissez-déposez l'activité Présenter la station de validation et fournissez les détails d'entrée.
7. Exporter les résultats de l'extraction
Pour exporter les résultats d'extraction, validés ou non, glissez et déposez une activité Exporter les résultats d'extraction à la fin de votre workflow. Cela génère les résultats dans un DataSet contenant plusieurs tables, qui peuvent ensuite être écrites dans un fichier Excel ou être utilisées directement dans un processus en aval.
Téléchargez l'exemple
Téléchargez cet exemple de projet pour exécuter le workflow W-9 avec l'Extracteur de formulaires intelligents à l'aide de ce lien.
- 1. Créer un processus vierge
- 2. Installer les packages d'activités requis
- 3. Créer une taxonomie
- 4. Numériser le document
- 5. Extraire les données à l'aide de l'Extracteur de formulaires intelligents (Intelligent Form Extractor)
- 6. Valider les résultats à l'aide de la Station de validation (Validation Station)
- 7. Exporter les résultats de l'extraction
- Téléchargez l'exemple