- Vue d'ensemble (Overview)
- Document Processing Contracts
- Notes de publication
- À propos des contrats de traitement de documents
- Classe Zone
- Interface ActivitéIPersisted
- Classe PrettyBoxConverter
- Interface ActivitéIClassifier
- Interface FournisseurIClassifieurCapacités
- Classe TypeDocumentClassifieur
- Classe RésultatClassifieur
- Classe ActivitéCodeClassifieur
- Classe ActivitéClassifieurNatif
- Classe ActivitéClassifieurCodeAsync
- Classe CapacitéClassifieurTypeDocument
- ContentValidationData Class
- EvaluatedBusinessRulesForFieldValue Class
- EvaluatedBusinessRuleDetails Class
- Classe ActivitéExtracteurCodeAsync
- Classe ActivitéExtracteurCode
- Classe ExtracteurTypeDocument
- Classe ExtracteurDocumentTypeCapacités
- Classe ExtracteurChampCapacités
- Classe ActivitéExtracteurNatif
- Classe ExtracteurRésultat
- FieldValue Class
- FieldValueResult Class
- Interface FournisseurICapabilities
- Interface ActivitéIExtractor
- Classe ChargeUtileExtracteur
- Énumération PrioritéActionDocument
- Classe DocumentActionData
- Énumération StatutActionDocument
- Énumération TypeActionDocument
- Classe DocumentClassificationActionData
- Classe DocumentValidationActionData
- Classe DonnéesUtilisateur
- Classe Documents
- Classe RésultatDivisionDocument
- Classe ExtensionDom
- Classe Page
- Classe SectionPage
- Classe Polygone
- Classe ConvertisseurPolygones
- Classe de métadonnées
- Classe GroupeMot
- Classe Mot
- Énumération SourceTraitement
- Classe CelluleRésultatsTable
- Classe ValeurTableRésultats
- Classe InformationsColonnesTableRésultats
- Classe TableRésultats
- Énumération Rotation
- Rule Class
- RuleResult Class
- RuleSet Class
- RuleSetResult Class
- Énumération TypeSection
- Énumération TypeGroupeMot
- ProjectionTexteIDocument Interface
- Classe RésultatClassification
- Classe RésultatExtraction
- Classe ResultatsDocument
- Classe ResultatsLimitesDocument
- Classe ResultatsDonnéesPoint
- Classe RésultatsValeur
- Classe ResultatsContenuRéference
- Classe ResultatsValeurJetons
- Classe ResultatsChampDérivé
- Énumération ResultatsSourceDonnées
- Classe ResultatsConstantes
- Classe ChampValeurSimple
- Classe ValeurChampTable
- Classe GroupeDocument
- Classe DocumentTaxonomie
- Classe TypeDocument
- Classe Champ
- Énumération TypeChamp
- FieldValueDetails Class
- Classe InfoLangage
- Classe SaisieMétadonnées
- Énumération TypeTexte
- Classe TypeFieldTypeField Class
- Interface ActivitéISuivi
- ITrainableActivity Interface
- Interface ActivitéClassifieurITrainable
- Interface ActivitéExtracteurITrainable
- Classe ActivitéFormationClassifieurCodeAsync
- Classe ActivitéFormationClassifieurCode
- Classe ActivitéFormationClassifieurNatif
- Classe ActivitéFormationExtracteurCodeAsync
- Classe ActivitéFormationExtracteurCode
- Classe ActivitéFormationExtracteurNative
- Classe PointsDonnéesBases
- Classe ValeurBasique
- Classe FauneCollectionComposants
- Classe BaseFacturePointDonnées
- Classe GestionnaireRésultatsExtraction
- Classe PointDonnéesGroupeChamps
- Classe ValeurGroupeChamps
- Classe BaseLookup
- Classe ParamètresCaviardageChamp
- Classe OptionsCaviardage (Aperçu)
- Énumération TypeCaviardage
- Classe BaseFacultatifRésultats
- Classe PointDonnéesTable
- Classe LigneTable
- Classe ValeurTable
- Classe PointDonnéesCaractèreGénérique
- Classe CollectionPointDonnéesCaractèreGénérique
- Document Understanding ML
- Serveur local OCR Document Understanding
- Document Understanding
- Notes de publication
- À propos du package d’activités Document Understanding
- Compatibilité du projet
- Configuration de la connexion externe
- API d'automatisation codée Document Understanding (aperçu)
- Définir le mot de passe du PDF
- Merge PDFs
- Get PDF Page Count
- Extraire le texte PDF (Extract PDF Text)
- Extract PDF Images
- Extract PDF Page Range
- Extraire les données du document
- Create Validation Task and Wait
- Attendre la tâche de validation et reprendre
- Create Validation Task
- Créer une action de validation de document (Create Document Validation Action)
- Retrieve Document Validation Artifacts
- Classer un document (Classify Document)
- Créer une tâche de validation de classification (Create Classification Validation Task)
- Créer une tâche de validation de classification et attendre (Create Classification Validation Task and Wait)
- Attendre la tâche de validation de la classification et reprendre
- IntelligentOCR
- Notes de publication
- À propos du package d'activités IntelligentOCR
- Compatibilité du projet
- Load Taxonomy
- Digitize Document
- Classify Document Scope
- Keyword Based Classifier
- Classifieur de projet Document Understanding (Document Understanding Project Classifier)
- Intelligent Keyword Classifier
- Create Document Classification Action
- Créer une action de validation de document (Create Document Validation Action)
- Retrieve Document Validation Artifacts
- Attendre l'action de classification du document et reprendre
- Tester l'étendue des classifieurs
- Outil d'entraînement de classifieur basé sur des mots-clés
- Intelligent Keyword Classifier Trainer
- Data Extraction Scope
- Extracteur de projet Document Understanding (Document Understanding Project Extractor)
- Entraîneur d’extracteur de projet Document Understanding
- Regex Based Extractor
- Form Extractor
- Extracteur de formulaires intelligents
- Caviarder le document
- Create Document Validation Action
- Wait For Document Validation Action And Resume
- Tester l'étendue des extracteurs
- Export Extraction Results
- Extracteur d'apprentissage automatique
- Machine Learning Extractor Trainer
- Machine Learning Classifier
- Machine Learning Classifier Trainer
- Classifieur génératif
- Extracteur génératif
- Configuration de l'authentification
- Valider des documents avec des actions App
- Valider manuellement des documents numérisés
- Extraction de données basée sur des ancres à l'aide de l'Extracteur de formulaires intelligent
- Station de validation
- Activités génératives - Bonnes pratiques
- Extracteur génératif - Bonnes pratiques
- Classifieur génératif - Bonnes pratiques
- Services ML
- OCR
- Contrats OCR
- Notes de publication
- À propos des contrats OCR
- Compatibilité du projet
- Interface ActivitéIOCR
- Classe OCRCodeAsync
- Classe ActivitéCodeOCR
- Classe ActivitéOCRNatif
- Classe Caractère
- Classe RésultatOCR
- Classe Mot
- Énumération StylesPolice
- Énumération RotationOCR
- Classe OCRCapabilities
- Classe BaseCaptureOCR
- Classe UsineCaptureOCR
- Classe BaseContrôleCapture
- Énumération UtilisationCaptureMoteur
- ScrapeEngineBase
- Classe ScrapeEngineFactory
- Classe ScrapeEngineProvider
- OmniPage
- PDF
- Notes de publication
- À propos du package d'activités PDF
- Compatibilité du projet
- API d'automatisation codée PDF (aperçu)
- Convertir un e-mail en PDF (aperçu)
- Convertir HTML en PDF (aperçu)
- Convertir un contenu textuel en PDF (aperçu)
- Export PDF Page As Image
- Extraire les pièces jointes d’un fichier PDF
- Extract Images From PDF
- Extract PDF Page Range
- Get PDF Page Count
- Join PDF Files
- Manage PDF Password
- Lire le texte PDF (Read PDF Text)
- Lire le PDF avec OCR (Read PDF With OCR)
- Lire le texte XPS (Read XPS Text)
- Lire le XPS avec OCR (Read XPS With OCR)
- [Non listé] Abbyy
- Notes de publication
- À propos du package d'activités Abbyy
- Compatibilité du projet
- Reconnaissance optique des caractères ABBYY (ABBYY OCR)
- Reconnaissance optique des caractères ABBYY Cloud (ABBYY Cloud OCR)
- FlexiCapture Classifier
- FlexiCapture Extractor
- FlexiCapture Scope
- Classer un document (Classify Document)
- Traiter le document (Process Document)
- Valider le document (Validate Document)
- Exporter le document (Export Document)
- Obtenir le champ (Get Field)
- Obtenir la table (Get Table)
- Prepare Validation Station Data
- [Non listé] Abbyy intégré
API d'automatisation codée pour le package d'activités Document Understanding, couvrant la classification des documents, l'extraction de données et les artefacts de validation.
UiPath.DocumentUnderstanding.Activities
API de workflow codé pour la classification des documents, l'extraction des données structurées et la création et la récupération d'artefacts de validation de documents. Ces API sont disponibles lors de la conception d'automatisations codées. Pour obtenir une introduction aux automatisations codées et à leur conception à l'aide d'API, consultez la section Automatisations codées.
- Accéder au service:
du(typeIDocumentUnderstandingService) - Package requis:
"UiPath.DocumentUnderstanding.Activities": "*"dans les dépendancesproject.json.
Espaces de noms importés automatiquement
Les espaces de noms suivants sont automatiquement disponibles dans les workflows codés lorsque le package Document Understanding est installé:
UiPath.DocumentUnderstanding.Activities.ApiUiPath.Platform.ResourceHandlingUiPath.DocumentProcessing.Contracts.ActionsUiPath.IntelligentOCR.StudioWeb.Activities.DataExtractionUiPath.IntelligentOCR.StudioWeb.Activities.DocumentClassification
Vue d’ensemble du service
Le service du expose chaque opération Document Understanding sous forme d'appel de méthode direct. Il n’y a aucune connexion ni étendue à ouvrir. Appelez directement des méthodes sur l’accesseur du service:
var extracted = du.ExtractDocumentData(@"C:\invoices\invoice.pdf", "Invoices", "Production", "invoice");
var extracted = du.ExtractDocumentData(@"C:\invoices\invoice.pdf", "Invoices", "Production", "invoice");
Le service reflète les activités Classer un document, Extraire les données du document, Créer des artefacts de validation de document et Récupérer les artefacts de validation de document .
Version ou balise du projet
Le paramètre projectVersionOrTag correspond à la liste déroulante Version unique de Studio. Transmettez un nom de version (par exemple, v3) ou une balise (par exemple, Production, Staging, live). Le runtime résout quel type correspond au projet. Pour le projet prédéfini, utilisez Production.
Paramètres communs
timeoutMs(Int): délai d'attente en millisecondes pour la classification et l'extraction. La valeur par défaut est3600000(1 heure).docType(String): l'ID du type de document. Saisissez le nom du type de document pour les projets comportant plusieurs types de documents, ou bien une chaîne vide pour les projets de type IXP disposant d'un seul extracteur par version.
Classification
DocumentData ClassifyDocument(string documentPath, string projectName, string projectVersionOrTag, int timeoutMs = 3600000)
Classe un document à partir d’un chemin de fichier local par rapport à un projet Document Understanding. Renvoie un objet DonnéesDocument , y compris le type de document prédit.
DocumentData ClassifyDocument(IResource file, string projectName, string projectVersionOrTag, int timeoutMs = 3600000)
Classe la ressource de document fournie. Accepte tous les éléments IResource, tels que la sortie de l'activité Chemin d'accès existant ou Obtenir le fichier/dossier local .
Extraction de données
IDocumentData<DictionaryData> ExtractDocumentData(string documentPath, string projectName, string projectVersionOrTag, string docType, int timeoutMs = 3600000)
Extrait les données structurées d’un document au niveau d’un chemin d’accès local. Renvoie les champs extraits sous la forme IDocumentData<DictionaryData>.
IDocumentData<DictionaryData> ExtractDocumentData(IResource file, string projectName, string projectVersionOrTag, string docType, int timeoutMs = 3600000)
Extrait les données structurées à partir de la ressource de document fournie.
IDocumentData<DictionaryData> ExtractDocumentData(DocumentData classifiedDocument, string projectName, string projectVersionOrTag, string docType = null, int timeoutMs = 3600000)
Extrait les données structurées d’un document déjà classé avec ClassifyDocument, ce qui évite de procéder à une nouvelle numérisation du fichier. Lorsque la valeur docType est null, elle est dérivée du type de document du document classifié.
Artefacts de validation
ContentValidationData CreateDocumentValidationArtifacts(IDocumentData<DictionaryData> automaticExtractionResults, string orchestratorFolderName, string orchestratorBucketName = null)
Charge les résultats d'extraction dans le stockage Orchestrator et renvoie un handle ContentValidationData . Utilisez le handle pour créer une action de validation ou pour récupérer les résultats ultérieurement avec RetrieveDocumentValidationArtifacts. Lorsque orchestratorBucketName est null, le compartiment par défaut est utilisé.
IDocumentData<DictionaryData> RetrieveDocumentValidationArtifacts(ContentValidationData contentValidationData, object completedAppAction = null, bool removeDataFromStorage = false, bool returnAutomaticExtractionResults = false)
Récupère les résultats d'extraction validés à partir du stockage. Lorsque la valeur removeDataFromStorage est true, les artefacts de stockage sont supprimés après la récupération. Lorsque la valeur returnAutomaticExtractionResults est true, les résultats d’extraction automatique d’origine sont renvoyés au lieu des résultats validés.
Relation avec les activités
L'API codée et les activités XAML de Document Understanding s'exécutent sur le même runtime, de sorte qu'un workflow codé atteint le même comportement de classification, d'extraction et d'artefact de validation que les activités Extraire les données du document et Classifier un document . La différence est la forme d'appel: le service prend des chemins de fichiers bruts ou des entrées IResource et renvoie directement les objets Données du document , et vous utilisez standard try/catch au lieu de l'option ContinuerSurErreur .
Modèles communs
Classer, puis extraire
Ce modèle classe un document, puis réutilise le résultat classifié pour extraire des données, ce qui évite de numériser le fichier une seconde fois.
[Workflow]
public void Execute()
{
var classified = du.ClassifyDocument(@"C:\docs\file.pdf", "MyProject", "Production");
Log($"Document type: {classified.DocumentType.DisplayName}");
// Reuses the classified document, so the file is not digitized again.
var extracted = du.ExtractDocumentData(classified, "MyProject", "Production");
}
[Workflow]
public void Execute()
{
var classified = du.ClassifyDocument(@"C:\docs\file.pdf", "MyProject", "Production");
Log($"Document type: {classified.DocumentType.DisplayName}");
// Reuses the classified document, so the file is not digitized again.
var extracted = du.ExtractDocumentData(classified, "MyProject", "Production");
}
Extraire et préparer les données pour les tâches d’application contenant le contrôle de validation
Ce modèle extrait les données, les charge dans le stockage sous forme d'artefacts de validation à des fins d'examen dans une tâche d'application et récupère les résultats validés une fois l'action terminée.
[Workflow]
public void Execute()
{
var extracted = du.ExtractDocumentData(@"C:\docs\invoice.pdf", "Invoices", "Production", "invoice");
// Upload the results so they can be reviewed in Action Center.
var artifacts = du.CreateDocumentValidationArtifacts(extracted, "Shared");
// After the Action Center validation action completes, retrieve the validated results.
var validated = du.RetrieveDocumentValidationArtifacts(artifacts, removeDataFromStorage: true);
}
[Workflow]
public void Execute()
{
var extracted = du.ExtractDocumentData(@"C:\docs\invoice.pdf", "Invoices", "Production", "invoice");
// Upload the results so they can be reviewed in Action Center.
var artifacts = du.CreateDocumentValidationArtifacts(extracted, "Shared");
// After the Action Center validation action completes, retrieve the validated results.
var validated = du.RetrieveDocumentValidationArtifacts(artifacts, removeDataFromStorage: true);
}
- Espaces de noms importés automatiquement
- Vue d’ensemble du service
- Version ou balise du projet
- Paramètres communs
- Classification
DocumentData ClassifyDocument(string documentPath, string projectName, string projectVersionOrTag, int timeoutMs = 3600000)DocumentData ClassifyDocument(IResource file, string projectName, string projectVersionOrTag, int timeoutMs = 3600000)- Extraction de données
IDocumentData<DictionaryData> ExtractDocumentData(string documentPath, string projectName, string projectVersionOrTag, string docType, int timeoutMs = 3600000)IDocumentData<DictionaryData> ExtractDocumentData(IResource file, string projectName, string projectVersionOrTag, string docType, int timeoutMs = 3600000)IDocumentData<DictionaryData> ExtractDocumentData(DocumentData classifiedDocument, string projectName, string projectVersionOrTag, string docType = null, int timeoutMs = 3600000)- Artefacts de validation
ContentValidationData CreateDocumentValidationArtifacts(IDocumentData<DictionaryData> automaticExtractionResults, string orchestratorFolderName, string orchestratorBucketName = null)IDocumentData<DictionaryData> RetrieveDocumentValidationArtifacts(ContentValidationData contentValidationData, object completedAppAction = null, bool removeDataFromStorage = false, bool returnAutomaticExtractionResults = false)- Relation avec les activités
- Modèles communs
- Classer, puis extraire
- Extraire et préparer les données pour les tâches d’application contenant le contrôle de validation