- Vue d'ensemble (Overview)
- Processus Document Understanding
- Didacticiels de démarrage rapide
- Composants de l'infrastructure
- Vue d’ensemble de classification de document
- Assistant de configuration des classifieurs de l'activité Classer l'étendue du document (Classify Document Scope)
- Keyword Based Classifier
- Intelligent Keyword Classifier
- FlexiCapture Classifier
- Machine Learning Classifier
- Activités liées à la classification des documents
- Vue d’ensemble de l'entraînement de la classification des documents
- Assistant de configuration des classifieurs (Configure Classifiers Wizard) de l'activité Tester l'étendue des classifieurs (Train Classifier Scope)
- Machine Learning Classifier Trainer
- Activités liées à l'entraînement de la classification des documents
- Vue d’ensemble de l’extraction des données
- Assistant de configuration des extracteurs (Configure Extractors Wizard) de l'activité Étendue de l'extraction de données (Data Extraction Scope)
- Regex Based Extractor
- Form Extractor
- Extracteur de formulaires intelligents
- Extracteur d'apprentissage automatique
- FlexiCapture Extractor
- Activités liées à l'extraction de données
- Consommation de données
- Paquets ML
- Pipelines
- Document Manager
- Services OCR
- Document Understanding déployé dans Automation Suite
- Installer et utiliser
- Première expérience d'exécution
- Déployer UiPathDocumentOCR
- Déployer un paquet ML prêt à l'emploi
- Offres groupées hors ligne 2022.10.0
- Offres groupées hors ligne 2022.10.2
- Bundles 2022.10.4 hors ligne
- Bundles hors ligne 2022.10.6
- Bundles 2022.10.8 hors ligne
- Bundles 2022.10.9 hors ligne
- Bundles 2022.10.10 hors ligne
- Bundles 2022.10.11 hors ligne
- Bundles 2022.10.12 hors ligne
- Bundles 2022.10.13 hors ligne
- Bundles 2022.10.14 hors ligne
- Bundles 2022.10.14+patch1 hors ligne
- Bundles hors ligne 2022.10.15
- Utiliser le gestionnaire de documents
- Utiliser l'infrastructure
- Document Understanding déployé dans une version AI Center autonome
- Apprentissage profond
- Licences
- Référence (Reference)
- UiPath.Abbyy.Activities
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
UiPath Document Manager est une application Web légère qui permet aux utilisateurs de préparer, de réviser et d'apporter des corrections aux ensembles de données requis pour l'entraînement et l'évaluation des modèles d'apprentissage automatique de Document Understanding. Elle permet à plusieurs utilisateurs d'effectuer diverses opérations :
Définir et configurer les champs à extraire par un modèle ML.
Importer des documents à des fins de labellisation
Pré-labelliser des documents à l'aide d'un modèle ML préexistant, tel que les modèles Extraction de factures (Invoice Extraction) ou Extraction de reçus (Receipt Extraction) fournis par UiPath prêts à l'emploi, ou à l'aide d'un modèle entraîné à l'aide d'AI Center.
Labelliser des documents
Exporter des documents au format attendu par les pipelines d'entraînement AI Center.
Interface utilisateur
L'interface de Document Manager contient les panneaux suivants :
Barre de gestion
Affiché en haut de la page dans Document Manager.
Vous permet d'effectuer plusieurs opérations : naviguer entre les documents, supprimer/restaurer un document, rechercher/filtrer des documents, exécuter des prédictions de modèle d'IA, importer et exporter des documents.
Voici les éléments disponibles dans la barre de gestion :
| Elément | Icon | Description |
|---|---|---|
|
Navigation |
|
Naviguez entre les documents qui correspondent au filtre actif. Entre les deux flèches, un compteur s'affiche. Il représente le numéro du document actuel sur le nombre total de documents qui correspondent au filtre ou à la recherche active. |
|
|
|
Rechercher ou filtrer des documents. Un filtre est également appliqué lors de l'exportation de documents. Vous pouvez également filtrer par mots d'un document ou par noms de documents. |
|
Supprimer / Restaurer |
|
Supprime ou restaure un document. Les documents supprimés peuvent être trouvés sous le filtre supprimé (deleted). |
|
|
|
Ouvrez la boîte de dialogue Importer des données (Import data). |
|
|
|
Ouvrez la boîte de dialogue Exporter les fichiers (Export files). |
|
Nom et type de document |
s/o |
Le nom et le type du document actuellement actif. Il existe trois types de documents :
Training and Validation documents are part of training datasets used by Training Pipelines. Evaluation documents are ignored by Training Pipelines and are intended to only be used by Evaluation pipelines in AI Center. These documents are the ones that were marked as evaluation by selecting the Mark this an evaluation set checkbox in the Import data dialog box. |
|
Télécharger |
|
L'option est disponible dans le menu déroulant à côté du nom du document. Cliquez sur l'icône pour télécharger un fichier zip contenant le document original. Outre le document d'origine, toutes les pages converties en interne par Document Manager en images |
|
Permanently delete |
|
L'option est disponible dans le menu déroulant à côté du nom du document. Supprime définitivement les fichiers individuels. Le Lorsque vous cliquez sur le bouton, un message contextuel apparaît vous demandant si vous êtes sûr de vouloir supprimer définitivement le document. Cliquez sur OK pour continuer ou sur Annuler (Cancel) pour revenir à l'écran précédent. |
|
Nom de la session |
s/o |
Le nom de la session en cours. |
|
Prévoir (Predict) |
|
Exécutez les prédictions du modèle d'IA et affichez les résultats. Après avoir configuré le prébalisage, le bouton est activé dans la barre de gestion. Cliquez dessus pour prébaliser le document actuel. At the moment, using the Predict option with Public Endpoints prelabels only the first 10 pages of a document. This is a known issue and a fix is in the working. Using the Predict option with ML Skills in AI Center, however, does not impose such a limitation. |
|
Paramètres |
|
Configure OCR and Prelabelling settings or access the How to... panel. See more details below. |
Options Supprimer (Delete) et Supprimer définitivement (Permanently Delete)
Let's go a little bit deeper in understanding the difference between Delete and Permanently Delete options.
-
The Delete option deletes the files, but not removing them entirely from your project. The deleted files can still be found under the deleted filter from the Search bar and restored by using the Restore option.
-
The Permanently Delete option deletes the selected files without any possibility of restoring them.
Observez l’utilisation des deux options dans le GIF ci-dessous :
Options de recherche
The Search bar is both a text input field and a drop-down.
Les options de recherche peuvent être saisies en écrivant dans la Barre de recherche (Search bar) ou en sélectionnant un filtre dans la liste déroulante. Il existe trois manières principales d’initialiser une recherche :
-
Using the built-in filters that are available in the Search bar's drop-down. You can choose any of the following filters: train-set, validate-set, train-validate-set, evaluation-set, deleted, labelled, unlabelled.
Remarque :Please note that for Forms AI only the following built-in filters are available: deleted, labelled, unlabelled.
-
Using the import batch names. These are also available in the Search bar's drop-down. If added by hand, the format is
batch:name, wherenameis replaced with the name you gave a batch at import time, e.g.batch:invoices1 -
Using keywords. You have to enter the keyword(s) as free text in the Search bar. The search looks for the keyword(s) in a document's content or the document name.
Vous pouvez choisir d’utiliser une ou plusieurs options de recherche. Chaque option supplémentaire utilisée génère un réseau de recherche plus spécifique. Voici quelques exemples de recherche qui commencent par un vaste réseau et progressent lentement vers une recherche plus précise :
- le lancement d’une recherche
labelledrenvoie tous les documentslabelledde l’ensemble de données. - le lancement d’une recherche
batch:invoices1renvoie tous les documents labellisés qui font partie du lotinvoices1. - le lancement d'une recherche
labelled batch:invoices1renvoie tous les documents labellisés qui font partie du lotinvoices1. - le lancement d’une recherche
labelled batch:invoices1 vermontrenvoie tous les documents labellisés du lotinvoices1qui contiennent le mot-clé entré, dans ce casvermont, soit dans le nom du document, soit dans le contenu du document.
La barre de recherche comporte un menu déroulant qui, lorsqu’il est ouvert, affiche les filtres suivants :
- train-set - Indicates the number of documents to be used for training the model. Automated action.
- validate-set - Indicates the number of documents to be used to validate the model after its training is complete. The split between the train and validate set is targeted to be 80%-20%. Automated action.
- train-validate-set - Indicates the number of documents found in both the train-set and validate-set filters. Automated action.
- evaluation-set - Indicates the number of documents that had the evaluation set checkbox checked during import and are intended to be used to evaluate the model in the stage of the training pipeline. More information can be found here. Manual action.
- deleted - Specifies the number of deleted documents. More information can be found here.
- labelled- Specifies the number of docs that have labels. A label is defined by at least one tagged/manually edited field per document.
- unlabelled - Specifies the number of docs that don't have labels.
- batch:name - Specifies the documents that have been comprised in the same import action.
L’affectation d’un document aux ensembles d’entraînement ou de validation est effectuée par l’application au moment de l’importation.
Le document importé se retrouve dans l’ensemble d’évaluation si la case Ensemble d’évaluation est cochée lors de l’importation.
Menu Paramètres
Le bouton Paramètres a deux options disponibles :
- Settings where you can configure the OCR service or Prelabelling
- Comment... qui sert de menu d'aide
Pour importer des documents dans Document Manager, il est obligatoire de configurer un service OCR.
Les options suivantes sont disponibles :
Méthode OCR
Les options basées sur le cloud sont :
- UiPath Document OCR - https://du.uipath.com/ocr;
- Google Cloud Vision OCR qui offre la meilleure couverture linguistique ;
- Google Cloud Vision OCR for Japanese, optimal pour la lecture de documents japonais ;
- Microsoft Read OCR.
URL OCR
La configuration de la reconnaissance optique de caractères nécessite que le service OCR ait une URL. Voici les URL que vous pouvez utiliser :
- public URLs such as https://du.uipath.com/ocr or third-party URLs from Google Vision OCR or Microsoft Read OCR
Clé OCR
The corresponding API Key for the selected OCR engine. For example, for UiPath Document OCR, you need to use the Document Understanding API Key. Mandatory for Document Manager Cloud and Document Manager On-Prem Online. It is not required for Document Manager On-Prem Air-gapped.
prébalisage
Si vous disposez déjà d'un modèle capable d'extraire certains des champs nécessitant d'être libellés et que seuls quelques champs supplémentaires nécessitent un libellé manuel, vous pouvez gagner beaucoup de temps en utilisant la fonctionnalité de prébalisage de Document Manager.
Les options suivantes sont disponibles :
URL de prébalisage
La prélabellisation nécessite que le modèle ML possède une URL. Voici les URL que vous pouvez utiliser :
- public URLs such as https://du.uipath.com/ie/invoices or https://du.uipath.com/ie/purchase_orders
- see the full list of endpoints here
- URL des compétences ML rendues publiques dans la version locale d'AI Center ou AI Center Cloud
Clé de prébalisage
The Document Understanding API Key. Mandatory for Document Manager Cloud and Document Manager On-Prem Online. It is not required for Document Manager On-Prem Air-gapped.
Comment...
L'option Comment... accède au menu d'aide de Document Manager.
Ici, vous pouvez trouver :
- La version de Document Manager
- Le lien Documentation menant à cette page de documentation.
- La section Contrôles de libellés (Labeling Controls) qui affiche les contrôles à utiliser lors de la gestion des données.
- La section Raccourcis du document (Document Shortcuts) qui affiche les raccourcis utilisés pour effectuer diverses opérations telles que la navigation et la mise à l'échelle de l'interface utilisateur.
- La section Configuration qui affiche des détails sur la configuration de l'instance telle qu'elle a été effectuée lors de l'installation.
Champs de colonnes
Les champs de colonne ont les options suivantes :
- Créer un nouveau champ de colonne

- Modifier le champ

- Développer/réduire les valeurs des champs de la colonne

For more details on column fields, visit this section.
Champs réguliers
Les champs réguliers ont les options suivantes :
- Créer un nouveau champ régulier

- Modifier le champ

For more details on regular fields, visit this section.
Champs de classification
Les champs de classification ont les options suivantes :
- Créer un nouveau champ de classification

- Modifier le champ

For more details on classification fields, visit this section.
Affichage du document
Pour les documents de plusieurs pages, vous pouvez faire défiler naturellement les pages comme dans n'importe quelle visionneuse PDF. Pour effectuer un zoom avant ou arrière, utilisez Ctrl + molette de la souris.
Vous pouvez labelliser les documents en sélectionnant les zones de mots et en les affectant à un champ en appuyant sur une touche. Vous pouvez également cliquer avec le bouton droit sur la zone de mot et vérifier les informations extraites.
For more details on how to label documents, visit this page.
Lorsque vous ouvrez une nouvelle session Document Manager ou lorsque vous avez un filtre vide, certaines directives s'affichent dans la vue du document :
De plus, les échecs de chargement sont également affichés dans la vue du document :
