UiPath Documentation
document-understanding
2020.10
false
Guide de l'utilisateur de Document Understanding
Important :
La localisation du contenu nouvellement publié peut prendre 1 à 2 semaines avant d’être disponible.

Créer et configurer des champs

Ajout de champs

Les champs ne peuvent pas être supprimés ou renommés, alors réfléchissez bien avant d'ajouter de nouveaux champs. Si, toutefois, vous décidez par la suite de ne pas utiliser certains champs pour l'apprentissage d'un modèle ML, vous pouvez toujours les masquer à l'aide de la case à cocher Caché (Hidden) dans la fenêtre Modifier le champ (Edit Field).

Click here for details about fields, their meaning, and when to use them.

Remarque :

Un maximum de 40 champs peut être créé.

Champs de colonnes

Les éléments de ligne Description ou Prix unitaire (Unit Price) d'un article sur une facture seraient des exemples de champs de colonne.

  1. Click + in the table section at the top of the page to add a new Column field. The Create Column Field window is displayed.
  2. Dans le champ Saisir un nom de champ unique (Enter Unique Field Name), nommez champ de façon appropriée. Les majuscules ne sont pas acceptées.
  3. Cliquez sur Créer (Create). La fenêtre Modifier un champ (Edit Field) s'affiche.
  4. Dans la liste déroulante Type de contenu (Content Type), sélectionnez le type de contenu.
  5. Dans la liste déroulante Évaluation (Scoring), sélectionnez la mesure utilisée pour déterminer la précision lors de l'exécution des évaluations des prédictions du modèle.
  6. Cliquez sur le champ Raccourci clavier (Hotkey) et appuyez sur une touche de votre clavier pour le remplir automatiquement.
  7. Fill in the hex code of the desired field color in the Color field.
  8. Cochez la case Multiligne (Multi line) si le champ à vérifier peut s'étendre sur plusieurs lignes de texte, telles que des adresses ou des descriptions. Si cette option n'est pas sélectionnée, seule la première ligne est renvoyée.
  9. Select the Split items checkbox if you want this field to be used as a delimiter between line items or rows in a table. Any line on which this field appears is considered to be a new line item or row in the table. Most commonly, this is used on Line Amount fields on Invoice line items.
  10. Cochez la case Masqué (Hidden) si vous ne voulez pas que ce champ fasse partie des ensembles de données exportés.
  11. Cliquez sur Enregistrer (Save) pour enregistrer tous vos paramètres.

Champs réguliers

Il s'agit de champs qui n'apparaissent qu'une seule fois sur un document donné. Une ligne d'élément Numéro de facture (Invoice Number) ou Montant total (Total Amount) sur un document de facture peuvent être des exemples de champs de colonne.

  1. Click + on the right pane in the Regular Fields section. The Create Regular Field window is displayed.
  2. Saisissez un nom unique dans le champ Saisir un nom de champ unique (Enter Unique Field Name). Les majuscules ne sont pas acceptées.
  3. Cliquez sur Créer (Create). La fenêtre Modifier un champ (Edit Field) s'affiche.
  4. Sélectionnez le type de contenu dans la liste déroulante Type de contenu (Content Type).
  5. Select the post-processing mechanism in case the model predicts more than one instance of a field on a given page from the Post processing drop-down.
  6. Cliquez sur le champ Raccourci clavier (Hotkey) et appuyez sur une touche de votre clavier pour le remplir automatiquement.
  7. Dans le champ Couleur (Color), remplissez le code hexadécimal de la couleur de champ souhaitée o
  8. Dans la liste déroulante Multipage, sélectionnez la stratégie de récupération des données. Celle-ci est utilisée dans le cas où les champs apparaissent sur des pages différentes d'un document de plusieurs pages. Cette option définit quelle page le modèle décide de renvoyer.
  9. Dans la liste déroulante Évaluation (Scoring), sélectionnez la mesure utilisée pour déterminer la précision lors de l'exécution des évaluations des prédictions du modèle.
  10. Cochez la case Multiligne (Multi line) si le champ à vérifier peut s'étendre sur plusieurs lignes de texte, telles que des adresses ou des descriptions. Si cette option n'est pas sélectionnée, seule la première ligne est renvoyée.
  11. Cochez la case Masqué (Hidden) si vous ne voulez pas que ce champ fasse partie des ensembles de données exportés.
  12. Cliquez sur Enregistrer (Save) pour enregistrer tous vos paramètres.

Champs de classification

Points de données qui se réfèrent à un document dans son ensemble. Par exemple, le type de dépense d'un reçu (nourriture, hôtel, compagnie aérienne, transport) ou la devise d'une facture (USD, EUR, JPY) seraient des exemples de champs de classification.

  1. Click + on the right pane in the Classification Fields section. The Create Classification Field window is displayed.

  2. Saisissez un nom unique dans le champ Saisir un nom de champ unique (Enter Unique Field Name). Les majuscules ne sont pas acceptées.

  3. Cliquez sur Créer (Create). La fenêtre Modifier un champ (Edit Field) s'affiche.

  4. Dans la zone de texte, remplissez la liste des classes et saisissez les noms sous forme de liste séparée par des virgules.

  5. Cliquez sur Enregistrer (Save) pour enregistrer tous vos paramètres.

    Important :

    Contrairement aux champs réguliers (Regular) et de colonne (Column), les champs Classification ne sont pas ré-entraînés. Par exemple, pour le champ Devise (Currency), si vous recyclez le modèle Factures (Invoices) sur un ensemble de données contenant uniquement des factures en USD et INR, le modèle résultant ne pourra reconnaître que ces deux devises.

Description des champs

Barre de gestion

Affiché en haut de la page dans le Data Manager. Vous permet d'effectuer plusieurs opérations : naviguer entre les documents, supprimer un document, filtrer des documents, exécuter des prédictions de modèle d'IA, importer et exporter des documents.

Champ Description

Naviguez entre les documents qui correspondent au filtre actif.

Entre les deux flèches, un compteur s'affiche.

Il représente le numéro du document actuel sur le nombre total de documents qui correspondent au filtre actif.

Supprimer (Delete) / Récupérer (Recover)

Supprime ou récupère un document.

Liste déroulante des filtres (Filter)

Filtre les documents. Ce filtre s'applique également aux données exportées. Les options suivantes sont disponibles :

  • train-validate-set

    -test-set

    -deleted

    -labeled

    -unlabeled

    -<batch_name>

Prévoir (Predict)

Exécutez les prédictions du modèle d'IA et affichez les résultats.

Importer (Import)

Importe un nouveau document à labelliser.

Exporter (Export)

Exporte les données labellisées.

Le filtre actif s'applique aux données exportées.

[DocumentName]

Le nom du document actuellement actif.

[UserName]

Le nom de l'utilisateur actuel.

Se déconnecter

Se déconnecte du Data Manager.

La déconnexion efface également les cookies.

Aide

Displays the Data Manager help menu.

Fenêtre Créer un champ (Create Field)

Permet de configurer le nom du champ à ajouter.

ChampDescription
Saisir un nom de champ uniqueLe nom du champ. Ne peut contenir que des lettres minuscules, des chiffres, des tirets bas "_" et des tirets "-".

Fenêtre Modifier le champ (Edit Field)

Permet de configurer le champ régulier et de colonne.

Champ Description

Type de contenu

Le type de contenu d'un champ. Les options suivantes sont disponibles :

  • string – appropriate for company names or addresses, as well as payment terms, or for any other field where the RPA developer prefers to build the parsing or formatting logic manually, in the RPA workflow.
  • number – appropriate for amounts or quantities, with intelligent parsing of the decimal/thousands separators.
  • date – the model parses, formats and unifies the output in a yyyy-mm-dd format.
  • phone - appropriate for phone numbers.
  • id-no – appropriate for alphanumeric codes, numbers of IDs, it is similar to the string content type, but includes cleaning of any characters coming before a “:”. If the id number you need to extract might contain “:” characters, please use string as content type instead, to avoid data loss.

Traitement ultérieur

Seulement affiché pour les champs réguliers.

Le mécanisme de post-traitement. Les options suivantes sont disponibles :

  • first span – if model predicts more than one instance of a field on a given page, the model returns the first one.
  • largest value – if model predicts more than one instance of a field on a given page, the model returns the largest numeric value. This is only displayed for content of type number and is appropriate for Total Amount fields.
  • longest value – if model predicts more than one instance of a field on a given page, the model returns the value consisting of the longest string of characters.

Raccourci clavier

Touche de raccourci pour ce champ.

Couleur

La couleur du champ.

Multipage

La stratégie de renvoi des données dans le cas où un champ apparaît sur plusieurs pages d'un document. Les options suivantes sont disponibles :

  • highest confidence - the default choice for string,phone, and number content types.
  • first occurrence - the default choice for id-no and data content types.
  • Dernière occurrence

    - longest string - only displayed for content of type string.

    - shortest string - only displayed for content of type string.

    - highest numeric value - only displayed for content of type number.

    - lowest numeric value - only displayed for content of type number.

Évaluation

Ne peut être configuré que pour le contenu de type chaîne. Tous les autres types de contenu utilisent une stratégie de notation de correspondance exacte (Exact Match).

La mesure utilisée pour déterminer la précision lors de l’évaluation des prédictions du modèle.

  • exact match – a prediction is only deemed to be correct (score of 1) if it exactly matches the true value. If it differs by even a single character, then it is deemed to be incorrect (score of 0).
  • levenshtein – a prediction is deemed to be partially correct according to the Levenshtein distance between the prediction and the true value. If a 10-letter value is predicted correctly except for the last 2 characters, then the score of that prediction will be 0.8.

Multiligne

Cochez cette case pour les champs qui peuvent s'étendre sur plusieurs lignes, comme les adresses ou les descriptions. Sinon, seule la première ligne sera renvoyée.

Fractionner les éléments

Seulement affiché pour les champs de colonne.

Cochez cette case si vous souhaitez que ce champ soit utilisé comme délimiteur entre les éléments de ligne ou les lignes d'un tableau. Toute ligne sur laquelle ce champ apparaît est considérée comme un nouvel élément ou une nouvelle ligne dans le tableau. Le plus souvent, cette fonction est utilisée dans les champs Lignes de montant (Line Amount) des lignes de montant de facture.

Masqué

Cochez cette case si vous ne voulez pas que ce champ fasse partie des ensembles de données exportés.

Menu d'aide de Data Manager

La section Contrôles de libellés (Labeling Controls) affiche les contrôles à utiliser lors de la gestion des données.

La section Raccourcis du document (Document Shortcuts) affiche les raccourcis utilisés pour effectuer diverses opérations telles que la navigation et la mise à l'échelle de l'interface utilisateur.

La section Configuration affiche des détails sur la configuration de l'instance telle qu'elle a été effectuée lors de l'installation.

La section Rapport d'erreurs (Error Reporting) vous permet d'afficher les journaux récemment générés.

Cette page vous a-t-elle été utile ?

Connecter

Besoin d'aide ? Assistance

Vous souhaitez apprendre ? UiPath Academy

Vous avez des questions ? UiPath Forum

Rester à jour