UiPath Documentation
document-understanding
2022.4
false
Guide de l'utilisateur de Document Understanding
Important :
La localisation du contenu nouvellement publié peut prendre 1 à 2 semaines avant d’être disponible.

Créer et configurer des champs

Les champs ne peuvent pas être renommés, alors réfléchissez bien avant de nommer un champ. Si, toutefois, vous décidez par la suite de ne pas utiliser certains champs pour l'entraînement d'un modèle ML, vous pouvez toujours les masquer à l'aide de la case à cocher Caché (Hidden) dans la fenêtre Modifier le champ (Edit Field).

Remarque :

Un maximum de 300 champs peut être créé.

Champs de colonnes

Les éléments de ligne Description ou Prix unitaire (Unit Price) d'un article sur une facture seraient des exemples de champs de colonne.

Créer un nouveau champ de colonne

  1. Cliquez sur image des documents dans la section Table en haut de la page pour ajouter un nouveau champ Colonne (Column). La fenêtre Créer un champ de colonne (Create Column Field) s'affiche.
  2. Saisissez un nom unique dans le champ Saisir un nom de champ unique (Enter unique field name). Les majuscules ne sont pas acceptées. Ne peut contenir que des lettres minuscules, des chiffres, et le tiret bas _ et des tirets -.
  3. Cliquez sur Créer (Create). La fenêtre Modifier un champ (Edit Field) s'affiche.
  4. Dans la liste déroulante Type de contenu (Content Type), sélectionnez le type de contenu.
  5. Dans la liste déroulante Évaluation (Scoring), sélectionnez la mesure utilisée pour déterminer la précision lors de l'exécution des évaluations des prédictions du modèle.
  6. Cliquez sur le champ Raccourci clavier (Hotkey) et appuyez sur une touche de votre clavier pour le remplir automatiquement.
  7. Remplissez le code hexadécimal de la couleur de champ souhaitée dans le champ Couleur (Color).
  8. Cochez la case Fractionner les éléments (Split items) si vous souhaitez que ce champ soit utilisé comme délimiteur entre les éléments de ligne ou les lignes d'un tableau. Toute ligne sur laquelle ce champ apparaît est considérée comme un nouvel élément ou une nouvelle ligne dans le tableau. Le plus souvent, cette fonction est utilisée dans les champs Lignes de montant (Line Amount) de facture.
  9. Cochez la case Masqué (Hidden) si vous ne voulez pas que ce champ fasse partie des ensembles de données exportés.
  10. Cliquez sur Enregistrer (Save) pour enregistrer tous vos paramètres.

Modifier un champ de colonne

Cliquez sur le bouton Modifier le champ (Edit field)image des documents. Les options disponibles pour les champs de colonne se trouvent dans le tableau ci-dessous.

Option Description

Type de contenu

Le type de contenu d'un champ :

  • string: appropriate for company names or addresses, as well as payment terms, or for any other field where the RPA developer prefers to build the parsing or formatting logic manually, in the RPA workflow.
  • number: appropriate for amounts or quantities, with intelligent parsing of the decimal/thousands separators.
  • date: the model parses, formats and unifies the output in a yyyy-mm-dd format.
  • ** phone** : approprié pour les numéros de téléphone. Le formatage supprime les lettres et les parenthèses, et remplace les espaces par des tirets.
  • id-no: appropriate for alphanumeric codes, numbers of IDs, it is similar to the string content type, but includes cleaning of any characters coming before a colon :. If the id number you need to extract might contain colon : characters, please use string as content type instead to avoid data loss.

Raccourci

Touche de raccourci pour ce champ. Une ou deux clés autorisées.

Couleur

La couleur du champ au format hexadécimal. Si la valeur n'est pas valide, une nouvelle est générée.

Évaluation

La mesure utilisée pour déterminer la précision lors de l’évaluation des prédictions du modèle. Il ne peut être configuré que pour le type de contenu de string. Tous les autres types de contenu utilisent une stratégie de notation de correspondance exacte (Exact Match). Options :

  • exact match: a prediction is only deemed to be correct (score of 1) if it exactly matches the true value. If it differs by even a single character, then it is deemed to be incorrect (score of 0).
  • levenshtein: a prediction is deemed to be partially correct according to the Levenshtein distance between the prediction and the true value. If a 10-letter value is predicted correctly, except for the last 2 characters, then the score of that prediction will be 0.8.

Fractionner les éléments

Cochez cette case si vous souhaitez que ce champ soit utilisé comme délimiteur entre les éléments de ligne ou les lignes d'un tableau. Toute ligne sur laquelle ce champ apparaît est considérée comme un nouvel élément ou une nouvelle ligne dans le tableau. Le plus souvent, cette fonction est utilisée dans les champs Lignes de montant (Line Amount) des éléments de ligne de la facture.

Masqué

Cochez cette case si vous ne voulez pas que ce champ fasse partie des ensembles de données exportés.

Supprimer un champ de colonne

Pour supprimer un champ de colonne, procédez comme suit :

  1. Cliquez sur le bouton Modifier le champ image des documents correspondant au champ de colonne que vous souhaitez supprimer.

  2. Cliquez sur le bouton Supprimer (Delete).

  3. Tapez le nom exact du champ.

  4. Cliquez sur OK .

  5. Le champ de colonne et ses données labellisées associées sont supprimés.

Champs réguliers

Il s'agit de champs qui n'apparaissent qu'une seule fois sur un document donné. Une ligne d'élément Numéro de facture (Invoice Number) ou Montant total (Total Amount) sur un document de facture peuvent être des exemples de champs de colonne.

Créer un nouveau champ régulier

  1. Click image des documents on the right pane in the Regular Fields section. The Create Regular Field window is displayed.
  2. Saisissez un nom unique dans le champ Saisir un nom de champ unique (Enter unique field name). Les majuscules ne sont pas acceptées. Ne peut contenir que des lettres minuscules, des chiffres, et le tiret bas _ et des tirets -.
  3. Cliquez sur Créer (Create). La fenêtre Modifier un champ (Edit Field) s'affiche.
  4. Sélectionnez le type de contenu dans la liste déroulante Type de contenu (Content Type).
  5. Sélectionnez le mécanisme de post-traitement au cas où le modèle prédit plusieurs instances d'un champ sur une page donnée dans la liste déroulante Traitement ultérieur (Post processing).
  6. Cliquez sur le champ Raccourci clavier (Hotkey) et appuyez sur une touche de votre clavier pour le remplir automatiquement.
  7. Dans le champ Couleur (Color), remplissez le code hexadécimal de la couleur de champ souhaitée o
  8. Dans la liste déroulante Multipage, sélectionnez la stratégie de récupération des données. Cette option est utilisée dans le cas où les champs apparaissent sur des pages différentes d'un document de plusieurs pages. Cette option définit quelle page le modèle décide de renvoyer.
  9. Dans la liste déroulante Évaluation (Scoring), sélectionnez la mesure utilisée pour déterminer la précision lors de l'exécution des évaluations des prédictions du modèle.
  10. Cochez la case Multiligne (Multi line) si le champ à vérifier peut s'étendre sur plusieurs lignes de texte, telles que des adresses ou des descriptions. Si cette option n'est pas sélectionnée, seule la première ligne est renvoyée.
  11. Cochez la case Masqué (Hidden) si vous ne voulez pas que ce champ fasse partie des ensembles de données exportés.
  12. Cliquez sur Enregistrer (Save) pour enregistrer tous vos paramètres.

Modifier un champ régulier

Cliquez sur le bouton Modifier le champ (Edit field)image des documents. Les options disponibles pour les champs de colonne se trouvent dans le tableau ci-dessous.

Option Description

Type de contenu

Le type de contenu d'un champ :

  • string: appropriate for company names or addresses, as well as payment terms, or for any other field where the RPA developer prefers to build the parsing or formatting logic manually, in the RPA workflow.
  • number: appropriate for amounts or quantities, with intelligent parsing of the decimal/thousands separators.
  • date: the model parses, formats and unifies the output in a yyyy-mm-dd format.
  • ** phone** : approprié pour les numéros de téléphone. Le formatage supprime les lettres et les parenthèses, et remplace les espaces par des tirets.
  • id-no: appropriate for alphanumeric codes, numbers of IDs, it is similar to the string content type, but includes cleaning of any characters coming before a colon :. If the id number you need to extract might contain colon : characters, please use string as content type instead to avoid data loss.

Traitement ultérieur

Le mécanisme de post-traitement. Si le modèle prévoit plus d’une instance d’un champ sur une page donnée, le modèle renvoie :

  • highest_confidence: the value with the highest confidence.
  • first_span: the first value.
  • largest_value: the largest numeric value. This is only displayed for number content type and is appropriate for Total Amount fields.
  • longest_value: the value consisting of the largest number of characters.

Raccourci

Touche de raccourci pour ce champ. Une ou deux clés autorisées.

Couleur

La couleur du champ au format hexadécimal. Si la valeur n'est pas valide, une nouvelle est générée.

Multipage

La stratégie de renvoi de données dans le cas où un champ apparaît sur différentes pages d'un document multipage.

  • highest_confidence - the default choice for string,phone, and number content types.
  • first_occurrence - the default choice for id-no and date content types.
  • last_occurrence

    -longest_string

  • shortest_string
  • highest_num_value - only displayed for number content type.
  • lowest_num_value - only displayed for number content type.

Évaluation

La mesure utilisée pour déterminer la précision lors de l’évaluation des prédictions du modèle. Il ne peut être configuré que pour le type de contenu de string. Tous les autres types de contenu utilisent une stratégie de notation de correspondance exacte (Exact Match). Options :

  • exact match: a prediction is only deemed to be correct (score of 1) if it exactly matches the true value. If it differs by even a single character, then it is deemed to be incorrect (score of 0).
  • levenshtein: a prediction is deemed to be partially correct according to the Levenshtein distance between the prediction and the true value. If a 10-letter value is predicted correctly, except for the last 2 characters, then the score of that prediction will be 0.8.

Multiligne

Cochez cette case pour les champs qui peuvent s'étendre sur plusieurs lignes de texte (adresses ou descriptions), sinon, seule la première ligne sera renvoyée.

Masqué

Cochez cette case si vous ne voulez pas que ce champ fasse partie des ensembles de données exportés.

Supprimer un champ régulier

Pour supprimer un champ normal, procédez comme suit :

  1. Cliquez sur le bouton Modifier le champ image des documents correspondant au champ normal que vous souhaitez supprimer.

  2. Cliquez sur le bouton Supprimer (Delete).

  3. Tapez le nom exact du champ.

  4. Cliquez sur OK .

  5. Le champ normal et ses données labellisées associées sont supprimés.

Champs de classification

Points de données qui se réfèrent à un document dans son ensemble. Par exemple, le type de dépense d'un reçu (nourriture, hôtel, compagnie aérienne, transport) ou la devise d'une facture (USD, EUR, JPY) seraient des exemples de champs de classification.

Créer un nouveau champ de classification

  1. Click image des documents on the right pane in the Classification Fields section. The Create Classification Field window is displayed.
  2. Saisissez un nom unique dans le champ Saisir un nom de champ unique (Enter unique field name). Les majuscules ne sont pas acceptées. Ne peut contenir que des lettres minuscules, des chiffres, et le tiret bas _ et des tirets -.
  3. Cliquez sur Créer (Create). La fenêtre Modifier un champ (Edit Field) s'affiche.
  4. Dans la zone de texte, remplissez la liste des classes et saisissez les noms sous forme de liste séparée par des virgules.
  5. Cliquez sur Enregistrer (Save) pour enregistrer tous vos paramètres.

Modifier un champ de classification

Click the Edit field image des documents button. Define a list of possible values. Commas must separate values. An optional description of the value may be included after colon : (option 1 : description 1).

Supprimer un champ de classification

Pour supprimer un champ de classification, procédez comme suit :

  1. Click the Edit fieldimage des documents button corresponding to the classification field you want to delete.

  2. Cliquez sur le bouton Supprimer (Delete).

  3. Tapez le nom exact du champ.

  4. Cliquez sur OK .

  5. Le champ de colonne et ses données étiquetées labellisées sont supprimés.

Cette page vous a-t-elle été utile ?

Connecter

Besoin d'aide ? Assistance

Vous souhaitez apprendre ? UiPath Academy

Vous avez des questions ? UiPath Forum

Rester à jour