UiPath Documentation
document-understanding
2021.10
false
Guia do usuário do Document Understanding.
Importante :
A localização de um conteúdo recém-publicado pode levar de 1 a 2 semanas para ficar disponível.

Criar e configurar campos

Fields cannot be renamed, so please think carefully before naming a field. If, however, there are fields that you later decide you do not want to use for training an ML model, you can either delete them or you can always hide them using the Hidden checkbox in the Edit field window.

Observação:

Um máximo de 300 campos podem ser criados.

Campos de coluna

Uma Descrição de item de linha ou Preço unitário em um documento de fatura seriam exemplos de campos de coluna.

Criar um novo campo de coluna

  1. Clique Imagem dos documentos na seção de tabela localizada na parte superior da página para adicionar um novo campo Coluna. A janela Criar campo de coluna é exibida.
  2. Preencha um nome exclusivo para o campo no espaço Inserir nome único de campo. O campo não aceita letras maiúsculas. Pode conter apenas letras minúsculas, números, sublinhado _ e traço -.
  3. Click Create. The Edit Field window is displayed.
  4. Na lista suspensa Tipo de conteúdo, selecione o tipo de conteúdo.
  5. From the Scoring drop-down, select the measure used to determine accuracy when running evaluations of model predictions.
  6. Clique no campo Hotkey e pressione uma tecla no teclado para preenchê-lo automaticamente.
  7. Preencha o código hexadecimal da cor de campo desejada no campo Cor.
  8. Marque a caixa de seleção Dividir itens se desejar que esse campo seja usado como delimitador entre itens de linha ou linhas em uma tabela. Qualquer linha na qual esse campo apareça é considerada um novo item de linha ou linha na tabela. É mais comumente usado em campos Line Amount nos itens de linha Fatura.
  9. Marque a caixa de seleção Oculto se não quiser que esse campo faça parte dos conjuntos de dados exportados.
  10. Clique em Salvar para salvar suas configurações.

Editar um campo de coluna

Clique no campo EditarImagem dos documentos botão. As opções disponíveis para campos de coluna podem ser encontradas na tabela abaixo.

Opção Description

Tipo de Conteúdo

O tipo de conteúdo de um campo:

  • string: appropriate for company names or addresses, as well as payment terms, or for any other field where the RPA developer prefers to build the parsing or formatting logic manually, in the RPA workflow.
  • number: appropriate for amounts or quantities, with intelligent parsing of the decimal/thousands separators.
  • date: the model parses, formats and unifies the output in a yyyy-mm-dd format.
  • ** phone**: apropriado para números de telefone. A formatação remove letras e parênteses e substitui espaços por traços.
  • id-no: appropriate for alphanumeric codes, numbers of IDs, it is similar to the string content type, but includes cleaning of any characters coming before a colon :. If the id number you need to extract might contain colon : characters, please use string as content type instead to avoid data loss.

Atalho

A tecla de atalho para o campo. Uma ou duas chaves permitidas.

Cor

A cor do campo em formato hexadecimal. Se o valor não for válido, um novo será gerado.

Pontuação

Medida usada para determinar a precisão ao executar avaliações de previsões de modelo. Ela só pode ser configurada para o tipo de conteúdo string. Todos os outros tipos de conteúdo usam uma estratégia de pontuação de correspondência exata. Opções:

  • exact match: a prediction is only deemed to be correct (score of 1) if it exactly matches the true value. If it differs by even a single character, then it is deemed to be incorrect (score of 0).
  • levenshtein: a prediction is deemed to be partially correct according to the Levenshtein distance between the prediction and the true value. If a 10-letter value is predicted correctly, except for the last 2 characters, then the score of that prediction will be 0.8.

Dividir itens

Marque esta caixa de seleção se deseja que este campo seja usado como delimitador entre itens de linha ou linhas em uma tabela. Qualquer linha na qual esse campo apareça é considerada um novo item de linha ou linha na tabela. É mais comumente usado em campos Valor de linha nos itens de linha Fatura.

Oculto

Marque esta caixa de seleção se não quiser que esse campo faça parte dos conjuntos de dados exportados.

Excluir um campo de coluna

Para excluir um campo de coluna, siga estas etapas:

  1. Clique no campo EditarImagem dos documentos botão correspondente ao campo de coluna que você deseja excluir.

  2. Clique no botão Excluir.

  3. Digite o nome exato do campo.

  4. Clique em OK.

  5. O campo da coluna e seus dados rotulados associados são excluídos.

Campos Regulares

Estes são campos que aparecem apenas uma vez em um determinado documento. Um item de linha Número da fatura ou Valor total em um documento de fatura seriam exemplos de campos de Coluna.

Cria um novo campo regular

  1. Click Imagem dos documentos on the right pane in the Regular Fields section. The Create Regular Field window is displayed.
  2. Preencha um nome exclusivo para o campo no espaço Inserir nome único de campo. O campo não aceita letras maiúsculas. Pode conter apenas letras minúsculas, números, sublinhado _ e traço -.
  3. Click Create. The Edit Field window is displayed.
  4. Select the content type from the Content Type drop-down.
  5. Select the post processing mechanism in case the model predicts more than one instance of a field on a given page from the Post processing drop-down.
  6. Clique no campo Hotkey e pressione uma tecla no teclado para preenchê-lo automaticamente.
  7. In the Color field, fill in the hex code of the desired field color o
  8. From the Multi page drop-down, select the data retrieval strategy. This option is used in case that fields appear on a few different pages of a multi-page document. This option defines how the model decides which one to return.
  9. From the Scoring drop-down, select the measure used to determine accuracy when running evaluations of model predictions.
  10. Marque a caixa de seleção Múltiplas linhas se o campo a ser verificado puder abranger várias linhas de texto, como endereços ou descrições. Se esta opção não for selecionada, somente a primeira linha será retornada.
  11. Marque a caixa de seleção Oculto se não quiser que esse campo faça parte dos conjuntos de dados exportados.
  12. Clique em Salvar para salvar suas configurações.

Editar um campo regular

Clique no campo EditarImagem dos documentos botão. As opções disponíveis para campos regulares podem ser encontradas na tabela abaixo.

Opção Description

Tipo de Conteúdo

O tipo de conteúdo de um campo:

  • string: appropriate for company names or addresses, as well as payment terms, or for any other field where the RPA developer prefers to build the parsing or formatting logic manually, in the RPA workflow.
  • number: appropriate for amounts or quantities, with intelligent parsing of the decimal/thousands separators.
  • date: the model parses, formats and unifies the output in a yyyy-mm-dd format.
  • ** phone**: apropriado para números de telefone. A formatação remove letras e parênteses e substitui espaços por traços.
  • id-no: appropriate for alphanumeric codes, numbers of IDs, it is similar to the string content type, but includes cleaning of any characters coming before a colon :. If the id number you need to extract might contain colon : characters, please use string as content type instead to avoid data loss.

Pós-processamento

Mecanismo de pós-processamento. Se o modelo prever mais de uma instância de um campo em uma determinada página, ele retornará:

  • highest_confidence: the value with the highest confidence.
  • first_span: the first value.
  • largest_value: the largest numeric value. This is only displayed for number content type and is appropriate for Total Amount fields.
  • longest_value: the value consisting of the largest number of characters.

Atalho

A tecla de atalho para o campo. Uma ou duas chaves permitidas.

Cor

A cor do campo em formato hexadecimal. Se o valor não for válido, um novo será gerado.

Multipágina

A estratégia de retorno de dados caso um campo apareça em páginas diferentes de um documento de várias páginas.

  • highest_confidence - the default choice for string,phone, and number content types.
  • first_occurrence - the default choice for id-no and date content types.
  • last_occurrence

    -longest_string

  • shortest_string
  • highest_num_value - only displayed for number content type.
  • lowest_num_value - only displayed for number content type.

Pontuação

Medida usada para determinar a precisão ao executar avaliações de previsões de modelo. Ela só pode ser configurada para o tipo de conteúdo string. Todos os outros tipos de conteúdo usam uma estratégia de pontuação de correspondência exata. Opções:

  • exact match: a prediction is only deemed to be correct (score of 1) if it exactly matches the true value. If it differs by even a single character, then it is deemed to be incorrect (score of 0).
  • levenshtein: a prediction is deemed to be partially correct according to the Levenshtein distance between the prediction and the true value. If a 10-letter value is predicted correctly, except for the last 2 characters, then the score of that prediction will be 0.8.

Multilinha

Marque esta caixa de seleção para campos que podem abranger várias linhas de texto (endereços ou descrições), caso contrário, apenas a primeira linha será retornada.

Oculto

Marque esta caixa de seleção se não quiser que esse campo faça parte dos conjuntos de dados exportados.

Excluir um campo regular

Para excluir um campo regular, siga estas etapas:

  1. Clique no campo EditarImagem dos documentos botão correspondente ao campo regular que deseja excluir.

  2. Clique no botão Excluir.

  3. Digite o nome exato do campo.

  4. Clique em OK.

  5. O campo regular e seus dados rotulados associados são excluídos.

Campos de Classificação

Pontos de dados que se referem a um documento como um todo. Por exemplo, o Tipo de Despesa de um recibo (Alimentação, Hotel, Companhia Aérea, Transporte) ou a Moeda de uma fatura (USD, EUR, JPY) seriam exemplos de campos de Classificação.

Cria um novo campo de classificação

  1. Click Imagem dos documentos on the right pane in the Classification Fields section. The Create Classification Field window is displayed.
  2. Preencha um nome exclusivo para o campo no espaço Inserir nome único de campo. O campo não aceita letras maiúsculas. Pode conter apenas letras minúsculas, números, sublinhado _ e traço -.
  3. Click Create. The Edit Field window is displayed.
  4. Na área de texto, preencha a lista de classes e digite os nomes como uma lista separada por vírgulas.
  5. Clique em Salvar para salvar suas configurações.

Editar um campo de classificação

Click the Edit field Imagem dos documentos button. Define a list of possible values. Commas must separate values. An optional description of the value may be included after colon : (option 1 : description 1).

Excluir um campo de classificação

Para excluir um campo de classificação, siga estas etapas:

  1. Click the Edit fieldImagem dos documentos button corresponding to the classification field you want to delete.

  2. Clique no botão Excluir.

  3. Digite o nome exato do campo.

  4. Clique em OK.

  5. O campo de classificação e seus dados rotulados associados são excluídos.

Esta página foi útil?

Conectar

Precisa de ajuda? Suporte

Quer aprender? Academia UiPath

Tem perguntas? Fórum do UiPath

Fique por dentro das novidades