UiPath Documentation
document-understanding
2022.4
false
Guia do usuário do Document Understanding.
Importante :
A localização de um conteúdo recém-publicado pode levar de 1 a 2 semanas para ficar disponível.

Introdução

O framework UiPath Document Understanding facilita o processamento de arquivos recebidos, desde a digitalização até a validação de dados extraídos, tudo em um ambiente aberto, extensível e versátil.

O Document Understanding foi projetado para ajudar você a combinar diferentes abordagens para extrair informações de vários tipos de documentos. O principal objetivo é tornar o processo de extração de dados o mais fácil possível: criar um único fluxo de trabalho que extrairá dados de vários documentos.

Antes de usar a estrutura do Document Understanding, é recomendável entender os seguintes componentes do framework Document Understanding:

  • TaxonomiaWhat documents need to be processed and what data is required from them? Used to define the document types and the pieces of information targeted for data extraction (fields) for each document type, and formalizes this information into a dedicated Taxonomy structure. This metadata information is managed through the Taxonomy Manager.
  • DigitalizaçãoO que este arquivo contém? Usado para obter o conteúdo textual e a estrutura do documento de entrada, transformando um arquivo em conteúdo legível por máquina para que possa ser processado posteriormente.
  • Classificação de DocumentoQue tipos de documentos da taxonomia são encontrados neste arquivo? Usado para determinar automaticamente quais tipos de documentos são encontrados em um arquivo digitalizado.
  • Validação da classificação de documentosA classificação prevista está correta? É assim que é possível revisá-la e corrigi-la. Usado para auxiliar na validação manual e correção dos resultados de classificação automática e divisão de documentos.
  • Treinamento de classificaçãoO humano revisou os dados? É assim que o robô pode aprender com isso. Usado para passar as informações validadas por humanos de volta para os classificadores, para usá-las para melhorar suas previsões futuras.
  • Extração de DadosQuais dados podem ser encontrados neste documento específico? Usado para capturar as informações necessárias para o tipo de documento identificado, dentro do documento de entrada fornecido e intervalo de páginas de classificação.
  • Validação de extração de dadosAs informações extraídas estão corretas? É assim que é possível revisá-la e corrigi-la. Usado para auxiliar na validação manual e correção dos resultados de dados extraídos automaticamente.
  • Treinamento em extração de dadosO humano revisou os dados? É assim que o robô pode aprender com isso. Usado para passar os dados extraídos validados por humanos de volta para os extratores, para usá-los para melhorar suas previsões de extração.
  • Data Consumption Used to export the validated data in order to consume it.
  • Metering & Charging Logic Used to explain the consumption of units per page for each available service.

O diagrama abaixo apresenta os componentes do Framework Document Understanding e como se relacionam entre si:

The Document Understanding framework is found in the UiPath.IntelligentOCR.Activities package. Once the UiPath.IntelligentOCR.Activities package is installed, the Taxonomy Manager wizard appears in the top ribbon of the UiPath Studio. This same package contains all the core document understanding framework activities.

As atividades de escopo (Classify Document Scope, Data Extraction Scope, Train Classifiers Scope, Train Extractors Scope) que fazem parte do framework Document Understanding permitem que você use qualquer classificação de documento e algoritmos de extração de dados que se adequam ao seu caso de uso e, em seguida, treinam esses algoritmos.

O framework Document Understanding pode ser usado não apenas com os classificadores e extratores prontos para uso, mas também com quaisquer outros personalizados. Eles podem ser criados usando as classes abstratas do pacote UiPath.DocumentProcessing.Contracts e podem ser implementados como atividades de classificação ou extração de dados. Mecanismos de OCR personalizados também podem ser criados usando as classes abstratas do pacote UiPath.OCR.Contracts.

Recursos

Os cursos dedicados ao Document Understanding podem ser encontrados na UiPath RPA Academy.

O Fórum Community da UiPath é o local para obter suporte da nossa comunidade sempre crescente de usuários.

  • Recursos

Esta página foi útil?

Conectar

Precisa de ajuda? Suporte

Quer aprender? Academia UiPath

Tem perguntas? Fórum do UiPath

Fique por dentro das novidades