- Introdução
- Componentes do framework
- Pacotes de ML
- Pipelines
- Gerenciador de Dados
- Serviços de OCR
- Document Understanding implantado no Automation Suite
- Document Understanding implantado no AI Center autônomo
- Aprendizagem profunda
- Licenciamento
- Referências
- UiPath.Abbyy.Activities
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
O framework UiPath Document Understanding facilita o processamento de arquivos recebidos, desde a digitalização até a validação de dados extraídos, tudo em um ambiente aberto, extensível e versátil.
O Document Understanding foi projetado para ajudar você a combinar diferentes abordagens para extrair informações de vários tipos de documentos. O principal objetivo é tornar o processo de extração de dados o mais fácil possível: criar um único fluxo de trabalho que extrairá dados de vários documentos.
Antes de usar a estrutura do Document Understanding, é recomendável entender os seguintes componentes do framework Document Understanding:
- TaxonomiaWhat documents need to be processed and what data is required from them? Used to define the document types and the pieces of information targeted for data extraction (fields) for each document type, and formalizes this information into a dedicated Taxonomy structure. This metadata information is managed through the Taxonomy Manager.
- DigitalizaçãoO que este arquivo contém? Usado para obter o conteúdo textual e a estrutura do documento de entrada, transformando um arquivo em conteúdo legível por máquina para que possa ser processado posteriormente.
- Que tipos de documentos da taxonomia são encontrados neste arquivo? Usado para determinar automaticamente quais tipos de documentos são encontrados em um arquivo digitalizado.
- A classificação prevista está correta? É assim que é possível revisá-la e corrigi-la. Usado para auxiliar na validação manual e correção dos resultados de classificação automática e divisão de documentos.
- O humano revisou os dados? É assim que o robô pode aprender com isso. Usado para passar as informações validadas por humanos de volta para os classificadores, para usá-las para melhorar suas previsões futuras.
- Extração de DadosQuais dados podem ser encontrados neste documento específico? Usado para capturar as informações necessárias para o tipo de documento identificado, dentro do documento de entrada fornecido e intervalo de páginas de classificação.
- Validação de extração de dadosAs informações extraídas estão corretas? É assim que é possível revisá-la e corrigi-la. Usado para auxiliar na validação manual e correção dos resultados de dados extraídos automaticamente.
- Treinamento em extração de dadosO humano revisou os dados? É assim que o robô pode aprender com isso. Usado para passar os dados extraídos validados por humanos de volta para os extratores, para usá-los para melhorar suas previsões de extração.
- Data Consumption Used to export the validated data in order to consume it.
- Metering & Charging Logic Used to explain the consumption of units per page for each available service.
O diagrama abaixo apresenta os componentes do Framework Document Understanding e como se relacionam entre si:
The Document Understanding framework is found in the UiPath.IntelligentOCR.Activities package. Once the UiPath.IntelligentOCR.Activities package is installed, the Taxonomy Manager wizard appears in the top ribbon of the UiPath Studio. This same package contains all the core document understanding framework activities.
As atividades de escopo (Classify Document Scope, Data Extraction Scope, Train Classifiers Scope, Train Extractors Scope) que fazem parte do framework Document Understanding permitem que você use qualquer classificação de documento e algoritmos de extração de dados que se adequam ao seu caso de uso e, em seguida, treinam esses algoritmos.
The Document Understanding framework can be used not only with the out-of-the-box classifiers and extractors but also with any custom-built ones. These can be created using the abstract classes from the package and can be implemented as classification or data extraction activities. Custom-built OCR engines can also be created using the abstract classes from the package.
Recursos
Os cursos dedicados ao Document Understanding podem ser encontrados na UiPath RPA Academy.
O Fórum Community da UiPath é o local para obter suporte da nossa comunidade sempre crescente de usuários.