- Visão geral
- Processo do Document Understanding
- Tutoriais de início rápido
- Como extrair dados de recibos
- Faturas retreinadas com um campo adicional
- Como extrair dados de formulários
- Componentes do framework
- Pacotes de ML
- Pipelines
- Gerenciador de Dados
- Serviços de OCR
- Document Understanding implantado no Automation Suite
- Document Understanding implantado no AI Center autônomo
- Aprendizagem profunda
- Crie um modelo de ML de alto desempenho
- Licenciamento
- Referências
- UiPath.Abbyy.Activities
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
O objetivo desta página é ajudar os usuários iniciantes a se familiarizarem com o Document Understanding.
For scalable production deployments, we strongly recommend using the Document Understanding Process available in UiPath Studio under the Templates section.
This quickstart guides you through the steps required to extract information from W-9 forms using the Intelligent Form Extractor. The W-9 forms are used as an example, but the procedure is similar for other types of documents where the data is structured.
Começando do zero, estas são as etapas que precisam ser seguidas:
- Crie um processo em branco
- Instale os pacotes de atividades exigidos
- Crie uma taxonomia
- Digitalize o documento
- Extraia os dados usando o Intelligent Form Extractor
- Valide os resultados usando o Validation Station
- Exportar Resultados da Extração
Agora, vamos ver cada passo em detalhes.
1. Crie um processo em branco
Execute o UiPath Studio.
Em INÍCIO, no modo de exibição Backstage, clique em Processo para criar um projeto.
A janela Novo processo em branco é exibida. Nesta janela, insira um nome para o novo projeto. Se desejar, você também pode adicionar uma descrição para classificar seus projetos com mais facilidade.
Clique em Criar. O novo projeto será aberto no Studio.
2. Instale os pacotes de atividades exigidos
No botão Gerenciar Pacotes na faixa de opções, além dos pacotes de atividades principais (UiPath.Excel.Activities, UiPath.Mail.Activities, UiPath.System.Activities, UiPath.UIAutomation.Activities) que são adicionados ao projeto por padrão, instale o seguintes pacotes de atividades:
3. Crie uma taxonomia
Depois que os pacotes estiverem instalados, liste os campos obrigatórios. Faremos a extração de dados para os campos abaixo:
- 1_Name -
Text - 2_BusinessName -
Text - 3a_Individual -
Boolean - 3b_CCorp -
Boolean - 3c_SCorp -
Boolean - 3d_Partnership -
Boolean - 3e_TrustEstate -
Boolean - 3f_LLC -
Boolean - 3f_LLCTaxClassification -
Boolean - 3g_Other -
Boolean - 3g_OtherDetail -
Boolean - 5_Address -
Text - 6_CityStateZip -
Text - 7_AcctNumber -
Text - TIN_SSN -
Text - TIN_ETN -
Text - Certification_Signature -
Boolean - Certification_SignatureDate -
Date
Open Taxonomy Manager and create a group named "Structured Documents", a category named "Lending Forms", and a document type named "W-9". Create above listed fields with user friendly names along with respective data types.
4. Digitalize o documento
No arquivo Main.xaml , adicione uma atividade Carregar taxonomia e crie uma variável para a saída da taxonomia.
Adicione uma atividade Digitize Document com UiPath Document OCR. Forneça a propriedade de entrada Caminho do Documento e crie variáveis de saída para Texto do Documento e Modelo de Objeto do Documento.
Lembre-se de adicionar a Chave de API do Document Understanding na atividade UiPath Document OCR.
5. Extraia os dados usando o Intelligent Form Extractor
Adicione uma atividade de Data Extraction Scope e preencha as propriedades.
Arraste e solte o Intelligent Form Extractor dentro dele. O endpoint deve ser preenchido automaticamente com o endpoint Intelligent Form Extractor, ou seja, https://du.uipath.com/svc/intelligentforms. Forneça a chave da API do Document Understanding.
Feito isso, para criar um novo modelo, clique em Gerenciar modelos > Criar modelo. Uma janela pop-up é exibida.
Em Tipo de documento, selecione o tipo de documento W-9 criado anteriormente.
Em Nome do documento, insira um nome para o seu modelo.
Em Documento de modelo (PDF nativo, se possível), anexe um documento de modelo onde você mapeará as posições do campo.
Em Mecanismo de OCR, selecione novamente o UiPath Document OCR. Assim como antes, o endpoint deve ser preenchido automaticamente, ou seja, https://du.uipath.com/ocr, e você só precisa fornecer a chave de API.
Clique em Configurar para ir para a próxima etapa. A janela pop-up Gerenciador de Modelos é aberta.
Here, we will need to select the areas where we want Intelligent Form Extractor to search for our fields. Configure them by following the steps detailed here. You also have the option of using anchors for your fields. More information on anchors here.
O resultado deve ser parecido com:
Clique em Salvar. Nesta tela, você pode definir os campos manuscritos ou de assinatura, quando aplicável. Você também pode definir sinônimos para campos booleanos. Feche a janela após terminar.
O próximo passo é configurar o extrator, ou seja, fazer com que o Intelligent Form Extractor processe todos os documentos do tipo W-9.
6. Valide os resultados usando o Validation Station
Para verificar os resultados através do Validation Station, arraste e solte a atividade Present Validation Station e forneça os detalhes de entrada.
7. Exporte os resultados da extração
Para exportar os resultados da extração, validados ou não, arraste e solte uma atividade Export Extraction Results para o final do seu fluxo de trabalho. Isso gera os resultados em um DataSet que contém várias tabelas que podem ser gravadas em um arquivo Excel ou usadas diretamente em um processo downstream.
Baixe o exemplo
Baixe este projeto de amostra para executar o fluxo de trabalho W-9 com Intelligent Form Extractor usando este link.