document-understanding

2024.10

false

Importante :

A localização de um conteúdo recém-publicado pode levar de 1 a 2 semanas para ficar disponível.

Guia do usuário de projetos modernos do Document Understanding

Conceitos-chave

Familiarize-se com os conceitos centrais em torno do UiPath® Document Understanding^TM.

Aprendizado ativo

O aprendizado ativo é nossa abordagem moderna para a criação de modelos para o Document Understanding^TM.

O aprendizado ativo fornece uma experiência interativa na qual o algoritmo de aprendizado pode consultar o usuário para rotular dados com as saídas desejadas. Esse processo ajuda a reduzir o tempo e os dados necessários para treinar um modelo de machine learning em até 80%. A IA é usada para orientar o processo, que inclui anotação automática, que normalmente é a tarefa mais demorada. O modelo também fornece recomendações de especialistas para melhorar a precisão usando os conjuntos de dados mais informativos.

Figura 1. Como o Aprendizado Ativo funciona

Usando o aprendizado ativo, você também pode monitorar suas automações por meio de recursos analíticos.

Tipos de Documento

Um tipo de documento refere-se à classificação ou categorização de um documento com base em seu conteúdo, formato, finalidade ou outros fatores de distinção. Alguns exemplos podem incluir faturas, recibos, contratos, relatórios, prontuários médicos, documentos legais e outros.

Alguns tipos de documentos têm conteúdo altamente estruturado, enquanto outros consistem principalmente em texto livre. Com base nisso, os documentos são classificados em três formatos principais:

Estruturado: os documentos destinam-se a coletar informações em um formato específico. Por exemplo, pesquisas, declarações de imposto, passaportes ou licenças são todos documentos estruturados.
Semiestruturado: documentos que não seguem um formato estrito e não estão associados a campos de dados especificados. Os documentos semiestruturados incluem faturas, recibos, contas de serviços públicos, extratos bancários e outros.
Não estruturado: documentos que não seguem um modelo específico ou organizado. Por exemplo, contratos, locações ou artigos de notícias são todos documentos não estruturados.

Para saber mais sobre os tipos de documento, consulte a seção Tipos de documento.

Modelos de ML

Os modelos de ML são como assistentes virtuais que foram treinados para aprender com dados e fazer previsões ou tomar decisões. Esses modelos são essencialmente algoritmos que aprendem a reconhecer padrões com base em dados históricos. Quanto mais dados aos quais eles estiverem expostos, mais eles podem aprimorar suas previsões ou decisões ao longo do tempo.

Você pode encontrar vários modelos de ML prontos para uso no Document Understanding^TM. Esses modelos ajudam você a classificar e extrair quaisquer pontos de dados que ocorrem comumente de documentos semiestruturados ou não estruturados, sem configuração necessária.

Verifique a página Tipos de documento pré-treinados para obter a lista completa de modelos pré-treinados e seus campos.

Os modelos de ML podem ser treinados em uma maioria de idiomas, desde que o OCR reconheça o documento e o texto com alta confiança.

Reconhecimento de caracteres óptico

O reconhecimento óptico de caracteres (OCR) é uma tecnologia especial usada para converter diferentes tipos de documentos, como documentos de papel digitalizados, arquivos PDF ou imagens obtidas por uma câmera digital, em dados editáveis e pesquisáveis.

A precisão de um mecanismo de OCR depende da qualidade do documento original. Um texto limpo e bem formatado em uma fonte legível normalmente produz a melhor saída.

Para obter mais informações sobre os idiomas compatíveis com as opções de mecanismos de OCR fornecidas pela UiPath®, consulte a página Idiomas compatíveis com OCR .

Nesta página

Aprendizado ativo
Tipos de Documento
Modelos de ML
Reconhecimento de caracteres óptico

Esta página foi útil?

AnteriorRecursos fundamentais

AvançarEscolha do tipo de implantação

Guia do usuário de projetos modernos do Document Understanding

Aprendizado ativo​

Tipos de Documento​

Modelos de ML​

Reconhecimento de caracteres óptico​

Esta página foi útil?

Aprendizado ativo

Tipos de Documento

Modelos de ML

Reconhecimento de caracteres óptico