- Visão geral
- Processo do Document Understanding
- Tutoriais de início rápido
- Componentes do framework
- Visão geral da digitalização
- Atividades relacionadas à digitalização
- Mecanismos OCR
- Pacotes de ML
- Visão geral
- Document Understanding - Pacote de ML
- DocumentClassifier - Pacote de ML
- Pacotes de ML com recursos de OCR
- 1040 - Pacote de ML
- 4506T - Pacote de ML
- 990 - Pacote de ML - Prévia
- ACORD125 - Pacote de ML
- ACORD126 - Pacote de ML
- ACORD131 - Pacote de ML
- ACORD140 - Pacote de ML
- ACORD25 - Pacote de ML
- Extratos bancários - Pacote de ML
- ConhecimentoDeEmbarque - Pacote de ML
- Certificado de incorporação - Pacote de ML
- Certificado de origem - Pacote de ML
- Cheques - Pacote de ML
- Certificado de produtos filhos - Pacote de ML
- CMS1500 — Pacote de ML
- Declaração de Conformidade da UE - Pacote de ML
- Demonstrações financeiras - Pacote de ML
- FM1003 - Pacote de ML
- I9 - Pacote de ML
- Cartões de identificação - Pacote de ML
- Faturas - Pacote de ML
- FaturasAustrália - Pacote de ML
- FaturasChina - Pacote de ML
- FaturasÍndia - Pacote de ML
- FaturasJapão - Pacote de ML
- Envio de faturas - Pacote de ML
- Romaneio de carga - Pacote de ML
- Passaportes - Pacote de ML
- Contracheques — Pacote de ML
- Ordens de compra - Pacote de ML
- Recibos – Pacote de ML
- AvisosDePagamento - Pacote de ML
- Contas de serviços - Pacote de ML
- Títulos de veículos - Pacote de ML
- W2 - Pacote de ML
- W9 - Pacote de ML
- Outros pacotes de ML prontos para uso
- Endpoints públicos
- Requisitos de Hardware
- Pipelines
- Document Manager
- Serviços de OCR
- Aprendizagem profunda
- Document Understanding implantado no Automation Suite
- Instalar e usar
- Experiência de primeira execução
- Implantar o UiPathDocumentOCR
- Implante um Pacote de ML pré-configurado
- Pacotes offline 2023.4.13+patch1
- Pacotes offline 2023.4.13
- Pacotes offline 2023.4.12
- Pacotes offline 2023.4.11
- Pacotes offline 2023.4.10+patch1
- Pacotes offline 2023.4.10
- Pacotes offline 2023.4.9
- Pacotes offline 2023.4.8
- Pacotes offline 2023.4.7
- Pacotes offline 2023.4.6
- Pacotes offline 2023.4.5
- Pacotes Oflline 2023.4.4
- Pacotes offline 2023.4.3
- Pacotes offline 2023.4.2
- Pacotes offline 2023.4.1
- Pacotes offline 2023.4.0
- Use o Document Manager
- Usar o Framework
- Document Understanding implantado no AI Center autônomo
- Licenciamento
- Atividades
- UiPath.Abbyy.Activities
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentProcessing.Contracts
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
O que é Digitalização
A Digitalização é o processo de obtenção de texto legível por máquina de um determinado arquivo de entrada para que um robô possa entender seu conteúdo e agir sobre ele. É a primeira etapa aplicada em arquivos que precisam ser processados por meio do framework Document UnderstandingTM .
A etapa de digitalização tem duas saídas:
- o texto do arquivo processado, armazenado em uma variável string, e
- o Modelo de Objeto de Documento desse arquivo - objeto JSON contendo informações básicas como nome, tipo de conteúdo, tamanho do texto, número de páginas, bem como informações detalhadas como rotação de página, idioma detectado, conteúdo e coordenadas para cada palavra identificada no Arquivo.
No framework Document Processing, a digitalização é realizada usando a atividade Digitize Document .
O que a Digitalização não é
Apesar de relacionada, a etapa de digitalização não é OCR.
Em muitos casos, os arquivos que precisam ser processados são arquivos PDF nativos (não digitalizados), que podem ser lidos programaticamente pelo robô sem aplicar OCR.
Quando o mecanismo OCR é utilizado na Digitalização
A atividade Digitize Document requer, como parte de sua configuração, a seleção de um mecanismo de OCR - para que, quando necessário, possa ser utilizado, mas que execute OCR apenas em:
- arquivos que são imagens
- formatos de imagens suportados são .png, .jpe, .jpg, .jpeg, .tiff, .tif, .bmp
- para arquivos TIFF de várias páginas, o OCR é aplicado para cada página
- Páginas PDF que
- não possuam nenhum conteúdo legível por máquina
- contenham imagens que cubram uma área significativa da página.
As seguintes limitações de digitalização se aplicam:
- Há um limite de tamanho de arquivo de 160 MB.
- Há um limite máximo de 500 páginas por documento.
O OCR também é sempre aplicado se a atividade Digitize Document estiver configurada com a flag ForceApplyOCR definida como True. Essa opção é geralmente recomendada para casos de uso nos quais uma porcentagem significativa de arquivos parece conter conteúdo nativo, mas o conteúdo lido nativamente não corresponde ao que um usuário pode observar nesses arquivos.
Como escolher o mecanismo OCR
As each use case has its own particularities, it is strongly recommended to test all available OCR Engines with different settings, in order to determine which one works best for your project. Another recommendation is to pay particular attention to the OCR engine arguments, such as Profile, Scale, Language etc. (may vary from one engine to another), so that you identify the best settings for each use case.