- Visão geral
- Sobre as atividades do Document Understanding
- Contratos de Processamento de Documentos
- Notas de versão
- Sobre os Contratos de Processamento de Documentos
- Classe Box
- Interface IPersistedActivity
- Classe PrettyBoxConverter
- Interface IClassifierActivity
- Interface IClassifierCapabilitiesProvider
- Classe ClassifierDocumentType
- Classe ClassifierResult
- Classe ClassifierCodeActivity
- Classe ClassifierNativeActivity
- Classe ClassifierAsyncCodeActivity
- Classe ClassifierDocumentTypeCapability
- ContentValidationData Class
- EvaluatedBusinessRulesForFieldValue Class
- EvaluatedBusinessRuleDetails Class
- Classe ExtractorAsyncCodeActivity
- Classe ExtractorCodeActivity
- Classe ExtractorDocumentType
- Classe ExtractorDocumentTypeCapabilities
- Classe ExtractorFieldCapability
- Classe ExtractorNativeActivity
- Classe ExtractorResult
- FieldValue Class
- FieldValueResult Class
- Interface ICapabilitiesProvider
- Interface IExtractorActivity
- Classe ExtractorPayload
- Enumeração DocumentActionPriority
- Classe DocumentActionData
- Enumeração DocumentActionStatus
- Enumeração DocumentActionType
- Classe DocumentClassificationActionData
- Classe DocumentValidationActionData
- Classe UserData
- Classe Document
- Classe DocumentSplittingResult
- Classe DomExtensions
- Classe Page
- Classe PageSection
- Classe Polígono
- Classe PolygonConverter
- Classe de metadados
- Classe WordGroup
- Classe Word
- Enumeração ProcessingSource
- Classe ResultsTableCell
- Classe ResultsTableValue
- Classe ResultsTableColumnInfo
- Classe ResultsTable
- Enumeração Rotation
- Rule Class
- RuleResult Class
- RuleSet Class
- RuleSetResult Class
- Enumeração SectionType
- Enumeração WordGroupType
- Interface IDocumentTextProjection
- Classe ClassificationResult
- Classe ExtractionResult
- Classe ResultsDocument
- Classe ResultsDocumentBounds
- Classe ResultsDataPoint
- Classe ResultsValue
- Classe ResultsContentReference
- Classe ResultsValueTokens
- Classe ResultsDerivedField
- Enumeração ResultsDataSource
- Classe ResultConstants
- Classe SimpleFieldValue
- Classe TableFieldValue
- Classe DocumentGroup
- Classe DocumentTaxonomy
- Classe DocumentType
- Classe Field
- Enumeração FieldType
- FieldValueDetails Class
- Classe LanguageInfo
- Classe MetadataEntry
- Enumeração de tipo de texto
- Classe TypeField
- Interface ITrackingActivity
- Interface ITrainableActivity
- Interface ITrainableClassifierActivity
- Interface ITrainableExtractorActivity
- Classe TrainableClassifierAsyncCodeActivity
- Classe TrainableClassifierCodeActivity
- Classe TrainableClassifierNativeActivity
- Classe TrainableExtractorAsyncCodeActivity
- Classe TrainableExtractorCodeActivity
- Classe TrainableExtractorNativeActivity
- Classe BasicDataPoint - visualização
- Classe ExtractionResultHandler — visualização
- Document Understanding ML
- Document Understanding OCR Local Server
- Document Understanding
- Notas de versão
- Sobre o pacote de atividades Document Understanding
- Compatibilidade do projeto
- Configuração da conexão externa
- Definir Senha do PDF
- Merge PDFs
- Get PDF Page Count
- Extract PDF Text
- Extract PDF Images
- Extract PDF Page Range
- Extract Document Data
- Criar tarefa de validação e aguardar
- Aguarde a tarefa de validação e retome
- Create Validation Task
- Classificar Documento
- Create Classification Validation Task
- Create Classification Validation Task and Wait
- Aguardar a tarefa de Validação de Classificação e retomar
- IntelligentOCR
- Notas de versão
- Sobre o pacote de atividades IntelligentOCR
- Compatibilidade do projeto
- Carregar Taxonomia
- Digitize Document
- Classificar Escopo do Documento
- Classificador baseado em palavra-chave
- Document Understanding Project Classifier
- Intelligent Keyword Classifier
- Create Document Classification Action
- Create Document Validation Artifacts
- Recuperar artefatos de validação de documento
- Aguardar ação de classificação do documento e retomar
- Train Classifiers Scope
- Instrutor de Classificador Baseado em Palavra-chave
- Intelligent Keyword Classifier Trainer
- Escopo da Extração de Dados
- Document Understanding Project Extractor
- Document Understanding Project Extractor Trainer
- Regex Based Extractor
- Form Extractor
- Intelligent Form Extractor
- Rasurar documento
- Create Document Validation Action
- Wait For Document Validation Action And Resume
- Escopo de Extratores de Treinamento
- Exportar Resultados da Extração
- Machine Learning Extractor
- Machine Learning Extractor Trainer
- Machine Learning Classifier
- Machine Learning Classifier Trainer
- Classificador Generativo
- Extrator Generativo
- Configuração da autenticação
- Validação de documentos com ações de aplicativos
- Validação manual para digitalizar documentos
- Extração de dados baseada em âncora usando a atividade Intelligent Form Extractor
- Validation Station
- Atividades generativas — Boas práticas
- Extrator generativo — boas práticas
- Classificador generativo — Boas práticas
- Serviços de ML
- OCR
- Contratos de OCR
- Notas de versão
- Sobre os Contratos OCR
- Compatibilidade do projeto
- Interface IOCRActivity
- Classe OCRAsyncCodeActivity
- Classe OCRCodeActivity
- Classe OCRNativeActivity
- Character Class
- Classe OCRResult
- Classe Word
- Enumeração FontStyles
- Enumeração OCRRotation
- Classe OCRCapabilities
- Classe OCRScrapeBase
- Classe OCRScrapeFactory
- Classe ScrapeControlBase
- Enumeração ScrapeEngineUsages
- ScrapeEngineBase
- Classe ScrapeEngineFactory
- Classe ScrapeEngineProvider
- OmniPage
- PDF
- [Não listado] Abbyy
- [Não listado] Abbyy Embedded

Atividades do Document Understanding
Sobre as atividades do Document Understanding
As atividades do Document Understanding permitem que você processe, classifique e extraia documentos, com o objetivo de automatizar a interpretação para eles.
As atividades do Document Understanding são um componente-chave do processamento de documentos. Torna possível o processamento completo de documentos, permitindo que o sistema interprete o significado de um documento e extraia informações dele. Você pode usar métodos de classificação de documentos e extração de dados para extrair e interpretar informações de vários documentos com diferentes estruturas.
Em um nível alto, os documentos passam pelas seguintes cinco etapas fundamentais:
- Definição de tipos de documentos e dados a serem extraídos;
- Fornecimento do texto e sua localização;
- Classificação dos documentos da lista especificada;
- Extração das informações;
- Confirmação dos dados extraídos por um humano.
Em seguida, os dados extraídos podem ser exportados e consumidos da forma que você desejar.
As atividades do Document Understanding incluem os seguintes pacotes:
- Document Processing Contracts: Contains data structures and interfaces to be used for integrating with the Document Understanding framework.
- Document Understanding OCR Local Server: Contains no activities, but once installed in a project, it enables you to use UiPath Document OCR running locally on the robot machine.
- Document Understanding Process: A template that provides logging, exception handling, retry mechanisms, and all the methods that should be used in a Document Understanding workflow, out of the box.
- Document Understanding: Allows you to process documents.
- Intelligent OCR: Contains the infrastructure for enabling document processing workflows.
- ML Services: Allows you to retrieve and call all ML Skills available on your tenant, as well as upload files or create labeling tasks.
- OCR: Contains the UiPath Screen OCR and UiPath Document OCR activities which use UiPath's in-house OCR engines.
- OCR Contracts: Contains the contracts needed to develop new OCR engines.
- OmniPage: Contains the OmniPage OCR activity which extracts data from an indicated UI (User Interface) element or image using the OmniPage OCR engine.
- PDF: Contains activities designed to extract data from PDF and XPS files.
Projetos e atividades modernos
Visit Activity or API-based limits to check the current specifications and parameters for optimal utilization of Document Understanding modern projects and Document Understanding activities.
Compatibilidade do projeto
Use a tabela a seguir para identificar a compatibilidade entre a plataforma e os pacotes de atividades:
Table 1. Document Understanding activities project compatibility
| Projetos do Windows - Legado do Studio | Projetos do Windows (Moderno) Studio | Projetos do Studio multiplataforma | |
|---|---|---|---|
| Document Understanding OCR Local Server | ✅ | ✅ | ✅ |
| Atividades de Document Understanding | ❌ | ✅ | ✅ |
| IntelligentOCR | ✅ | ✅ | ❌ |
| Serviços de ML | ✅ | ✅ | ❌ |
| OCR | ✅ | ✅ | ❌ |
| Contratos de OCR | ✅ | ✅ | ✅ |
| omnipage | ✅ | ✅ | ❌ |
| ✅ | ✅ | ❌ |