- Información general
- Proceso de Document Understanding
- Tutoriales de inicio rápido
- Componentes de marco
- Resumen de la clasificación de documentos
- Asistente para Configurar clasificadores de Clasificar ámbito de documento
- Clasificador basado en palabras clave
- Clasificador inteligente de palabra clave
- Clasificador de CapturaFlexible
- Clasificador de aprendizaje automático
- Actividades relacionadas con la clasificación de documentos
- Consumo de datos
- Paquetes ML
- Procesos
- Administrador de documentos
- Servicios de OCR
- Document Understanding implementado en Automation Suite
- Instalar y utilizar
- Primera experiencia de ejecución
- Implementar UiPathDocumentOCR
- Implementar un paquete ML listo para usar
- Paquetes sin conexión 2022.10.0
- Paquetes sin conexión 2022.10.2
- Paquetes sin conexión 2022.10.4
- Paquetes sin conexión 2022.10.6
- Paquetes sin conexión 2022.10.8
- Paquetes sin conexión 2022.10.9
- Paquetes sin conexión 2022.10.10
- Paquetes sin conexión 2022.10.11
- Paquetes sin conexión 2022.10.12
- Paquetes sin conexión 2022.10.13
- Paquetes sin conexión 2022.10.14
- Paquetes sin conexión 2022.10.14+patch1
- Paquetes sin conexión 2022.10.15
- Utiliza Document Manager
- Utilizar el marco
- Document Understanding implementado en AI Center independiente
- Aprendizaje profundo
- Licencia
- Referencias
- Actividades.DeUipath
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
El marco de Document Understanding de UiPath facilita el procesamiento de los archivos entrantes, desde la digitalización de archivos hasta la validación de los datos extraídos, todo ello en un entorno abierto, extensible y versátil.
Document Understanding está diseñado para ayudarte a combinar diferentes enfoques para extraer información de múltiples tipos de documentos. El objetivo principal es facilitar al máximo el proceso de extracción de datos: crear un único flujo de trabajo que extraiga datos de diversos documentos.
Antes de usar el marco de trabajo de Document Understanding, se recomienda entender los siguientes componentes del marco de trabajo de Document Understanding.
- TaxonomíaWhat documents need to be processed and what data is required from them? Used to define the document types and the pieces of information targeted for data extraction (fields) for each document type, and formalizes this information into a dedicated Taxonomy structure. This metadata information is managed through the Taxonomy Manager.
- Digitalización¿Qué contiene este archivo? Se utiliza para obtener el contenido textual y la estructura del documento entrante, convirtiendo un archivo en contenido legible por la máquina para que pueda ser procesado posteriormente.
- Clasificación de documentos¿Qué tipos de documentos de la taxonomía se encuentran en este archivo? Se utiliza para determinar automáticamente qué tipos de documentos se encuentran dentro de un archivo digitalizado.
- Validación de clasificación de documentos¿Es correcta la clasificación prevista? Así es como puedo revisarlo y corregirlo. Se utiliza para ayudar en la validación y corrección humana de la clasificación automática y los resultados de la división de documentos.
- Entrenamiento de la clasificación¿El humano revisó los datos? Así es como el robot puede aprender de él. Se utiliza para devolver la información validada por humanos a los clasificadores, para que la utilicen para mejorar sus predicciones futuras.
- Extracción de información¿Qué datos se pueden encontrar en este documento en particular? Se utiliza para capturar la información necesaria para el tipo de documento identificado, dentro del rango de documentos de entrada y páginas de clasificación dados.
- Validación de extracción de datos¿Es correcta la información extraída? Así es como puedo revisarlo y corregirlo. Se utiliza para ayudar en la validación y corrección humana de los resultados de datos extraídos automáticamente.
- Entrenamiento de extracción de datos¿El humano revisó los datos? Así es como el robot puede aprender de él. Se utiliza para devolver los datos extraídos validados por humanos a los extractores, para utilizarlos para mejorar sus predicciones de extracción.
- Data Consumption Used to export the validated data to consume it.
- Metering & Charging Logic Used to explain the consumption of units per page for each available service.
El siguiente diagrama presenta los componentes del marco de Document Understanding y cómo se relacionan entre sí:
The Document Understanding framework is found in the UiPath.IntelligentOCR.Activities package. Once the UiPath.IntelligentOCR.Activities package is installed, the Taxonomy Manager wizard appears in the top ribbon of the UiPath Studio. This same package contains all the core document understanding framework activities.
Las actividades de ámbito (Clasificar ámbito de documento, ámbito de extracción de datos, Ámbito de entrenamiento de los clasificadores, Ámbito de entrenamiento de los extractores) que forman parte del marco de Document Understanding te permiten usar cualquier algoritmo de clasificación de documentos y de extracción de datos que se ajuste a tu caso de uso y luego entrenar estos algoritmos.
The Document Understanding framework can be used not only with the out-of-the-box classifiers and extractors but also with any custom-built ones. These can be created using the abstract classes from the package and can be implemented as classification or data extraction activities. Custom-built OCR engines can also be created using the abstract classes from the package.
Recursos
Los cursos especializados en Document Understanding pueden encontrarse en UiPath RPA Academy.
El Foro de UiPath Community es el lugar donde recibir ayuda de nuestra creciente comunidad de usuarios.