- Información general
- Proceso de Document Understanding
- Tutoriales de inicio rápido
- Componentes de marco
- Resumen de la clasificación de documentos
- Asistente para Configurar clasificadores de Clasificar ámbito de documento
- Clasificador basado en palabras clave
- Clasificador inteligente de palabra clave
- Clasificador de CapturaFlexible
- Clasificador de aprendizaje automático
- Actividades relacionadas con la clasificación de documentos
- Consumo de datos
- Paquetes ML
- Acerca de los paquetes ML
- Configuración de OCR
- Requisitos de hardware
- Procesos
- Administrador de documentos
- Servicios de OCR
- Document Understanding implementado en Automation Suite
- Instalar y utilizar
- Primera experiencia de ejecución
- Implementar UiPathDocumentOCR
- Implementar un paquete ML listo para usar
- Paquetes sin conexión 2022.10.0
- Paquetes sin conexión 2022.10.2
- Paquetes sin conexión 2022.10.4
- Paquetes sin conexión 2022.10.6
- Paquetes sin conexión 2022.10.8
- Paquetes sin conexión 2022.10.9
- Paquetes sin conexión 2022.10.10
- Paquetes sin conexión 2022.10.11
- Paquetes sin conexión 2022.10.12
- Paquetes sin conexión 2022.10.13
- Paquetes sin conexión 2022.10.14
- Paquetes sin conexión 2022.10.14+patch1
- Paquetes sin conexión 2022.10.15
- Utiliza Document Manager
- Utilizar el marco
- Document Understanding implementado en AI Center independiente
- Aprendizaje profundo
- Licencia
- Referencias
- Actividades.DeUipath
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
El uso de un paquete ML de Document Undestanding implica estos pasos:
-
Recopila muestras de documentos y los requisitos de los puntos de datos que deben extraerse.
-
Labeling documents using Document Manager. Document Manager itself connects to an OCR Service.
-
Descarga o exportación de documentos etiquetados como conjunto de datos de entrenamiento y carga de la carpeta exportada en el almacenamiento de AI Center.
-
Descarga o exportación de documentos etiquetados como un conjunto de datos de evaluación y carga de la carpeta exportada en el almacenamiento de AI Center.
-
Ejecución de un proceso de entrenamiento en AI Center.
-
Evaluación del rendimiento del modelo con un proceso de evaluación en AI Center.
-
Implementación del modelo entrenado como una habilidad ML en AI Center.
-
Consulta de la habilidad ML desde un flujo de trabajo RPA con el paquete de actividades UiPath.DocumentUnderstanding.ML.
Nota:Recuerda que el uso de paquetes ML de Document Understanding requiere que la máquina en la que está instalado AI Center pueda acceder a
https://du-metering.uipath.com.Importante:Al crear un paquete UiPath.DocumentUnderstanding.ML.Activities en AI Center, el nombre del paquete no debe contener ninguna palabra clave reservada de Python, como
class,break,from,finally,globaloNone. Ten en cuenta que esta lista no es exhaustiva, ya que el nombre del paquete se usa paraclass <pkg-name>yimport <pkg-name>.
Se trata de modelos de aprendizaje automático listos para usarse para clasificar y extraer cualquier punto de datos común de documentos semiestructurados o no estructurados, incluidos los campos regulares, las columnas de tablas y los campos de clasificación, con un enfoque sin plantillas.
Los paquetes de aprendizaje automático suministrados por UiPath tienen la versión 0 y ya están disponibles en tu tenant, lo que significa que no es necesario descargarlos.
La descarga está disponible solo para las versiones 1 o superiores, que ya fueron entrenadas por ti.
Document Understanding contiene múltiples paquetes de ML divididos en cinco categorías principales:
- UiPath Document OCR
- Document Understanding
- Clasificador de documentos
- Out-of-the-box Pre-trained ML Packages
- Paquetes ML DU preentrenados listos para usar en AI Center
- Otros paquetes ML listos para usar
UiPath Document OCR
This is a non-retrainable model which can be used with the UiPath Document OCR engine activity as part of the Digitize Document activity. To be used, the ML Skill must first be made public so that a URL can be copy-pasted into the UiPath Document OCR engine activity.
You can run UiPathDocumentOCR on GPU or CPU, accuracy being the same on both cases, training on GPU being faster than te one on CPU. Check the Hardware Requirements for more details.
UiPathDocumentOCR requiere acceso al servidor de medición de Document Understanding en https://du.uipath.com/metering si la habilidad ML se ejecuta en una implementación regular de AI Center local. No se necesita acceso a Internet en las implementaciones aisladas de AI Center locales.
UiPathDocumentOCR_CPU
Este paquete ML se puede implementar de la misma manera que el paquete ML de UiPathDocumentOCR, con las siguientes diferencias:
- está optimizado para ejecutarse en la CPU, por lo que deberías ver un aumento de velocidad de 3 a 4 veces cuando se ejecuta en el flujo de trabajo, y de 5 a 10 veces cuando se utiliza para importar documentos en el administrador de documentos.
- la precisión es ligeramente inferior a la del paquete ML UiPathDocumentOCR , y es similar a la del paquete UiPath.DocumentUnderstanding.OCR.LocalServer Studio
- Debido a que es más rápida, la CPU también se recomienda cuando los documentos son grandes (más de 20 páginas por documento) en ausencia de una GPU, que es lo ideal.
Document Understanding
Se trata de un modelo genérico y reentrenable para extraer cualquier punto de datos común de cualquier tipo de documentos estructurados o semiestructurados, creando un modelo desde cero. Este paquete ML debe ser entrenado. Si se implementa sin entrenamiento previo, la implementación falla con un error que indica que el modelo no está entrenado.
Clasificador de documentos
Se trata de un modelo genérico y reentrenable para clasificar cualquier tipo de documentos estructurados o semiestructurados, creando un modelo desde cero. Este paquete ML debe ser entrenado. Si se implementa sin entrenamiento previo, la implementación falla con un error que indica que el modelo no está entrenado.
Out-of-the-box Pre-trained ML Packages
Se trata de paquetes de ML reentrenables que contienen el conocimiento de diferentes modelos de aprendizaje automático.
Se pueden personalizar para extraer campos adicionales o admitir idiomas adicionales mediante ejecuciones de procesos. Gracias a las capacidades de aprendizaje de transferencia de última generación, este modelo puede volver a entrenarse con documentos etiquetados adicionales y adaptarse a casos de uso específicos o ampliarse para que admita más idiomas latinos, cirílicos o griegos.
El conjunto de datos usado puede tener los mismos campos, un subconjunto de campos o tener campos adicionales. Para beneficiarte de la inteligencia ya contenida en el modelo preentrenado, es necesario usar campos con los mismos nombres que en el propio modelo listo para usar.
Estos paquetes ML son:
-
Invoices: The fields extracted out-of-the-box can be found here.
-
InvoicesAustralia: The fields extracted out-of-the-box can be found here.
-
InvoicesIndia: The fields extracted out-of-the-box can be found here.
-
InvoicesJapan
Preview: The fields extracted out-of-the-box can be found here.Retraining using data from Validation Station is currently not supported.
-
InvoicesChina
Preview: The fields extracted out-of-the-box can be found here.Retraining using data from Validation Station is currently not supported.
-
Receipts: The fields extracted out-of-the-box can be found here.
-
Purchase Orders: The fields extracted out-of-the-box can be found here.
-
Utility Bills: The fields extracted out-of-the-box can be found here.
-
ID Cards : The fields extracted out-of-the-box can be found here.
-
Passports: The fields extracted out-of-the-box can be found here.
-
RemittanceAdvices: The fields extracted out-of-the-box can be found here.
-
BillsOfLading: The fields extracted out-of-the-box can be found here.
-
W2: The fields extracted out-of-the-box can be found here.
-
W9: The fields extracted out-of-the-box can be found here.
-
ACORD125: The fields extracted out-of-the-box can be found here
-
I9: The fields extracted out-of-the-box can be found here
-
990
Preview: The fields extracted out-of-the-box can be found here -
4506T: The fields extracted out-of-the-box can be found here
-
FM1003
Preview: The fields extracted out-of-the-box can be found here -
ACORD25 - The fields extracted out-of-the-box can be found here
-
1040 - The fields extracted out-of-the-box can be found here
-
Checks - The fields extracted out-of-the-box can be found here
-
Bank Statements - The fields extracted out-of-the-box can be found here
-
Financial statements - The fields extracted out-of-the-box can be found here
-
Packing Lists - The fields extracted out-of-the-box can be found here
-
ACORD131 - The fields extracted out-of-the-box can be found here
-
ACORD126 - The fields extracted out-of-the-box can be found here
-
ACORD140 - The fields extracted out-of-the-box can be found here
-
Vehicle Titles - The fields extracted out-of-the-box can be found here
Estos modelos son arquitecturas de aprendizaje profundo diseñadas por UiPath. Una GPU puede usarse tanto en el tiempo de servicio como en el de entrenamiento, pero no es obligatoria. Una GPU ofrece una mejora de más de 10 veces en la velocidad para el entrenamiento en particular.
Los paquetes ML preentrenados listos para usar pueden dividirse en categorías de documentos en función del uso previsto de cada modelo:
| Categoría de documento | Modelo de ML |
|---|---|
|
KYC |
|
|
Seguros |
|
|
Préstamos |
|
|
Recursos humanos |
|
|
Envíos |
|
|
AP |
|
|
AR |
|
|
Gastos |
|
Otros paquetes ML listos para usar
Se trata de paquetes no entrenables que son necesarios para los componentes no ML del paquete de Document Understanding.
Estos paquetes ML son:
- FormExtractor: Deploy as Public Skill and paste the URL into the Form Extractor activity.
- IntelligentFormExtractor: Deploy as Public Skill and paste the URL into the Intelligent Form Extractor activity. Make sure to first deploy the HandwritingRecognition ML Skill and configure that as OCR for the this package.
- IntelligentKeywordClassifier: Deploy as Public Skill and paste the URL into the Intelligent Keyword Classifier activity.
- HandwritingRecognitionOCR: implementa como habilidad pública y usa como OCR al crear el paquete Extractor inteligente de formularios.