- Información general
- Proceso de Document Understanding
- Tutoriales de inicio rápido
- Componentes de marco
- Resumen de la clasificación de documentos
- Asistente para Configurar clasificadores de Clasificar ámbito de documento
- Clasificador basado en palabras clave
- Clasificador inteligente de palabra clave
- Clasificador de CapturaFlexible
- Clasificador de aprendizaje automático
- Actividades relacionadas con la clasificación de documentos
- Consumo de datos
- Paquetes ML
- Procesos
- Administrador de documentos
- Servicios de OCR
- Document Understanding implementado en Automation Suite
- Instalar y utilizar
- Primera experiencia de ejecución
- Implementar UiPathDocumentOCR
- Implementar un paquete ML listo para usar
- Paquetes sin conexión 2022.10.0
- Paquetes sin conexión 2022.10.2
- Paquetes sin conexión 2022.10.4
- Paquetes sin conexión 2022.10.6
- Paquetes sin conexión 2022.10.8
- Paquetes sin conexión 2022.10.9
- Paquetes sin conexión 2022.10.10
- Paquetes sin conexión 2022.10.11
- Paquetes sin conexión 2022.10.12
- Paquetes sin conexión 2022.10.13
- Paquetes sin conexión 2022.10.14
- Paquetes sin conexión 2022.10.14+patch1
- Paquetes sin conexión 2022.10.15
- Utiliza Document Manager
- Utilizar el marco
- Document Understanding implementado en AI Center independiente
- Aprendizaje profundo
- Licencia
- Referencias
- Actividades.DeUipath
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
UiPath Document Manager es una aplicación web ligera que permite a los usuarios preparar, revisar y realizar correcciones en los conjuntos de datos necesarios para el entrenamiento y la evaluación de los modelos de aprendizaje automático de Document Understanding. Permite que varios usuarios realicen diversas operaciones:
Define y configura los campos a extraer por un modelo ML.
Importa documentos para el etiquetado.
Preetiqueta los documentos con un modelo ML preexistente, como la extracción de facturas o la extracción de recibos proporcionados listos para usar por UiPath, o usando un modelo entrenado con AI Center.
Etiqueta los documentos.
Exporta los documentos en el formato previsto por los procesos de entrenamiento de AI Center.
La interfaz de usuario
La interfaz del administrador de documentos contiene los siguientes paneles:
Barra de gestión
Se muestra en la parte superior de la página en Administrador de documentos.
Permite realizar múltiples operaciones: navegar entre documentos, eliminar/restaurar un documento, buscar/filtrar documentos, ejecutar predicciones de modelos de IA, importar y exportar documentos.
Estos son los elementos disponibles en la barra de administración:
| Elemento | Icono | Descripción |
|---|---|---|
|
Navegación |
|
Permite navegar entre los documentos que coinciden con el filtro activo. Entre las dos flechas aparece un contador. Muestra el número del documento actual del total de documentos que coinciden con la búsqueda o filtro activos. |
|
|
|
Busca o filtra documentos. El filtro también se aplica al exportar documentos. También puedes filtrar por palabras de un documento o por nombres de documentos. |
|
Eliminar/Restaurar |
|
Elimina o restaura un documento. Los documentos eliminados se encuentran bajo el filtro de eliminados. |
|
|
|
Abre el cuadro de diálogo Importar datos. |
|
|
|
Abre el cuadro de diálogo Exportar archivos. |
|
Nombre y tipo de documento |
N/D |
El nombre del documento actualmente activo y su tipo. Hay tres tipos de documentos:
Training and Validation documents are part of training datasets used by Training Pipelines. Evaluation documents are ignored by Training Pipelines and are intended to only be used by Evaluation pipelines in AI Center. These documents are the ones that were marked as evaluation by selecting the Mark this an evaluation set checkbox in the Import data dialog box. |
|
Descargar |
|
La opción está disponible en el desplegable junto al nombre del documento. Haz clic en el icono para descargar un archivo Zip que contiene el documento original. Además del documento original, también se descargan todas las páginas convertidas internamente por el administrador de documentos en imágenes |
|
Eliminar de forma permanente |
|
La opción está disponible en el desplegable junto al nombre del documento. Borra permanentemente archivos individuales. Al hacer clic en el botón, se mostrará un mensaje emergente que te preguntará si quieres eliminar de forma definitiva el documento. Haz clic en Aceptar para continuar o Cancelar para volver a la pantalla anterior. |
|
Nombre de la sesión |
N/D |
El nombre de la sesión actual. |
|
Predecir |
|
Ejecutar las predicciones del modelo de IA y mostrar los resultados. Una vez se configure el preetiquetado, el botón se activa en la barra de administración. Haz clic en él para preetiquetar el documento actual. At the moment, using the Predict option with Public Endpoints prelabels only the first 10 pages of a document. This is a known issue and a fix is in the working. Using the Predict option with ML Skills in AI Center, however, does not impose such a limitation. |
|
Configuración |
|
Configura los ajustes de OCR y preetiquetado o accede al panel Tutorial. Consulta más detalles a continuación. |
Opciones Eliminar y Eliminar de forma permanente
Let's go a little bit deeper in understanding the difference between Delete and Permanently Delete options.
-
The Delete option deletes the files, but not removing them entirely from your project. The deleted files can still be found under the deleted filter from the Search bar and restored by using the Restore option.
-
The Permanently Delete option deletes the selected files without any possibility of restoring them.
Observa el uso de ambas opciones en el siguiente archivo GIF:
Opción de búsqueda
The Search bar is both a text input field and a drop-down.
Las opciones de búsqueda pueden introducirse escribiendo en la barra de búsqueda o seleccionando un filtro en el menú desplegable. Hay tres maneras principales de inicializar una búsqueda:
-
Using the built-in filters that are available in the Search bar's drop-down. You can choose any of the following filters: train-set, validate-set, train-validate-set, evaluation-set, deleted, labelled, unlabelled.
Nota:Please note that for Forms AI only the following built-in filters are available: deleted, labelled, unlabelled.
-
Using the import batch names. These are also available in the Search bar's drop-down. If added by hand, the format is
batch:name, wherenameis replaced with the name you gave a batch at import time, e.g.batch:invoices1 -
Using keywords. You have to enter the keyword(s) as free text in the Search bar. The search looks for the keyword(s) in a document's content or the document name.
Puedes optar por utilizar una o varias opciones de búsqueda. Cada opción adicional utilizada proporciona una red de búsqueda más específica. A continuación, se muestran algunos ejemplos de búsqueda que comienzan con una búsqueda amplia y progresan lentamente hacia una búsqueda más refinada:
- una búsqueda
labelledmuestra todos los documentoslabelleddel conjunto de datos. - una búsqueda
batch:invoices1muestra todos los documentos que forman parte del loteinvoices1. - iniciar una búsqueda
labelled batch:invoices1devuelve todos los documentos etiquetados que formen parte del loteinvoices1. - una búsqueda
labelled batch:invoices1 vermontmuestra todos los documentos etiquetados del loteinvoices1que contengan la palabra clave introducida, en este casovermont, ya sea en el nombre o en el contenido del documento.
La barra de búsqueda dispone de un menú desplegable que, al abrirse, muestra los siguientes filtros.
- train-set - Indicates the number of documents to be used for training the model. Automated action.
- validate-set - Indicates the number of documents to be used to validate the model after its training is complete. The split between the train and validate set is targeted to be 80%-20%. Automated action.
- train-validate-set - Indicates the number of documents found in both the train-set and validate-set filters. Automated action.
- evaluation-set - Indicates the number of documents that had the evaluation set checkbox checked during import and are intended to be used to evaluate the model in the stage of the training pipeline. More information can be found here. Manual action.
- deleted - Specifies the number of deleted documents. More information can be found here.
- labelled- Specifies the number of docs that have labels. A label is defined by at least one tagged/manually edited field per document.
- unlabelled - Specifies the number of docs that don't have labels.
- batch:name - Specifies the documents that have been comprised in the same import action.
La aplicación asigna un documento a los conjuntos de entrenamiento o de validación en el momento de la importación.
El documento importado termina en el conjunto de evaluación si la casilla de verificación del conjunto de evaluación está marcada durante la importación.
Menú de ajustes
El botón de configuración tiene dos opciones disponibles:
- Settings where you can configure the OCR service or Prelabelling
- Tutorial, que sirve como menú de ayuda.
Para importar documentos en el administrador de documentos, es obligatorio configurar un servicio de OCR.
Las siguientes opciones están disponibles:
Método OCR
Las opciones basadas en la nube son las siguientes:
- UiPath Document OCR - https://du.uipath.com/ocr;
- Google Cloud Vision OCR, que tiene la mejor cobertura lingüística;
- Google Cloud Vision OCR para japonés, óptimo para leer documentos en japonés;
- Microsoft Read OCR.
URL del OCR
La configuración de OCR requiere que el servicio OCR disponga de una URL. Estas son las posibles URL que puedes usar:
- public URLs such as https://du.uipath.com/ocr or third-party URLs from Google Vision OCR or Microsoft Read OCR
Clave OCR
The corresponding API Key for the selected OCR engine. For example, for UiPath Document OCR, you need to use the Document Understanding API Key. Mandatory for Document Manager Cloud and Document Manager On-Prem Online. It is not required for Document Manager On-Prem Air-gapped.
Preetiquetado
Si ya tienes un modelo que puedes extraer algunos campos que necesitan etiquetarse, y solo existen unos cuantos campos adicionales que requieren etiquetado manual, puedes ahorrar mucho tiempo utilizando la función de preetiquetado del administrador de documentos.
Las siguientes opciones están disponibles:
URL de preetiquetado
El preetiquetado requiere que el modelo ML tenga una URL. Estas son las posibles URL que puedes usar:
- public URLs such as https://du.uipath.com/ie/invoices or https://du.uipath.com/ie/purchase_orders
- see the full list of endpoints here
- URL de las habilidades ML que han sido hechas públicas en AI Center local o en AI Center en la nube.
Clave de preetiquetado
The Document Understanding API Key. Mandatory for Document Manager Cloud and Document Manager On-Prem Online. It is not required for Document Manager On-Prem Air-gapped.
Información sobre...
Con la opción Tutorial accedes al menú de ayuda del administrador de documentos.
Aquí puedes encontrar lo siguiente:
- La versión del administrador de documentos
- El enlace Documentación que lleva a esta página de documentación.
- La sección Controles de etiquetado que muestra los controles que se usarán al manejar los datos.
- La sección Atajos de documentos que muestra los accesos directos usados para realizar diversas operaciones como la navegación y el escalado de la interfaz de usuario.
- La sección Configuración que muestra los detalles de la configuración de la instancia realizada durante la instalación.
Campos de columna
Los campos de columna tienen las siguientes opciones:
- Crear un campo de columna nuevo

- Editar campo

- Expandir/Contraer los valores de campo de columna

For more details on column fields, visit this section.
Campos regulares
Los campos regulares tienen las siguientes opciones:
- Crear un campo regular nuevo

- Editar campo

For more details on regular fields, visit this section.
Campos de clasificación
Los campos de clasificación tienen las siguientes opciones:
- Crear un campo de clasificación nuevo

- Editar campo

For more details on classification fields, visit this section.
Vista de documentos
En el caso de los documentos de varias páginas, puedes desplazarte de forma natural por las páginas como en cualquier visor de PDF. Para ampliar o reducir la imagen, pulsa Ctrl a la vez que desplazas el ratón.
Puedes etiquetar los documentos seleccionando los recuadros de palabras y asignándolas a un campo con una tecla. También puedes hacer clic con el botón derecho en el recuadro de palabras y verificar la información extraída.
For more details on how to label documents, visit this page.
Cuando se abre una nueva sesión del administrador de documentos o cuando se tiene un filtro vacío, se muestran ciertas directrices en la vista del documento:
Además, los fallos de carga también se muestran en la vista de documentos:
