UiPath Documentation
document-understanding
2020.10
false
Guía del usuario de Document Understanding
Importante :
La localización de contenidos recién publicados puede tardar entre una y dos semanas en estar disponible.

Importar documentos

AI Center does not support filenames containing special characters, so we strongly recommend that before importing documents to Data Manager, you make sure that their names contain only Latin characters, numbers, dash (-) and underscore (_).

Hay cuatro tipos de Importar admitidos en Data Manager:

  • Importación de esquema
  • Importación de documentos sin formato
  • Importación del conjunto de datos de Data Manager
  • Importación de conjunto de datos del Entrenador del extractor con aprendizaje automático (característica de VISTA PREVIA)

Importación de esquema

Si te gustaría lanzar una nueva instancia de Data Manager utilizando el mismo esquema que en una instancia existente, puedes seguir estos pasos:

  1. Introduce una cadena aleatoria en el filtro de la instancia existente, de forma que no quede ningún documento en la vista.
  2. Haz clic en el botón Exportar. Se exportará un archivo zip.
  3. Importa el archivo zip directamente en la nueva instancia de Data Manager (no lo descomprimas). El esquema se importará.

También puedes utilizar uno de los esquemas predefinidos que se proporcionan en la sección Configurar Data Manager de esta documentación.

Importación de documentos sin formato

Los tipos de documentos que se pueden ser importados para el etiquetado son .pdf, .tiff, .png y .jpg. Los pasos son:

  1. Click Import. The Import Data window is displayed.

  2. Provide a batch name in the Batch Name field. This enables you to easily filter and find these documents using the Filter drop-down later on.

  3. If you want to use this document batch for training an ML model, leave the Make this a test set checkbox unselected.

  4. If you want to use this document batch for evaluating an ML model (i.e. measuring its performance), select the Make this a test set checkbox. This ensures the data is ignored by the training pipelines.

  5. Carga o arrastra un archivo o conjunto de archivos en la sección Examinar o soltar archivos.

    Se acepta cualquier tipo de archivo. La aplicación los inspecciona e indica cuántos de ellos se pueden importar. También se aceptan archivos .zip. La aplicación descomprime el archivo y recorre las carpetas de manera recurrente para encontrar todos los archivos que contiene.

    Importing a dataset zip file exported from another Data Manager instance will import the documents with the labels. This works only if the dataset schema is the same or is a subset of the pre-existing schema in the Data Manager.

Importación del conjunto de datos de Data Manager

To import a dataset that was labelled previously on another instance of Data Manager, you need to get the zip file which was exported originally, and import it directly into the new Data Manager instance. If your new Data Manager instance is completely empty (no data and no fields defined) then both the data and the schema will be imported. If your new Data Manager instance already has fields defined, then the newly imported dataset needs to have the same fields, or a subset of those fields. Otherwise the import will be rejected.

Importación de conjuntos de datos de la estación de validación (característica de vista previa)

A medida que tu flujo de trabajo RPA procesa los documentos usando un modelo ML existente, algunos documentos pueden requerir de validación humana mediante la actividad Estación de validación (disponible en los robots attended o en el navegador que usa el Action Center de Orchestrator).

The validated data generated in Validation Station can be exported using Machine Learning Extractor Trainer activity and can be used to train ML models using the feature described here.

Los pasos que hay que realizar son los siguientes:

  1. Configura el Entrenador del extractor con aprendizaje automático para que los datos salgan en una carpeta con ruta <Trainer/Output/Folder> (usa cualquier ruta de carpeta vacía).
  2. Ejecuta el flujo de trabajo RPA, incluyendo la Estación de validación y el Entrenador del extractor ML.
  3. El Entrenador del extractor con aprendizaje automático creará 3 subcarpetas denominadas: documentos, metadatos y predicciones en la carpeta de salida.
  4. Comprime <Trainer/Output/Folder> para obtener un archivo zip como, por ejemplo, TrainerOutputFolder.zip.
  5. Importa el archivo zip en Data Manager. Data Manager detectará que la importación contiene datos generados por el Entrenador del extractor con aprendizaje automático e importará los datos en consecuencia.
  6. Exporta los datos como siempre y cárgalos en AI Center.
  7. Inicia el Proceso de entrenamiento o el Proceso completo y asegúrate de seleccionar el Paquete ML y la versión que deseas ajustar.

¿Te ha resultado útil esta página?

Conectar

¿Necesita ayuda? Soporte

¿Quiere aprender? UiPath Academy

¿Tiene alguna pregunta? Foro de UiPath

Manténgase actualizado