Document Understanding
2022.10
False
Imagen de fondo del banner
Guía del usuario de Document Understanding
Última actualización 19 de abr. de 2024

Importar documentos

El cuadro de diálogo Importar datos permite importar fácilmente nuevos documentos para etiquetar o revisar.

Haz clic en el botón Importar de la barra de gestión.

El cuadro de diálogo contiene los siguientes controles:

  • Campo de texto Nombre del lote: es obligatorio introducir un nombre para tu exportación, de lo contrario la sección Examinar o soltar archivos se desactiva; un nombre válido puede tener hasta 24 caracteres y no debe contener caracteres especiales.
  • Casilla Haz de este un conjunto de evaluación: cuando se selecciona, el conjunto de datos se utiliza con fines de evaluación.
  • Casilla Habilitar documentos grandes: si está seleccionada, puedes cargar documentos de más de 150 páginas.
  • Sección Examinar o soltar archivos: haz clic en Examinar los archivos para subirlos para navegar por tu directorio o simplemente arrastra los archivos dentro del marco.
  • Sección Estado: haz clic en (cargar el registro de importación anterior) para comprobar el estado de la última importación; cuando cargues datos, en la sección de estado recibirás un resumen de tus archivos y se te pedirá que continúes con la importación haciendo clic en o que abortes la importación haciendo clic en CANCELAR.


    Importante:

    La versión 2021.10 del administrador de documentos admite el etiquetado de documentos de varias páginas. Se trata de un cambio importante con respecto a las versiones anteriores, en las que cada página se etiquetaba por separado. El etiquetado y la exportación de documentos de varias páginas supone que cada documento representa un único documento lógico. Por ejemplo, un documento de seis páginas puede contener una única factura de seis páginas, pero no debe contener tres facturas diferentes de dos páginas cada una. Esto es especialmente importante para los conjuntos de evaluación.

    Este requisito no es pertinente para exportaciones retrocompatibles.

Tipos de importación

Hay 4 tipos de importación compatibles en el administrador de documentos:

Importación de esquema

Si deseas iniciar una nueva sesión del administrador de documentos con el mismo esquema que en una sesión existente, puedes seguir estos pasos:

  1. Haz clic en el botón Exportar docs image en la barra de gestión.
  2. En el cuadro de diálogo Exportar archivos, marca la opción Esquema.
  3. Haz clic en el botón Exportar dentro del cuadro de diálogo. Se exporta un archivo .zip.
  4. Haz clic en el botón Importar docs image de la barra de gestión.
  5. Carga o arrastra el archivo .zip directamente en la nueva sesión del administrador de documentos (no lo descomprimas). En este paso, también puedes cargar un .
  6. Haz clic en en la sección Estado para proceder a la importación. El esquema se importa.

También puedes utilizar uno de los esquemas predefinidos que se proporcionan en la página.

La importación de esquemas también puede aplicarse a campos con varios valores.

Importante: Ten en cuenta que los campos multivaluados solo son compatibles con los modelos con la versión 2022.10 o superior.

Importación de documentos sin formato

Los tipos de documentos que se pueden importar para el etiquetado son .pdf, .tiff, .png y .jpg.
.zip files are not supported for raw documents import.

Los ajustes de OCR deben configurarse antes de la importación.

Sigue estos pasos:

  1. Haz clic en el botón Importar docs image. Se muestra el cuadro de diálogo Importar datos.
  2. Indica un nombre de lote en el campo Nombre del lote. Esto te permite filtrar y encontrar fácilmente estos documentos usando el desplegable Buscar más adelante.
    • Si deseas usar este lote de documentos para el entrenamiento de un modelo ML, deja sin seleccionar la casilla Hacer de esto un conjunto de evaluación.
    • Si deseas usar este lote de documentos para evaluar un modelo ML (por ejemplo, para medir su rendimiento), selecciona la casilla Hacer de esto un conjunto de evaluación. Esto garantiza que los datos sean ignorados por los procesos de entrenamiento.
  3. Si tienes documentos de más de 150 páginas, marca la casilla Habilitar documentos grandes. En caso contrario, deja la casilla sin marcar.
  4. Carga o arrastra un archivo o conjunto de archivos en la sección Examinar o soltar archivos.
  5. Haz clic en . Se importa el archivo o conjunto de archivos.


Importación de conjuntos de datos del administrador de documentos

Para importar un conjunto de datos que fue etiquetado previamente en otra sesión del administrador de documentos, es necesario obtener el archivo .zip que fue exportado originalmente, e importarlo directamente en la nueva instancia del administrador de documentos.

Si tu nueva instancia del administrador de documentos está completamente vacía (sin datos ni campos definidos), se importan tanto los documentos con etiquetas como el esquema.

Si tu nueva instancia del administrador de documentos ya tiene campos definidos, el nuevo conjunto de datos importado debe tener los mismos campos, o un subconjunto de esos campos. En caso contrario, se rechaza la importación.

Dividir grandes conjuntos de datos

Para importar conjuntos de datos del administrador de documentos de más de 1 GB o que tengan más de 1500 archivos, te recomendamos que uses este script que divide los archivos .zip en múltiples archivos .zip de menos de 1 GB y que tengan menos de 1500 archivos.

Importación del conjunto de datos de la estación de validación

A medida que tu flujo de trabajo RPA procesa los documentos usando un modelo ML existente, algunos documentos pueden requerir de validación humana mediante la actividad Estación de validación (disponible en los robots attended o en el navegador que usa el Action Center de Orchestrator).

Los datos validados generados en la Estación de validación se pueden exportar usando la actividad Entrenador de extractor con aprendizaje automático y se pueden usar para entrenar modelos ML con la característica descrita a continuación.

Nota: para la importación del conjunto de datos de la Estación de validación es obligatorio disponer de un esquema definido.

Sigue estos pasos:

  1. Configura el entrenador de extractor con aprendizaje automático para que los datos salgan en una carpeta con ruta <Trainer/Output/Folder> (usa cualquier ruta de carpeta vacía).
  2. Ejecuta un flujo de trabajo de RPA que incluya la estación de validación y el entrenador de extractor con aprendizaje automático.
  3. El entrenador de extractor con aprendizaje automático crea tres subcarpetas: documentos, metadatos y predicciones dentro de la carpeta de salida.
  4. Comprime <Trainer/Output/Folder> para obtener un archivo .zip, por ejemplo TrainerOutputFolder.zip.
  5. Importa el archivo .zip en el administrador de documentos, que detecta que la importación contiene datos producidos por el entrenador de extractor con aprendizaje automático e importa los datos en consecuencia.

Si faltan campos requeridos por el conjunto de datos, se muestra un mensaje de error en el cuadro de diálogo de importación.



Was this page helpful?

Obtén la ayuda que necesitas
RPA para el aprendizaje - Cursos de automatización
Foro de la comunidad UiPath
Logotipo blanco de UiPath
Confianza y seguridad
© 2005-2024 UiPath. All rights reserved.