UiPath Documentation
document-understanding
2022.4
false
Guía del usuario de Document Understanding
Importante :
La localización de contenidos recién publicados puede tardar entre una y dos semanas en estar disponible.

Crear y configurar campos

Fields cannot be renamed, so please think carefully before naming a field. If, however, there are fields that you later decide you do not want to use for training an ML model, you can either delete them or you can always hide them using the Hidden checkbox in the Edit field window.

Nota:

Se puede crear un máximo de 300 campos.

Campos de columna

La descripción o el precio unitario de un elemento en un documento de factura serían ejemplos de campos de columna.

Crear un campo de columna nuevo

  1. Clic Imagen de documentos en la sección de la tabla en la parte superior de la página para añadir un nuevo campo Columna. Se mostrará la ventana Crear campo de columna .
  2. Introduce un nombre único para el campo en Introducir nombre único del campo. El campo no acepta mayúsculas. Solo puede contener letras minúsculas, números, guiones bajos _ y guion -.
  3. Click Create. The Edit Field window is displayed.
  4. En el desplegable Tipo de contenido, selecciona el tipo de contenido.
  5. From the Scoring drop-down, select the measure used to determine accuracy when running evaluations of model predictions.
  6. Haz clic en el campo Tecla de acceso rápido y pulsa una tecla de tu teclado para rellenarlo automáticamente.
  7. Introduce el código hexadecimal del color del campo deseado en el campo Color.
  8. Selecciona la casilla Dividir elementos si deseas que este campo se use como delimitador entre los elementos o filas de una tabla. En cualquier línea en la que aparezca este campo, se considera que hay un elemento de línea o fila nueva en la tabla. Normalmente, esto se utiliza en campos de Cantidad de línea en elementos de línea de Factura.
  9. Selecciona la casilla Oculto si no deseas que este campo forme parte de los conjuntos de datos exportados.
  10. Haz clic en Guardar para guardar la configuración.

Editar un campo de columnas

Haz clic en el campo EditarImagen de documentos botón. Las opciones disponibles para los campos de columna se pueden encontrar en la siguiente tabla.

Opción Descripción

Tipo de contenido

El tipo de contenido de un campo:

  • string: appropriate for company names or addresses, as well as payment terms, or for any other field where the RPA developer prefers to build the parsing or formatting logic manually, in the RPA workflow.
  • number: appropriate for amounts or quantities, with intelligent parsing of the decimal/thousands separators.
  • date: the model parses, formats and unifies the output in a yyyy-mm-dd format.
  • ** teléfono**: apropiado para los números de teléfono. El formato elimina las letras y los paréntesis, y reemplaza los espacios por guiones.
  • id-no: appropriate for alphanumeric codes, numbers of IDs, it is similar to the string content type, but includes cleaning of any characters coming before a colon :. If the id number you need to extract might contain colon : characters, please use string as content type instead to avoid data loss.

Atajo

La tecla de acceso directo al campo. Se permiten una o dos claves.

Color

El color del campo en formato hexadecimal. Si el valor no es válido, se genera uno nuevo.

Puntuación

La medida usada para determinar la precisión al ejecutar evaluaciones de los modelos de predicción. Solo se puede configurar para el tipo de contenido string. Todos los demás tipos de contenido usan una estrategia de puntuación de coincidencia exacta. Opciones:

  • exact match: a prediction is only deemed to be correct (score of 1) if it exactly matches the true value. If it differs by even a single character, then it is deemed to be incorrect (score of 0).
  • levenshtein: a prediction is deemed to be partially correct according to the Levenshtein distance between the prediction and the true value. If a 10-letter value is predicted correctly, except for the last 2 characters, then the score of that prediction will be 0.8.

Dividir los elementos

Selecciona esta casilla si deseas que este campo se use como delimitador entre elementos o filas de una tabla. En cualquier línea en la que aparezca este campo, se considera que hay un elemento de línea o fila nueva en la tabla. Normalmente, esto se utiliza en campos de Cantidad de línea en elementos de línea de Factura.

Oculto

Selecciona esta casilla si no deseas que este campo forme parte de los conjuntos de datos exportados.

Eliminar un campo de columnas

Para eliminar un campo de columnas, sigue estos pasos:

  1. Haz clic en el campo EditarImagen de documentos correspondiente al campo de la columna que desea eliminar.

  2. Haz clic en el botón Eliminar.

  3. Escribe el nombre exacto del campo.

  4. Haz clic en Aceptar.

  5. El campo de la columna y sus datos etiquetados asociados se eliminan.

Campos regulares

Son campos que solo aparecen una vez en un documento determinado. El Número de factura o Importe total de un elemento de línea en un documento de factura serían ejemplos de campos de columna.

Crear un campo regular nuevo

  1. Click Imagen de documentos on the right pane in the Regular Fields section. The Create Regular Field window is displayed.
  2. Introduce un nombre único para el campo en Introducir nombre único del campo. El campo no acepta mayúsculas. Solo puede contener letras minúsculas, números, guiones bajos _ y guion -.
  3. Click Create. The Edit Field window is displayed.
  4. Select the content type from the Content Type drop-down.
  5. Select the post processing mechanism in case the model predicts more than one instance of a field on a given page from the Post processing drop-down.
  6. Haz clic en el campo Tecla de acceso rápido y pulsa una tecla de tu teclado para rellenarlo automáticamente.
  7. In the Color field, fill in the hex code of the desired field color o
  8. From the Multi page drop-down, select the data retrieval strategy. This option is used in case that fields appear on a few different pages of a multi-page document. This option defines how the model decides which one to return.
  9. From the Scoring drop-down, select the measure used to determine accuracy when running evaluations of model predictions.
  10. Selecciona la casilla Multilínea si el campo que se va a comprobar puede abarcar varias líneas de texto, como direcciones o descripciones. Si no se selecciona esta opción, solo se devuelve la primera línea.
  11. Selecciona la casilla Oculto si no deseas que este campo forme parte de los conjuntos de datos exportados.
  12. Haz clic en Guardar para guardar la configuración.

Editar un campo regular

Haz clic en el campo EditarImagen de documentos botón. Las opciones disponibles para los campos regulares se pueden encontrar en la siguiente tabla.

Opción Descripción

Tipo de contenido

El tipo de contenido de un campo:

  • string: appropriate for company names or addresses, as well as payment terms, or for any other field where the RPA developer prefers to build the parsing or formatting logic manually, in the RPA workflow.
  • number: appropriate for amounts or quantities, with intelligent parsing of the decimal/thousands separators.
  • date: the model parses, formats and unifies the output in a yyyy-mm-dd format.
  • ** teléfono**: apropiado para los números de teléfono. El formato elimina las letras y los paréntesis, y reemplaza los espacios por guiones.
  • id-no: appropriate for alphanumeric codes, numbers of IDs, it is similar to the string content type, but includes cleaning of any characters coming before a colon :. If the id number you need to extract might contain colon : characters, please use string as content type instead to avoid data loss.

Posprocesamiento

El mecanismo de posprocesamiento. Si el modelo predice más de una instancia de un campo en una página determinada, el modelo regresa:

  • highest_confidence: the value with the highest confidence.
  • first_span: the first value.
  • largest_value: the largest numeric value. This is only displayed for number content type and is appropriate for Total Amount fields.
  • longest_value: the value consisting of the largest number of characters.

Atajo

La tecla de acceso directo al campo. Se permiten una o dos claves.

Color

El color del campo en formato hexadecimal. Si el valor no es válido, se genera uno nuevo.

Multipágina

La estrategia de devolución de datos en caso de que un campo aparezca en diferentes páginas de un documento de varias páginas.

  • highest_confidence - the default choice for string,phone, and number content types.
  • first_occurrence - the default choice for id-no and date content types.
  • última_ocurrencia

    -longest_string

  • cadena_más_corta
  • highest_num_value - only displayed for number content type.
  • lowest_num_value - only displayed for number content type.

Puntuación

La medida usada para determinar la precisión al ejecutar evaluaciones de los modelos de predicción. Solo se puede configurar para el tipo de contenido string. Todos los demás tipos de contenido usan una estrategia de puntuación de coincidencia exacta. Opciones:

  • exact match: a prediction is only deemed to be correct (score of 1) if it exactly matches the true value. If it differs by even a single character, then it is deemed to be incorrect (score of 0).
  • levenshtein: a prediction is deemed to be partially correct according to the Levenshtein distance between the prediction and the true value. If a 10-letter value is predicted correctly, except for the last 2 characters, then the score of that prediction will be 0.8.

Línea múltiple

Selecciona esta casilla para los campos que pueden abarcar varias líneas de texto (direcciones o descripciones); de lo contrario, solo se devuelve la primera línea.

Oculto

Selecciona esta casilla si no deseas que este campo forme parte de los conjuntos de datos exportados.

Borrar un campo regular

Para eliminar un campo regular, sigue estos pasos:

  1. Haz clic en el campo EditarImagen de documentos correspondiente al campo regular que deseas eliminar.

  2. Haz clic en el botón Eliminar.

  3. Escribe el nombre exacto del campo.

  4. Haz clic en Aceptar.

  5. El campo regular y sus datos etiquetados asociados se eliminan.

Campos de clasificación

Puntos de datos que se refieren a un documento en su conjunto. Por ejemplo, el Tipo de gasto de un recibo (comida, hotel, aerolínea, transporte) o la Divisa de una factura (USD, EUR, JPY) serían ejemplos de campos de clasificación.

Crear un campo de clasificación nuevo

  1. Click Imagen de documentos on the right pane in the Classification Fields section. The Create Classification Field window is displayed.
  2. Introduce un nombre único para el campo en Introducir nombre único del campo. El campo no acepta mayúsculas. Solo puede contener letras minúsculas, números, guiones bajos _ y guion -.
  3. Click Create. The Edit Field window is displayed.
  4. En el área de texto, rellena la lista de clases y escribe los nombres como una lista separada por comas.
  5. Haz clic en Guardar para guardar la configuración.

Editar un campo de clasificación

Click the Edit field Imagen de documentos button. Define a list of possible values. Commas must separate values. An optional description of the value may be included after colon : (option 1 : description 1).

Eliminar un campo de clasificación

Para eliminar un campo de clasificación, sigue estos pasos:

  1. Click the Edit fieldImagen de documentos button corresponding to the classification field you want to delete.

  2. Haz clic en el botón Eliminar.

  3. Escribe el nombre exacto del campo.

  4. Haz clic en Aceptar.

  5. El campo de clasificación y sus datos etiquetados asociados se eliminan.

¿Te ha resultado útil esta página?

Conectar

¿Necesita ayuda? Soporte

¿Quiere aprender? UiPath Academy

¿Tiene alguna pregunta? Foro de UiPath

Manténgase actualizado