- Información general
- Proceso de Document Understanding
- Tutoriales de inicio rápido
- Componentes de marco
- Resumen de la clasificación de documentos
- Asistente para Configurar clasificadores de Clasificar ámbito de documento
- Clasificador basado en palabras clave
- Clasificador inteligente de palabra clave
- Clasificador de CapturaFlexible
- Clasificador de aprendizaje automático
- Actividades relacionadas con la clasificación de documentos
- Consumo de datos
- Paquetes ML
- Procesos
- Administrador de documentos
- Servicios de OCR
- Document Understanding implementado en Automation Suite
- Instalar y utilizar
- Primera experiencia de ejecución
- Implementar UiPathDocumentOCR
- Implementar un paquete ML listo para usar
- Paquetes sin conexión 2022.10.0
- Paquetes sin conexión 2022.10.2
- Paquetes sin conexión 2022.10.4
- Paquetes sin conexión 2022.10.6
- Paquetes sin conexión 2022.10.8
- Paquetes sin conexión 2022.10.9
- Paquetes sin conexión 2022.10.10
- Paquetes sin conexión 2022.10.11
- Paquetes sin conexión 2022.10.12
- Paquetes sin conexión 2022.10.13
- Paquetes sin conexión 2022.10.14
- Paquetes sin conexión 2022.10.14+patch1
- Paquetes sin conexión 2022.10.15
- Utiliza Document Manager
- Utilizar el marco
- Document Understanding implementado en AI Center independiente
- Aprendizaje profundo
- Licencia
- Referencias
- Actividades.DeUipath
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
Esta sección incluye información general y técnica sobre el componente de digitalización.
Qué es digitalización
La digitalización es el proceso de obtener un texto legible por la máquina a partir de un archivo determinado entrante, de modo que un robot pueda comprender su contenido y actuar en consecuencia. Es el primer paso que se aplica a los archivos que deben ser procesados a través del marco de Document Understanding.
El paso de digitalización tiene dos salidas:
- el texto del archivo procesado, almacenado en una variable de string, y
- el modelo de objeto de documento de ese archivo: objeto JSON que contiene información básica como el nombre, el tipo de contenido, la longitud del texto, el número de páginas, así como información detallada como la rotación de la página, el idioma detectado, el contenido y las coordenadas de cada palabra identificada en el archivo.
En el marco de procesamiento de documentos, la digitalización se realiza utilizando la actividad Digitalizar documento .
Cuándo se usa el OCR en la digitalización
La actividad Digitalizar documento requiere, como parte de su configuración, la selección de un motor de OCR para que, en caso de necesidad, se pueda utilizar; pero solo ejecuta el OCR en
- archivos que sean imágenes
- los formatos de imágenes admitidos son .png, .gif, .jpe, .jpg, .jpeg, .tiff, .tif, .bmp
- en los archivos TIFF de varias páginas, el OCR se aplica a cada página
- páginas en PDF que
- no exponen ningún contenido legible por máquina
- contienen imágenes que cubren un área significativa de la página.
El OCR también se aplica, siempre, si la actividad Digitalizar documento está configurada con el indicador ForzarAplicaciónOCR establecido como Verdadero. Esta opción suele recomendarse para casos de uso en los que un porcentaje significativo de archivos parece tener contenido nativo, pero el contenido leído de forma nativa no se corresponde con lo que un usuario puede ver en esos archivos.
Cómo elegir el motor de OCR
As each use case has its own particularities, it is strongly recommended to test all available OCR Engines with different settings, to determine which one works best for your project. Another recommendation is to pay particular attention to the OCR engine arguments, such as Profile,Scale,Language etc. (may vary from one engine to another), so that you identify the best settings for each use case.
Qué no es digitalización
Aunque esté relacionado, el paso de digitalización no es OCR.
En muchos casos, los archivos que hay que procesar son archivos PDF nativos (no escaneados), que el robot puede leer de forma programada sin aplicar el OCR.