- Información general
- Primeros pasos
- Crear modelos
- Consumir modelos
- Detalles del modelo
- Puntos finales públicos
- 1040: tipo de documento
- 1040 Anexo C: tipo de documento
- 1040 Anexo D: tipo de documento
- 1040 Anexo E: tipo de documento
- 1040x: tipo de documento
- 3949a: tipo de documento
- 4506T: tipo de documento
- 709: tipo de documento
- 941x: tipo de documento
- 9465: tipo de documento
- ACORD125: tipo de documento
- ACORD126: tipo de documento
- ACORD131: tipo de documento
- ACORD140: tipo de documento
- ACORD25: tipo de documento
- Estados de cuenta bancarios: tipo de documento
- Facturas de carga: tipo de documento
- Certificado de incorporación: tipo de documento
- Certificado de origen: tipo de documento
- Comprobaciones: tipo de documento
- Certificado de producto secundario: tipo de documento
- CMS 1500: tipo de documento
- Declaración de conformidad de la UE: tipo de documento
- Estados financieros: tipo de documento
- FM1003: tipo de documento
- I9: tipo de documento
- Tarjetas de identificación: tipo de documento
- Facturas: tipo de documento
- Facturas2: tipo de documento
- Facturas Australia: tipo de documento
- Facturas China: tipo de documento
- Facturas Hebreo: tipo de documento
- Facturas India: tipo de documento
- Facturas Japón: tipo de documento
- Remisión de facturas: tipo de documento
- Listas de embalaje: tipo de documento
- Nóminas: tipo de documento
- Pasaportes: tipo de documento
- Órdenes de compra: tipo de documento
- Recibos: tipo de documento
- Recibos2: tipo de documento
- Recibos Japón: tipo de documento
- Notificaciones de remesas: tipo de documento
- UB04: tipo de documento
- Divulgación de cierre de hipotecas en EE. UU.: tipo de documento
- Facturas de servicios públicos: tipo de documento
- Títulos de vehículos: tipo de documento
- W2: tipo de documento
- W9: tipo de documento
- Idiomas admitidos
- Paneles de insights
- Document Understanding implementado en Automation Suite
- Datos y seguridad
- Registro
- Licencia
- Tutorial
- Solución de problemas

Guía del usuario de proyectos modernos de Document Understanding
The DocPath large language model (LLM) is our latest data extraction model technology, designed to replace current generation models used within UiPath® Document UnderstandingTM. While DocPath operates similarly to previous models, it was trained using a wide variety of documents. This enables it to process common document types with little to no training needed. What sets DocPath LLM apart is its generative architecture, which significantly improves accuracy and simplifies extraction. Additionally, you can also fine-tune the model with your unique datasets.
To gain further insights into the DocPath architecture and the techniques used for training, check the DocPath page from our AI blog.
Currently, UiPath DocPath is only available for US-based tenants (excluding GxP and Government Cloud) in Document Understanding modern projects.
- Public endpoints for extraction models in Europe are based on DocPath, except for Financial Statements.
- The following public endpoints for extraction models are based on DocPath in the Japan region:
- Facturas China
- Facturas Japón
- Recibos de Japón
DocPath LLM offers numerous enhancements over previous models. It improves accuracy, especially with tables, adapts to various document layouts to reduce annotation efforts, and boosts automation rates.
- Improved accuracy: DocPath LLM delivers a higher accuracy rate and superior F1 score for semi-structured documents such as invoices, receipts, and purchase orders. This ensures precise and consistent data extraction.
- Anotación sin esfuerzo: el modelo reduce el trabajo manual al requerir solo una anotación por documento, eliminando la necesidad de anotar cada instancia de campo en cada página.
- Enhanced automation: With a greater correlation between confidence level and accuracy, DocPath LLM enhances automation rates while reducing the number of documents sent to Action Center for the same accuracy level.
From our internal tests, DocPath outperformed its predecessor in performance. It reduced the false positive rate by around 15%, and the false negative rate dropped by nearly 17%.
The DocPath LLM is available exclusively for Document Understanding modern projects. Despite the introduction of DocPath, all existing project versions will still use current model versions. This ensures a seamless transition without any disruption to ongoing production workflows.
To start training an exisiting document type on DocPath, unconfirm and confirm all fields in a few documents.
Los nombres de campo que elijas pueden afectar en gran medida al rendimiento del modelo. Para garantizar resultados óptimos, utiliza el lenguaje natural y la gramática adecuada para los nombres de campo. Solo debes utilizar acrónimos ampliamente reconocidos como Número (No), Cuenta (Acct), Dirección (Addr) y Apartamento (Apt). Actualmente, solo se admiten idiomas de Europa occidental, así que asegúrate de que los nombres de campo elegidos se alineen con estos idiomas. Evita utilizar nombres no descriptivos, como "Columna 3", a menos que el documento utilice específicamente esa terminología.
UiPath DocPath currently supports only Latin script languages. If you need to train a model in non-Latin script languages, choose the legacy model type. If the legacy model is selected, choose the appropriate base model for your document type.
To choose between DocPath or legacy model type, navigate to the Settings tab in Document Type Manager and select the needed model type from the Model type drop-down list.
- Los campos extraídos deben coincidir exactamente con el texto de los documentos. Este proceso no incluye resumir u otros tipos de análisis de texto.
- The following document types are not currently based on DocPath and still work on the previous generation:
- Estados financieros
- Facturas China
- Facturas en hebreo
- Facturas Japón
El tipo de documento se entrenará utilizando el modelo heredado.
UiPath DocPath does not currently support non-Latin script languages.