- Información general
- Contratos de procesamiento de documentos
- Notas relacionadas
- Acerca de los contratos de procesamiento de documento
- Clase Cuadro
- Interfaz IPersistedActivity
- Clase PrettyBoxConverter
- Interfaz IClassifierActivity
- Interfaz IClasificadorProveedorDeCapacidades
- Clase ClassifierDocumentType
- Clase ClassifierResult
- ClassifierCodeActivity Class
- ClassifierNativeActivity Class
- ClassifierAsyncCodeActivity Class
- Clase ClasificadorCapacidadDeTipoDeDocumento
- ContentValidationData Class
- EvaluatedBusinessRulesForFieldValue Class
- EvaluatedBusinessRuleDetails Class
- Clase
- Clase
- Clase ExtractorDocumentType
- Clase ExtractorDocumentTypeCapabilities
- Clase ExtractorFieldCapability
- Clase
- Clase ExtractorResult
- FieldValue Class
- FieldValueResult Class
- Interfaz ICapabilitiesProvider
- Interfaz IExtractorActivity
- Clase ExtractorPayload
- Enumeración DocumentActionPriority
- Clase DocumentActionData
- Enumeración DocumentActionStatus
- DocumentActionType Enum
- Clase DocumentClassificationActionData
- Clase DocumentValidationActionData
- Clase UserData
- Clase Documento
- Clase DocumentoDividirResultado
- Clase DomExtensions
- Clase Página
- Clase SecciónDePágina
- Clase de polígono
- Clase PolygonConverter
- Clase de metadatos
- Clase GrupoDeWord
- Clase Word
- Enum FuenteDeProcesamiento
- Clase ResultadosTablaCelda
- Clase ResultadosTablaValor
- Clase ResultadosTablaColumnaInfo
- Clase TablaDeResultados
- Enum Rotación
- Rule Class
- RuleResult Class
- RuleSet Class
- RuleSetResult Class
- Enum TipoDeSección
- Enum TipoDeGrupoDeWord
- Interfaz IDocumentTextProjection
- Clase ResultadoDeClasificación
- Clase ResultadoDeExtracción
- Clase ResultadosDeDocumento
- Clase ResultadosDeLímitesDeDocumento
- Clase ResultadosDePuntoDeDatos
- Clase ResultadosDeValor
- Clase ResultadosDeContenidoDeReferencia
- Clase ResultadosDeValorDeTokens
- Clase ResultadosDeCampoDerivado
- Enum ResultadosDeFuenteDeDatos
- Clase ResultadoDeConstantes
- Clase ValorDeCampoSimple
- Clase ValorDeCampoDeTabla
- Clase GrupoDeDocumento
- Clase TaxonomíaDeDocumento
- Clase TipoDeDocumento
- Clase Campo
- Enum TipoDeCampo
- FieldValueDetails Class
- Clase InformaciónDeLenguaje
- Clase MetadataEntry
- Enumeración de tipo de texto
- Clase TipoDeCampo
- Interfaz de actividad de ITracking
- Interfaz de ITrainableActivity
- Interfaz ITrainableClassifierActivity
- Interfaz ITrainableExtractorActivity
- Clase TrainableClassifierAsyncCodeActivity
- Clase TrainableClassifierCodeActivity
- Clase TrainableClassifierNativeActivity
- Clase TrainableExtractorAsyncCodeActivity
- Clase TrainableExtractorCodeActivity
- Clase TrainableExtractorNativeActivity
- Clase BasicDataPoint
- Clase BasicValue
- Clase ComponentCollectionFacade
- Clase DataPointFacadeBase
- Clase ExtractionResultHandler
- Clase FieldGroupDataPoint
- Clase de valor de grupo de campos
- Clase FieldLookupBase
- Clase de ConfiguraciónDeRedacciónDeCampo
- Clase de RedactionOptions (vista previa)
- Enumeración de tipo de redacción
- Clase ResultsValueFacadeBase
- Clase TableDataPoint
- Clase de FilaDeTabla
- Clase ValorDeTabla
- Clase WildcardDataPoint
- Clase WildcardDataPointCollection
- Document Understanding ML
- Servidor local de OCR de Document Understanding
- Document Understanding
- Notas relacionadas
- Acerca del paquete de actividades Document Understanding
- Compatibilidad de proyectos
- Configurar la conexión externa
- API de automatización codificada de Document Understanding (vista previa)
- Establecer contraseña de PDF
- Fusionar PDF
- Obtener el recuento de páginas del PDF
- Extraer texto en PDF
- Extraer imágenes en PDF
- Extraer rango de página en PDF
- Extraer datos del documento
- Cree una tarea de validación y espere
- Esperar la tarea de validación y continuar
- Crear tarea de validación
- Crear artefactos de validación de documentos
- Recuperar artefactos de validación de documentos
- Clasificar documento
- Crear tarea de validación de clasificación
- Crear tarea de validación de clasificación y esperar
- Esperar la tarea de validación de clasificación y reanudar
- OCRInteligente
- Notas relacionadas
- Acerca del paquete de actividades IntelligentOCR
- Compatibilidad de proyectos
- Cargar taxonomía
- Digitalizar documento
- Clasificar ámbito de documento
- Clasificador basado en palabras clave
- Clasificador de proyectos de Document Understanding
- Clasificador inteligente de palabra clave
- Crear acción de clasificación de documentos
- Crear artefactos de validación de documentos
- Recuperar artefactos de validación de documentos
- Esperar la acción de clasificación de documentos y reanudar
- Entrenar el alcance de los clasificadores
- Entrenador del clasificador basado en palabras clave
- Entrenador del clasificador inteligente de palabra clave
- Alcance de la extracción de información
- Extractor de proyectos de Document Understanding
- Entrenador del extractor de proyectos de Document Understanding
- Extractor basado en regex
- Extractor de forma
- Extractor inteligente de formularios
- Redactar documento
- Crear acción de validación de documentos
- Esperar la acción de validación de documentos y reanudar
- Entrenar el alcance de los Extractores
- Exportar resultados de extracción
- Extractor con aprendizaje automático
- Entrenador de extractor con aprendizaje automático
- Clasificador de aprendizaje automático
- Entrenador del clasificador de aprendizaje automático
- Clasificador generativo
- Extractor generativo
- Configurar autenticación
- Validar documentos con acciones de la aplicación
- Validación manual para digitalizar documentos
- Extracción de datos basada en anclajes utilizando el extractor inteligente de formularios
- Estación de validación
- Actividades generativas: buenas prácticas
- Extractor generativo: buenas prácticas
- Clasificador generativo: buenas prácticas
- Servicios ML
- OCR
- Contratos OCR
- Notas relacionadas
- Acerca de los contratos OCR
- Compatibilidad de proyectos
- IOCRActivity Interface
- OCRAsyncCodeActivity Class
- OCRCodeActivity Class
- OCRNativeActivity Class
- Clase Carácter
- Clase OCRResult
- Clase Word
- FontStyles Enum
- OCRRotation Enum
- Clase OCRCapabilities
- OCRScrapeBase Class
- OCRScrapeFactory Class
- ScrapeControlBase Class
- Enum ScrapeEngineUsages
- ExtraerBaseDelEctor
- Clase ScrapeEngineFactory
- Clase ExtraerEngineProvider
- OmniPage
- PDF
- Notas relacionadas
- Acerca del paquete de actividades de PDF
- Compatibilidad de proyectos
- API de automatización codificadas en PDF (vista previa)
- Convertir correo electrónico a PDF (vista previa)
- Convertir HTML a PDF (vista previa)
- Convertir texto a PDF (vista previa)
- Exportar página en PDF como imagen
- Extraer archivos adjuntos de PDF
- Extraer imágenes de PDF
- Extraer rango de página en PDF
- Obtener el recuento de páginas del PDF
- Unir archivos PDF
- Administrar contraseña de PDF
- Leer texto en PDF
- Leer PDF con OCR
- Leer texto en XPS
- Leer XPS con OCR
- [No en la lista] Abbyy
- [No en la lista] Abbyy incrustado
API de automatización codificadas para el paquete de actividades de Document Understanding, que cubren la clasificación de documentos, la extracción de datos y los artefactos de validación.
UiPath.DocumentUnderstanding.Activities
API de flujo de trabajo codificado para clasificar documentos, extraer datos estructurados y crear y recuperar artefactos de validación de documentos. Estas API están disponibles al diseñar automatizaciones codificadas. Para obtener una introducción a las automatizaciones codificadas y cómo diseñarlas utilizando API, consulta Automatizaciones codificadas.
- Descriptor de acceso de servicio:
du(tipoIDocumentUnderstandingService) - Paquete requerido:
"UiPath.DocumentUnderstanding.Activities": "*"en las dependenciasproject.json.
Espacios de nombres importados automáticamente
Los siguientes espacios de nombres están disponibles automáticamente en los flujos de trabajo codificados cuando se instala el paquete Document Understanding:
UiPath.DocumentUnderstanding.Activities.ApiUiPath.Platform.ResourceHandlingUiPath.DocumentProcessing.Contracts.ActionsUiPath.IntelligentOCR.StudioWeb.Activities.DataExtractionUiPath.IntelligentOCR.StudioWeb.Activities.DocumentClassification
Descripción general del servicio
El servicio du expone cada operación de Document Understanding como una llamada de método directo. No hay conexión ni ámbito que abrir. Llamar a métodos en el descriptor de acceso de servicio directamente:
var extracted = du.ExtractDocumentData(@"C:\invoices\invoice.pdf", "Invoices", "Production", "invoice");
var extracted = du.ExtractDocumentData(@"C:\invoices\invoice.pdf", "Invoices", "Production", "invoice");
El servicio refleja las actividades Clasificar documento, Extraer datos de documento, Crear artefactos de validación de documentos y Recuperar artefactos de validación de documentos de Studio Web.
Versión o etiqueta del proyecto
El parámetro projectVersionOrTag se asigna al menú desplegable Versión única de Studio. Pasa un nombre de versión (por ejemplo, v3) o una etiqueta (por ejemplo, Production, Staging, live). El runtime resuelve el tipo que coincida con el proyecto. Para el proyecto predefinido, utiliza Production.
Parámetros comunes
timeoutMs(Int): tiempo de espera en milisegundos para la clasificación y extracción. El valor predeterminado es3600000(1 hora).docType(String): el ID del tipo de documento. Pasa el nombre del tipo de documento para proyectos con varios tipos de documentos, o una cadena vacía para proyectos de estilo IXP que tienen un solo extractor por versión.
Clasificación
DocumentData ClassifyDocument(string documentPath, string projectName, string projectVersionOrTag, int timeoutMs = 3600000)
Clasifica un documento de una ruta de archivo local en comparación con un proyecto de Document Understanding. Devuelve un objeto DatosDeDocumento , incluido el tipo de documento predicho.
DocumentData ClassifyDocument(IResource file, string projectName, string projectVersionOrTag, int timeoutMs = 3600000)
Clasifica el recurso de documento proporcionado. Acepta cualquier IResource, como la salida de la actividad Ruta existente u Obtener archivo o carpeta local .
Extracción de información
IDocumentData<DictionaryData> ExtractDocumentData(string documentPath, string projectName, string projectVersionOrTag, string docType, int timeoutMs = 3600000)
Extrae datos estructurados de un documento en una ruta de archivo local. Devuelve los campos extraídos como IDocumentData<DictionaryData>.
IDocumentData<DictionaryData> ExtractDocumentData(IResource file, string projectName, string projectVersionOrTag, string docType, int timeoutMs = 3600000)
Extrae datos estructurados del recurso de documento proporcionado.
IDocumentData<DictionaryData> ExtractDocumentData(DocumentData classifiedDocument, string projectName, string projectVersionOrTag, string docType = null, int timeoutMs = 3600000)
Extrae datos estructurados de un documento ya clasificado con ClassifyDocument, lo que evita volver a digitalizar el archivo. Cuando docType es null, se deriva del tipo de documento del documento clasificado.
Artefactos de validación
ContentValidationData CreateDocumentValidationArtifacts(IDocumentData<DictionaryData> automaticExtractionResults, string orchestratorFolderName, string orchestratorBucketName = null)
Carga los resultados de la extracción en el almacenamiento de Orchestrator y devuelve un identificador ContentValidationData . Utiliza el identificador para crear una acción de validación o para recuperar los resultados más tarde con RetrieveDocumentValidationArtifacts. Cuando orchestratorBucketName es null, se utiliza el depósito predeterminado.
IDocumentData<DictionaryData> RetrieveDocumentValidationArtifacts(ContentValidationData contentValidationData, object completedAppAction = null, bool removeDataFromStorage = false, bool returnAutomaticExtractionResults = false)
Recupera resultados de extracción validados del almacenamiento. Cuando removeDataFromStorage es true, los artefactos de almacenamiento se eliminan después de la recuperación. Cuando returnAutomaticExtractionResults es true, se devuelven los resultados originales de extracción automática en lugar de los validados.
Relación con las actividades
La API codificada y las actividades XAML de Document Understanding se ejecutan en el mismo runtime, por lo que un flujo de trabajo codificado alcanza el mismo comportamiento de clasificación, extracción y artefacto de validación que las actividades Extraer datos del documento y Clasificar documento . La diferencia es la forma de la llamada: el servicio toma rutas de archivo simples o entradas IResource y devuelve objetos de Datos de documento directamente, y utilizas ordinario try/catch en lugar de la opción Continuar en caso de error de la actividad.
Patrones comunes
Clasificar y luego extraer
Este patrón clasifica un documento y luego reutiliza el resultado clasificado para extraer datos, lo que evita digitalizar el archivo por segunda vez.
[Workflow]
public void Execute()
{
var classified = du.ClassifyDocument(@"C:\docs\file.pdf", "MyProject", "Production");
Log($"Document type: {classified.DocumentType.DisplayName}");
// Reuses the classified document, so the file is not digitized again.
var extracted = du.ExtractDocumentData(classified, "MyProject", "Production");
}
[Workflow]
public void Execute()
{
var classified = du.ClassifyDocument(@"C:\docs\file.pdf", "MyProject", "Production");
Log($"Document type: {classified.DocumentType.DisplayName}");
// Reuses the classified document, so the file is not digitized again.
var extracted = du.ExtractDocumentData(classified, "MyProject", "Production");
}
Extraer y preparar datos para las tareas de la aplicación que contienen el control de validación
Este patrón extrae datos, los carga en el almacenamiento como artefactos de validación para su revisión en una tarea de aplicación y recupera los resultados validados después de que se complete la acción.
[Workflow]
public void Execute()
{
var extracted = du.ExtractDocumentData(@"C:\docs\invoice.pdf", "Invoices", "Production", "invoice");
// Upload the results so they can be reviewed in Action Center.
var artifacts = du.CreateDocumentValidationArtifacts(extracted, "Shared");
// After the Action Center validation action completes, retrieve the validated results.
var validated = du.RetrieveDocumentValidationArtifacts(artifacts, removeDataFromStorage: true);
}
[Workflow]
public void Execute()
{
var extracted = du.ExtractDocumentData(@"C:\docs\invoice.pdf", "Invoices", "Production", "invoice");
// Upload the results so they can be reviewed in Action Center.
var artifacts = du.CreateDocumentValidationArtifacts(extracted, "Shared");
// After the Action Center validation action completes, retrieve the validated results.
var validated = du.RetrieveDocumentValidationArtifacts(artifacts, removeDataFromStorage: true);
}
- Espacios de nombres importados automáticamente
- Descripción general del servicio
- Versión o etiqueta del proyecto
- Parámetros comunes
- Clasificación
DocumentData ClassifyDocument(string documentPath, string projectName, string projectVersionOrTag, int timeoutMs = 3600000)DocumentData ClassifyDocument(IResource file, string projectName, string projectVersionOrTag, int timeoutMs = 3600000)- Extracción de información
IDocumentData<DictionaryData> ExtractDocumentData(string documentPath, string projectName, string projectVersionOrTag, string docType, int timeoutMs = 3600000)IDocumentData<DictionaryData> ExtractDocumentData(IResource file, string projectName, string projectVersionOrTag, string docType, int timeoutMs = 3600000)IDocumentData<DictionaryData> ExtractDocumentData(DocumentData classifiedDocument, string projectName, string projectVersionOrTag, string docType = null, int timeoutMs = 3600000)- Artefactos de validación
ContentValidationData CreateDocumentValidationArtifacts(IDocumentData<DictionaryData> automaticExtractionResults, string orchestratorFolderName, string orchestratorBucketName = null)IDocumentData<DictionaryData> RetrieveDocumentValidationArtifacts(ContentValidationData contentValidationData, object completedAppAction = null, bool removeDataFromStorage = false, bool returnAutomaticExtractionResults = false)- Relación con las actividades
- Patrones comunes
- Clasificar y luego extraer
- Extraer y preparar datos para las tareas de la aplicación que contienen el control de validación