- Introducción
- Configuración de su cuenta
- Equilibrio
- Clústeres
- Deriva del concepto
- Cobertura
- Conjuntos de datos
- Campos generales
- Etiquetas (predicciones, niveles de confianza, jerarquía de etiquetas y sentimiento de etiqueta)
- Modelos
- Transmisiones
- Clasificación del modelo
- Proyectos
- Precisión
- Recordar
- Mensajes anotados y no anotados
- Campos extraídos
- Fuentes
- Taxonomías
- Formación
- Predicciones positivas y negativas verdaderas y falsas
- Validación
- Mensajes
- Control y administración de acceso
- Gestionar fuentes y conjuntos de datos
- Comprender la estructura de datos y los permisos
- Crear o eliminar un origen de datos en la GUI
- Preparando datos para cargar archivos .CSV
- Cargar un archivo CSV en un origen
- Cargar un archivo PST
- Crear un conjunto de datos
- Fuentes y conjuntos de datos multilingües
- Habilitar sentimiento en un conjunto de datos
- Modificar la configuración del conjunto de datos
- Eliminar un mensaje
- Eliminar un conjunto de datos
- Exportar un conjunto de datos
- Utilizar integraciones de Exchange
- Etiquetas de transformación de correo electrónico
- Entrenamiento y mantenimiento de modelos
- Comprender las etiquetas, los campos generales y los metadatos
- Jerarquía de etiquetas y mejores prácticas
- Comparar casos de uso de análisis y automatización
- Convertir tus objetivos en etiquetas
- Descripción general del proceso de entrenamiento del modelo
- Anotación generativa
- Estado de Dastaset
- Entrenamiento de modelos y mejores prácticas de anotación
- Entrenamiento con análisis de sentimiento de etiqueta habilitado
- Comprender los requisitos de datos
- Entrenamiento
- Introducción a Refinar
- Explicación de la precisión y la recuperación
- Precisión y recuperación
- Cómo funciona la validación
- Comprender y mejorar el rendimiento del modelo
- Razones para etiquetar una precisión media baja
- Entrenamiento utilizando la etiqueta Comprobar y la etiqueta Perdida
- Entrenamiento mediante la etiqueta de aprendizaje (refinar)
- Entrenamiento mediante Buscar (Refinar)
- Comprender y aumentar la cobertura
- Mejorar el equilibrio y utilizar Reequilibrar
- Cuándo dejar de entrenar tu modelo
- Uso de campos generales
- Extracción generativa
- Uso de análisis y supervisión
- Automations and Communications Mining™
- Desarrollador
- Uso de la API
- Tutorial de la API
- Fuentes
- Conjuntos de datos
- Comentarios
- Archivos adjuntos
- Predictions
- Crear una transmisión
- Actualizar una transmisión
- Obtener una transmisión por nombre
- Obtener todas las transmisiones
- Eliminar una transmisión
- Obtener resultados de la transmisión
- Obtener comentarios de una transmisión (heredado)
- Avanzar una transmisión
- Restablecer una transmisión
- Etiquetar una excepción
- Desetiquetar una excepción
- Eventos de auditoría
- Obtener todos los usuarios
- Cargar datos
- Descargando datos
- Integración de Exchange con el usuario del servicio de Azure
- Integración de Exchange con la autenticación de aplicaciones de Azure
- Integración de Exchange con Azure Application Authentication y Graph
- Guía de migración: servicios web de Exchange (EWS) a la API de Microsoft Graph
- Obtener datos para Tableau con Python
- Integración de Elasticsearch
- Extracción de campos general
- Integración de Exchange autohospedado
- Marco de automatización de UiPath®
- Actividades oficiales de UiPath®
- Cómo aprenden las máquinas a entender palabras: una guía para las incrustaciones en PNL
- Aprendizaje basado en solicitudes con Transformers
- Efficient Transformers II: destilación de conocimientos y ajuste
- Transformadores eficientes I: mecanismos de atención
- Modelado de intenciones jerárquico profundo no supervisado: obtener valor sin datos de entrenamiento
- Corregir el sesgo de anotación con Communications Mining™
- Aprendizaje activo: mejores modelos ML en menos tiempo
- Todo está en los números: evaluar el rendimiento del modelo con métricas
- Por qué es importante la validación del modelo
- Comparación de Communications Mining™ y Google AutoML para la inteligencia de datos conversacional
- Licencia
- Preguntas frecuentes y más
Cargue correos electrónicos históricos en Communications Mining desde un archivo PST exportado desde Exchange, con los requisitos de exportación, las limitaciones conocidas y las resoluciones para errores de carga.
Un archivo PST es una instantánea única, no una transmisión en vivo. Utilice una carga de PST para desbloquear el entrenamiento del modelo o para rellenar los correos electrónicos históricos mientras se configura una integración permanente. Para la ingestión de correo electrónico continua, utiliza la integración de Exchange en su lugar.
Cargas un archivo PST con Communications Mining™ CLI, que analiza los correos electrónicos del archivo y los escribe en un depósito. A continuación, creas un origen a partir de ese depósito y añades el origen a un conjunto de datos.
Cuándo utilizar un archivo PST
| Usar un archivo PST cuando | No utilices un archivo PST cuando |
|---|---|
| Debe desbloquear el entrenamiento del modelo antes de que esté disponible una integración en vivo. | Está pasando a producción. En su lugar, configura la integración de Exchange . |
| Necesitas un relleno histórico de correos electrónicos que la integración en vivo no puede alcanzar, por ejemplo, porque el buzón utiliza un archivo in situ. | Necesitas una ingestión en tiempo real o continua. Un archivo PST captura el buzón en un único momento. |
| Su entorno bloquea la integración de Exchange y necesita datos en la plataforma rápidamente. | Necesitas hilos de conversación completos. Una exportación PST puede omitir mensajes de una conversación. |
Para un relleno histórico, mantén la integración de Exchange habilitada para los nuevos correos electrónicos y utiliza el archivo PST solo para los datos más antiguos. Mantener la sincronización en ejecución durante el entrenamiento proporciona al aprendizaje activo más datos con los que trabajar.
Limitaciones conocidas
Una carga de PST no es una forma fiable de introducir datos en la plataforma, y no sustituye a una integración en vivo. Cada carga de PST pierde algunos datos, así que no esperes que todos los correos electrónicos del archivo lleguen a la plataforma. Cuando tu entorno lo permita, utiliza la integración de Exchange en su lugar.
Se aplican las siguientes limitaciones:
- Los archivos PST exportados desde Outlook no son compatibles. Una exportación de cliente de Outlook elimina los encabezados de transporte que requiere Communications Mining y omite la carpeta Elementos enviados. La CLI puede fallar al analizar un archivo de este tipo por completo. Esta es la causa más común de pérdida de datos a gran escala.
- Los correos electrónicos cuyo único cuerpo es RTF no se cargan. La CLI utiliza el cuerpo HTML cuando hay uno presente y recurre al cuerpo de texto sin formato. Un correo electrónico se suelta solo cuando faltan ambos. La mayoría de los correos de Outlook compuestos por RTF también incluyen una alternativa de texto sin formato y se cargan sin problemas. No hay forma de detectar correos electrónicos solo RTF en un archivo PST antes de ejecutar la carga.
- El contenido del archivo adjunto no se carga. Solo se cargan los metadatos del archivo adjunto: nombre, tamaño y tipo de contenido. El tipo de contenido se infiere de la extensión del archivo en lugar de leerse del archivo PST. Los archivos adjuntos que son en sí mismos correos electrónicos se omiten, por lo que un correo electrónico cuyo único archivo adjunto es un mensaje reenviado no informa de archivos adjuntos.
- Se espera cierta pérdida de datos. Como regla general, calcula aproximadamente el 1 % de los correos electrónicos que fallan. Los resultados reales varían en ambas direcciones, así que ejecuta la carga con
--dry-runprimero y comprueba los contadoresemails failed to parseyfailed to uploadque la CLI imprime al final de cada ejecución. - Los elementos que no son correos electrónicos se cuentan como fallos. La CLI recorre cada carpeta del archivo PST y requiere que cada elemento tenga un encabezado
Message-IDy un encabezadoDate. Los borradores, los elementos del calendario, los contactos y las tareas no tienen ninguno, por lo que se informan como fallos de análisis. Se espera un recuento de fallos distinto de cero. - Los hilos pueden estar incompletos. Un archivo PST no contiene necesariamente todos los mensajes de una conversación.
- Los conjuntos de caracteres distintos de UTF-8 se pueden distorsionar. Los correos electrónicos en japonés (ISO-2022-JP) y chino son los más afectados. El comportamiento depende del tipo de cuerpo:
- Los cuerpos de texto sin formato se convierten utilizando la página de códigos del mensaje. Si la conversión falla, el correo electrónico se descarta y se cuenta como un error de análisis, que
--dry-runinforma. - Los cuerpos HTML se coaccionan a UTF-8, por lo que los bytes que no se pueden decodificar se convierten en caracteres de reemplazo. No se produce ningún error, no se incrementa ningún contador y
--dry-runno lo informa. Comprueba una muestra de correos electrónicos HTML en la plataforma después de la carga.
- Los cuerpos de texto sin formato se convierten utilizando la página de códigos del mensaje. Si la conversión falla, el correo electrónico se descarta y se cuenta como un error de análisis, que
Para rellenar un buzón antes de exportarlo, mueve, copia o redirige los correos electrónicos, por ejemplo, arrastrándolos entre buzones en Outlook. No los reenvíes. Un mensaje reenviado llega con la conversación anterior eliminada del cuerpo, lo que deja solo encabezados y direcciones y no es útil para el entrenamiento.
Exportar el archivo PST
Exporta el archivo PST desde Exchange, no desde Outlook. Un archivo PST exportado desde el cliente de Outlook, a través de Archivo > Abrir y exportar > Importar/Exportar, omite la carpeta Elementos enviados y otras carpetas, y puede producir un archivo que la CLI no puede analizar.
Para obtener una descripción general de las rutas de exportación compatibles, consulta Procedimientos de exportación de buzón.
Microsoft 365 y Exchange Online
Usa Microsoft Purview eDiscovery para buzones en la nube. Para obtener más información, consulta Exportar resultados de búsqueda en eDiscovery.
Prerrequisitos:
- El administrador que ejecuta la exportación tiene el rol de eDiscovery Manager en el portal de Microsoft Purview. Este rol no está asignado de forma predeterminada.
- La organización tiene una licencia E3 o E5.
Steps:
- En el portal de Microsoft Purview, crea o abre un caso de eDiscovery.
- Ejecuta una búsqueda en el ámbito de los buzones de correo de destino. Deje las palabras clave vacías para devolver todo lo que esté en el intervalo de fechas.
- Selecciona Exportar en la búsqueda.
- En Formato de exportación, elige Crear PST para mensajes.
- Incluye el buzón de archivo y los elementos recuperables para exportar el historial completo. Los buzones de correo principal y de archivo se fusionan en un solo archivo PST.
- Establece el tamaño máximo del paquete PST en 1, 2, 5 o 10 GB. Los paquetes más pequeños son más fáciles de transferir.
- Descarga el paquete desde Gestor de procesos.
Los paquetes de exportación caducan a los 14 días. Extrae el paquete con una herramienta de archivado de terceros en lugar de la extracción integrada de Windows, y comprueba los tamaños de archivo después de que se complete la descarga.
Servidor de Exchange Server
Este procedimiento se aplica a Exchange Server 2016, 2019 y Subscription Edition. Para obtener más información, consulta Exportar resultados de búsqueda de eDiscovery a un archivo PST.
Prerrequisitos:
- La máquina de exportación tiene.NET Framework 4.7 y el complemento ClickOnce instalado en Chrome o Firefox.
- La cuenta que ejecuta la exportación no utiliza la autenticación multifactor (MFA). La herramienta de exportación PST de eDiscovery no funciona con cuentas MFA, así que primero crea una contraseña de aplicación para la cuenta.
Steps:
- En el centro de administración de Exchange, ve a Gestión de cumplimiento > eDiscovery y retención de documentos electrónicos local.
- Selecciona la búsqueda y luego selecciona Exportar a un archivo PST.
- En la herramienta de exportación de PST de eDiscovery, elige una ubicación de descarga.
- Opcionalmente, selecciona Habilitar desduplicación para escribir todos los resultados en un solo archivo PST e Incluir elementos no buscables.
- Selecciona Inicio.
Los proxies y cortafuegos corporativos pueden bloquear o acelerar la descarga de exportación. Es posible que los puntos finales de Microsoft involucrados deban añadirse a tu lista de permisos de red.
Cargar el archivo PST
Requisitos previos
- La CLI de Communications Mining está instalada. Para obtener más detalles, consulta CLI.
- Se configura un contexto para tu punto final de Communications Mining. Para obtener más información, consulta Configurar la CLI.
- El archivo PST se exporta desde Exchange, como se describe en la sección anterior.
- Tienes permisos para crear depósitos y orígenes en el proyecto de destino.
La carga de correos electrónicos consume AI Units o Platform Units, por lo que la CLI te solicita que aceptes el cargo antes de que se inicie la carga. Una ejecución en seco no consume nada, pero sigue mostrando la solicitud. Añade --yes para suprimir la solicitud en una ejecución desatendida o con script.
Pasos
-
Crea un depósito para los correos electrónicos. Los nombres de proyectos y depósitos solo aceptan letras, dígitos, guiones y guiones bajos.
re -c <context> create bucket <ProjectName>/<BucketName>re -c <context> create bucket <ProjectName>/<BucketName> -
Comprueba que el archivo PST se analiza antes de consumir cualquier unidad.
re -c <context> parse pst --bucket <ProjectName>/<BucketName> --file <PathToPst> --dry-runre -c <context> parse pst --bucket <ProjectName>/<BucketName> --file <PathToPst> --dry-runEl comando lee todo el archivo e informa de los errores de análisis sin cargar nada. Imprime
No parse errors foundo un desglose de cada error distinto y el número de correos electrónicos afectados. -
Carga el archivo PST en el depósito.
re -c <context> parse pst --bucket <ProjectName>/<BucketName> --file <PathToPst> --resume-on-errorre -c <context> parse pst --bucket <ProjectName>/<BucketName> --file <PathToPst> --resume-on-errorEl marcador
--resume-on-erroromite y cuenta los correos electrónicos que no se pueden procesar. Sin él, el primer correo electrónico que falla aborta toda la ejecución.
Los correos electrónicos están ahora en el depósito. Para que estén disponibles para el entrenamiento, crea un origen desde el depósito y añade ese origen a un conjunto de datos.
Opciones de carga y comportamiento
- Un archivo PST por comando. El marcador
--filetoma una única ruta. Bucle en su shell para cargar varios archivos PST. - El nombre del buzón en la plataforma es el nombre del archivo PST, incluida la extensión. Un archivo llamado
export (1).pstproduce un buzón llamadoexport (1).pst, que es visible para tus usuarios. Cambia el nombre del archivo a algo significativo antes de cargarlo. - Un archivo PST grande se inicia lentamente. El CLI cuenta cada elemento del archivo antes de comenzar a cargarse, por lo que el archivo se lee dos veces y la barra de progreso tarda un tiempo en aparecer. No detengas la ejecución.
--num-threadsno tiene ningún efecto. El comandore parse pstes de un solo hilo por diseño.- Volver a ejecutar el mismo archivo PST en el mismo depósito es idempotente. Cada correo electrónico se introduce en su encabezado
Message-IDy la carga es un upsert, por lo que es seguro volver a ejecutarla después de una carga fallida o interrumpida. - Suelta
--resume-on-erroral diagnosticar fallos. La CLI se detiene en el primer fallo e informa del motivo.
Depósitos, orígenes y conjuntos de datos
Comprender cómo se mueven los correos electrónicos a través de la plataforma evita la causa más común de comentarios duplicados:
- Un depósito almacena correos electrónicos sin procesar. Aquí es donde aterrizan los correos electrónicos PST y Exchange.
- Se crea un origen a partir de un depósito. Los correos electrónicos se sincronizan desde el depósito hasta el origen, donde se convierten en comentarios.
- Un conjunto de datos es aquello en lo que se entrena. Contiene uno o más orígenes.
Como práctica recomendada, adjunta un depósito a un origen y rellena cada origen a través de un solo método, ya sea un depósito o la API. Si adjuntas el mismo depósito a cuatro orígenes, cada correo electrónico se duplica en los cuatro.
Para obtener más información sobre la creación del origen, consulta Crear o eliminar un origen de datos en la GUI.
Correos electrónicos duplicados cuando también utilizas la integración de Exchange
Communications Mining elimina los duplicados de los correos electrónicos en el encabezado Message-ID y la carga es un upsert. Por lo tanto, rellenar con un archivo PST y luego habilitar la integración de Exchange no produce comentarios duplicados. Dos archivos PST que comparten correos electrónicos tampoco se duplican, siempre que ambos lleven el mismo Message-ID. Si ves duplicados, comprueba a cuántos orígenes está asociado el depósito.
Solución de problemas
| Síntoma | Causa y resolución |
|---|---|
Todos los correos electrónicos fallan al analizar, por ejemplo Total emails: 304 / failed to parse: 304 / uploaded: 0. | El archivo PST se exportó desde Outlook, que no es compatible. Vuelve a exportar el archivo desde Exchange. |
| Algunos correos electrónicos fallan y el motivo no está claro. | Vuelve a ejecutar la carga sin --resume-on-error para que la CLI se detenga en el primer error e imprima el motivo. Un --dry-run informa de los mismos errores en todo el archivo sin cargarlo. |
| Debes saber si un archivo PST está dañado. | Si la CLI puede abrir el archivo e iterar sus elementos, busca una causa a nivel de análisis en su lugar. Si el archivo no se puede leer en absoluto, descárgalo de nuevo y comprueba que el tamaño del archivo local coincide con el origen. Una descarga parcial se parece a un archivo corrupto. |
| La CLI informa de más correos electrónicos de los que contiene el conjunto de datos. | Los archivos PST contienen valores Message-ID duplicados, que la plataforma elimina los duplicados al cargarlos. No hay disponible ningún informe de lo que se ha eliminado. Para confirmar, cuente los valores Message-ID únicos en el archivo. |
| Debes encontrar los correos electrónicos solo RTF antes de ejecutar la carga. | Esto no es detectable por adelantado. Ejecuta la carga con --dry-run y lee los errores informados. |
| Parece que la carga se ha detenido. | En un archivo PST grande, CLI cuenta todos los elementos antes de cargarlos, por lo que primero hay una fase larga y silenciosa. Si la ejecución está realmente atascada, comprueba que la máquina no tiene recursos limitados y copia el archivo PST en una ruta local fuera de cualquier carpeta de almacenamiento en la nube sincronizada. |
| Los correos electrónicos muestran texto ilegible. | Limitación conocida para conjuntos de caracteres distintos de UTF-8, como el japonés ISO-2022-JP y el chino. Los cuerpos HTML se corrompen de forma silenciosa, por lo que --dry-run no los informa. No hay ninguna solución disponible. |
re create bucket o re parse pst devuelve Unknown context, o se dirige al tenant incorrecto. | Cada comando necesita un contexto: re -c <context>. El marcador -c toma el nombre de un contexto que ya has guardado, no una cadena de organización y tenant. Un contexto creado con re config parse-from-url se llama <organization>/<tenant>, y un contexto creado con re config add --name production se llama production. Enumera los contextos guardados con re config ls. |
| La carga solicita confirmación y bloquea una ejecución con script. | La solicitud es el consentimiento para el cargo de AI Unit o Platform Unit. Añade --yes. |
| La CLI no puede llegar a la plataforma. | Su red está filtrando la salida. Añade la plataforma y los puntos finales CLI a tu lista de permisos, o ejecuta la CLI desde una máquina que tenga acceso. |
| No se han cargado todos los correos electrónicos. | Se espera hasta cierto punto. Confirma que la exportación procedía de Exchange, que se utilizó --resume-on-error y comprueba los contadores de fallos. Los borradores, los elementos de calendario y los contactos se cuentan como fallos. |
Si su problema no aparece en la lista, envíe un ticket de soporte de UiPath®.
- Cuándo utilizar un archivo PST
- Limitaciones conocidas
- Exportar el archivo PST
- Microsoft 365 y Exchange Online
- Servidor de Exchange Server
- Cargar el archivo PST
- Requisitos previos
- Pasos
- Opciones de carga y comportamiento
- Depósitos, orígenes y conjuntos de datos
- Correos electrónicos duplicados cuando también utilizas la integración de Exchange
- Solución de problemas