UiPath Documentation
ixp
latest
false
Guía del usuario de Communications Mining
Importante :
La localización de contenidos recién publicados puede tardar entre una y dos semanas en estar disponible.

Cargar un archivo PST

Cargue correos electrónicos históricos en Communications Mining desde un archivo PST exportado desde Exchange, con los requisitos de exportación, las limitaciones conocidas y las resoluciones para errores de carga.

Importante:

Un archivo PST es una instantánea única, no una transmisión en vivo. Utilice una carga de PST para desbloquear el entrenamiento del modelo o para rellenar los correos electrónicos históricos mientras se configura una integración permanente. Para la ingestión de correo electrónico continua, utiliza la integración de Exchange en su lugar.

Cargas un archivo PST con Communications Mining™ CLI, que analiza los correos electrónicos del archivo y los escribe en un depósito. A continuación, creas un origen a partir de ese depósito y añades el origen a un conjunto de datos.

Cuándo utilizar un archivo PST

Usar un archivo PST cuandoNo utilices un archivo PST cuando
Debe desbloquear el entrenamiento del modelo antes de que esté disponible una integración en vivo.Está pasando a producción. En su lugar, configura la integración de Exchange .
Necesitas un relleno histórico de correos electrónicos que la integración en vivo no puede alcanzar, por ejemplo, porque el buzón utiliza un archivo in situ.Necesitas una ingestión en tiempo real o continua. Un archivo PST captura el buzón en un único momento.
Su entorno bloquea la integración de Exchange y necesita datos en la plataforma rápidamente.Necesitas hilos de conversación completos. Una exportación PST puede omitir mensajes de una conversación.
Consejo:

Para un relleno histórico, mantén la integración de Exchange habilitada para los nuevos correos electrónicos y utiliza el archivo PST solo para los datos más antiguos. Mantener la sincronización en ejecución durante el entrenamiento proporciona al aprendizaje activo más datos con los que trabajar.

Limitaciones conocidas

Una carga de PST no es una forma fiable de introducir datos en la plataforma, y no sustituye a una integración en vivo. Cada carga de PST pierde algunos datos, así que no esperes que todos los correos electrónicos del archivo lleguen a la plataforma. Cuando tu entorno lo permita, utiliza la integración de Exchange en su lugar.

Se aplican las siguientes limitaciones:

  • Los archivos PST exportados desde Outlook no son compatibles. Una exportación de cliente de Outlook elimina los encabezados de transporte que requiere Communications Mining y omite la carpeta Elementos enviados. La CLI puede fallar al analizar un archivo de este tipo por completo. Esta es la causa más común de pérdida de datos a gran escala.
  • Los correos electrónicos cuyo único cuerpo es RTF no se cargan. La CLI utiliza el cuerpo HTML cuando hay uno presente y recurre al cuerpo de texto sin formato. Un correo electrónico se suelta solo cuando faltan ambos. La mayoría de los correos de Outlook compuestos por RTF también incluyen una alternativa de texto sin formato y se cargan sin problemas. No hay forma de detectar correos electrónicos solo RTF en un archivo PST antes de ejecutar la carga.
  • El contenido del archivo adjunto no se carga. Solo se cargan los metadatos del archivo adjunto: nombre, tamaño y tipo de contenido. El tipo de contenido se infiere de la extensión del archivo en lugar de leerse del archivo PST. Los archivos adjuntos que son en sí mismos correos electrónicos se omiten, por lo que un correo electrónico cuyo único archivo adjunto es un mensaje reenviado no informa de archivos adjuntos.
  • Se espera cierta pérdida de datos. Como regla general, calcula aproximadamente el 1 % de los correos electrónicos que fallan. Los resultados reales varían en ambas direcciones, así que ejecuta la carga con --dry-run primero y comprueba los contadores emails failed to parse y failed to upload que la CLI imprime al final de cada ejecución.
  • Los elementos que no son correos electrónicos se cuentan como fallos. La CLI recorre cada carpeta del archivo PST y requiere que cada elemento tenga un encabezado Message-ID y un encabezado Date. Los borradores, los elementos del calendario, los contactos y las tareas no tienen ninguno, por lo que se informan como fallos de análisis. Se espera un recuento de fallos distinto de cero.
  • Los hilos pueden estar incompletos. Un archivo PST no contiene necesariamente todos los mensajes de una conversación.
  • Los conjuntos de caracteres distintos de UTF-8 se pueden distorsionar. Los correos electrónicos en japonés (ISO-2022-JP) y chino son los más afectados. El comportamiento depende del tipo de cuerpo:
    • Los cuerpos de texto sin formato se convierten utilizando la página de códigos del mensaje. Si la conversión falla, el correo electrónico se descarta y se cuenta como un error de análisis, que --dry-run informa.
    • Los cuerpos HTML se coaccionan a UTF-8, por lo que los bytes que no se pueden decodificar se convierten en caracteres de reemplazo. No se produce ningún error, no se incrementa ningún contador y --dry-run no lo informa. Comprueba una muestra de correos electrónicos HTML en la plataforma después de la carga.
Importante:

Para rellenar un buzón antes de exportarlo, mueve, copia o redirige los correos electrónicos, por ejemplo, arrastrándolos entre buzones en Outlook. No los reenvíes. Un mensaje reenviado llega con la conversación anterior eliminada del cuerpo, lo que deja solo encabezados y direcciones y no es útil para el entrenamiento.

Exportar el archivo PST

Exporta el archivo PST desde Exchange, no desde Outlook. Un archivo PST exportado desde el cliente de Outlook, a través de Archivo > Abrir y exportar > Importar/Exportar, omite la carpeta Elementos enviados y otras carpetas, y puede producir un archivo que la CLI no puede analizar.

Para obtener una descripción general de las rutas de exportación compatibles, consulta Procedimientos de exportación de buzón.

Microsoft 365 y Exchange Online

Usa Microsoft Purview eDiscovery para buzones en la nube. Para obtener más información, consulta Exportar resultados de búsqueda en eDiscovery.

Prerrequisitos:

  • El administrador que ejecuta la exportación tiene el rol de eDiscovery Manager en el portal de Microsoft Purview. Este rol no está asignado de forma predeterminada.
  • La organización tiene una licencia E3 o E5.

Steps:

  1. En el portal de Microsoft Purview, crea o abre un caso de eDiscovery.
  2. Ejecuta una búsqueda en el ámbito de los buzones de correo de destino. Deje las palabras clave vacías para devolver todo lo que esté en el intervalo de fechas.
  3. Selecciona Exportar en la búsqueda.
  4. En Formato de exportación, elige Crear PST para mensajes.
  5. Incluye el buzón de archivo y los elementos recuperables para exportar el historial completo. Los buzones de correo principal y de archivo se fusionan en un solo archivo PST.
  6. Establece el tamaño máximo del paquete PST en 1, 2, 5 o 10 GB. Los paquetes más pequeños son más fáciles de transferir.
  7. Descarga el paquete desde Gestor de procesos.
Importante:

Los paquetes de exportación caducan a los 14 días. Extrae el paquete con una herramienta de archivado de terceros en lugar de la extracción integrada de Windows, y comprueba los tamaños de archivo después de que se complete la descarga.

Servidor de Exchange Server

Este procedimiento se aplica a Exchange Server 2016, 2019 y Subscription Edition. Para obtener más información, consulta Exportar resultados de búsqueda de eDiscovery a un archivo PST.

Prerrequisitos:

  • La máquina de exportación tiene.NET Framework 4.7 y el complemento ClickOnce instalado en Chrome o Firefox.
  • La cuenta que ejecuta la exportación no utiliza la autenticación multifactor (MFA). La herramienta de exportación PST de eDiscovery no funciona con cuentas MFA, así que primero crea una contraseña de aplicación para la cuenta.

Steps:

  1. En el centro de administración de Exchange, ve a Gestión de cumplimiento > eDiscovery y retención de documentos electrónicos local.
  2. Selecciona la búsqueda y luego selecciona Exportar a un archivo PST.
  3. En la herramienta de exportación de PST de eDiscovery, elige una ubicación de descarga.
  4. Opcionalmente, selecciona Habilitar desduplicación para escribir todos los resultados en un solo archivo PST e Incluir elementos no buscables.
  5. Selecciona Inicio.
Nota:

Los proxies y cortafuegos corporativos pueden bloquear o acelerar la descarga de exportación. Es posible que los puntos finales de Microsoft involucrados deban añadirse a tu lista de permisos de red.

Cargar el archivo PST

Requisitos previos

  • La CLI de Communications Mining está instalada. Para obtener más detalles, consulta CLI.
  • Se configura un contexto para tu punto final de Communications Mining. Para obtener más información, consulta Configurar la CLI.
  • El archivo PST se exporta desde Exchange, como se describe en la sección anterior.
  • Tienes permisos para crear depósitos y orígenes en el proyecto de destino.
Importante:

La carga de correos electrónicos consume AI Units o Platform Units, por lo que la CLI te solicita que aceptes el cargo antes de que se inicie la carga. Una ejecución en seco no consume nada, pero sigue mostrando la solicitud. Añade --yes para suprimir la solicitud en una ejecución desatendida o con script.

Pasos

  1. Crea un depósito para los correos electrónicos. Los nombres de proyectos y depósitos solo aceptan letras, dígitos, guiones y guiones bajos.

    re -c <context> create bucket <ProjectName>/<BucketName>
    re -c <context> create bucket <ProjectName>/<BucketName>
    
  2. Comprueba que el archivo PST se analiza antes de consumir cualquier unidad.

    re -c <context> parse pst --bucket <ProjectName>/<BucketName> --file <PathToPst> --dry-run
    re -c <context> parse pst --bucket <ProjectName>/<BucketName> --file <PathToPst> --dry-run
    

    El comando lee todo el archivo e informa de los errores de análisis sin cargar nada. Imprime No parse errors found o un desglose de cada error distinto y el número de correos electrónicos afectados.

  3. Carga el archivo PST en el depósito.

    re -c <context> parse pst --bucket <ProjectName>/<BucketName> --file <PathToPst> --resume-on-error
    re -c <context> parse pst --bucket <ProjectName>/<BucketName> --file <PathToPst> --resume-on-error
    

    El marcador --resume-on-error omite y cuenta los correos electrónicos que no se pueden procesar. Sin él, el primer correo electrónico que falla aborta toda la ejecución.

Los correos electrónicos están ahora en el depósito. Para que estén disponibles para el entrenamiento, crea un origen desde el depósito y añade ese origen a un conjunto de datos.

Opciones de carga y comportamiento

  • Un archivo PST por comando. El marcador --file toma una única ruta. Bucle en su shell para cargar varios archivos PST.
  • El nombre del buzón en la plataforma es el nombre del archivo PST, incluida la extensión. Un archivo llamado export (1).pst produce un buzón llamado export (1).pst, que es visible para tus usuarios. Cambia el nombre del archivo a algo significativo antes de cargarlo.
  • Un archivo PST grande se inicia lentamente. El CLI cuenta cada elemento del archivo antes de comenzar a cargarse, por lo que el archivo se lee dos veces y la barra de progreso tarda un tiempo en aparecer. No detengas la ejecución.
  • --num-threads no tiene ningún efecto. El comando re parse pst es de un solo hilo por diseño.
  • Volver a ejecutar el mismo archivo PST en el mismo depósito es idempotente. Cada correo electrónico se introduce en su encabezado Message-ID y la carga es un upsert, por lo que es seguro volver a ejecutarla después de una carga fallida o interrumpida.
  • Suelta --resume-on-error al diagnosticar fallos. La CLI se detiene en el primer fallo e informa del motivo.

Depósitos, orígenes y conjuntos de datos

Comprender cómo se mueven los correos electrónicos a través de la plataforma evita la causa más común de comentarios duplicados:

  • Un depósito almacena correos electrónicos sin procesar. Aquí es donde aterrizan los correos electrónicos PST y Exchange.
  • Se crea un origen a partir de un depósito. Los correos electrónicos se sincronizan desde el depósito hasta el origen, donde se convierten en comentarios.
  • Un conjunto de datos es aquello en lo que se entrena. Contiene uno o más orígenes.

Como práctica recomendada, adjunta un depósito a un origen y rellena cada origen a través de un solo método, ya sea un depósito o la API. Si adjuntas el mismo depósito a cuatro orígenes, cada correo electrónico se duplica en los cuatro.

Para obtener más información sobre la creación del origen, consulta Crear o eliminar un origen de datos en la GUI.

Correos electrónicos duplicados cuando también utilizas la integración de Exchange

Communications Mining elimina los duplicados de los correos electrónicos en el encabezado Message-ID y la carga es un upsert. Por lo tanto, rellenar con un archivo PST y luego habilitar la integración de Exchange no produce comentarios duplicados. Dos archivos PST que comparten correos electrónicos tampoco se duplican, siempre que ambos lleven el mismo Message-ID. Si ves duplicados, comprueba a cuántos orígenes está asociado el depósito.

Solución de problemas

SíntomaCausa y resolución
Todos los correos electrónicos fallan al analizar, por ejemplo Total emails: 304 / failed to parse: 304 / uploaded: 0.El archivo PST se exportó desde Outlook, que no es compatible. Vuelve a exportar el archivo desde Exchange.
Algunos correos electrónicos fallan y el motivo no está claro.Vuelve a ejecutar la carga sin --resume-on-error para que la CLI se detenga en el primer error e imprima el motivo. Un --dry-run informa de los mismos errores en todo el archivo sin cargarlo.
Debes saber si un archivo PST está dañado.Si la CLI puede abrir el archivo e iterar sus elementos, busca una causa a nivel de análisis en su lugar. Si el archivo no se puede leer en absoluto, descárgalo de nuevo y comprueba que el tamaño del archivo local coincide con el origen. Una descarga parcial se parece a un archivo corrupto.
La CLI informa de más correos electrónicos de los que contiene el conjunto de datos.Los archivos PST contienen valores Message-ID duplicados, que la plataforma elimina los duplicados al cargarlos. No hay disponible ningún informe de lo que se ha eliminado. Para confirmar, cuente los valores Message-ID únicos en el archivo.
Debes encontrar los correos electrónicos solo RTF antes de ejecutar la carga.Esto no es detectable por adelantado. Ejecuta la carga con --dry-run y lee los errores informados.
Parece que la carga se ha detenido.En un archivo PST grande, CLI cuenta todos los elementos antes de cargarlos, por lo que primero hay una fase larga y silenciosa. Si la ejecución está realmente atascada, comprueba que la máquina no tiene recursos limitados y copia el archivo PST en una ruta local fuera de cualquier carpeta de almacenamiento en la nube sincronizada.
Los correos electrónicos muestran texto ilegible.Limitación conocida para conjuntos de caracteres distintos de UTF-8, como el japonés ISO-2022-JP y el chino. Los cuerpos HTML se corrompen de forma silenciosa, por lo que --dry-run no los informa. No hay ninguna solución disponible.
re create bucket o re parse pst devuelve Unknown context, o se dirige al tenant incorrecto.Cada comando necesita un contexto: re -c <context>. El marcador -c toma el nombre de un contexto que ya has guardado, no una cadena de organización y tenant. Un contexto creado con re config parse-from-url se llama <organization>/<tenant>, y un contexto creado con re config add --name production se llama production. Enumera los contextos guardados con re config ls.
La carga solicita confirmación y bloquea una ejecución con script.La solicitud es el consentimiento para el cargo de AI Unit o Platform Unit. Añade --yes.
La CLI no puede llegar a la plataforma.Su red está filtrando la salida. Añade la plataforma y los puntos finales CLI a tu lista de permisos, o ejecuta la CLI desde una máquina que tenga acceso.
No se han cargado todos los correos electrónicos.Se espera hasta cierto punto. Confirma que la exportación procedía de Exchange, que se utilizó --resume-on-error y comprueba los contadores de fallos. Los borradores, los elementos de calendario y los contactos se cuentan como fallos.

Si su problema no aparece en la lista, envíe un ticket de soporte de UiPath®.

¿Te ha resultado útil esta página?

Conectar

¿Necesita ayuda? Soporte

¿Quiere aprender? UiPath Academy

¿Tiene alguna pregunta? Foro de UiPath

Manténgase actualizado