- Información general
- Requisitos
- Plantillas de implementación
- Manual: preparar la instalación
- Manual: preparar la instalación
- Paso 2: configurar el registro compatible con OCI para las instalaciones sin conexión
- Paso 3: configurar el almacén de objetos externo
- Paso 4: configurar High Availability Add-on
- Paso 5: configurar las bases de datos SQL
- Paso 6: configurar el equilibrador de carga
- Paso 7: configurar el DNS
- Paso 8: configurar los discos
- Paso 9: configurar los ajustes a nivel de kernel y sistema operativo
- Paso 10: configurar los puertos de nodo
- Paso 11: aplicar ajustes varios
- Paso 12: Validar e instalar los paquetes RPM necesarios
- Paso 13: Generar cluster_config.json
- Configuración de certificados
- Configuración de la base de datos
- Configuración del almacén de objetos externo
- Configuración de URL prefirmada
- Configuración de la autenticación Kerberos
- Configuración de registro externo compatible con OCI
- Disaster recovery: configuraciones activas/pasivas y activas/activas
- Configuración de High Availability Add-on
- Configuración específica de Orchestrator
- Configuración específica de Insights
- Process Mining-specific configuration
- Configuración específica de Document Understanding
- Automation Suite Robots-specific configuration
- Configuración de la supervisión
- Opcional: configurar el servidor proxy
- Opcional: habilitación de la resistencia a fallos de zona en un clúster multinodo de producción preparada para alta disponibilidad
- Opcional: pasar resolv.conf personalizado
- Optional: Increasing fault tolerance
- parámetros de install-uipath.sh
- Inclusión de un nodo agente dedicado compatible con GPU
- Añadir un nodo agente dedicado a Task Mining
- Conexión de la aplicación Task Mining
- Añadir un nodo agente dedicado a Automation Suite Robots
- Paso 15: configurar el registro temporal de Docker para las instalaciones sin conexión
- Paso 16: validar los requisitos previos para la instalación
- Manual: realizar la instalación
- Después de la instalación
- Administración de clústeres
- Gestionar los productos
- Primeros pasos con el Portal de administración del clúster
- Migrar del en el clúster a High Availability Add-on externo
- Migrar del registro en clúster a un registro externo compatible con OCI
- Cambiar manualmente al clúster secundario en una configuración activa/pasiva
- Disaster Recovery: realizar operaciones posteriores a la instalación
- Convertir una instalación existente en una configuración en varios sitios
- Directrices sobre la actualización de una implementación activa/pasiva o activa/activa
- Directrices sobre la copia de seguridad y restauración de una implementación activa/pasiva o activa/activa
- Redireccionando el tráfico de los servicios no compatibles al clúster principal
- Escalar una implementación de nodo único (evaluación) a una implementación multinodo (HA)
- Supervisión y alertas
- Migración y actualización
- Paso 1: Mover los datos de la organización de identidad de independiente a Automation Suite
- Paso 2: restaurar la base de datos del producto independiente
- Paso 3: Realizar una copia de seguridad de la base de datos de la plataforma en Automation Suite
- Paso 4: Fusionar organizaciones en Automation Suite
- Paso 5: actualizar las cadenas de conexión de los productos migrados
- Paso 6: migrar el Orchestrator independiente
- Paso 7: migrar Insights independiente
- Paso 8: Migrar Test Manager independiente
- Paso 9: eliminar el tenant predeterminado
- Realizar una migración de un solo tenant
- Migrar de Automation Suite en Linux a Automation Suite en EKS / AKS
- Actualizar Automation Suite
- Descargar los paquetes de instalación y obtener todos los archivos del primer nodo del servidor
- Recuperar la última configuración aplicada del clúster
- Actualizar la configuración del clúster
- Configurar el registro compatible con OCI para las instalaciones sin conexión
- Ejecutar la actualización
- Realizar operaciones posteriores a la actualización
- Configuración específica del producto
- Uso de la herramienta de configuración de Orchestrator
- Configurar parámetros de Orchestrator
- Configuración de Orchestrator
- Configurar AppSettings
- Configurar el tamaño máximo de la solicitud
- Anular la configuración de almacenamiento a nivel de clúster
- Configurar almacenes de credenciales
- Configurar clave de cifrado por tenant
- Limpiar la base de datos de Orchestrator
- Buenas prácticas y mantenimiento
- Solución de problemas
- Cómo solucionar los problemas de los servicios durante la instalación
- Cómo desinstalar el clúster
- Cómo limpiar los artefactos sin conexión para mejorar el espacio en disco
- Cómo borrar datos de Redis
- Cómo habilitar el registro de Istio
- Cómo limpiar manualmente los registros
- Cómo limpiar los registros antiguos almacenados en el depósito sf-logs
- Cómo deshabilitar los registros de transmisión para AI Center
- Cómo depurar instalaciones de Automation Suite fallidas
- Cómo eliminar imágenes del instalador antiguo después de la actualización
- Cómo deshabilitar la descarga de la suma de comprobación TX
- Cómo actualizar desde Automation Suite 2022.10.10 y 2022.4.11 a 2023.10.2
- Cómo establecer manualmente el nivel de registro de ArgoCD en Info
- Cómo expandir el almacenamiento de AI Center
- Cómo generar el pull_secret_value codificado para registros externos
- Cómo abordar los cifrados débiles en TLS 1.2
- Cómo trabajar con certificados
- Cómo reenviar registros de aplicaciones a Splunk
- Cómo limpiar las imágenes de Docker no utilizadas de los pods de registro
- Cómo recopilar datos de uso de DU con el almacén de objetos en el clúster (Ceph)
- Cómo instalar RKE2 SELinux en entornos aislados
- Cómo limpiar copias de seguridad diferenciales antiguas en un servidor NFS
- No se puede ejecutar una instalación sin conexión en el sistema operativo RHEL 8.4
- Error al descargar el paquete
- La instalación sin conexión falla porque falta un binario
- Problema de certificado en la instalación sin conexión
- First installation fails during Longhorn setup
- Error de validación de la cadena de conexión SQL
- Error en la comprobación de requisitos previos para el módulo iscsid de selinux
- Azure disk not marked as SSD
- Fallo tras la actualización del certificado
- El antivirus causa problemas de instalación
- Automation Suite not working after OS upgrade
- Automation Suite requiere que backlog_wait_time se establezca en 0
- El volumen no se puede montar porque no está listo para las cargas de trabajo
- Error de recopilación de registros del paquete de soporte
- Se ignora la cadena de conexión SQL de la automatización de pruebas
- Configuración de DNS no respetada por CoreDNS
- Pérdida de datos al reinstalar o actualizar Insights tras la actualización de Automation Suite
- La actualización de nodo único falla en la etapa de tejido
- Cluster unhealthy after automated upgrade from 2021.10
- Upgrade fails due to unhealthy Ceph
- RKE2 no se inicia debido a un problema de espacio
- El volumen no se puede montar y permanece en estado de bucle de conexión/desconexión
- La actualización falla debido a objetos clásicos en la base de datos de Orchestrator
- El clúster de Ceph se encuentra en un estado degradado tras una actualización en paralelo.
- Un componente Insights en mal estado provoca el fallo de la migración
- La actualización del servicio falla para Apps
- Tiempos de actualización in situ
- La migración del registro de Docker se atasca en la fase de eliminación de PVC
- Error de aprovisionamiento de AI Center después de actualizar a 2023.10 o posterior
- La actualización falla en entornos sin conexión
- La validación SQL falla durante la actualización
- pod de snapshot-controller-crds en estado CrashLoopBackOff después de la actualización
- Error de actualización/reinstalación del punto final de la API REST de Longhorn
- La actualización falla debido a los tamaños de PVC de Insights anulados
- La actualización del servicio falla durante la ejecución del script previo al servicio
- Fallo al cargar o descargar datos en el almacén de objetos
- PVC resize does not heal Ceph
- Fallo en el redimensionamiento de PVC de objectstore
- Rook Ceph o Looker pod atascados en estado Init
- Error de archivo adjunto de volumen de StatefulSet
- Fallo en la creación de volúmenes persistentes
- Error al compactar las métricas debido a bloques corruptos en Thanos
- Establecer un intervalo de tiempo de espera para los portales de gestión
- La autenticación no funciona tras la migración
- kinit: no se puede encontrar la KDC para el territorio <AD Domain> mientras se obtienen las credenciales iniciales
- kinit: keytab no contiene claves adecuadas para *** mientras se obtienen las credenciales iniciales
- Error en la operación GSSAPI debido a un código de estado no válido
- Alarma recibida por un error en el trabajo de Kerberos-tgt-update
- Proveedor de SSPI: servidor no encontrado en la base de datos de Kerberos
- Error en inicio de sesión de un usuario AD debido a una cuenta deshabilitada
- ArgoCD login failed
- Actualizar las conexiones del directorio subyacente
- Fallo en la obtención de la imagen de Sandbox
- Los pods no se muestran en la interfaz de usuario de ArgoCD
- Fallo de la sonda Redis
- El servidor RKE2 no se inicia
- Secreto no encontrado en el espacio de nombres UiPath
- ArgoCD entra en estado de progreso tras la primera instalación
- Manual ArgoCD NetworkPolicy mitigation (GHSA-47m3-95c7-g2g8)
- Unhealthy services after cluster restore or rollback
- Pods atascados en Inicialización: 0 / X
- Faltan métricas de Ceph-rook en los paneles de supervisión
- Los pods no pueden comunicarse con FQDN en un entorno de proxy
- Error al configurar las alertas de correo electrónico después de la actualización
- No hay problema ascendente en buen estado
- Error al añadir nodos agente en entornos sin conexión
- El acceso a FQDN devuelve RBAC: error de acceso denegado
- Document Understanding no se encuentra en la barra izquierda de Automation Suite
- Estado fallido al crear una sesión de etiquetado de datos
- Estado fallido al intentar implementar una habilidad ML
- El trabajo de migración falla en ArgoCD
- El reconocimiento de la escritura manual con el extractor de formularios inteligente no funciona
- Error en la implementación de la habilidad ML debido a la caducidad del token
- Ejecutar alta disponibilidad con Process Mining
- La ingestión de Process Mining falló al iniciar sesión con Kerberos
- Después de Disaster Recovery, Dapr no funciona correctamente para Process Mining
- Configurar Dapr con Redis en modo clúster
- No se puede conectar a la base de datos AutomationSuite_ProcessMining_Warehouse utilizando una cadena de conexión en formato pyodbc
- La instalación de Airflow falla con sqlalchemy.exc.ArgumentError: no se pudo analizar la URL rfc1738 de la cadena ''
- Cómo añadir una regla de tabla de IP para utilizar el puerto 1433 de SQL Server
- El certificado de Automation Suite no es de confianza desde el servidor donde se ejecuta CData Sync
- Ejecutar la herramienta de diagnóstico
- Uso del paquete de soporte de Automation Suite
- Explorar registros
Para evitar la pérdida de datos, asegúrese de que la infraestructura que utiliza no elimina automáticamente los discos del clúster al reiniciarlo o apagarlo. Si esta función está activada, asegúrese de desactivarla.
Azure subscription and permissions
La implementación requiere acceso a una suscripción de Azure y un grupo de recursos con el rol RBAC Propietario. El rol de propietario es necesario para crear una identidad administrada asignada por el usuario con el rol de colaborador asignado en el ámbito del grupo de recursos. La identidad administrada es necesaria para gestionar las máquinas virtuales (realizar acciones de escalado ascendente y descendente, aplicar protección de instancias, actualizar el sistema operativo).
Puede comprobar su asignación de roles haciendo lo siguiente:
Grupo de recursos → Control de accesos (IAM) → Comprobar acceso → Ver mi acceso
Cuotas
The deployment provisions a number of Standard_D (general purpose), Standard_F and/or Standard_NC (with GPU) VMs. The Azure subscription has a quota on the number of cores that can be provisioned for the VM family.
Algunas de las máquinas virtuales implementadas deben aprovisionarse con SSD premium y, según la configuración, con Ultra SSD. Asegúrese de que estos SSD estén disponibles y no estén bloqueados por ninguna política.
Usamos grupos elásticos de SQL para implementar las bases de datos. Asegúrate de que los grupos elásticos de SQL no sean bloqueados por ninguna política.
Para comprobar la cuota de suscripción, ve a Uso + cuotas en el portal de Azure.
Asegúrese de que su cuota sea suficiente para la implementación de Automation Suite; de lo contrario, la implementación fallará. Solicita un aumento seleccionando Solicitar aumento.
Instance protection
Como parte del proceso de instalación, añadimos protección de instancias de las operaciones de conjunto de escalado a todos los nodos del conjunto de escalas de servidor. Dado que estas operaciones se realizan desde Azure, sin el contexto del servidor, se evita el mal funcionamiento del clúster. Proporcionamos runbooks para las operaciones de gestión de clústeres. Para obtener más información sobre la protección de instancias de conjunto de escalado, consulta la documentación de Azure.
Instance termination
Terminating the Server Virtual Machine instances will most likely result in data loss and cause the cluster to crash. Do not attempt terminating the Server Virtual Machine instances.
Proporcionamos soporte para la finalización de instancias de máquinas virtuales de agentes. Esto significa que cuando se termina una instancia de máquina virtual de agente, acordonamos, drenamos y eliminamos ese nodo del clúster de Automation Suite.
Ejecutamos un script en cada instancia de máquina virtual de agente que agrupa el servicio de metadatos de instancia para eventos de terminación. Cada vez que recibimos un evento, activamos un cordón y un comando de drenaje en el nodo respectivo, y un servidor también ejecuta un comando de eliminación de nodo para ese nodo específico.
Hay registros ampliados disponibles para este proceso. Puedes encontrar los registros de cada operación de finalización de nodo en la cuenta de almacenamiento principal de implementación en el contenedor logs . Cada archivo de registro contiene el nombre del nodo y tiene el sufijo -termination.log .
Disponibilidad de la región de la familia de VM
Asegúrese de que las SKU de VM estén disponibles para la región de la implementación.
Puede comprobar la disponibilidad en: Productos de Azure por región.
Cluster certificate configuration
La plantilla de Azure te permite proporcionar certificados para un dominio personalizado que especifiques durante la implementación, de modo que no tengas que hacerlo manualmente después de la implementación. Sin embargo, debes asegurarte de que los certificados .crt estén codificados en Base64 antes de proporcionarlos.
El siguiente script genera las cadenas codificadas en Base64 a partir de un único certificado .pfx (certificado de servidor). A continuación, puedes utilizar estas cadenas al rellenar los parámetros de la plantilla. Puedes ejecutar este script bash en una máquina Windows utilizando el subsistema de Windows para Linux. Utiliza openssl para convertir los certificados. Ten en cuenta que el certificado del servidor (el .pfx) debe cumplir algunosrequisitos.
Ejecuta los siguientes comandos uno por uno, ya que algunos requieren la contraseña del certificado .pfx :
pfxFile=<path of the pfx file>
# Key
openssl pkcs12 -in $pfxFile -nocerts -out serverCertKeyEncrypted.key
openssl rsa -in serverCertKeyEncrypted.key -out serverCertKeyDecrypted.key
# Server cert
openssl pkcs12 -in $pfxFile -clcerts -nokeys -out serverCert.crt
# CA Bundle:
openssl pkcs12 -in $pfxFile -cacerts -nokeys -chain | sed -ne '/-BEGIN CERTIFICATE-/,/-END CERTIFICATE-/p' > caBundle.crt
# Converting to base64 and removing newlines
cat serverCertKeyDecrypted.key | base64 | tr -d '\n' > base64CertKey
cat serverCert.crt | base64 | tr -d '\n' > base64Cert
cat caBundle.crt | base64 | tr -d '\n' > base64CABundle
pfxFile=<path of the pfx file>
# Key
openssl pkcs12 -in $pfxFile -nocerts -out serverCertKeyEncrypted.key
openssl rsa -in serverCertKeyEncrypted.key -out serverCertKeyDecrypted.key
# Server cert
openssl pkcs12 -in $pfxFile -clcerts -nokeys -out serverCert.crt
# CA Bundle:
openssl pkcs12 -in $pfxFile -cacerts -nokeys -chain | sed -ne '/-BEGIN CERTIFICATE-/,/-END CERTIFICATE-/p' > caBundle.crt
# Converting to base64 and removing newlines
cat serverCertKeyDecrypted.key | base64 | tr -d '\n' > base64CertKey
cat serverCert.crt | base64 | tr -d '\n' > base64Cert
cat caBundle.crt | base64 | tr -d '\n' > base64CABundle
External Orchestrator certificates
Para conectar AI Center a un Orchestrator externo, debes establecer Connect AiCenter to an external Orchestrator en true y proporcionar certificados para Orchestrator e Identity a los parámetros enumerados en Implementación de Automation Suite en Azure. Para obtener más información sobre cómo obtener los certificados, consulta Certificados de cadena.
Para codificar los certificados en formato base64, ejecute los siguientes comandos:
cat orchestrator.cer | base64 | tr -d '\n' > orchestratorCert
cat identity.cer | base64 | tr -d '\n' > identityCert
cat orchestrator.cer | base64 | tr -d '\n' > orchestratorCert
cat identity.cer | base64 | tr -d '\n' > identityCert
Para registrar AI Center en el Orchestrator externo, debes ejecutar el runbook RegisterAiCenterExternalOrchestrator.
Resistencia a fallos de zona en un clúster de producción multinodo preparada para alta disponibilidad
De forma predeterminada, las plantillas implementan las VM en tantas zonas de disponibilidad de Azure como es posbile para habilitar la resistencia a fallos de zona en un clúster de producción multinodo preparada para alta disponibilidad.
Not all Azure Regions support Availability Zones. Refer to Azure Geographies for details. VM SKUs have additional Availability Zones restrictions that you can check using the CLI cmdlet. Refer to Get-AzComputeResourceSku for details.
El clúster se considera resistente a los fallos de zona si los servidores se distribuyen en tres zonas de disponibilidad de Azure. Si la región de Azure no admite zonas de disponibilidad para tipo de VM seleccionada para los servidores, la implementación continuará sin resistencia de zona.
Dns
La plantilla proporciona un equilibrador de carga de Azure con una IP pública y una etiqueta de DNS para acceder a los servicios.
La etiqueta de DNS es propiedad de Microsoft y debe tener un formato similar a: <dnsName>.<regionName>.cloudapp.azure.com.
También implementamos una zona DNS privada, para que los VM del clúster puedan resolver varios subdominios. Esto es necesario para el proceso de instalación. Para resolver registros en una zona DNS privada desde la red virtual, compruebe que el servidor DNS esté establecido en Azure-provided o 168.63.129.16.
Si desea acceder al clúster a través de Internet, consulte el Paso 3: Pasos posteriores a la implementación.
Implementar en una red virtual existente
La plantilla permite implementar los nodos en una red virtual existente. Sin embargo, la red virtual debe disponer de una subred que cumpla los siguientes requisitos:
- tiene suficiente espacio de direcciones libre para acomodar todos los nodos y el equilibrador de carga interno
- conectividad saliente, preferiblemente configurada a través de una puerta de enlace NAT según la recomendación de Microsoft
- permite el tráfico HTTPS en el puerto
443 - Optional: has a service endpoint configured for
Microsoft.Storage. This is needed if you enable the backup at deployment time.
Al implementar en una red virtual existente, debe tener el rol de RBAC de propietario para crear una asignación de rol de colaborador en su ámbito. Esto es necesario para la operación de actualización de instancia al escalar horizontalmente.
Copia de seguridad
The template allows you to enable the backup at deployment time. This implies creating a Microsoft Storage Account with a variable storage capacity (depending on the number of server nodes - # of server nodes x 512GB) used as an NFS share and configuring the backup for the cluster.
By default, the backup interval is set to 90 minutes, and the retention interval is 72 hours. You can change the backup and retention intervals post-deployment. For details, refer to BackupCluster.
- Azure subscription and permissions
- Grupo de recursos → Control de accesos (IAM) → Comprobar acceso → Ver mi acceso
- Cuotas
- Instance protection
- Instance termination
- Disponibilidad de la región de la familia de VM
- Cluster certificate configuration
- External Orchestrator certificates
- Resistencia a fallos de zona en un clúster de producción multinodo preparada para alta disponibilidad
- Dns
- Implementar en una red virtual existente
- Copia de seguridad