- Información general
- Requisitos
- Plantillas de implementación
- Manual: preparar la instalación
- Manual: preparar la instalación
- Paso 2: configurar el registro compatible con OCI para las instalaciones sin conexión
- Paso 3: configurar el almacén de objetos externo
- Paso 4: configurar High Availability Add-on
- Paso 5: configurar las bases de datos SQL
- Paso 7: configurar el DNS
- Paso 8: configurar los discos
- Paso 9: configurar los ajustes a nivel de kernel y sistema operativo
- Paso 10: configurar los puertos de nodo
- Paso 11: aplicar ajustes varios
- Paso 12: Validar e instalar los paquetes RPM necesarios
- Paso 13: Generar cluster_config.json
- Ejemplo de Clúster_config.json
- Configuración general
- Configuración del perfil
- Configuración de certificados
- Configuración de la base de datos
- Configuración del almacén de objetos externo
- Configuración de URL prefirmada
- Configuración de ArgoCD
- Configuración de la autenticación Kerberos
- Configuración de registro externo compatible con OCI
- Disaster recovery: configuraciones activas/pasivas y activas/activas
- Configuración de High Availability Add-on
- Configuración específica de Orchestrator
- Configuración específica de Insights
- Process Mining-specific configuration
- Configuración específica de Document Understanding
- Automation Suite Robots-specific configuration
- Configuración de la supervisión
- Opcional: configurar el servidor proxy
- Opcional: habilitación de la resistencia a fallos de zona en un clúster multinodo de producción preparada para alta disponibilidad
- Opcional: pasar resolv.conf personalizado
- Optional: Increasing fault tolerance
- Inclusión de un nodo agente dedicado compatible con GPU
- Añadir un nodo agente dedicado a Automation Suite Robots
- Paso 15: configurar el registro temporal de Docker para las instalaciones sin conexión
- Paso 16: validar los requisitos previos para la instalación
- Ejecutar uipathctl
- Manual: realizar la instalación
- Después de la instalación
- Administración de clústeres
- Gestionar los productos
- Primeros pasos con el Portal de administración del clúster
- Añadir un nuevo nodo al clúster
- Eliminar un nodo del clúster
- Reparar un nodo del clúster
- Iniciar y apagar un nodo
- Cambiar el nombre de un nodo
- Migración de Redis desde un clúster a un High Availability Add-on externo
- Migrating data between objectstores
- Migrating in-cluster objectstore to external objectstore
- Migrar del registro en clúster a un registro externo compatible con OCI
- Cambiar manualmente al clúster secundario en una configuración activa/pasiva
- Disaster Recovery: realizar operaciones posteriores a la instalación
- Convertir una instalación existente en una configuración en varios sitios
- Directrices sobre la actualización de una implementación activa/pasiva o activa/activa
- Directrices sobre la copia de seguridad y restauración de una implementación activa/pasiva o activa/activa
- Escalar una implementación de nodo único (evaluación) a una implementación multinodo (HA)
- Supervisión y alertas
- Migración y actualización
- Migrar entre clústeres de Automation Suite
- Actualizar Automation Suite
- Descargar los paquetes de instalación y obtener todos los archivos del primer nodo del servidor
- Recuperar la última configuración aplicada del clúster
- Actualizar la configuración del clúster
- Configurar el registro compatible con OCI para las instalaciones sin conexión
- Ejecutar la actualización
- Realizar operaciones posteriores a la actualización
- Configuración específica del producto
- Configuración avanzada de Orchestrator
- Configurar parámetros de Orchestrator
- Configurar AppSettings
- Configurar el tamaño máximo de la solicitud
- Anular la configuración de almacenamiento a nivel de clúster
- Configurar NLog
- Guardar los registros del robot en Elasticsearch
- Configurar almacenes de credenciales
- Configurar clave de cifrado por tenant
- Limpiar la base de datos de Orchestrator
- Omitir la instalación de la biblioteca de host
- Buenas prácticas y mantenimiento
- Solución de problemas
- Cómo solucionar los problemas de los servicios durante la instalación
- Cómo reducir los permisos para un directorio de copia de seguridad NFS
- Cómo desinstalar el clúster
- Cómo limpiar los artefactos sin conexión para mejorar el espacio en disco
- Cómo borrar datos de Redis
- Cómo habilitar el registro de Istio
- Cómo limpiar manualmente los registros
- Sacar a Ceph del modo solo lectura
- Cómo limpiar los registros antiguos almacenados en el depósito sf-logs
- Cómo deshabilitar los registros de transmisión para AI Center
- Cómo depurar instalaciones de Automation Suite fallidas
- Cómo eliminar imágenes del instalador antiguo después de la actualización
- Cómo deshabilitar la descarga de la suma de comprobación TX
- Cómo establecer manualmente el nivel de registro de ArgoCD en Info
- Cómo expandir el almacenamiento de AI Center
- Cómo generar el pull_secret_value codificado para registros externos
- Cómo abordar los cifrados débiles en TLS 1.2
- Cómo comprobar la versión de TLS
- Cómo trabajar con certificados
- Cómo programar la copia de seguridad y la restauración de datos de Ceph
- Cómo recopilar datos de uso de DU con el almacén de objetos en el clúster (Ceph)
- Cómo instalar RKE2 SELinux en entornos aislados
- Cómo limpiar copias de seguridad diferenciales antiguas en un servidor NFS
- Cómo implementar Insights en un clúster habilitado para FIPS
- Cómo migrar a cgroup v2
- Cómo recuperar la autenticación Kerberos después de reiniciar una máquina virtual
- Cómo enviar una imagen de Docker local al registro en el clúster
- Cómo excluir depósitos de la copia de seguridad
- Error al descargar el paquete
- La instalación sin conexión falla porque falta un binario
- Azure disk not marked as SSD
- Fallo tras la actualización del certificado
- Errores de validación del certificado TLS
- El antivirus causa problemas de instalación
- Automation Suite not working after OS upgrade
- Automation Suite requiere que backlog_wait_time se establezca en 0
- La instalación del registro temporal falla en RHEL 8.9
- Problema de reinicio frecuente en las implementaciones del espacio de nombres de uipath durante las instalaciones sin conexión
- Configuración de DNS no respetada por CoreDNS
- La propagación del registro en el clúster falla debido a la memoria insuficiente
- Las comprobaciones de requisitos previos fallan cuando los proyectos modernos de Document Understanding están habilitados y AI Center está deshabilitado
- Upgrade fails due to unhealthy Ceph
- La actualización falla debido a objetos clásicos en la base de datos de Orchestrator
- El clúster de Ceph se encuentra en un estado degradado tras una actualización en paralelo.
- La actualización del servicio falla para Apps
- Tiempos de actualización in situ
- La actualización falla en entornos sin conexión
- pod de snapshot-controller-crds en estado CrashLoopBackOff después de la actualización
- La actualización falla debido a los tamaños de PVC de Insights anulados
- Error de actualización debido a un nombre de host en mayúsculas
- Establecer un intervalo de tiempo de espera para los portales de gestión
- La autenticación no funciona tras la migración
- kinit: no se puede encontrar la KDC para el territorio <AD Domain> mientras se obtienen las credenciales iniciales
- kinit: keytab no contiene claves adecuadas para *** mientras se obtienen las credenciales iniciales
- Error en la operación GSSAPI debido a un código de estado no válido
- Alarma recibida por un error en el trabajo de Kerberos-tgt-update
- Proveedor de SSPI: servidor no encontrado en la base de datos de Kerberos
- Error en inicio de sesión de un usuario AD debido a una cuenta deshabilitada
- ArgoCD login failed
- Fallo en la obtención de la imagen de Sandbox
- Los pods no se muestran en la interfaz de usuario de ArgoCD
- Fallo de la sonda Redis
- El servidor RKE2 no se inicia
- ArgoCD entra en estado de progreso tras la primera instalación
- Pod del servidor de repositorio de ArgoCD en CrashLoopBackOff
- Mitigación manual de Política de red de ArgoCD (GHSA-47m3-95c7-g2g8)
- Faltan métricas de Ceph-rook en los paneles de supervisión
- Falta de coincidencia en los errores informados durante las comprobaciones de estado de diagnóstico
- Configurar solicitudes de recursos y límites para cargas de trabajo creadas por uipathctl
- No hay problema ascendente en buen estado
- Inicio de Redis bloqueado por antivirus
- Los pods de AI Center y Document Understanding no se inician con la verificación del certificado TLS habilitada
- Fluentd no exporta registros en entornos IPv6
- Studio Desktop no puede cargar conectores y actividades de Integration Service
- Document Understanding no se encuentra en la barra izquierda de Automation Suite
- Estado fallido al crear una sesión de etiquetado de datos
- Estado fallido al intentar implementar una habilidad ML
- El trabajo de migración falla en ArgoCD
- El reconocimiento de la escritura manual con el extractor de formularios inteligente no funciona
- Ejecutar alta disponibilidad con Process Mining
- La ingestión de Process Mining falló al iniciar sesión con Kerberos
- No se puede conectar a la base de datos AutomationSuite_ProcessMining_Warehouse utilizando una cadena de conexión en formato pyodbc
- La instalación de Airflow falla con sqlalchemy.exc.ArgumentError: no se pudo analizar la URL rfc1738 de la cadena ''
- Cómo añadir una regla de tabla de IP para utilizar el puerto 1433 de SQL Server
- El certificado de Automation Suite no es de confianza desde el servidor donde se ejecuta CData Sync
- Process Mining no se carga después de deshabilitarlo y volver a habilitarlo
- Ejecutar la herramienta de diagnóstico
- Uso del paquete de soporte de Automation Suite
- Explorar registros
Elimine un nodo de servidor, agente o GPU de un clúster multinodo de Automation Suite para el mantenimiento o la gestión de recursos.
Después de instalar Automation Suite, puedes eliminar cualquier nodo del clúster para fines de mantenimiento de la máquina o para liberar recursos no utilizados. Puedes eliminar los nodos de servidor, agente y GPU del clúster.
La eliminación de un nodo de un clúster solo es posible en configuraciones de producción multinodo preparada para alta disponibilidad.
La eliminación de nodos del clúster no provoca periodos de inactividad. Sin embargo, puede afectar al componente de caché interno si HAA no está configurado.
La eliminación del nodo GPU no esperará a los trabajos ya programados, como el proceso de entrenamiento o el análisis. Si estos trabajos se eliminan en el proceso de eliminación de nodos, deberás empezar de nuevo. Asegúrate de que no se estén ejecutando procesos en los nodos que planeas eliminar.
La realización de los siguientes pasos solo dará lugar a la eliminación de nodos del clúster. La máquina no se eliminará por completo y algunos residuos pueden hacerla inutilizable para otras instalaciones.
Asegúrate de formatear la máquina y prepararla para la instalación o para añadirla a un clúster existente siguiendo las instrucciones en Configurar los discos.
Requisitos
Para eliminar correctamente un nodo del clúster, debe cumplir los siguientes requisitos:
- La capacidad del clúster resultante debe coincidir con la capacidad total necesaria para ejecutar las cargas de trabajo programadas antes de la eliminación del nodo. Por ejemplo, si las cargas de trabajo totales requieren 32 vCPU y 64 GB de memoria, después de la eliminación del nodo, los nodos restantes del clúster deberían tener al menos la misma cantidad de recursos. De lo contrario, no se te permitirá eliminar los nodos.
- El clúster resultante debe tener como mínimo 3 nodos de servidor; se requiere además un número impar de nodos de servidor.
- Si la configuración es multizonal, el clúster resultante debe tener nodos de servidor en cada de las 3 zonas.
- El clúster debe estar en buen estado, es decir, todos los nodos o pods están en buen estado. Los pods no están en buen estado cuando se encuentran en cualquiera de los siguientes estados:
Pending,Error,Init,Crashloopbackoff,Terminating. - No se pueden eliminar nodos de GPU a menos que haya disponibles nodos de GPU correspondientes adicionales.
Eliminar un nodo del clúster
Para eliminar un nodo del clúster, siga estos pasos:
-
Inicie sesión en los nodos de servidor que no planea eliminar, y acceda a la carpeta del instalador:
cd /opt/UiPathAutomationSuitecd /opt/UiPathAutomationSuite -
Opcionalmente, si utiliza la configuración en línea, ejecute el siguiente comando:
cd online_installer_{VERSION} # Example: if you are using version 2021.10.3 then replace {VERSION} with 2021.10.3cd online_installer_{VERSION} # Example: if you are using version 2021.10.3 then replace {VERSION} with 2021.10.3 -
Elimine uno o varios nodos del clúster ejecutando el siguiente comando:
./bin/uipathctl rke2 node remove --name [comma separated list of node names without space in quotes] # Example: # ./bin/uipathctl rke2 node remove --name "server1,agent3"./bin/uipathctl rke2 node remove --name [comma separated list of node names without space in quotes] # Example: # ./bin/uipathctl rke2 node remove --name "server1,agent3"
El script te advierte que apagues o finalices el nodo; no elimina el nodo del clúster hasta que apagues el nodo. El script espera 5 minutos para que el nodo se apague antes de que se agote el tiempo de espera. El script proporciona instrucciones sobre qué nodo apagar y en qué orden. También puedes volver a ejecutar el script si no has apagado el nodo en el tiempo solicitado.
Para automatizar todo el proceso de eliminación de nodos, siga los siguientes pasos:
- Agrega la
--skip-node-deletional final del script en el paso 3. - Una vez que el script se ha realizado correctamente, desconecta el primer nodo de destino y vuelve a ejecutar el script, esta vez sin
--skip-node-deletion. Si no has desconectado el nodo en el orden proporcionado al script, éste fallará. Siempre puedes volver a ejecutar el script una vez desconectado el nodo previsto. - Repita el paso anterior hasta que se eliminen correctamente todos los nodos.
Para obtener el nombre de los nodos a eliminar, consulta Cómo obtener el nombre del nodo.
La eliminación de los nodos del servidor puede tardar unas horas y depende del volumen total de datos almacenados en el clúster. Eliminar los nodos agente, incluidos los nodos GPU, puede tardar hasta 20 minutos.
Cómo obtener el nombre del nodo
Para obtener los nombres de los nodos, siga estos pasos:
-
Establezca el contexto de Kubernetes como se explica en Habilitar kubectl.
-
Obtenga el nombre del nodo ejecutando el siguiente comando:
kubectl get nodeskubectl get nodes
En la siguiente imagen se observa un resultado de muestra, en el que los nombres de los nodos son agent3, server0, server1 y server2.