- Visão geral
- Requisitos
- Modelos de implantação
- Manual: preparando a instalação
- Manual: preparando a instalação
- Etapa 2: configuração do registro compatível com OCI para instalações offline
- Etapa 3: configuração do objectstore externo
- Etapa 4: configuração do High Availability Add-on
- Etapa 5: configuração de bancos de dados SQL
- Etapa 7: configuração do DNS
- Etapa 8: configuração dos discos
- Etapa 9: configuração dos ajustes do nível do kernel e do sistema operacional
- Etapa 10: configuração das portas do nó
- Etapa 11: aplicação de configurações diversas
- Etapa 12: validação e instalação dos pacotes RPM necessários
- Etapa 13: geração de cluster_config.json
- Amostra Cluster_config.json
- Configuração geral
- Configuração do perfil
- Configuração de Certificados
- Configuração do Banco de Dados
- Configuração externa do Objectstore
- Configuração de URL pré-assinada
- Configuração do ArgoCD
- Configuração da autenticação do Kerberos
- Configuração de registro externo compatível com OCI
- Disaster Recovery: configurações Ativo/Passivo e Ativo/Ativo
- Configuração do High Availability Add-on
- Configuração específica do Orchestrator
- Configuração específica do Insights
- Process Mining-specific configuration
- Configuração específica do Document Understanding
- Automation Suite Robots-specific configuration
- Configuração do monitoramento
- Opcional: configuração do servidor proxy
- Opcional: habilitação da resiliência a falhas zonais em um cluster de produção pronto para alta disponibilidade de vários nós
- Opcional: transmitindo resolv.conf personalizado
- Optional: Increasing fault tolerance
- Adicionando um nó de agente dedicado com suporte a GPU
- Adicionando um nó de agente dedicado para robôs do Automation Suite
- Etapa 15: configuração do registro temporário do Docker para instalações offline
- Etapa 16: validação dos pré-requisitos para a instalação
- Executando o uipathctl
- Manual: realizando a instalação
- Pós-instalação
- Administração de cluster
- Gerenciando produtos
- Introdução ao portal de administração do cluster
- Migração do Redis do High Availability Add-on no cluster para externo
- Migrating data between objectstores
- Migrating in-cluster objectstore to external objectstore
- Migração de um registro no cluster para um registro externo compatível com OCI
- Mudança para o cluster secundário manualmente em uma configuração Ativo/Passivo
- Disaster Recovery: executando operações pós-instalação
- Convertendo uma instalação existente para configuração multi-local
- Diretrizes sobre atualização de uma implantação Ativo/Passivo ou Ativo/Ativo
- Diretrizes sobre backup e restauração de uma implantação Ativo/Passivo ou Ativo/Ativo
- Escalando uma implantação de nó único (avaliação) para uma implantação de vários nós (HA)
- Monitoramento e alertas
- Migração e atualização
- Migração entre clusters do Automation Suite
- Atualizando o Automação Suite
- Download dos pacotes de instalação e obtenção de todos os arquivos no primeiro nó do servidor
- Recuperação da mais recente configuração aplicada do cluster
- Atualização da configuração de cluster
- Configuração do registro compatível com OCI para instalações offline
- Execução da atualização
- Realização de operações pós-atualização
- Configuração específica do produto
- Configuração avançada do Orchestrator
- Configuração de parâmetros do Orchestrator
- Configuração do AppSettings
- Configuração do tamanho máximo da solicitação
- Substituição da configuração de armazenamento no nível do cluster
- Configuração do NLog
- Salvando logs do robô no Elasticsearch
- Configuração dos repositórios de credenciais
- Configuração da chave de criptografia por tenant
- Limpeza do banco de dados do Orchestrator
- Ignorar a instalação da biblioteca do host
- Melhores práticas e manutenção
- Solução de problemas
- Como solucionar problemas dos serviços durante a instalação
- Como reduzir as permissões para um diretório de backup NFS
- Como desinstalar o cluster
- Como limpar os artefatos offline para melhorar o espaço em disco
- Como limpar os dados do Redis
- Como habilitar o registro em log do Istio
- Como limpar logs manualmente
- Alterando o modo somente leitura do Ceph
- Como limpar logs antigos armazenados no bucket do sf-logs
- Como desabilitar os logs de streaming para o AI Center
- Como depurar instalações do Automation Suite com falha
- Como excluir imagens do instalador antigo após a atualização
- Como desabilitar o descarregamento de soma de verificação do TX
- Como definir manualmente o nível de log do ArgoCD como Info
- Como expandir o armazenamento do AI Center
- Como gerar o pull_secret_value codificado para registros externos
- Como lidar com cifras fracas no TLS 1.2
- Como verificar a versão do TLS
- Como trabalhar com certificados
- Como agendar o backup e restaurar dados do Ceph
- Como coletar dados de uso de DU com objectstore (Ceph) no cluster
- Como instalar o RKE2 SELinux em ambientes air-gapped
- Como limpar backups diferenciados antigos em um servidor NFS
- Como implantar o Insights em um cluster habilitado para FIPS
- Como migrar para o Cgroup v2
- Como recuperar a autenticação do Kerberos após uma reinicialização da VM
- Como enviar uma imagem do Docker local para o registro no cluster
- Como excluir buckets do backup
- Erro ao baixar o pacote
- A instalação offline falha devido a um binário ausente
- Azure disk not marked as SSD
- Falha após a atualização do certificado
- Erros de validação de certificado TLS
- Antivírus causa problemas de instalação
- Automation Suite not working after OS upgrade
- O Automation Suite requer que backlog_wait_time seja definido como 0
- A instalação do registro temporário falha no RHEL 8.9
- Problema de reinício frequente em implantações de namespace uipath durante instalações offline
- Configurações de DNS não honradas pelo CoreDNS
- A geração de registros no cluster falha devido a memória insuficiente
- As verificações de pré-requisitos falham quando os projetos modernos do Document Understanding estão habilitados e o AI Center está desabilitado
- Upgrade fails due to unhealthy Ceph
- A atualização falha devido a objetos clássicos no banco de dados do Orchestrator
- Um cluster do Ceph foi encontrado em um estado degradado após atualização lado a lado
- A atualização do serviço falha para o Apps
- Tempos limite de atualização no local
- Falha de atualização em ambientes offline
- pod snapshot-controller-crds no estado CrashLoopBackOff após a atualização
- Falha de atualização devido aos tamanhos de PVC do Insights substituídos
- Falha de atualização devido ao nome de host em letra maiúscula
- Configurando um intervalo de tempo limite para os portais de gerenciamento
- Autenticação não funciona após migração
- kinit: não é possível encontrar o KDC para o realm <AD Domain> ao obter credenciais iniciais
- kinit: o Keytab não contém chaves adequadas para *** ao obter credenciais iniciais
- Falha na operação GSSAPI devido a código de status inválido
- Alarme recebido para trabalho com falha do Kerberos-tgt-update
- Provedor de SSPI: servidor não encontrado no banco de dados Kerberos
- Falha de login para usuário do AD devido a conta desabilitada
- ArgoCD login failed
- Falha ao obter a imagem do sandbox
- Os pods não são exibidos na UI do ArgoCD
- Falha de teste do Redis
- O servidor RKE2 falha ao iniciar
- O ArgoCD entra em estado Em andamento após a primeira instalação
- Pod de repositório do ArgoCD em CrashLoopBackOff
- Migreção manual do ArgoCD NetworkPolicy (GHSA-47m3-95c7-g2g8)
- Métricas Ceph-rook ausentes nos painéis de monitoramento
- Incompatibilidade em erros relatados durante as verificações de integridade do diagnóstico
- Configuração de solicitações e limites de recursos para cargas de trabalho criadas pelo uipathctl
- Nenhum problema upstream íntegro
- Inicialização do Redis bloqueada por antivírus
- Os pods do AI Center e do Document Understanding falham ao iniciar com a verificação do certificado TLS habilitada
- O Fluentd não exporta logs em ambientes IPv6
- O Studio Desktop não pode carregar conectores e atividades do Integration Service
- O Document Understanding não está no menu de navegação esquerdo do Automation Suite
- Status de Falha ao criar uma sessão de rotulagem de dados
- Status de Falha ao tentar implantar uma habilidade de ML
- Trabalho de migração falha no ArgoCD
- Reconhecimento de escrita com o Extrator de formulários inteligente não está funcionando
- Execução de alta disponibilidade com o Process Mining
- Falha na ingestão do Process Mining ao fazer logon usando o Kerberos
- Não é possível conectar-se ao banco de dados AutomationSuite_ProcessMining_Warehouse usando uma string de conexão em formato pyodbc.
- A instalação do Airflow falha com sqlalchemy.exc.ArgumentError: não foi possível analisar o URL rfc1738 da string ''
- Como adicionar uma regra de tabela de IP para usar a porta 1433 do SQL Server
- O certificado do Automation Suite não é confiável para o servidor em que o CData Sync está sendo executado
- O Process Mining falha ao carregar após desabilitá-lo e reabilitá-lo
- Execução da ferramenta de diagnóstico
- Usando o pacote de suporte do Automation Suite
- Exploração de logs
Restaure um cluster do Automation Suite a partir de um backup de instantâneo e habilite novamente o backup após a conclusão da restauração.
Depois que um cluster é restaurado, o backup de instantâneo não é habilitado. Para habilitá-lo após a restauração, consulte Habilitação do instantâneo de backup.
Restaurar o cluster não restaura fontes de dados externas, como o SQL Server, objectstore ou o registro compatível com OCI. Certifique-se de restaurar essas fontes de dados para o snapshot relevante.
Para restaurar o cluster, execute as seguintes etapas:
-
Instale a infraestrutura de cluster em todos os nós do servidor. Detalhes...
Observação:O hardware que você fornece para o cluster de restauração deve ser semelhante ao hardware do cluster de backup. Para obter detalhes, consulte Requisitos de hardware e software.
-
Configure o instantâneo no cluster restaurado. Detalhes...
-
Selecione o snapshot para restaurar. Detalhes...
-
Restaure os dados e as configurações. Detalhes...
Step 1: Installing the cluster infrastructure
Preparação
-
Baixe o instalador de restauração. Você pode encontrá-lo dentro do pacote
as-installer.zip. Para obter instruções de download, consulte Download dos pacotes de instalação. -
Em ambientes offline, você deve fornecer um registro externo compatível com OCI ou um registro temporário. Observe que a configuração do registro deve permanecer a mesma do cluster original. Para configurar o registro, consulte as seguintes instruções:
- Configurando o registro externo compatível com OCI
- Configuração do registro temporário do Docker. Escolha esta opção apenas se você não usou um registro externo compatível com OCI antes de ocorrer o desastre.
-
Prepare o arquivo de configuração e disponibilize-o em todos os nós do cluster. Para preparar o arquivo de configuração, siga uma das seguintes etapas:
- Opção A: reutilize o arquivo
cluster_config.jsonque você aplicou ao cluster antes de ocorrer o desastre; - Opção B: crie um arquivo
cluster_config.jsonmínimo com os parâmetros necessários, conforme mostrado no exemplo a seguir:{ "fixed_rke_address": "fqdn", "fqdn": "fqdn", "rke_token": "guid", "profile": "cluster_profile", "external_object_storage": { "enabled": false }, "install_type": "offline or online", "snapshot": { "enabled": true, "nfs": { "server": "nfs_server_endpoint", "location": "nfs_server_mountpoint" } }, "proxy": { "enabled": false } }{ "fixed_rke_address": "fqdn", "fqdn": "fqdn", "rke_token": "guid", "profile": "cluster_profile", "external_object_storage": { "enabled": false }, "install_type": "offline or online", "snapshot": { "enabled": true, "nfs": { "server": "nfs_server_endpoint", "location": "nfs_server_mountpoint" } }, "proxy": { "enabled": false } }Observação:Esse exemplo usa parâmetros para uma configuração de backup baseada em NFS. Se você usar uma configuração de backup diferente, deve substituir a seção relacionada ao NFS pelos parâmetros específicos para sua configuração de backup.
- Opção A: reutilize o arquivo
A seguinte tabela descreve todos os parâmetros que você deve incluir no arquivo cluster_config.json mínimo. Certifique-se de fornecer os mesmos valores de parâmetros usados no cluster original. Você pode alterar os valores de parâmetro após a restauração.
Em ambientes offline, além de definir os parâmetros cluster_config.json listados na tabela a seguir, você também deve fornecer a configuração do registro externo compatível com OCI. Para obter detalhes, consulte Configuração do registro externo compatível com OCI.
| Parâmetro | Valor |
|---|---|
|
| FQDN do cluster do Automation Suite. O valor deve ser igual ao antigo FQDN. Fornecer um valor FQDN diferente pode fazer com que a restauração falhe. |
|
| O endereço fixo usado para registro de nó de balanceamento de carga e solicitações de API do Kube. fqdn . Caso contrário, use o valor fqdn do primeiro nó do servidor. Para obter detalhes, consulte Configuração do balanceador de carga . |
|
| Use um GUID recém-gerado aqui. Este é um segredo pré-compartilhado, específico do cluster. É necessário para todos os nós associados ao cluster. |
|
| Define o perfil da instalação. Os perfis disponíveis são:
|
|
| Indica o tipo de instalação que você planeja realizar. Suas opções são:
|
|
| O FQDN ou o endereço IP do local de armazenamento do instantâneo (como mynfs.mycompany.com ou 192.23.222.81 ). |
|
| O local ou caminho para o local de armazenamento do instantâneo. |
|
| O caminho para o diretório personalizado usado para logs do pod. Isso é necessário se o cluster tiver sido configurado com o caminho de logs de pod personalizado. |
|
| Este parâmetro é obrigatório apenas se o proxy estiver habilitado. Para obter detalhes, consulte Opcional: configuração do servidor do proxy. |
Para obter detalhes sobre como configurar cluster_config.json, consulte Manual: experiência de instalação avançada.
Execução
Instalar a infraestrutura de cluster no nó do servidor primário
Para instalar a infraestrutura no nó primário do cluster de restauração, execute os seguintes comandos:
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json --accept-license-agreement --restore
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json --accept-license-agreement --restore
Copie cluster_config.json do nó do servidor principal para os nós de servidor/agentes restantes. A etapa de instalação da infraestrutura no nó do servidor primário adiciona valores extras dos quais os nós restantes precisam.
Instalando a infraestrutura de cluster em servidores secundários
Para instalar a infraestrutura nos servidores secundários:
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json -j server --accept-license-agreement --restore
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json -j server --accept-license-agreement --restore
Como instalar a infraestrutura em todas as máquinas de agente
Para instalar a infraestrutura nos nós do agente:
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json -j agent --accept-license-agreement --restore
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json -j agent --accept-license-agreement --restore
Preenchimento do registro no cluster para instalações offline
Essa etapa é necessária apenas se você usar um registro no cluster para instalações offline. Você deve hidratar o registro antes de disparar a restauração, usando o seguinte comando:
./bin/uipathctl rke2 registry hydrate-registry /opt/UiPathAutomationSuite/cluster_config.json
./bin/uipathctl rke2 registry hydrate-registry /opt/UiPathAutomationSuite/cluster_config.json
Instalando a infraestrutura de cluster em nós de serviço
Instalação da infraestrutura de cluster nos nós de Automation Suite Robots
Para instalar a infraestrutura de cluster nos nós de Automation Suite Robots:
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json -j asrobots --accept-license-agreement --restore
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json -j asrobots --accept-license-agreement --restore
Instalando a infraestrutura de cluster em nós de GPU
Para instalar a infraestrutura do cluster nos nós da GPU:
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json -j gpu --accept-license-agreement --restore
cd <installer directory>
./bin/uipathctl rke2 install -i ../../cluster_config.json -o output.json -j gpu --accept-license-agreement --restore
Etapa 2: preparando o cluster para restauração
Depois que a infraestrutura estiver instalada, você precisa preparar o instantâneo do cluster para restauração. Com base em seu cenário, você deve executar os seguintes comandos:
-
Se você usar um objetore externo:
./bin/uipathctl manifest apply /opt/UiPathAutomationSuite/cluster_config.json --only velero --versions versions/helm-charts.json./bin/uipathctl manifest apply /opt/UiPathAutomationSuite/cluster_config.json --only velero --versions versions/helm-charts.json -
Se você usar um ceph-objectstore no cluster:
./bin/uipathctl manifest apply /opt/UiPathAutomationSuite/cluster_config.json --only base,rook-ceph-operator,rook-ceph-object-store,velero --versions versions/helm-charts.json./bin/uipathctl manifest apply /opt/UiPathAutomationSuite/cluster_config.json --only base,rook-ceph-operator,rook-ceph-object-store,velero --versions versions/helm-charts.json
Para configurar o backup do cluster restaurado, siga as etapas na seção Configurar o instantâneo do cluster .
Step 3: Selecting the snapshot to restore
Depois de configurar o snapshot, liste os snapshots existentes e decida aquele que você deseja usar como um ponto de restauração.
Step 4: Restoring data and settings
Para restaurar para um cluster anterior, forneça o nome do instantâneo do qual você deseja converter usando o sinalizador --from-snapshot <snapshot-name> .
./bin/uipathctl snapshot restore create <restore_name> --from-snapshot <snapshot_name>
./bin/uipathctl snapshot restore create <restore_name> --from-snapshot <snapshot_name>
O comando dispara o processo de restauração. O processo primeiro restaura o backup e depois executa tarefas relacionadas ao Automation Suite. Quando o armazenamento do Ceph no cluster é configurado, ele também restaura os dados do Ceph antes de sincronizar os aplicativos.
Se o processo de restauração falhar, você pode executar novamente o comando restore create com um novo nome. A nova tentativa retoma o processo de restauração da etapa em que falhou durante a tentativa anterior.
Para verificar o status do processo de restauração, execute o seguinte comando:
./bin/uipathctl snapshot restore history
./bin/uipathctl snapshot restore history
Esse comando mostra apenas o status de restauração do estado do cluster (recursos do Kubernetes).
Para monitorar as tarefas de restauração e pós-restauração de dados do Objectstore executadas pelo Automation Suite, verifique a saída do terminal do comando restore create de instantâneo.
Se você não especificar o nome do snapshot mais recente, o cluster restaurará o snapshot mais recente bem-sucedido. Consulte a lista de instantâneo para obter instantâneos disponíveis.
Restaurando cluster_config.json
Após a recuperação do cluster do Automation Suite, você pode querer recuperar o arquivo cluster_config.json para uso futuro, como adicionar novos nós ao cluster, atualizar, etc.
Para restaurar cluster_config.json, siga as seguintes etapas:
-
Você precisa encontrar a última configuração aplicada, executando o seguinte comando:
./bin/uipathctl manifest list-revisions./bin/uipathctl manifest list-revisionsA amostra a seguir é um exemplo da saída do comando:
VERSION UPDATED STATUS 1 2024-11-07 00:46:41 +0000 UTC successful 2 2024-11-07 01:14:20 +0000 UTC successful 3 2024-11-07 01:23:23 +0000 UTC successfulVERSION UPDATED STATUS 1 2024-11-07 00:46:41 +0000 UTC successful 2 2024-11-07 01:14:20 +0000 UTC successful 3 2024-11-07 01:23:23 +0000 UTC successful -
Selecione o número correto da VERSÃO implantado antes da criação do backup e execute o seguinte comando para recuperar o arquivo
cluster_config.json:./bin/uipathctl manifest get-revision --version <VERSION>./bin/uipathctl manifest get-revision --version <VERSION>A amostra a seguir é um exemplo da saída do comando:
./bin/uipathctl manifest get-revision --version 1 > ./cluster_config.json./bin/uipathctl manifest get-revision --version 1 > ./cluster_config.json
Adicionando certificados de CA ao armazenamento de confiança
Após restaurar o cluster, certifique-se de adicionar seus certificados de CA ao armazenamento de confiança das VMs restauradas. Para detalhes, consulte:
Recuperação de nova senha de monitoramento
Esta seção é aplicável apenas se você usar a solução de monitoramento integrada.
Após a restauração de um cluster do Automation Suite, você precisa recuperar a nova senha de monitoramento. Para isso, siga as etapas de Acesso às ferramentas de monitoramento.
Habilitação do AI Center no cluster restaurado
Depois de restaurar um cluster do Automation Suite com o AI Center™ habilitado, siga as etapas do procedimento Habilitação do AI Center no cluster restaurado .
Geração de novo ticket do Kerberos
Se a autenticação do Kerberos estiver configurada, você deve certificar-se de que o tíquete do Kerberos não esteja expirado.
Para gerar um novo tíquete do Kerberos, execute os seguintes comandos:
kubectl get cronjobs -A | grep kerberos //to identify the job with name kerberos-tgt-update
kubectl create job --from=cronjob/<cron-job-name> <new_job_name> -n <namespace>
kubectl get cronjobs -A | grep kerberos //to identify the job with name kerberos-tgt-update
kubectl create job --from=cronjob/<cron-job-name> <new_job_name> -n <namespace>
Certifique-se de substituir <cron-job-name>, <new_job_name> e <namespace> pelo nome real do seu trabalho cron, o nome pretendido para o novo trabalho e seu namespace real, respectivamente.
- Step 1: Installing the cluster infrastructure
- Preparação
- Execução
- Etapa 2: preparando o cluster para restauração
- Step 3: Selecting the snapshot to restore
- Step 4: Restoring data and settings
- Restaurando cluster_config.json
- Adição de certificados de CA ao armazenamento de confiança
- Recuperação de nova senha de monitoramento
- Habilitação do AI Center no cluster restaurado
- Geração de novo ticket do Kerberos