- Visão geral
- Requisitos
- Modelos de implantação
- Manual: preparando a instalação
- Manual: preparando a instalação
- Etapa 2: configuração do registro compatível com OCI para instalações offline
- Etapa 3: configuração do objectstore externo
- Etapa 4: configuração do High Availability Add-on
- Etapa 5: configuração de bancos de dados SQL
- Etapa 6: configuração do balanceador de carga
- Etapa 7: configuração do DNS
- Etapa 8: configuração dos discos
- Etapa 9: configuração dos ajustes do nível do kernel e do sistema operacional
- Etapa 10: configuração das portas do nó
- Etapa 11: aplicação de configurações diversas
- Etapa 12: validação e instalação dos pacotes RPM necessários
- Etapa 13: geração de cluster_config.json
- Configuração de Certificados
- Configuração do Banco de Dados
- Configuração externa do Objectstore
- Configuração de URL pré-assinada
- Configuração da autenticação do Kerberos
- Configuração de registro externo compatível com OCI
- Disaster Recovery: configurações Ativo/Passivo e Ativo/Ativo
- Configuração do High Availability Add-on
- Configuração específica do Orchestrator
- Configuração específica do Insights
- Process Mining-specific configuration
- Configuração específica do Document Understanding
- Automation Suite Robots-specific configuration
- Configuração do monitoramento
- Opcional: configuração do servidor proxy
- Opcional: habilitação da resiliência a falhas zonais em um cluster de produção pronto para alta disponibilidade de vários nós
- Opcional: transmitindo resolv.conf personalizado
- Optional: Increasing fault tolerance
- Parâmetros do install-uipath.sh
- Adicionando um nó de agente dedicado com suporte a GPU
- Adição de um nó de agente dedicado ao Task Mining
- Conexão do aplicativo Task Mining
- Adicionando um nó de agente dedicado para robôs do Automation Suite
- Etapa 15: configuração do registro temporário do Docker para instalações offline
- Etapa 16: validação dos pré-requisitos para a instalação
- Manual: realizando a instalação
- Pós-instalação
- Administração de cluster
- Gerenciando produtos
- Introdução ao portal de administração do cluster
- Migração do High Availability Add-on no cluster para externo
- Migração de um registro no cluster para um registro externo compatível com OCI
- Mudança para o cluster secundário manualmente em uma configuração Ativo/Passivo
- Disaster Recovery: executando operações pós-instalação
- Convertendo uma instalação existente para configuração multi-local
- Diretrizes sobre atualização de uma implantação Ativo/Passivo ou Ativo/Ativo
- Diretrizes sobre backup e restauração de uma implantação Ativo/Passivo ou Ativo/Ativo
- Redirecionamento do tráfego dos serviços não compatíveis para o cluster principal
- Escalando uma implantação de nó único (avaliação) para uma implantação de vários nós (HA)
- Monitoramento e alertas
- Migração e atualização
- Etapa 1: mover os dados da organização do Identity, de independente para o Automation Suite
- Etapa 2: restauração do banco de dados de produtos independente
- Etapa 3: backup do banco de dados da plataforma no Automation Suite
- Etapa 4: mesclando organizações no Automation Suite
- Etapa 5: atualização das strings de conexão do produto migradas
- Etapa 6: migração do Orchestrator independente
- Etapa 7: migração do Insights independente
- Etapa 8: migração do Test Manager independente
- Etapa 9: exclusão do tenant padrão
- Executando uma migração de único tenant
- Migração do Automation Suite no Linux para o Automation Suite no EKS/AKS
- Atualizando o Automação Suite
- Download dos pacotes de instalação e obtenção de todos os arquivos no primeiro nó do servidor
- Recuperação da mais recente configuração aplicada do cluster
- Atualização da configuração de cluster
- Configuração do registro compatível com OCI para instalações offline
- Execução da atualização
- Realização de operações pós-atualização
- Configuração específica do produto
- Uso da ferramenta de configuração do Orchestrator
- Configuração de parâmetros do Orchestrator
- Configurações de aplicativo do Orchestrator
- Configuração do AppSettings
- Configuração do tamanho máximo da solicitação
- Substituição da configuração de armazenamento no nível do cluster
- Configuração dos repositórios de credenciais
- Configuração da chave de criptografia por tenant
- Limpeza do banco de dados do Orchestrator
- Melhores práticas e manutenção
- Solução de problemas
- Como solucionar problemas dos serviços durante a instalação
- Como desinstalar o cluster
- Como limpar os artefatos offline para melhorar o espaço em disco
- Como limpar os dados do Redis
- Como habilitar o registro em log do Istio
- Como limpar logs manualmente
- Como limpar logs antigos armazenados no bucket do sf-logs
- Como desabilitar os logs de streaming para o AI Center
- Como depurar instalações do Automation Suite com falha
- Como excluir imagens do instalador antigo após a atualização
- Como desabilitar o descarregamento de soma de verificação do TX
- Como atualizar do Automation Suite 2022.10.10 e 2022.4.11 para 2023.10.2
- Como definir manualmente o nível de log do ArgoCD como Info
- Como expandir o armazenamento do AI Center
- Como gerar o pull_secret_value codificado para registros externos
- Como lidar com cifras fracas no TLS 1.2
- Como trabalhar com certificados
- Como encaminhar logs do aplicativo para o Splunk
- Como limpar imagens do Docker não usadas dos pods de registro
- Como coletar dados de uso de DU com objectstore (Ceph) no cluster
- Como instalar o RKE2 SELinux em ambientes air-gapped
- Como limpar backups diferenciados antigos em um servidor NFS
- Não é possível executar uma instalação offline no SO RHEL 8.4
- Erro ao baixar o pacote
- A instalação offline falha devido a um binário ausente
- Problema de certificado na instalação offline
- First installation fails during Longhorn setup
- Erro de validação da string de conexão ao SQL
- Verificação de pré-requisito para o módulo iscsid do selinux falha
- Azure disk not marked as SSD
- Falha após a atualização do certificado
- Antivírus causa problemas de instalação
- Automation Suite not working after OS upgrade
- O Automation Suite requer que backlog_wait_time seja definido como 0
- Não é possível montar o volume devido a não estar pronto para cargas de trabalho
- Falha na coleta de logs do pacote de suporte
- A cadeia de caracteres de conexão SQL da Automação de Teste é ignorada
- Configurações de DNS não honradas pelo CoreDNS
- Perda de dados ao reinstalar ou atualizar o Insights após a atualização do Automation Suite
- A atualização de nó único falha no estágio de malha
- Cluster unhealthy after automated upgrade from 2021.10
- Upgrade fails due to unhealthy Ceph
- RKE2 não é iniciado devido a um problema de espaço
- O volume não pode ser montado e permanece no estado de loop anexar/desanexar
- A atualização falha devido a objetos clássicos no banco de dados do Orchestrator
- Um cluster do Ceph foi encontrado em um estado degradado após atualização lado a lado
- Um componente sem integridade do Insights causa uma falha na migração
- A atualização do serviço falha para o Apps
- Tempos limite de atualização no local
- Migração de registro do Docker presa no estágio de exclusão do PVC
- Falha no provisionamento do AI Center após a atualização para a 2023.10 ou posterior
- Falha de atualização em ambientes offline
- A validação de SQL falha durante a atualização
- pod snapshot-controller-crds no estado CrashLoopBackOff após a atualização
- Erro de upgrade/reinstalação do endpoint da API REST do Longhorn
- Falha de atualização devido aos tamanhos de PVC do Insights substituídos
- Falha de atualização de serviço durante a execução de script pré-serviço
- Falha ao carregar ou baixar dados no objectstore
- PVC resize does not heal Ceph
- Falha no redimensionamento do PVC do Objectstore
- Pod do Rook Ceph ou Looker travado no estado Init
- Erro de anexo de volume StatefulSet
- Falha ao criar volumes persistentes
- Falha ao compactar métricas devido a blocos corrompidos no Thanos
- Configurando um intervalo de tempo limite para os portais de gerenciamento
- Autenticação não funciona após migração
- kinit: não é possível encontrar o KDC para o realm <AD Domain> ao obter credenciais iniciais
- kinit: o Keytab não contém chaves adequadas para *** ao obter credenciais iniciais
- Falha na operação GSSAPI devido a código de status inválido
- Alarme recebido para trabalho com falha do Kerberos-tgt-update
- Provedor de SSPI: servidor não encontrado no banco de dados Kerberos
- Falha de login para usuário do AD devido a conta desabilitada
- ArgoCD login failed
- Atualizar as conexões de diretório subjacentes
- Falha ao obter a imagem do sandbox
- Os pods não são exibidos na UI do ArgoCD
- Falha de teste do Redis
- O servidor RKE2 falha ao iniciar
- Segredo não encontrado no namespace da UiPath
- O ArgoCD entra em estado Em andamento após a primeira instalação
- Manual ArgoCD NetworkPolicy mitigation (GHSA-47m3-95c7-g2g8)
- Unhealthy services after cluster restore or rollback
- Pods presos em Init:0/X
- Métricas Ceph-rook ausentes nos painéis de monitoramento
- Os pods não podem se comunicar com o FQDN em um ambiente de proxy
- Falha ao configurar alertas por e-mail após a atualização
- Nenhum problema upstream íntegro
- Falha ao adicionar nós de agente em ambientes offline
- O acesso ao FQDN retorna RBAC: erro de acesso negado
- O Document Understanding não está no menu de navegação esquerdo do Automation Suite
- Status de Falha ao criar uma sessão de rotulagem de dados
- Status de Falha ao tentar implantar uma habilidade de ML
- Trabalho de migração falha no ArgoCD
- Reconhecimento de escrita com o Extrator de formulários inteligente não está funcionando
- Falha na implantação de habilidade de ML devido à expiração do token
- Execução de alta disponibilidade com o Process Mining
- Falha na ingestão do Process Mining ao fazer logon usando o Kerberos
- Após a recuperação de desastres, o Dapr não está funcionando corretamente para Process Mining
- Configurando o Dapr com o Redis no modo de cluster
- Não é possível conectar-se ao banco de dados AutomationSuite_ProcessMining_Warehouse usando uma string de conexão em formato pyodbc.
- A instalação do Airflow falha com sqlalchemy.exc.ArgumentError: não foi possível analisar o URL rfc1738 da string ''
- Como adicionar uma regra de tabela de IP para usar a porta 1433 do SQL Server
- O certificado do Automation Suite não é confiável para o servidor em que o CData Sync está sendo executado
- Execução da ferramenta de diagnóstico
- Usando o pacote de suporte do Automation Suite
- Exploração de logs
kubernetes-system
KubernetesDiskPressure
Esse alerta indica que o uso do disco é muito alto no nó Kubernetes.
Ao surgir esse alerta, tente ver qual pod está consumindo mais disco.
KubernetesMemoryPressure
Esse alerta indica que o uso de memória está muito alto no nó do Kubernetes.
Se esse alerta disparar, tente ver qual pod está consumindo mais memória.
KubePersistentVolumeFillingUp
When Warning: The available space is less than 30% and is likely to fill up within four days.
When Critical: The available space is less than 10%.
Para qualquer serviço que fique sem espaço, pode ser difícil recuperar os dados, portanto, os volumes devem ser redimensionados antes de atingir 0% de espaço disponível.
Para obter instruções, consulte Configuração do cluster.
Para alertas específicos do Prometheus, consulte o PrometheusStorageUsage para obter mais detalhes e instruções.
KubePersistentVolumeErrors
O PersistentVolume não pode ser provisionado. Isso significa que qualquer serviço que exija o volume não será iniciado. Verifique se há outros erros com armazenamento Longhorn e/ou Ceph e entre em contato com o Suporte da UiPath®.
node-exporter
NodeFilesystemSpaceFillingUp
O sistema de arquivos em um nó específico está sendo preenchido completamente. Provisione mais espaço adicionando um disco ou montando discos não utilizados.
NodeFilesystemAlmostOutOfSpace
O sistema de arquivos em um nó específico está sendo preenchido completamente. Provisione mais espaço adicionando um disco ou montando discos não utilizados.
NodeFilesystemFilesFillingUp
O sistema de arquivos em um nó específico está sendo preenchido completamente. Provisione mais espaço adicionando um disco ou montando discos não utilizados.
NodeFilesystemAlmostOutOfFiles
O sistema de arquivos em um nó específico está sendo preenchido completamente. Provisione mais espaço adicionando um disco ou montando discos não utilizados.
NodeNetworkReceiveErrs
Há um problema com a interface de rede física no nó. Se os problemas persistirem, pode ser necessário substituí-la.
NodeNetworkTransmitErrs
Há um problema com a interface de rede física no nó. Se os problemas persistirem, pode ser necessário substituí-la.
ceph.rule, cluster-state-alert.rule
CephClusterErrorState
Este alerta indica que o cluster de armazenamento Ceph está em estado de erro por mais de 10m.
Este alerta reflete que a tarefa rook-ceph-mgr esteve em estado de erro por um período de tempo inaceitável. Verifique se há outros alertas que possam ter sido acionados antes deste e solucione-os primeiro.
CephMonQuorumAtRisk
Esse alerta indica que o quorum do cluster de armazenamento está baixo.
Múltiplos mons trabalham juntos para fornecer redundância; isso é possível porque cada um mantém uma cópia dos metadados. O cluster é implantado com 3 mons e requer 2 ou mais mons para estar em funcionamento para quorum e para que as operações de armazenamento sejam executadas. Se o quorum for perdido, o acesso aos dados estará em risco.
Se esse alerta for disparado, verifique se algum OSD está no estado de término, se houver algum, force a exclusão desses pods e aguarde algum tempo até que o operador se reconcilie. Se o problema persistir, entre em contato com o Suporte da UiPath®.
cluster-utilization-alert.rules
CephClusterNearFull
Esse alerta indica que a utilização do cluster de armazenamento Ceph ultrapassou 75% e se tornará somente leitura em 85%.
Se esse alerta for disparado, libere algum espaço no Ceph excluindo alguns conjuntos de dados não utilizados no AI Center ou no Task Mining ou expanda o armazenamento disponível para o Ceph PVC.
Antes de redimensionar o PVC, certifique-se de atender aos requisitos de armazenamento. Para obter detalhes, consulte Avaliando suas necessidades de armazenamento.
CephClusterCriticallyFull
Esse alerta indica que a utilização do cluster de armazenamento Ceph superou 80% e se tornará somente leitura aos 85%.
Se esse alerta for disparado, libere algum espaço no Ceph excluindo alguns conjuntos de dados não utilizados no AI Center ou no Task Mining ou expanda o armazenamento disponível para o Ceph PVC.
Antes de redimensionar o PVC, certifique-se de atender aos requisitos de armazenamento. Para obter detalhes, consulte Avaliando suas necessidades de armazenamento.
CephClusterReadOnly
Esse alerta indica que a utilização do cluster de armazenamento do Ceph ultrapassou 85% e se tornará somente leitura agora. Libere algum espaço ou expanda o cluster de armazenamento imediatamente.
Se esse alerta for disparado, libere algum espaço no Ceph excluindo alguns conjuntos de dados não utilizados no AI Center ou no Task Mining ou expanda o armazenamento disponível para o Ceph PVC.
Antes de redimensionar o PVC, certifique-se de atender aos requisitos de armazenamento. Para obter detalhes, consulte Avaliando suas necessidades de armazenamento.
osd-alert.rules
CephOSDCriticallyFull
Quando a gravidade do alerta é Critical, o espaço disponível é inferior a 20%.
Para qualquer serviço que fique sem espaço, pode ser difícil recuperar os dados, portanto, você deve redimensionar os volumes antes de atingir 10% de espaço disponível. Consulte as seguintes instruções: Configuração do cluster.
CephOSDNearFull
Esse alerta indica que a utilização do cluster de armazenamento Ceph ultrapassou 75% e se tornará somente leitura em 85%.
Se esse alerta for disparado, libere algum espaço no Ceph excluindo alguns conjuntos de dados não utilizados no AI Center ou no Task Mining ou expanda o armazenamento disponível para o Ceph PVC.
Antes de redimensionar o PVC, certifique-se de atender aos requisitos de armazenamento. Para obter detalhes, consulte Avaliando suas necessidades de armazenamento.
PersistentVolumeUsageNearFull
Esse alerta indica que a utilização do cluster de armazenamento Ceph ultrapassou 75% e se tornará somente leitura em 85%.
Se esse alerta for disparado, libere algum espaço no Ceph excluindo alguns conjuntos de dados não utilizados no AI Center ou no Task Mining ou expanda o armazenamento disponível para o Ceph PVC.
Antes de redimensionar o PVC, certifique-se de atender aos requisitos de armazenamento. Para obter detalhes, consulte Avaliando suas necessidades de armazenamento.
persistent-volume-alert.rules
PersistentVolumeUsageCritical
Se esse alerta for disparado, libere algum espaço no Ceph excluindo alguns conjuntos de dados não utilizados no AI Center ou no Task Mining ou expanda o armazenamento disponível para o Ceph PVC.
Antes de redimensionar o PVC, certifique-se de atender aos requisitos de armazenamento. Para obter detalhes, consulte Avaliando suas necessidades de armazenamento.
pool-quota.rules
CephPoolQuotaBytesCriticallyExhausted
Esse alerta indica que o uso do pool de armazenamento do Ceph ultrapassou 90%.
Se esse alerta disparar, libere algum espaço no CEPH excluindo alguns conjuntos de dados não utilizados no AI Center ou no Task Mining ou expanda o armazenamento disponível para o Ceph PVC.
Antes de redimensionar o PVC, certifique-se de atender aos requisitos de armazenamento. Para obter detalhes, consulte Avaliando suas necessidades de armazenamento.
host-disk
LowDiskForRancherPartition
Este alerta indica que o espaço livre para a partição /var/lib/rancher é menor que:
- 35% - a gravidade do alerta é warning
- 25% - a gravidade do alerta é crítica
Se esse alerta disparar, aumente o tamanho do disco.
LowDiskForKubeletPartition
Este alerta indica que o espaço livre para a partição /var/lib/kubelet é menor que:
- 35% - a gravidade do alerta é warning
- 25% - a gravidade do alerta é crítica Se esse alerta for acionado, aumente o tamanho do disco.
LowDiskForVarPartition
Este alerta indica que o espaço livre para a partição /var é menor que:
- 35% - a gravidade do alerta é warning
- 25% - a gravidade do alerta é crítica
Os requisitos de armazenamento para habilidades de ML podem aumentar substancialmente o uso do disco.
Se esse alerta disparar, aumente o tamanho do disco.
- kubernetes-system
- KubernetesDiskPressure
- KubernetesMemoryPressure
- KubePersistentVolumeFillingUp
- KubePersistentVolumeErrors
- node-exporter
- NodeFilesystemSpaceFillingUp
- NodeFilesystemAlmostOutOfSpace
- NodeFilesystemFilesFillingUp
- NodeFilesystemAlmostOutOfFiles
- NodeNetworkReceiveErrs
- NodeNetworkTransmitErrs
- ceph.rule, cluster-state-alert.rule
- CephClusterErrorState
- CephMonQuorumAtRisk
- cluster-utilization-alert.rules
- CephClusterNearFull
- CephClusterCriticallyFull
- CephClusterReadOnly
- osd-alert.rules
- CephOSDCriticallyFull
- CephOSDNearFull
- PersistentVolumeUsageNearFull
- persistent-volume-alert.rules
- PersistentVolumeUsageCritical
- pool-quota.rules
- CephPoolQuotaBytesCriticallyExhausted
- host-disk
- LowDiskForRancherPartition
- LowDiskForKubeletPartition
- LowDiskForVarPartition