- Visão geral
- Requisitos
- Modelos de implantação
- Manual: preparando a instalação
- Manual: preparando a instalação
- Etapa 2: configuração do registro compatível com OCI para instalações offline
- Etapa 3: configuração do objectstore externo
- Etapa 4: configuração do High Availability Add-on
- Etapa 5: configuração de bancos de dados SQL
- Etapa 7: configuração do DNS
- Etapa 8: configuração dos discos
- Etapa 9: configuração dos ajustes do nível do kernel e do sistema operacional
- Etapa 10: configuração das portas do nó
- Etapa 11: aplicação de configurações diversas
- Etapa 12: validação e instalação dos pacotes RPM necessários
- Etapa 13: geração de cluster_config.json
- Amostra Cluster_config.json
- Configuração geral
- Configuração do perfil
- Configuração de Certificados
- Configuração do Banco de Dados
- Configuração externa do Objectstore
- Configuração de URL pré-assinada
- Configuração do ArgoCD
- Configuração da autenticação do Kerberos
- Configuração de registro externo compatível com OCI
- Disaster Recovery: configurações Ativo/Passivo e Ativo/Ativo
- Configuração do High Availability Add-on
- Configuração específica do Orchestrator
- Configuração específica do Insights
- Process Mining-specific configuration
- Configuração específica do Document Understanding
- Automation Suite Robots-specific configuration
- Configuração do monitoramento
- Opcional: configuração do servidor proxy
- Opcional: habilitação da resiliência a falhas zonais em um cluster de produção pronto para alta disponibilidade de vários nós
- Opcional: transmitindo resolv.conf personalizado
- Optional: Increasing fault tolerance
- Adicionando um nó de agente dedicado com suporte a GPU
- Adicionando um nó de agente dedicado para robôs do Automation Suite
- Etapa 15: configuração do registro temporário do Docker para instalações offline
- Etapa 16: validação dos pré-requisitos para a instalação
- Executando o uipathctl
- Manual: realizando a instalação
- Pós-instalação
- Administração de cluster
- Gerenciando produtos
- Introdução ao portal de administração do cluster
- Migração do Redis do High Availability Add-on no cluster para externo
- Migrating data between objectstores
- Migrating in-cluster objectstore to external objectstore
- Migração de um registro no cluster para um registro externo compatível com OCI
- Mudança para o cluster secundário manualmente em uma configuração Ativo/Passivo
- Disaster Recovery: executando operações pós-instalação
- Convertendo uma instalação existente para configuração multi-local
- Diretrizes sobre atualização de uma implantação Ativo/Passivo ou Ativo/Ativo
- Diretrizes sobre backup e restauração de uma implantação Ativo/Passivo ou Ativo/Ativo
- Escalando uma implantação de nó único (avaliação) para uma implantação de vários nós (HA)
- Monitoramento e alertas
- Migração e atualização
- Migração entre clusters do Automation Suite
- Atualizando o Automação Suite
- Download dos pacotes de instalação e obtenção de todos os arquivos no primeiro nó do servidor
- Recuperação da mais recente configuração aplicada do cluster
- Atualização da configuração de cluster
- Configuração do registro compatível com OCI para instalações offline
- Execução da atualização
- Realização de operações pós-atualização
- Configuração específica do produto
- Configuração avançada do Orchestrator
- Configuração de parâmetros do Orchestrator
- Configuração do AppSettings
- Configuração do tamanho máximo da solicitação
- Substituição da configuração de armazenamento no nível do cluster
- Configuração do NLog
- Salvando logs do robô no Elasticsearch
- Configuração dos repositórios de credenciais
- Configuração da chave de criptografia por tenant
- Limpeza do banco de dados do Orchestrator
- Ignorar a instalação da biblioteca do host
- Melhores práticas e manutenção
- Solução de problemas
- Como solucionar problemas dos serviços durante a instalação
- Como reduzir as permissões para um diretório de backup NFS
- Como desinstalar o cluster
- Como limpar os artefatos offline para melhorar o espaço em disco
- Como limpar os dados do Redis
- Como habilitar o registro em log do Istio
- Como limpar logs manualmente
- Alterando o modo somente leitura do Ceph
- Como limpar logs antigos armazenados no bucket do sf-logs
- Como desabilitar os logs de streaming para o AI Center
- Como depurar instalações do Automation Suite com falha
- Como excluir imagens do instalador antigo após a atualização
- Como desabilitar o descarregamento de soma de verificação do TX
- Como definir manualmente o nível de log do ArgoCD como Info
- Como expandir o armazenamento do AI Center
- Como gerar o pull_secret_value codificado para registros externos
- Como lidar com cifras fracas no TLS 1.2
- Como verificar a versão do TLS
- Como trabalhar com certificados
- Como agendar o backup e restaurar dados do Ceph
- Como coletar dados de uso de DU com objectstore (Ceph) no cluster
- Como instalar o RKE2 SELinux em ambientes air-gapped
- Como limpar backups diferenciados antigos em um servidor NFS
- Como implantar o Insights em um cluster habilitado para FIPS
- Como migrar para o Cgroup v2
- Como recuperar a autenticação do Kerberos após uma reinicialização da VM
- Como enviar uma imagem do Docker local para o registro no cluster
- Como excluir buckets do backup
- Erro ao baixar o pacote
- A instalação offline falha devido a um binário ausente
- Azure disk not marked as SSD
- Falha após a atualização do certificado
- Erros de validação de certificado TLS
- Antivírus causa problemas de instalação
- Automation Suite not working after OS upgrade
- O Automation Suite requer que backlog_wait_time seja definido como 0
- A instalação do registro temporário falha no RHEL 8.9
- Problema de reinício frequente em implantações de namespace uipath durante instalações offline
- Configurações de DNS não honradas pelo CoreDNS
- A geração de registros no cluster falha devido a memória insuficiente
- As verificações de pré-requisitos falham quando os projetos modernos do Document Understanding estão habilitados e o AI Center está desabilitado
- Upgrade fails due to unhealthy Ceph
- A atualização falha devido a objetos clássicos no banco de dados do Orchestrator
- Um cluster do Ceph foi encontrado em um estado degradado após atualização lado a lado
- A atualização do serviço falha para o Apps
- Tempos limite de atualização no local
- Falha de atualização em ambientes offline
- pod snapshot-controller-crds no estado CrashLoopBackOff após a atualização
- Falha de atualização devido aos tamanhos de PVC do Insights substituídos
- Falha de atualização devido ao nome de host em letra maiúscula
- Configurando um intervalo de tempo limite para os portais de gerenciamento
- Autenticação não funciona após migração
- kinit: não é possível encontrar o KDC para o realm <AD Domain> ao obter credenciais iniciais
- kinit: o Keytab não contém chaves adequadas para *** ao obter credenciais iniciais
- Falha na operação GSSAPI devido a código de status inválido
- Alarme recebido para trabalho com falha do Kerberos-tgt-update
- Provedor de SSPI: servidor não encontrado no banco de dados Kerberos
- Falha de login para usuário do AD devido a conta desabilitada
- ArgoCD login failed
- Falha ao obter a imagem do sandbox
- Os pods não são exibidos na UI do ArgoCD
- Falha de teste do Redis
- O servidor RKE2 falha ao iniciar
- O ArgoCD entra em estado Em andamento após a primeira instalação
- Pod de repositório do ArgoCD em CrashLoopBackOff
- Migreção manual do ArgoCD NetworkPolicy (GHSA-47m3-95c7-g2g8)
- Métricas Ceph-rook ausentes nos painéis de monitoramento
- Incompatibilidade em erros relatados durante as verificações de integridade do diagnóstico
- Configuração de solicitações e limites de recursos para cargas de trabalho criadas pelo uipathctl
- Nenhum problema upstream íntegro
- Inicialização do Redis bloqueada por antivírus
- Os pods do AI Center e do Document Understanding falham ao iniciar com a verificação do certificado TLS habilitada
- O Fluentd não exporta logs em ambientes IPv6
- O Studio Desktop não pode carregar conectores e atividades do Integration Service
- O Document Understanding não está no menu de navegação esquerdo do Automation Suite
- Status de Falha ao criar uma sessão de rotulagem de dados
- Status de Falha ao tentar implantar uma habilidade de ML
- Trabalho de migração falha no ArgoCD
- Reconhecimento de escrita com o Extrator de formulários inteligente não está funcionando
- Execução de alta disponibilidade com o Process Mining
- Falha na ingestão do Process Mining ao fazer logon usando o Kerberos
- Não é possível conectar-se ao banco de dados AutomationSuite_ProcessMining_Warehouse usando uma string de conexão em formato pyodbc.
- A instalação do Airflow falha com sqlalchemy.exc.ArgumentError: não foi possível analisar o URL rfc1738 da string ''
- Como adicionar uma regra de tabela de IP para usar a porta 1433 do SQL Server
- O certificado do Automation Suite não é confiável para o servidor em que o CData Sync está sendo executado
- Process Mining fails to load after disabling and re-enabling it
- Execução da ferramenta de diagnóstico
- Usando o pacote de suporte do Automation Suite
- Exploração de logs
Resolva alertas de rede, como certificados TLS expirados no Automation Suite.
kubernetes-system-apiserver
CertificadoDoRKE2Expiry7Days
Esse alerta indica que o certificado do servidor TLS expira nos 7 dias seguintes.
Para corrigir esse problema, atualize o certificado TLS. Para obter instruções, consulte Gerenciamento dos certificados.
ExpiraçãoDoCertificadoDoRKE290Dias
Esse alerta tem diferentes níveis de gravidade e mensagens com base no número de dias restantes:
- Mensagem de alerta de gravidade de aviso: os certificados do RKE2 vão expirar em 89 dias! Para renovar, reinicie o RKE.
- Mensagem de alerta de gravidade de aviso: os certificados do RKE2 vão expirar em 29 dias! Para renovar, reinicie o RKE.
- Mensagem de alerta de Severidade crítica: os certificados do RKE2 vão expirar em 7 dias! Para renovar, reinicie o RKE.
ExpiraçãoDoCertificadoDoRKE2CA60Dias
Alerta de gravidade do aviso
Mensagem: os certificados de CA do RKE2 vão expirar em 59 dias!
ExpiraçãoDoCertificadoDoRKE2CA30Dias
Alerta de gravidade crítica
Mensagem: os certificados de CA do RKE2 vão expirar em 29 dias!
ExpiraçãoDoCertificadoDoRKE2CA15Dias
Esse alerta indica que o certificado do servidor TLS expira nos 15 dias seguintes.
Para corrigir esse problema, atualize o certificado TLS. Para obter instruções, consulte Gerenciamento de certificados do servidor.
uipath.cronjob.alerts.rules
IdentityKerberosTgtUpdateFailed
Este trabalho atualiza o tíquete do Kerberos mais recente para todos os serviços da UiPath®. Falhas neste trabalho fariam com que a autenticação do SQL Server falhasse.
Para corrigir esse problema, verifique os logs:
kubectl -n uipath logs job/kerberos-tgt-update
kubectl -n uipath logs job/kerberos-tgt-update
Se o problema persistir, entre em contato com o Suporte da UiPath®.
IdentityCertificateExpiry30Days
Este alerta indica que o certificado de assinatura do token de identidade expirará nos próximos 30 dias.
Para corrigir esse problema, atualize o certificado de assinatura do token de identidade. Para obter instruções, consulte Gerenciamento de certificados do servidor.
IdentityCertificateExpiry7Days
Esse alerta indica que o certificado de assinatura do token de identidade expirará nos 7 dias seguintes.
Para corrigir esse problema, atualize o certificado de assinatura do token de identidade. Para obter instruções, consulte Gerenciamento de certificados do servidor.
UiPathAvailabilityHighTrafficBackend, UiPathAvailabilityMediumTrafficUserFacing, UiPathAvailabilityMediumTrafficBackend, UiPathAvailabilityLowTrafficUserFacing, UiPathAvailabilityLowTrafficBackend
A quantidade de respostas http 500 dos serviços da UiPath® excede um determinado limite. A tabela a seguir descreve os limites de nível de tráfego usados para avaliar taxas de erro.
| Nível de tráfego | Quantidade de solicitações em 20 minutos | Limite de erro (para http 500s) |
|---|---|---|
| Alta | >100.000 | 0,1% |
| Médio | Entre 10.000 e 100.000 | 1% |
| Baixa | < 10.000 | 5% |
Os erros em serviços voltados para o usuário provavelmente resultariam em funcionalidade degradada que é diretamente observável na interface do usuário do Automation Suite, já os erros em serviços de back-end teriam consequências menos óbvias.
O alerta indica qual serviço está apresentando uma alta taxa de erro. Para entender quais problemas de cascata podem haver de outros serviços dos quais o serviço de relatório depende, você pode usar o painel de carga de trabalho do Istio, que mostra os erros entre os serviços.
Verifique novamente todos os produtos do Automation Suite recentemente reconfigurados. Logs detalhados também estão disponíveis com o comando kubectl logs. Se o erro persistir, entre em contato com o Suporte da UiPath®.
certificados
SecretCertificateExpiry30Days
Esse alerta indica que o certificado do servidor TLS expirará nos 30 dias seguintes.
Para corrigir esse problema, atualize o certificado TLS do servidor. Para obter instruções, consulte Gerenciamento de certificados do servidor.
SecretCertificateExpiry7Days
Esse alerta indica que o certificado do servidor TLS expirará nos 7 dias seguintes.
Para corrigir esse problema, atualize o certificado TLS. Para obter instruções, consulte Gerenciamento de certificados do servidor.
CertificadoDoRKE2Expiry7Days
Esse alerta indica que o certificado do servidor RKE2 expirará nos 7 dias seguintes.
uipath.requestrouting.alerts
UiPathRequestRouting
Erros na camada de roteamento de solicitação resultariam em funcionalidade degradada que é diretamente observável na interface do usuário do Automation Suite. As solicitações não serão roteadas para serviços de back-end.
Você pode encontrar o log de erro detalhado do roteamento de solicitações em pods istio-ingressgateway no namespace istio-system. Recupere o nome do pod executando os seguintes comandos:
kubectl get pods -n istio-system
kubectl logs <istio-ingressgateway-pod-name> -n istio-system
kubectl get pods -n istio-system
kubectl logs <istio-ingressgateway-pod-name> -n istio-system
Se o erro persistir, entre em contato com o Suporte da UiPath®.
InternodeCommunicationBroken
O nó parou de responder devido a algum problema que causou comunicação interrompida entre nós no cluster.
Para corrigir esse problema, siga as seguintes etapas:
- Certifique-se de implementar as configurações mencionadas na Etapa 8: configuração dos ajustes do nível do kernel e do sistema operacional.
- Se aplicável, certifique-se de implementar as alterações mencionadas em Como desabilitar o descarregamento de soma de verificação do TX.
- Se as etapas anteriores não resolverem o problema, entre em contato com o Suporte da UiPath® com o pacote de suporte gerado.
- kubernetes-system-apiserver
- CertificadoDoRKE2Expiry7Days
- ExpiraçãoDoCertificadoDoRKE290Dias
- ExpiraçãoDoCertificadoDoRKE2CA60Dias
- ExpiraçãoDoCertificadoDoRKE2CA30Dias
- ExpiraçãoDoCertificadoDoRKE2CA15Dias
- uipath.cronjob.alerts.rules
- IdentityKerberosTgtUpdateFailed
- IdentityCertificateExpiry30Days
- IdentityCertificateExpiry7Days
- UiPathAvailabilityHighTrafficBackend, UiPathAvailabilityMediumTrafficUserFacing, UiPathAvailabilityMediumTrafficBackend, UiPathAvailabilityLowTrafficUserFacing, UiPathAvailabilityLowTrafficBackend
- certificados
- SecretCertificateExpiry30Days
- SecretCertificateExpiry7Days
- CertificadoDoRKE2Expiry7Days
- uipath.requestrouting.alerts
- UiPathRequestRouting
- InternodeCommunicationBroken