- 概述
- 要求
- 部署模板
- 手动:准备安装
- 手动:准备安装
- 步骤 2:为离线安装配置符合 OCI 的注册表
- 步骤 3:配置外部对象存储
- 步骤 4:配置 High Availability Add-on
- 步骤 5:配置 SQL 数据库
- 步骤 7:配置 DNS
- 步骤 8:配置磁盘
- 步骤 9:配置内核和操作系统级别设置
- 步骤 10:配置节点端口
- 步骤 11:应用其他设置
- 步骤 12:验证并安装所需的 RPM 包
- 步骤 13:生成 cluster_config.json
- Cluster_config.json 示例
- 常规配置
- 配置文件配置
- 证书配置
- 数据库配置
- 外部对象存储配置
- 预签名 URL 配置
- ArgoCD 配置
- Kerberos 身份验证配置
- 符合 OCI 的外部注册表配置
- Disaster Recovery:主动/被动和主动/主动配置
- High Availability Add-on 配置
- 特定于 Orchestrator 的配置
- Insights 特定配置
- Process Mining 特定配置
- Document Understanding 特定配置
- Automation Suite Robot 特定配置
- 监控配置
- 可选:配置代理服务器
- 可选:在多节点 HA 就绪生产集群中启用区域故障恢复
- 可选:传递自定义 resolv.conf
- 可选:提高容错能力
- 添加具有 GPU 支持的专用代理节点
- 为 Automation Suite Robot 添加专用代理节点
- 步骤 15:为离线安装配置临时 Docker 注册表
- 步骤 16:验证安装的先决条件
- 正在运行 uipathctl
- 手动:执行安装
- 安装后
- 集群管理
- 监控和警示
- 迁移和升级
- 特定于产品的配置
- 最佳实践和维护
- 故障排除
- 如何在安装过程中对服务进行故障排除
- 如何减少 NFS 备份目录的权限
- 如何卸载集群
- 如何清理离线工件以改善磁盘空间
- 如何清除 Redis 数据
- 如何启用 Istio 日志记录
- 如何手动清理日志
- 如何清理存储在 sf-logs 存储桶中的旧日志
- 如何禁用 AI Center 的流日志
- 如何对失败的 Automation Suite 安装进行调试
- 如何在升级后从旧安装程序中删除映像
- 如何禁用 TX 校验和卸载
- 如何手动将 ArgoCD 日志级别设置为 Info
- 如何扩展 AI Center 存储
- 如何为外部注册表生成已编码的 pull_secret_value
- 如何解决 TLS 1.2 中的弱密码问题
- 如何查看 TLS 版本
- 如何使用证书
- 如何计划 Ceph 备份和还原数据
- 如何使用集群内对象存储 (Ceph) 收集 DU 使用情况数据
- 如何在离线环境中安装 RKE2 SELinux
- 如何清理 NFS 服务器上的旧差异备份
- 如何在已启用 FIPS 的集群中部署 Insights
- 如何迁移到 cgroup v2
- 如何在虚拟机重新启动后恢复 Kerberos 身份验证
- 如何将本地 Docker 映像推送到集群内注册表
- 如何从备份中排除存储桶
- 无法获取沙盒映像
- Pod 未显示在 ArgoCD 用户界面中
- Redis 探测器失败
- RKE2 服务器无法启动
- 在 UiPath 命名空间中找不到密码
- ArgoCD 在首次安装后进入“进行中”状态
- 处于 CrashLoopBackOff 状态的 ArgoCD 存储库服务器 Pod
- 手动 ArgoCD 网络策略缓解措施 (MHSA-47m3-95c7-g2g8)
- 监控仪表板中缺少 Ceph-rook 指标
- 诊断性运行状况检查期间报告的错误不匹配
- 为 uipathctl 创建的工作负载配置资源请求和限制
- 无正常的上游问题
- 杀毒软件阻止了 Redis 启动
- 无法在启用 TLS 证书验证的情况下启动 AI Center 和 Document Understanding Pod
- Fluentd 不会在 IPv6 环境中导出日志
- Studio 桌面版无法加载 Integration Service 连接器和活动
- 运行诊断工具
- 使用 Automation Suite 支持捆绑包
- 探索日志
当 uipathctl 创建的工作负载无法计划或完成时,如何调整 CPU 和内存请求和限制。
描述
运行 uipathctl 命令时,由该命令创建的 Kubernetes 工作负载可能会由于其 CPU 或内存要求而失败。
您可能会遇到以下任一症状:
- Pod 保持
Pending状态,并且其事件包含Insufficient cpu或Insufficient memory。 - Pod 以
OOMKilled状态终止。 - 工作负载受限于 CPU,或在命令超时前无法完成。
- 准入策略拒绝 Pod,因为其资源请求或限制不符合命名空间中配置的
ResourceQuota或LimitRange要求。
此问题可能会影响 uipathctl 创建的用于先决条件检查、运行状况检查、支持包生成、迁移、Helm 操作和升级的工作负载。
解决方案
首先,识别受影响的 Pod 并检查其事件:
kubectl get pods -A
kubectl describe pod <pod-name> -n <namespace>
kubectl get pods -A
kubectl describe pod <pod-name> -n <namespace>
根据报告的情况:
- 对于
OOMKilled,请增加内存限制。如果必须在具有更多可用内存的节点上计划 Pod,则同时增加内存请求。 - 对于具有
Pending或Insufficient cpu的Insufficient memoryPod,仅在工作负载可以在保证容量较低的情况下安全运行时减少请求。否则,请添加集群容量。 - 对于配额或限制范围错误,请指定符合目标命名空间中配置策略的请求和限制。
- 对于速度慢或 CPU 节流的工作负载,请增加 CPU 限制。
您可以更改 input.json 中的资源要求,也可以针对单个命令覆盖资源要求。
在 input.json 中配置资源要求
uipathctl 将其工作负载分组为以下资源类别:
| 等级 | 运营 | 默认请求 (CPU/内存) | 默认限制 (CPU/内存) |
|---|---|---|---|
diagnostic | 运行状况检查和只读验证探测器 | 50m / 64Mi | 250m / 256Mi |
operational | 先决条件检查、支持捆绑包、Helm 操作和身份数据迁移 | 1m / 1k | 2 / 2Gi |
workload | 对象存储、PVC 和 MongoDB 迁移,以及升级文件服务器 | 250m / 512Mi | 2 / 2Gi |
要更改使用 Automation Suite 配置的命令的默认值,请将 workload_resources 添加到 input.json。例如,要增加可用于数据量大的迁移工作负载的资源,请使用以下配置:
{
"workload_resources": {
"workload": {
"requests": {
"cpu": "500m",
"memory": "1Gi"
},
"limits": {
"cpu": "2",
"memory": "4Gi"
}
}
}
}
{
"workload_resources": {
"workload": {
"requests": {
"cpu": "500m",
"memory": "1Gi"
},
"limits": {
"cpu": "2",
"memory": "4Gi"
}
}
}
}
您可以独立配置 diagnostic、operational 和 workload 类。您也可以仅指定要更改的值。任何省略 CPU 或内存的值都将保留其默认值。
请求不能超过其相应的限制。使用标准 Kubernetes 资源数量,例如对于 CPU,使用 500m 或 1,对于内存,使用 256Mi 或 1Gi。
单个命令的覆盖资源要求
对于公开 --probe-cpu 和 --probe-memory 选项的命令,您可以覆盖该命令创建的帮助程序 Pod 的资源要求。例如:
uipathctl health check --probe-cpu 500m --probe-memory 512Mi
uipathctl health check --probe-cpu 500m --probe-memory 512Mi
每个选项都可设置指定资源的请求和限制。如果仅指定一个选项,则其他资源将保留其有效值。
这些选项可用于以下命令:
uipathctl health checkuipathctl health testuipathctl health diagnoseuipathctl config add-host-adminuipathctl config enable-basic-authuipathctl service aicenter sync-skillsuipathctl service aicenter sync-skill-statusuipathctl service orchestrator notifications-migration start
当两种配置方法都适用时,uipathctl 将按以下顺序解析值,后一个值优先:
- 内置默认值。
workload_resources或所应用的集群配置中的input.json值。--probe-cpu或--probe-memory命令行选项。
更新资源要求后,请再次运行受影响的命令,并确认 uipathctl 创建的工作负载已成功启动。
设置允许完成工作负载的最小请求和限制。请求过高可能会阻止计划,而限制过低可能会导致限制或终止。