automation-suite
2.2510
true
Linux 版 Automation Suite 安装指南
- 概述
- 要求
- 部署模板
- 手动:准备安装
- 手动:准备安装
- 步骤 2:为离线安装配置符合 OCI 的注册表
- 步骤 3:配置外部对象存储
- 步骤 4:配置 High Availability Add-on
- 步骤 5:配置 SQL 数据库
- 步骤 7:配置 DNS
- 步骤 8:配置磁盘
- 步骤 9:配置内核和操作系统级别设置
- 步骤 10:配置节点端口
- 步骤 11:应用其他设置
- 步骤 12:验证并安装所需的 RPM 包
- 步骤 13:生成 cluster_config.json
- Cluster_config.json 示例
- 常规配置
- 配置文件配置
- 证书配置
- 数据库配置
- 外部对象存储配置
- 预签名 URL 配置
- ArgoCD 配置
- Kerberos 身份验证配置
- 符合 OCI 的外部注册表配置
- Disaster Recovery:主动/被动和主动/主动配置
- High Availability Add-on 配置
- 特定于 Orchestrator 的配置
- Insights 特定配置
- Process Mining 特定配置
- Document Understanding 特定配置
- Automation Suite Robot 特定配置
- 监控配置
- 可选:配置代理服务器
- 可选:在多节点 HA 就绪生产集群中启用区域故障恢复
- 可选:传递自定义 resolv.conf
- 可选:提高容错能力
- 添加具有 GPU 支持的专用代理节点
- 为 Automation Suite Robot 添加专用代理节点
- 步骤 15:为离线安装配置临时 Docker 注册表
- 步骤 16:验证安装的先决条件
- 正在运行 uipathctl
- 手动:执行安装
- 安装后
- 集群管理
- 监控和警示
- 迁移和升级
- 特定于产品的配置
- 最佳实践和维护
- 故障排除
- 如何在安装过程中对服务进行故障排除
- 如何减少 NFS 备份目录的权限
- 如何卸载集群
- 如何清理离线工件以改善磁盘空间
- 如何清除 Redis 数据
- 如何启用 Istio 日志记录
- 如何手动清理日志
- 如何清理存储在 sf-logs 存储桶中的旧日志
- 如何禁用 AI Center 的流日志
- 如何对失败的 Automation Suite 安装进行调试
- 如何在升级后从旧安装程序中删除映像
- 如何禁用 TX 校验和卸载
- 如何手动将 ArgoCD 日志级别设置为 Info
- 如何扩展 AI Center 存储
- 如何为外部注册表生成已编码的 pull_secret_value
- 如何解决 TLS 1.2 中的弱密码问题
- 如何查看 TLS 版本
- 如何使用证书
- 如何计划 Ceph 备份和还原数据
- 如何使用集群内对象存储 (Ceph) 收集 DU 使用情况数据
- 如何在离线环境中安装 RKE2 SELinux
- 如何清理 NFS 服务器上的旧差异备份
- 如何在已启用 FIPS 的集群中部署 Insights
- 如何迁移到 cgroup v2
- 如何在虚拟机重新启动后恢复 Kerberos 身份验证
- 如何将本地 Docker 映像推送到集群内注册表
- 如何从备份中排除存储桶
- 无法获取沙盒映像
- Pod 未显示在 ArgoCD 用户界面中
- Redis 探测器失败
- RKE2 服务器无法启动
- 在 UiPath 命名空间中找不到密码
- ArgoCD 在首次安装后进入“进行中”状态
- 处于 CrashLoopBackOff 状态的 ArgoCD 存储库服务器 Pod
- 手动 ArgoCD 网络策略缓解措施 (MHSA-47m3-95c7-g2g8)
- 监控仪表板中缺少 Ceph-rook 指标
- 诊断性运行状况检查期间报告的错误不匹配
- 为 uipathctl 创建的工作负载配置资源请求和限制
- 无正常的上游问题
- 杀毒软件阻止了 Redis 启动
- 无法在启用 TLS 证书验证的情况下启动 AI Center 和 Document Understanding Pod
- Fluentd 不会在 IPv6 环境中导出日志
- Studio 桌面版无法加载 Integration Service 连接器和活动
- 运行诊断工具
- 使用 Automation Suite 支持捆绑包
- 探索日志
重要 :
请注意,此内容已使用机器翻译进行了部分本地化。
新发布内容的本地化可能需要 1-2 周的时间才能完成。
有关监控 Automation Suite 中堆栈配置参数和资源配置的参考。
重要提示:
本页面上的监控配置参数在 Automation Suite 版本 2.2510.0 中不起作用通过 2.2510.2。此问题在 Automation Suite 2.2510.3 中已解决。
要配置足够的资源进行监控(请参阅使用监控堆栈),您应该考虑集群中的 vCPU 数量和所需的指标保留量。接下来详细介绍了如何设置以下监控资源配置。
下表描述了监控字段的详细信息:
| 参数 | 描述 |
|---|---|
prometheus_retention | 以天为单位。 此为指标将保留的天数,用于在 Grafana 中进行可视化并通过 Prometheus 控制台进行手动查询。 默认值为 7。 |
prometheus_storage_size | 以 GB 为单位。 每个 Prometheus 副本要保留的存储空间量。 根据经验,将此值设置为: 0.65 * vCPU cores * (prometheus_retention / 7) 示例:如果您将 prometheus_retention设置为 14 天,并且集群具有分布在 5 台计算机上的 80 个核心,则这将变为: 0.65 * 80 * (14 / 7) 52 * (2) 104 默认值为 45,不应设置得更低。 如果 Prometheus 的存储空间开始不足,系统将使用特定的修复说明触发警示。请参阅警示 Runbook部分。 |
prometheus_memory_limit | 以 MB 为单位。 限制每个 Prometheus 副本的内存量。 根据经验,将此值设置为: 100 * vCPU cores * (prometheus_retention / 7) 示例:如果您将 prometheus_retention设置为 14 天,并且集群具有分布在 5 台计算机上的 80 个核心,则这将变为: 100 * 80 * (14 / 7) 8000 * (2) 16000 对于单节点评估模式,默认值为 3200,对于多节点 HA 就绪生产模式,默认值为 6000,并且不应低于这个值。 如果 Prometheus 的内存开始不足,系统将使用特定的修复说明触发警示。请参阅警示 Runbook部分。 |
示例
"monitoring": {
"prometheus_retention": 14,
"prometheus_memory_limit": 16000,
"prometheus_storage_size": 104
}
"monitoring": {
"prometheus_retention": 14,
"prometheus_memory_limit": 16000,
"prometheus_storage_size": 104
}
可选:配置监控解决方案
您可以配置集群安装以排除内置监控组件。此选项让您可以使用自己的监控堆栈,并为组织提供了灵活性,并自定义了可观察性解决方案。
您可以排除以下组件:Prometheus/Grafana、Goldpinger 和警示。
可通过cluster config.json文件中的exclude_components字段控制对这些组件的排除,如以下示例所示:
{
"exclude_components": [
"monitoring",
"goldpinger",
"alerts"
]
}
{
"exclude_components": [
"monitoring",
"goldpinger",
"alerts"
]
}
安装后,您可以通过更新exclude_components列表来启用或禁用监控堆栈。
备注:
在集群升级或迁移期间,不会迁移或保留与外部监控解决方案相关的数据。您负责安装、升级或迁移监控堆栈和数据,并负责处理因 Kubernetes 版本升级而可能发生的任何兼容性问题。