- 概述
- 要求
- 部署模板
- 手动:准备安装
- 手动:准备安装
- 步骤 2:为离线安装配置符合 OCI 的注册表
- 步骤 3:配置外部对象存储
- 步骤 4:配置 High Availability Add-on
- 步骤 5:配置 SQL 数据库
- 步骤 6:配置负载均衡器
- 步骤 7:配置 DNS
- 步骤 8:配置磁盘
- 步骤 9:配置内核和操作系统级别设置
- 步骤 10:配置节点端口
- 步骤 11:应用其他设置
- 步骤 12:验证并安装所需的 RPM 包
- 步骤 13:生成 cluster_config.json
- 证书配置
- 数据库配置
- 外部对象存储配置
- 预签名 URL 配置
- Kerberos 身份验证配置
- 符合 OCI 的外部注册表配置
- Disaster Recovery:主动/被动和主动/主动配置
- High Availability Add-on 配置
- 特定于 Orchestrator 的配置
- Insights 特定配置
- Process Mining 特定配置
- Document Understanding 特定配置
- Automation Suite Robot 特定配置
- 监控配置
- 可选:配置代理服务器
- 可选:在多节点 HA 就绪生产集群中启用区域故障恢复
- 可选:传递自定义 resolv.conf
- 可选:提高容错能力
- install-uipath.sh 参数
- 添加具有 GPU 支持的专用代理节点
- 为 Task Mining 添加专用代理节点
- 连接 Task Mining 应用程序
- 为 Automation Suite Robot 添加专用代理节点
- 步骤 15:为离线安装配置临时 Docker 注册表
- 步骤 16:验证安装的先决条件
- 手动:执行安装
- 安装后
- 集群管理
- 监控和警示
- 迁移和升级
- 特定于产品的配置
- 最佳实践和维护
- 故障排除
- 如何在安装过程中对服务进行故障排除
- 如何卸载集群
- 如何清理离线工件以改善磁盘空间
- 如何清除 Redis 数据
- 如何启用 Istio 日志记录
- 如何手动清理日志
- 如何清理存储在 sf-logs 存储桶中的旧日志
- 如何禁用 AI Center 的流日志
- 如何对失败的 Automation Suite 安装进行调试
- 如何在升级后从旧安装程序中删除映像
- 如何禁用 TX 校验和卸载
- 如何从 Automation Suite 2022.10.10 和 2022.4.11 升级到 2023.10.2
- 如何手动将 ArgoCD 日志级别设置为 Info
- 如何扩展 AI Center 存储
- 如何为外部注册表生成已编码的 pull_secret_value
- 如何解决 TLS 1.2 中的弱密码问题
- 如何使用证书
- 如何将应用程序日志转发到 Splunk
- 如何从注册表 Pod 中清理未使用的 Docker 映像
- 如何使用集群内对象存储 (Ceph) 收集 DU 使用情况数据
- 如何在离线环境中安装 RKE2 SELinux
- 如何清理 NFS 服务器上的旧差异备份
- 升级 Automation Suite 后重新安装或升级 Insights 时丢失数据
- 单节点升级在结构阶段失败
- 从 2021.10 自动升级后,集群运行状况不佳
- 由于 Ceph 运行状况不佳,升级失败
- 由于空间问题,RKE2 未启动
- 卷无法装载,且仍处于附加/分离循环状态
- 由于 Orchestrator 数据库中的传统对象,升级失败
- 并行升级后,发现 Ceph 集群处于降级状态
- Insights 组件运行状况不佳导致迁移失败
- Apps 服务升级失败
- 就地升级超时
- Docker 注册表迁移卡在 PVC 删除阶段
- 升级到 2023.10 或更高版本后 AI Center 配置失败
- 在离线环境中升级失败
- 升级期间 SQL 验证失败
- 快照-控制器-crds Pod 在升级后处于 CrashLoopBackOff 状态
- Longhorn REST API 端点升级/重新安装错误
- 由于 Insights PVC 大小被覆盖,升级失败
- 预服务脚本执行期间服务升级失败
- 使用 Process Mining 运行高可用性
- 使用 Kerberos 登录时 Process Mining 挖掘失败
- 在 Disaster Recovery 后,DAPR 无法正常用于 Process Mining
- 在集群模式下使用 Redis 配置 Dapr
- 无法使用 pyodbc 格式连接字符串连接到 AutomationSuite_ProcessMining_Warehouse 数据库
- Airflow 安装失败,并显示 sqlalchemy.exc.ArgumentError:无法从字符串“”中解析 rfc1738 URL
- 如何添加 IP 表格规则以使用 SQL Server 端口 1433
- 运行 CData Sync 的服务器不信任 Automation Suite 证书
- 运行诊断工具
- 使用 Automation Suite 支持捆绑包
- 探索日志
有关 Automation Suite 中适用于同一个集群和外部计算机部署的 High Availability Add-on 配置选项的参考。
Automation Suite 支持安装在同一集群或外部计算机上的 High Availability Add-on (HAA)。
您必须配置 HAA,才能为多节点设置启用实际的 HA 设置。为此,您可以为安装程序提供 HAA 许可证,也可以在外部计算机上安装 HAA 并将 HAA 配置提供给安装程序。
集群内 Redis High Availability Add-on 配置
In a multi-node HA-ready production setup, High Availability (HA) is enabled by default. However, the Redis-based in-memory cache used by cluster services runs on a single node and represents a single point of failure. Therefore, if you have not purchased a High Availability Add-on (HAA) license, a cache node failure or restart will result in downtime for the entire cluster.
To prevent such an incident, you can purchase HAA, which enables redundant, multi-node HA-ready production deployment of the cache.
所有安装都包括具有单节点许可证的 HAA 软件。此许可证是免费的,无需购买。
如果您希望跨多个节点启用 HAA,则需要购买 HAA 许可证。这将在多节点 HA 就绪生产设置中实现集群的完全高可用性。
HAA 基于 Redis 技术。
为此,请执行以下步骤:
- 购买 HAA 许可证。有关详细信息,请联系 UiPath™。
- 更新
cluster_config.json文件中的以下字段:fabric.redis.license- 输入已转换为单个 Base64 字符串的 HAA 许可证。您需要将整个许可证密钥编码为 Base64,包括文本-----LICENSE START----- and -----LICENSE END-----。在 Bash 中,您可以使用以下命令来执行此操作:echo '-----LICENSE START-----<license_key_here>-----LICENSE END-----' | base64 -w0echo '-----LICENSE START-----<license_key_here>-----LICENSE END-----' | base64 -w0fabric.redis.ha- 使用true启用 HAA,并确保配置fabric.redis.license参数。这将启用 HAA 数据库复制,并将 HAA Pod 的数量增加到 3。默认情况下,fabric.redis.ha设置为false。备注:如果启用了
redis.ha,则需要将redis.license设置为支持两个以上分片的许可证。"fabric": { "redis": { "ha": "true", "license": "Base64String" // Replace Base64String with the encoded full license string. } }"fabric": { "redis": { "ha": "true", "license": "Base64String" // Replace Base64String with the encoded full license string. } }
- 重新运行结构安装程序:
./install-uipath.sh -i cluster_config.json -f -o output.json --accept-license-agreement./install-uipath.sh -i cluster_config.json -f -o output.json --accept-license-agreement
更新 Redis 许可证
要更新 Redis 许可证,请执行以下步骤:
-
设置 kubectl 和 ArgoCD 访问权限:
- 在主节点上启用 kubectl 访问权限。有关说明,请参阅启用 kubectl 。
- 启用对 ArgoCD 的访问权限。有关说明,请参阅访问 ArgoCD 。
-
检查当前许可证状态:
要检查当前许可证的状态,请运行以下 Shell 命令:
kubectl get rec -n redis-system redis-cluster -o jsonpath='{.status.licenseStatus}' | jqkubectl get rec -n redis-system redis-cluster -o jsonpath='{.status.licenseStatus}' | jq- 在安装程序中包含的许可证到期日期之后部署的集群将显示 4 个分片的试用许可证,该许可证将在 30 天后过期,如以下示例所示:
- 已在运行的集群会在许可证过期时显示以下状态:
-
更新现有许可证:
-
要更新现有许可证,请运行以下 Shell 命令:
kubectl patch application fabric-installer -n argocd \ --type=json -p '[{"op":"add","path":"/spec/source/helm/parameters/-","value":{"name": "global.redis.license", "value": "<LICENSE_KEY_IN_BASE64>"}}]'kubectl patch application fabric-installer -n argocd \ --type=json -p '[{"op":"add","path":"/spec/source/helm/parameters/-","value":{"name": "global.redis.license", "value": "<LICENSE_KEY_IN_BASE64>"}}]' -
要查看是否已应用更改,请访问 ArgoCD。有关说明,请参阅访问 ArgoCD 。
-
如果结构安装程序应用程序显示为不同步,并且同步过程未自动触发,请自行选择“同步”按钮。如果您使用的是较旧的 Automation Suite 版本,则可能会发生这种情况。
备注:ArgoCD 用户界面显示已同步的应用程序与 Redis 运算符成功应用新许可证之间存在一小段延迟。
-
要在 Redis 运算符尝试应用许可证时查看其日志,请运行以下命令:
kubectl logs -n redis-system --since=300s -l name=redis-enterprise-operator -c redis-enterprise-operator --tail=-1 | grep licensekubectl logs -n redis-system --since=300s -l name=redis-enterprise-operator -c redis-enterprise-operator --tail=-1 | grep license -
如果您尝试应用过期的许可证,或者运行附带过期许可证的安装程序,您将获得以下输出:
-
要在运行旧版安装程序之前更新 Redis 许可证,请更新
<installer_folder>/defaults.json中的fabric.redis.license密钥:
-
-
检查是否应用了新许可证:
要检查是否应用了新许可证,请运行以下 Shell 命令:
kubectl get rec -n redis-system redis-cluster -o jsonpath='{.status.licenseStatus}' | jqkubectl get rec -n redis-system redis-cluster -o jsonpath='{.status.licenseStatus}' | jq在下图中,您可以看到 Redis 集群从 30 天试用许可证切换到单分片 10 年许可证。
外部 High Availability Add-on 配置
选择 Automation Suite 的主动/主动配置时,必须使用外部集群托管的 High Availability Add-on。在所有其他情况下,它只是可选的。
要配置 High Availability Add-on,必须更新cluster_config.json文件中的以下参数:
| 参数 | 描述 |
|---|---|
|
| 提供 High Availability Add-on (HAA) 服务器的 FQDN。 |
|
| 提供用于连接到 HAA 服务器的密码。 |
|
| 提供 HAA 服务器的端口。 |
fabric.redis.tls | 启用 TLS 协议。默认情况下,启用 TLS。 如果在启用 TLS 时需要证书,请确保通过 |
"fabric": {
"redis": {
"hostname": "redis_fqdn",
"password": "credential_to_connect_redis",
"port": 6380,
"tls": true,
}
}
"fabric": {
"redis": {
"hostname": "redis_fqdn",
"password": "credential_to_connect_redis",
"port": 6380,
"tls": true,
}
}