automation-suite
2.2510
true
Linux 版 Automation Suite 安装指南
- 概述
- 要求
- 部署模板
- 手动:准备安装
- 手动:准备安装
- 步骤 2:为离线安装配置符合 OCI 的注册表
- 步骤 3:配置外部对象存储
- 步骤 4:配置 High Availability Add-on
- 步骤 5:配置 SQL 数据库
- 步骤 7:配置 DNS
- 步骤 8:配置磁盘
- 步骤 9:配置内核和操作系统级别设置
- 步骤 10:配置节点端口
- 步骤 11:应用其他设置
- 步骤 12:验证并安装所需的 RPM 包
- 步骤 13:生成 cluster_config.json
- Cluster_config.json 示例
- 常规配置
- 配置文件配置
- 证书配置
- 数据库配置
- 外部对象存储配置
- 预签名 URL 配置
- ArgoCD 配置
- Kerberos 身份验证配置
- 符合 OCI 的外部注册表配置
- Disaster Recovery:主动/被动和主动/主动配置
- High Availability Add-on 配置
- 特定于 Orchestrator 的配置
- Insights 特定配置
- Process Mining 特定配置
- Document Understanding 特定配置
- Automation Suite Robot 特定配置
- 监控配置
- 可选:配置代理服务器
- 可选:在多节点 HA 就绪生产集群中启用区域故障恢复
- 可选:传递自定义 resolv.conf
- 可选:提高容错能力
- 添加具有 GPU 支持的专用代理节点
- 为 Automation Suite Robot 添加专用代理节点
- 步骤 15:为离线安装配置临时 Docker 注册表
- 步骤 16:验证安装的先决条件
- 正在运行 uipathctl
- 手动:执行安装
- 安装后
- 集群管理
- 监控和警示
- 迁移和升级
- 特定于产品的配置
- 最佳实践和维护
- 故障排除
- 如何在安装过程中对服务进行故障排除
- 如何减少 NFS 备份目录的权限
- 如何卸载集群
- 如何清理离线工件以改善磁盘空间
- 如何清除 Redis 数据
- 如何启用 Istio 日志记录
- 如何手动清理日志
- 将 Ceph 退出只读模式
- 如何清理存储在 sf-logs 存储桶中的旧日志
- 如何禁用 AI Center 的流日志
- 如何对失败的 Automation Suite 安装进行调试
- 如何在升级后从旧安装程序中删除映像
- 如何禁用 TX 校验和卸载
- 如何手动将 ArgoCD 日志级别设置为 Info
- 如何扩展 AI Center 存储
- 如何为外部注册表生成已编码的 pull_secret_value
- 如何解决 TLS 1.2 中的弱密码问题
- 如何查看 TLS 版本
- 如何使用证书
- 如何计划 Ceph 备份和还原数据
- 如何使用集群内对象存储 (Ceph) 收集 DU 使用情况数据
- 如何在离线环境中安装 RKE2 SELinux
- 如何清理 NFS 服务器上的旧差异备份
- 如何在已启用 FIPS 的集群中部署 Insights
- 如何迁移到 cgroup v2
- 如何在虚拟机重新启动后恢复 Kerberos 身份验证
- 如何将本地 Docker 映像推送到集群内注册表
- 如何从备份中排除存储桶
- 无法获取沙盒映像
- Pod 未显示在 ArgoCD 用户界面中
- Redis 探测器失败
- RKE2 服务器无法启动
- ArgoCD 在首次安装后进入“进行中”状态
- 处于 CrashLoopBackOff 状态的 ArgoCD 存储库服务器 Pod
- 手动 ArgoCD 网络策略缓解措施 (MHSA-47m3-95c7-g2g8)
- 监控仪表板中缺少 Ceph-rook 指标
- 诊断性运行状况检查期间报告的错误不匹配
- 为 uipathctl 创建的工作负载配置资源请求和限制
- 无正常的上游问题
- 杀毒软件阻止了 Redis 启动
- 无法在启用 TLS 证书验证的情况下启动 AI Center 和 Document Understanding Pod
- Fluentd 不会在 IPv6 环境中导出日志
- Studio 桌面版无法加载 Integration Service 连接器和活动
- 使用 Process Mining 运行高可用性
- 使用 Kerberos 登录时 Process Mining 挖掘失败
- 无法使用 pyodbc 格式连接字符串连接到 AutomationSuite_ProcessMining_Warehouse 数据库
- Airflow 安装失败,并显示 sqlalchemy.exc.ArgumentError:无法从字符串“”中解析 rfc1738 URL
- 如何添加 IP 表格规则以使用 SQL Server 端口 1433
- 运行 CData Sync 的服务器不信任 Automation Suite 证书
- Process Mining fails to load after disabling and re-enabling it
- 运行诊断工具
- 使用 Automation Suite 支持捆绑包
- 探索日志
重要 :
请注意,此内容已使用机器翻译进行了部分本地化。
新发布内容的本地化可能需要 1-2 周的时间才能完成。
适用于 Automation Suite 的 GCP Marketplace 部署架构,包括网络、DNS 和基础架构组件。
架构图
下图显示了 Automation Suite 的 GCP Marketplace 部署架构。
组件
- 虚拟网络
- 所有节点所在的子网。
- 用于出站连接的 NAT 网关(附加到 Cloud 路由器的 Cloud Nat 资源);
- 用于保护子网流量的防火墙规则。
- 安装所需的 DNS 私有区域。有关详细信息,请参阅“已知限制”部分。
- 4 个托管实例组。您可以为服务器、代理、GPU 代理节点和 Automation Suite Robot 节点选择实例类型。请确保满足每种节点的硬件要求。每个虚拟机都有一个 128 GB 的操作系统和 256 GB 的集群二进制文件和状态磁盘。服务器节点有两个额外的磁盘:一个 512GB 的数据磁盘和一个用于对象存储的 512GB 磁盘。
- 服务器节点(集群控制平面)。服务器节点也运行工作负载。
- 代理节点。 设计为仅运行工作负载(它们没有控制平面服务)。 如果所需的代理节点数为 0,则会创建一个空的托管实例组。
- GPU 节点。 专门用于具有视频卡的 ML 模型的节点。 如果所需的 GPU 节点数为 0,则不会创建托管实例组。
- Automation Suite 机器人节点。 设计为仅运行机器人工作负载。 如果所需的 Automation Suite 机器人节点数为 0,则会创建一个空的托管实例组。 Automation Suite 机器人节点有一个额外的 32GB 磁盘,用于缓存机器人包。
- 用于平衡从端口
443到节点的 HTTPS 流量的公共负载均衡器。 - 转发节点注册请求需要 2 个内部负载均衡器和一个托管实例组。虚拟机具有尽可能小的实例大小。
- 用于访问其他节点的堡垒实例。它具有公共 IP 和启用的 SSH。
- SQL 数据库实例:
- 8 核和 32 GB RAM
- 可手动扩展的 1000 GB 磁盘大小
- 数据库由安装程序创建
- Process Mining
AutomationSuite_Airflow数据库的 PostgreSQL 数据库实例。- 4 核和 16GB RAM
- 64 GB 磁盘大小
- 500 IOPS 及以上
- 如果已安装 Process Mining 且集群为 HA(至少具有 3 个服务器节点),则部署辅助 SQL 数据库实例:
- 16 核和 32 GB RAM
- 可手动扩展的 100 GB 磁盘大小
- Process Mining 所需的数据库由安装程序创建
- 密码管理器,用于存储为 SQL 服务器、Automation Suite 平台和 ArgoCD 控制台自动生成的凭据。
- 用于虚拟机身份的服务帐户。
已知限制
Process Mining
- 如果在多节点 HA 就绪生产模式下启用 Process Mining,安装将失败。确保不要在安装时选择 Process Mining。创建
AutomationSuite_ProcessMining_Warehouse数据库后,您可以启用 Process Mining 后安装功能。有关详细信息,请参阅管理产品。
Dns
- 由于 DNS 无法自动附加到 LB:
- 配置 DNS 的步骤只能在安装后完成,而在安装过程中需要执行这些步骤。私有 DNS 区域解决了此问题,并且可以在安装完成后安全地将其删除。或者,出于测试目的,请查看步骤 4:配置 DNS。
RHEL
- Google 可能会更新 RHEL 版本,恕不另行通知,从而使 Automation Suite 部署不受支持。 目前,使用自定义 RHEL 映像进行手动部署是获得支持的唯一方法。