automation-suite
2023.4
false
- 概述
- 要求
- 安装
- 安装后
- 集群管理
- 监控和警示
- 迁移和升级
- 特定于产品的配置
- 最佳实践和维护
- 故障排除
AI Center 注意事项
重要 :
请注意此内容已使用机器翻译进行了部分本地化。
Linux 版 Automation Suite 安装指南
Last updated 2024年9月5日
AI Center 注意事项
除了作为完整平台要求一部分的核心服务要求之外,AI Center 还需要其他资源,具体取决于您要运行或训练的模型。有关所需 GPU 硬件版本和兼容的 NVIDIA 驱动程序的更多详细信息,请参阅兼容性矩阵。
注意:下表描述了 AI Center 所需的其他资源。
在此表格中,所有服务器节点都需要数据磁盘。代理节点不需要此操作。
使用 |
CPU |
RAM (GiB) |
GPU |
磁盘 (GiB) |
---|---|---|---|---|
用于服务的最小值(ML 技能,一个副本) |
0.6 |
2 |
0 |
|
用于训练的最小值(管道) |
1 |
4 |
0 |
|
DU 模型服务(ML 技能,一个副本) |
1 |
4 |
0 |
|
DU 模型训练 |
2 |
24 |
强烈推荐 |
|
注意:下表描述了小型和平均 AI Center 实现所需的资源。请注意,这些数字是一般指导原则。
在此表格中,所有服务器节点都需要数据磁盘。代理节点不需要此操作。
使用 |
CPU |
RAM (GiB) |
GPU |
磁盘 (GiB) |
---|---|---|---|---|
小型实现:
|
4 |
32 |
0 |
|
平均实现:
|
8 |
52 |
强烈推荐 |
|
1 个(3 个技能 + 1 个管道)*
rancher
分区上的 20 GiB = rancher
分区上的 80 GiB
2 1 个管道 * 105 GiB = 105 数据磁盘
3(5 个技能 + 2 个管道 + 1 个 DU 管道)*
rancher
分区上的 20 GiB = rancher
分区上的 160 GiB
4(2 个管道 + 1 个 DU 管道)* 105 GiB = 315 数据磁盘