72-GPU system
Grace Blackwell
具体 GPU 版本、CPU、内存与互联取决于确认后的实例配置,硬件显存参考值不代表已分配资源
厂商规格说明 ↗需报价
公开参考价 / GPU 小时,Arvica 售价、税费及附加服务以批准报价为准
确认可用容量
选择按需或预留算力,开通前确认地区、开始时间与访问环境
GB200 NVL72 将 Grace CPU 与 Blackwell GPU 整合为液冷机架级系统 该方案围绕完整系统容量展开 并非单卡租用
Grace Blackwell
具体 GPU 版本、CPU、内存与互联取决于确认后的实例配置,硬件显存参考值不代表已分配资源
厂商规格说明 ↗公开参考价 / GPU 小时,Arvica 售价、税费及附加服务以批准报价为准
选择按需或预留算力,开通前确认地区、开始时间与访问环境
| 公开来源 | GPU 版本 | 参考价/GPU 小时 | 价格类型 |
|---|---|---|---|
| 当前未记录该配置可比较的公开费率 请申请具体配置报价 | |||
公开参考费率不代表实时库存或相同实例规格,Arvica 报价会确认完整配置与费用
适合评估可受益于大型 NVLink 域的分布式训练或推理 应从模型并行策略、数据集和预期利用率开始规划
需要 Blackwell Ultra 时可比较 GB300 若任务无需机架级配额 B200 节点可能更容易按需规划
NVL72 设计包含 72 个 Blackwell GPU 和 36 个 Grace CPU 分布式软件仍需管理跨设备的数据放置与通信
需一并明确 NVLink 域、外部网络、存储吞吐、液冷环境与验收测试 汇总带宽不等于单卡应用可用带宽
Grace 使用 Arm CPU 迁移前需验证容器、原生库、监控代理和数据工具对主机架构的支持
NVIDIA 硬件参考 ↗ · 选型建议为 Arvica 的评估 请结合实际工作负载验证
明确操作系统、框架和容器镜像版本 Arvica 在开通前确认驱动与 GPU 兼容性 模板名称不代表软件许可或已保证预装的镜像
配置时保存 SSH 公钥 私钥保留在自己的设备上 访问准备就绪后 经核实的部署记录会提供实际主机和登录用户
容量规划中应区分启动盘、数据集、模型权重与检查点 使用数据卷前确认持久性、备份责任、挂载规则和删除行为
按需确认数据进出、公网 IP 访问与私有网络 涉及受监管或位置敏感的数据时 应在提交前通过高级设置指定所需地区
Arvica 提供经核实的访问信息后 使用私钥及实例页面显示的准确主机与用户名连接 然后检查分配的 GPU 与拓扑
ssh -i ~/.ssh/your_key USER@HOST nvidia-smi nvidia-smi topo -m
将 USER 与 HOST 替换为你自己的部署信息 这些命令用于检查已有机器 不会创建机器
参数量 × 每权重字节数仅估算权重 还需加入 KV 缓存、激活值、临时张量和框架开销 训练还需要梯度与优化器状态
同时记录模型版本、精度、输入输出长度、并发、延迟与错误率 在相同条件下比较完成任务或成功请求的成本
计入全部分配 GPU、运行时间、存储、网络、税费与支持 月度估算采用 730 小时方便比较 实际计费周期和最低租期由合同明确
适合评估可受益于大型 NVLink 域的分布式训练或推理 应从模型并行策略、数据集和预期利用率开始规划
NVL72 设计包含 72 个 Blackwell GPU 和 36 个 Grace CPU 分布式软件仍需管理跨设备的数据放置与通信
Grace 使用 Arm CPU 迁移前需验证容器、原生库、监控代理和数据工具对主机架构的支持
需一并明确 NVLink 域、外部网络、存储吞吐、液冷环境与验收测试 汇总带宽不等于单卡应用可用带宽
不能据此判断 资源配额、存储和预留承诺可能继续计费 请核对合同并通过支持申请对应生命周期操作
保留方式取决于约定的存储配置 申请销毁前应导出数据 并确认备份与数据卷保留安排
当前配置进入 Arvica 容量审核,只有基础设施核实后才显示运行状态
最终报价会在订购前明确 GPU、存储、网络、税费与服务费用
多节点互联及容量预留需求可通过企业容量入口提交