288 GB HBM4
Rubin
具体 GPU 版本、CPU、内存与互联取决于确认后的实例配置,硬件显存参考值不代表已分配资源
厂商规格说明 ↗需报价
公开参考价 / GPU 小时,Arvica 售价、税费及附加服务以批准报价为准
确认可用容量
选择按需或预留算力,开通前确认地区、开始时间与访问环境
NVIDIA Rubin R100(NVIDIA 官方也直接称为 Rubin GPU)是 Blackwell Ultra(B300)之后的新一代产品 NVIDIA 公布的参数包括 288 GB HBM4、最高 22 TB/s 显存带宽、50 PFLOPS FP4 密集算力及 3.6 TB/s 的 NVLink 6 互联 NVIDIA 表示预计 2026 年第四季度前后开始送样 更广泛的云端供应预计在 2027 年 目前尚无公开定价 登记预订意向 以便在容量规划推进时获得通知
| GPU 显存 | 288 GB HBM4 |
|---|---|
| 显存带宽 | 最高 22 TB/s |
| 密集算力(FP4) | 50 PFLOPS |
| 互联 | NVLink 6 · 3.6 TB/s |
| 供货状态 | 预计 2026 年第四季度送样 · 目前仅开放预订登记 |
R100 尚未发货 登记后 Arvica 会在容量开放时与你联系确认价格与可用性
Rubin
具体 GPU 版本、CPU、内存与互联取决于确认后的实例配置,硬件显存参考值不代表已分配资源
厂商规格说明 ↗公开参考价 / GPU 小时,Arvica 售价、税费及附加服务以批准报价为准
选择按需或预留算力,开通前确认地区、开始时间与访问环境
| 公开来源 | GPU 版本 | 参考价/GPU 小时 | 价格类型 |
|---|---|---|---|
| 当前未记录该配置可比较的公开费率 请申请具体配置报价 | |||
公开参考费率不代表实时库存或相同实例规格,Arvica 报价会确认完整配置与费用
适合评估 FP4 精度下的万亿参数级推理 以及受显存带宽限制的多节点训练任务 目前仅为预订规划 尚无已确认的交付日期、价格或配置
如需当前可用容量 可比较 GB300 NVL72 或 B300 R100 预订不代表已确认交付日期、价格或配置 需待 NVIDIA 及合作伙伴供货确认
288 GB HBM4、最高 22 TB/s 带宽为厂商公布的参考数据 Rubin 平台的显存、互联及系统配置尚未正式最终确定 请以后续公布信息为准
NVIDIA 公布 Rubin 代 GPU 配备 3.6 TB/s 的 NVLink 6 互联 在伙伴机架级平台公布前 不应假定节点数量、NVLink 域或主机 CPU 配置
Rubin 预计需要新的 CUDA 与驱动版本 一旦获得早期访问权限 应为框架、内核和容器镜像预留验证时间
NVIDIA 硬件参考 ↗ · 选型建议为 Arvica 的评估 请结合实际工作负载验证
明确操作系统、框架和容器镜像版本 Arvica 在开通前确认驱动与 GPU 兼容性 模板名称不代表软件许可或已保证预装的镜像
配置时保存 SSH 公钥 私钥保留在自己的设备上 访问准备就绪后 经核实的部署记录会提供实际主机和登录用户
容量规划中应区分启动盘、数据集、模型权重与检查点 使用数据卷前确认持久性、备份责任、挂载规则和删除行为
按需确认数据进出、公网 IP 访问与私有网络 涉及受监管或位置敏感的数据时 应在提交前通过高级设置指定所需地区
Arvica 提供经核实的访问信息后 使用私钥及实例页面显示的准确主机与用户名连接 然后检查分配的 GPU 与拓扑
ssh -i ~/.ssh/your_key USER@HOST nvidia-smi nvidia-smi topo -m
将 USER 与 HOST 替换为你自己的部署信息 这些命令用于检查已有机器 不会创建机器
参数量 × 每权重字节数仅估算权重 还需加入 KV 缓存、激活值、临时张量和框架开销 训练还需要梯度与优化器状态
同时记录模型版本、精度、输入输出长度、并发、延迟与错误率 在相同条件下比较完成任务或成功请求的成本
计入全部分配 GPU、运行时间、存储、网络、税费与支持 月度估算采用 730 小时方便比较 实际计费周期和最低租期由合同明确
适合评估 FP4 精度下的万亿参数级推理 以及受显存带宽限制的多节点训练任务 目前仅为预订规划 尚无已确认的交付日期、价格或配置
288 GB HBM4、最高 22 TB/s 带宽为厂商公布的参考数据 Rubin 平台的显存、互联及系统配置尚未正式最终确定 请以后续公布信息为准
Rubin 预计需要新的 CUDA 与驱动版本 一旦获得早期访问权限 应为框架、内核和容器镜像预留验证时间
NVIDIA 公布 Rubin 代 GPU 配备 3.6 TB/s 的 NVLink 6 互联 在伙伴机架级平台公布前 不应假定节点数量、NVLink 域或主机 CPU 配置
不能据此判断 资源配额、存储和预留承诺可能继续计费 请核对合同并通过支持申请对应生命周期操作
保留方式取决于约定的存储配置 申请销毁前应导出数据 并确认备份与数据卷保留安排
当前配置进入 Arvica 容量审核,只有基础设施核实后才显示运行状态
最终报价会在订购前明确 GPU、存储、网络、税费与服务费用
多节点互联及容量预留需求可通过企业容量入口提交
| GPU | 显存参考 | 选型依据 |
|---|---|---|
| R100 | 288 GB HBM4 | 适合评估 FP4 精度下的万亿参数级推理 以及受显存带宽限制的多节点训练任务 目前仅为预订规划 尚无已确认的交付日期、价格或配置 |
| H200 | 141 GB HBM3e | 模型权重、KV 缓存和并发请求争用显存时 可测试 H200 根据精度和运行开销 更大显存可能减少跨卡拆分需求 |
| B300 | 288 GB HBM3e | 模型状态、激活值或 KV 缓存限制当前部署时 可评估 B300 使用代表性模型和目标并发 判断减少卡数并采用更大显存是否改善总成本 |
| GB300 NVL72 | 72-GPU system | 可评估用于持续大模型推理或高通信需求分布式训练的机架容量 提交需求时提供并行方案与服务目标 |
| 配置 | 实际差异 | 下单前确认 |
|---|---|---|
| SXM · 虚拟机 · 288 GB HBM4 | 虚拟机内使用客户操作系统与分配资源 | GPU 数量、NVLink/NVSwitch 拓扑、节点间网络及 NUMA 分布 |
| SXM · Bare Metal · 288 GB HBM4 | 独立物理主机配置 主机权限以确认服务为准 | GPU 数量、NVLink/NVSwitch 拓扑、节点间网络及 NUMA 分布 |
仅权重可按参数量 × 每参数字节数估算 7B 模型 BF16 权重约 14 GB 70B 约 140 GB 还需加上 KV 缓存、激活、框架缓冲和训练状态 这是算术估算 不是可运行保证
使用相同模型版本、精度、序列长度和并发 记录首 token 时间、p95 延迟、输出 tokens/s、峰值显存及完整实例费用 训练比较还需记录每步时间及相同质量目标下的收敛情况
下方提供厂商规格来源 当前尚未发布此配置的 Arvica 应用吞吐实测数据 性能承诺前应进行针对工作负载的验收测试
NVIDIA ↗浏览 PCIe/SXM 及虚拟机/裸金属独立配置 开通前向 Arvica 提交预订需求
2 款可咨询配置