NVIDIA / Rubin新品

R100
规格、价格与算力配置

NVIDIA Rubin R100(NVIDIA 官方也直接称为 Rubin GPU)是 Blackwell Ultra(B300)之后的新一代产品 NVIDIA 公布的参数包括 288 GB HBM4、最高 22 TB/s 显存带宽、50 PFLOPS FP4 密集算力及 3.6 TB/s 的 NVLink 6 互联 NVIDIA 表示预计 2026 年第四季度前后开始送样 更广泛的云端供应预计在 2027 年 目前尚无公开定价 登记预订意向 以便在容量规划推进时获得通知

GPU 显存288 GB HBM4
显存带宽最高 22 TB/s
密集算力(FP4)50 PFLOPS
互联NVLink 6 · 3.6 TB/s
供货状态预计 2026 年第四季度送样 · 目前仅开放预订登记
意向登记

登记 R100 意向

R100 尚未发货 登记后 Arvica 会在容量开放时与你联系确认价格与可用性

硬件参考

288 GB HBM4

Rubin

具体 GPU 版本、CPU、内存与互联取决于确认后的实例配置,硬件显存参考值不代表已分配资源

厂商规格说明
价格状态

需报价

公开参考价 / GPU 小时,Arvica 售价、税费及附加服务以批准报价为准

容量

确认可用容量

选择按需或预留算力,开通前确认地区、开始时间与访问环境

PUBLIC PRICE REFERENCES / AUD

R100 · 价格参考

公开来源GPU 版本参考价/GPU 小时价格类型
当前未记录该配置可比较的公开费率 请申请具体配置报价

公开参考费率不代表实时库存或相同实例规格,Arvica 报价会确认完整配置与费用

围绕工作负载选择

01

何时选择此 GPU

适合评估 FP4 精度下的万亿参数级推理 以及受显存带宽限制的多节点训练任务 目前仅为预订规划 尚无已确认的交付日期、价格或配置

02

何时考虑其他型号

如需当前可用容量 可比较 GB300 NVL72 或 B300 R100 预订不代表已确认交付日期、价格或配置 需待 NVIDIA 及合作伙伴供货确认

03

显存规划

288 GB HBM4、最高 22 TB/s 带宽为厂商公布的参考数据 Rubin 平台的显存、互联及系统配置尚未正式最终确定 请以后续公布信息为准

04

互联与扩展

NVIDIA 公布 Rubin 代 GPU 配备 3.6 TB/s 的 NVLink 6 互联 在伙伴机架级平台公布前 不应假定节点数量、NVLink 域或主机 CPU 配置

05

软件兼容性

Rubin 预计需要新的 CUDA 与驱动版本 一旦获得早期访问权限 应为框架、内核和容器镜像预留验证时间

NVIDIA 硬件参考 · 选型建议为 Arvica 的评估 请结合实际工作负载验证

从配置到访问

准备你的算力环境

操作系统与容器

明确操作系统、框架和容器镜像版本 Arvica 在开通前确认驱动与 GPU 兼容性 模板名称不代表软件许可或已保证预装的镜像

SSH 与私有访问

配置时保存 SSH 公钥 私钥保留在自己的设备上 访问准备就绪后 经核实的部署记录会提供实际主机和登录用户

存储与检查点

容量规划中应区分启动盘、数据集、模型权重与检查点 使用数据卷前确认持久性、备份责任、挂载规则和删除行为

网络与数据位置

按需确认数据进出、公网 IP 访问与私有网络 涉及受监管或位置敏感的数据时 应在提交前通过高级设置指定所需地区

首次连接检查

Arvica 提供经核实的访问信息后 使用私钥及实例页面显示的准确主机与用户名连接 然后检查分配的 GPU 与拓扑

ssh -i ~/.ssh/your_key USER@HOST
nvidia-smi
nvidia-smi topo -m

将 USER 与 HOST 替换为你自己的部署信息 这些命令用于检查已有机器 不会创建机器

订购前评估任务需求

模型显存

参数量 × 每权重字节数仅估算权重 还需加入 KV 缓存、激活值、临时张量和框架开销 训练还需要梯度与优化器状态

测量有效吞吐

同时记录模型版本、精度、输入输出长度、并发、延迟与错误率 在相同条件下比较完成任务或成功请求的成本

完整成本

计入全部分配 GPU、运行时间、存储、网络、税费与支持 月度估算采用 730 小时方便比较 实际计费周期和最低租期由合同明确

RESERVED / CLUSTERS

需要更多容量?

明确 GPU 配额、互联、存储、地点与租期,Arvica 根据工作负载准备容量方案

申请容量

先规划 再测试

模型适配与吞吐取决于精度、软件、批次、上下文及系统拓扑,请依据工作负载评估,不将未经验证的吞吐数字作为承诺

训练费用计算器

FAQ

如何选择 GPU 数量?

适合评估 FP4 精度下的万亿参数级推理 以及受显存带宽限制的多节点训练任务 目前仅为预订规划 尚无已确认的交付日期、价格或配置

显存需要检查什么?

288 GB HBM4、最高 22 TB/s 带宽为厂商公布的参考数据 Rubin 平台的显存、互联及系统配置尚未正式最终确定 请以后续公布信息为准

需要准备什么软件?

Rubin 预计需要新的 CUDA 与驱动版本 一旦获得早期访问权限 应为框架、内核和容器镜像预留验证时间

包含什么互联配置?

NVIDIA 公布 Rubin 代 GPU 配备 3.6 TB/s 的 NVLink 6 互联 在伙伴机架级平台公布前 不应假定节点数量、NVLink 域或主机 CPU 配置

关闭操作系统就能停止计费吗?

不能据此判断 资源配额、存储和预留承诺可能继续计费 请核对合同并通过支持申请对应生命周期操作

销毁后数据会保留吗?

保留方式取决于约定的存储配置 申请销毁前应导出数据 并确认备份与数据卷保留安排

可以立即开通吗?

当前配置进入 Arvica 容量审核,只有基础设施核实后才显示运行状态

参考价格就是最终账单吗?

最终报价会在订购前明确 GPU、存储、网络、税费与服务费用

可以使用更大的集群吗?

多节点互联及容量预留需求可通过企业容量入口提交

查看相关 GPU

预订前比较配置

GPU显存参考选型依据
R100288 GB HBM4适合评估 FP4 精度下的万亿参数级推理 以及受显存带宽限制的多节点训练任务 目前仅为预订规划 尚无已确认的交付日期、价格或配置
H200141 GB HBM3e模型权重、KV 缓存和并发请求争用显存时 可测试 H200 根据精度和运行开销 更大显存可能减少跨卡拆分需求
B300288 GB HBM3e模型状态、激活值或 KV 缓存限制当前部署时 可评估 B300 使用代表性模型和目标并发 判断减少卡数并采用更大显存是否改善总成本
GB300 NVL7272-GPU system可评估用于持续大模型推理或高通信需求分布式训练的机架容量 提交需求时提供并行方案与服务目标

不同配置具体差在哪里

配置实际差异下单前确认
SXM · 虚拟机 · 288 GB HBM4虚拟机内使用客户操作系统与分配资源GPU 数量、NVLink/NVSwitch 拓扑、节点间网络及 NUMA 分布
SXM · Bare Metal · 288 GB HBM4独立物理主机配置 主机权限以确认服务为准GPU 数量、NVLink/NVSwitch 拓扑、节点间网络及 NUMA 分布

计算实际显存需求

仅权重可按参数量 × 每参数字节数估算 7B 模型 BF16 权重约 14 GB 70B 约 140 GB 还需加上 KV 缓存、激活、框架缓冲和训练状态 这是算术估算 不是可运行保证

衡量有用性能

使用相同模型版本、精度、序列长度和并发 记录首 token 时间、p95 延迟、输出 tokens/s、峰值显存及完整实例费用 训练比较还需记录每步时间及相同质量目标下的收敛情况

性能资料状态

下方提供厂商规格来源 当前尚未发布此配置的 Arvica 应用吞吐实测数据 性能承诺前应进行针对工作负载的验收测试

NVIDIA ↗
独立配置 · 预订意向

选择部署配置

浏览 PCIe/SXM 及虚拟机/裸金属独立配置 开通前向 Arvica 提交预订需求

预订所需配置 主机规格为参考 供货、地区、最终价格与交付安排随订单确认 提交咨询不收取费用

2 款可咨询配置

需预订虚拟机

R100 SXM

获取澳元报价交付时间待确认

示例配置

GPU
1 × R100
GPU 显存
288 GB HBM4
vCPU
16
RAM
128 GB
存储
500 GB
可用库存需确认地区随订单确认服务Arvica Cloud
提交预订需求 咨询后续供货
需预订裸金属

R100 SXM

获取澳元报价交付时间待确认

示例配置

GPU
8 × R100
GPU 显存
288 GB HBM4
vCPU
128
RAM
2048 GB
存储
4000 GB
可用库存需确认地区随订单确认服务Arvica Cloud
提交预订需求 咨询后续供货
Arvica 会跟进容量需求 为你确认合适的配置、价格和交付安排