141 GB HBM3e
Hopper
具体 GPU 版本、CPU、内存与互联取决于确认后的实例配置,硬件显存参考值不代表已分配资源
厂商规格说明 ↗A$ 5.53
公开参考价 / GPU 小时,Arvica 售价、税费及附加服务以批准报价为准
参考价格来源 ↗确认可用容量
选择按需或预留算力,开通前确认地区、开始时间与访问环境
H200 将 Hopper 架构与 141 GB HBM3e 显存结合 适合评估大显存推理、长上下文服务及超过 80 GB 显存需求的训练配置
Hopper
具体 GPU 版本、CPU、内存与互联取决于确认后的实例配置,硬件显存参考值不代表已分配资源
厂商规格说明 ↗公开参考价 / GPU 小时,Arvica 售价、税费及附加服务以批准报价为准
参考价格来源 ↗选择按需或预留算力,开通前确认地区、开始时间与访问环境
| 公开来源 | GPU 版本 | 参考价/GPU 小时 | 价格类型 |
|---|---|---|---|
| Hyperstack ↗ | H200 SXM · 141 GB | A$ 5.53 | on-demand |
| Runpod ↗ | H200 · 141 GB | A$ 6.36 | secure-pod |
公开参考费率不代表实时库存或相同实例规格,Arvica 报价会确认完整配置与费用
模型权重、KV 缓存和并发请求争用显存时 可测试 H200 根据精度和运行开销 更大显存可能减少跨卡拆分需求
按完成任务成本或成功请求成本比较 H100 与 H200 应用能利用额外显存时才有价值 如需 Blackwell 软件路线 可比较 B200
NVIDIA 规格为 141 GB HBM3e 和 4.8 TB/s 显存带宽 这些是硬件参数 并非应用吞吐保证
可本地容纳的任务可选择单卡 张量并行需核对节点拓扑 多节点训练还需明确网络和存储设计
保持模型服务、CUDA 运行时和注意力内核与 Hopper 兼容 应在实际并发下测试目标上下文窗口 不只检查权重大小
NVIDIA 硬件参考 ↗ · 选型建议为 Arvica 的评估 请结合实际工作负载验证
明确操作系统、框架和容器镜像版本 Arvica 在开通前确认驱动与 GPU 兼容性 模板名称不代表软件许可或已保证预装的镜像
配置时保存 SSH 公钥 私钥保留在自己的设备上 访问准备就绪后 经核实的部署记录会提供实际主机和登录用户
容量规划中应区分启动盘、数据集、模型权重与检查点 使用数据卷前确认持久性、备份责任、挂载规则和删除行为
按需确认数据进出、公网 IP 访问与私有网络 涉及受监管或位置敏感的数据时 应在提交前通过高级设置指定所需地区
Arvica 提供经核实的访问信息后 使用私钥及实例页面显示的准确主机与用户名连接 然后检查分配的 GPU 与拓扑
ssh -i ~/.ssh/your_key USER@HOST nvidia-smi nvidia-smi topo -m
将 USER 与 HOST 替换为你自己的部署信息 这些命令用于检查已有机器 不会创建机器
参数量 × 每权重字节数仅估算权重 还需加入 KV 缓存、激活值、临时张量和框架开销 训练还需要梯度与优化器状态
同时记录模型版本、精度、输入输出长度、并发、延迟与错误率 在相同条件下比较完成任务或成功请求的成本
计入全部分配 GPU、运行时间、存储、网络、税费与支持 月度估算采用 730 小时方便比较 实际计费周期和最低租期由合同明确
模型权重、KV 缓存和并发请求争用显存时 可测试 H200 根据精度和运行开销 更大显存可能减少跨卡拆分需求
NVIDIA 规格为 141 GB HBM3e 和 4.8 TB/s 显存带宽 这些是硬件参数 并非应用吞吐保证
保持模型服务、CUDA 运行时和注意力内核与 Hopper 兼容 应在实际并发下测试目标上下文窗口 不只检查权重大小
可本地容纳的任务可选择单卡 张量并行需核对节点拓扑 多节点训练还需明确网络和存储设计
不能据此判断 资源配额、存储和预留承诺可能继续计费 请核对合同并通过支持申请对应生命周期操作
保留方式取决于约定的存储配置 申请销毁前应导出数据 并确认备份与数据卷保留安排
当前配置进入 Arvica 容量审核,只有基础设施核实后才显示运行状态
最终报价会在订购前明确 GPU、存储、网络、税费与服务费用
多节点互联及容量预留需求可通过企业容量入口提交
浏览 PCIe/SXM 及虚拟机/裸金属独立配置 开通前向 Arvica 提交预订需求
4 款可咨询配置