你的专属配置
了解你的 HGX H100 集群
- 每 GPU 显存
- 80 GB HBM3 · 3.35 TB/s
- GPU 互连
- NVLink 4 · 900 GB/s
- 节点互连
- 8×400G IB NDR · 3.2 Tbps
- 节点配置
- 8 GPU · 15 TB NVMe · 2 TB RAM
规划 GPU 容量
HGX H100 是否适合你的模型?
先明确工作负载的约束条件,再比较硬件配置和预留成本。
当工作负载能在其显存范围内运行,且预留成本是重点时,可评估 H100。使用自己的模型与配置,与 H200 比较实际训练时间或推理吞吐量。
推理容量规划:vLLM 优化指南申请报价时,请提供以下信息
- 模型与任务:训练、微调或推理。
- 计算精度、上下文长度、批次大小与并发用户数。
- GPU 数量、数据集大小、存储与网络需求。
- 预留期限、计划启动日期和成功标准。
比较显存与预留费率
| GPU | 每 GPU 显存 | 月度合约 | 年度合约 |
|---|---|---|---|
| HGX B300 | 288 GB HBM3e | $83.20 起 | $58.50 起 |
| HGX B200 | 180 GB HBM3e | $72.80 起 | $50.70 起 |
| HGX H200 | 141 GB HBM3e | $44.20 起 | $31.20 起 |
| HGX H100 | 80 GB HBM3 | $28.60 起 | $19.50 起 |
价格以美元计,按完整的 8 GPU 节点每小时收费。显存容量本身并不能决定性能,最终容量、可用性和合约条款在方案中确认。
获取我的方案GPU 价格按单块 GPU 还是按节点收费?
公布的 HGX 价格以美元计,按月度或年度预留合约中的完整 8 GPU 节点每小时收费。NVL72 系统按机架报价,价格不含税。
AI 项目应该选择哪款 NVIDIA GPU?
请比较显存容量、网络需求,以及训练或推理工作负载。硬件页面提供 B300、B200、H200、H100 与整机架系统。团队可根据模型、数据集与算力需求协助规划配置。
专属集群能用于训练、微调和推理吗?
可以。TensorBay 提供用于模型训练、微调和推理的专属 NVIDIA GPU 基础设施。你可以使用 Slurm、Kubernetes 或 SSH,并根据工作负载配置软件环境。
申请报价之后会发生什么?
提供所需 GPU、容量与预留期限,或介绍项目需求。团队将在评估后于 48 小时内准备方案,包括配置与交付时间,最终容量和条款在方案中确认。
询价时需要确认哪些部署与交付信息?
请说明团队所在地区、数据存放地、目标部署地区和启动日期。具体数据中心、可交付 GPU 配置、网络访问方式和交付时间在项目方案中确认。部署前可按工作负载约定验收标准。
如何规划 Qwen、DeepSeek 或 Kimi 等模型的算力?
请提供具体模型版本、训练或推理目标与数据规模。结合显存、计算精度、上下文长度、并发和软件兼容性评估容量,再用实际工作负载验证延迟与吞吐。团队会根据项目需求核对可用配置。
GPU 租赁报价是否包含数据传输与存储?
GPU 预留费率与存储、数据传输和额外网络服务分项列出。请提供数据量、预计入站与出站流量,以及所需连接方式,并在方案中确认总费用、计费单位与税费。页面标价为美元,不是人民币。
08让创意拥有成长空间
下一次 AI 突破,从一次沟通开始。
告诉我们你的挑战。团队将协助确定 GPU、容量和时间安排,并在 48 小时内提供方案,支持项目启动或进一步扩展。
- 围绕项目定制的配置
- 包含交付时间的方案
- 启用前的验收测试