B300
为大型模型与推理提供大显存算力
- 节点配置
- 8 GPU · 30 TB NVMe · 2 TB RAM
- 节点互连
- Quantum-X800 XDR 800G
为你的下一次突破提供 GPU 云算力
训练更具突破性的模型,让 AI 真正投入生产。专属 NVIDIA GPU、高速网络,以及围绕业务需求打造的集群,助力你的下一步。
8 GPU 节点每小时 $19.50 起 · 年度预留合约

助力团队将 AI 转化为业务价值。
为大型模型与推理提供大显存算力
前沿模型训练与 FP4 推理
为长上下文模型服务提供更大显存
兼顾预算的训练与微调算力
价格以美元计,按完整的 8 GPU 节点每小时收费。整机架系统单独报价,实际配置以可用容量和合约条款为准。
06从研究走向成果
02TensorBay 的优势
集群的每一层都为你的团队而设计,让算力更可控、运行更可预测,创新拥有更大空间。
F-01
直接运行在专属硬件上,将机器算力集中用于你的工作负载。在项目的每个阶段,掌握性能主动权。
F-02
专属节点、网络和存储,为团队提供独享的基础设施,支持训练、实验和 AI 生产部署。
F-03
集群交付前经过 72 小时的负载、显存、网络和热测试。先查看测试结果,再确认验收。
F-04
使用自己的驱动、内核与工具。通过 Slurm、Kubernetes 或 SSH,构建适合模型需求的软件环境。
F-05
同机架备用节点与 15 分钟节点更换 SLA,有助于降低硬件故障对项目的影响。
F-06
公开价格,预留合约内按分钟计量,每节点每月包含 20 TB 出站流量。提前看清成本,规划业务。
03支撑雄心的基础设施
电力、冷却、GPU 与网络,由我们统一设计和运营,为 AI 提供可持续扩展的基础设施。
1 GW
已签约的电力容量覆盖五个国家,为基础设施扩展提供支持。
PUE 1.12
130 kW 机架采用芯片直冷液冷技术,面向高强度 AI 工作负载设计。
24,000+ GPUs
以六周为周期扩展容量,每次交付前进行 72 小时测试。
97.4%
过去 90 天的集群有效利用率,即实际转化为有效计算工作的容量占比。
专属网络
专属 InfiniBand 将集群连接起来,为分布式训练和 GPU 间数据交换提供带宽。
800Gb/s
每条 InfiniBand XDR 链路,Blackwell 配备 Quantum-X800
存储
本地 NVMe、WEKA 和 S3 兼容存储,支持按项目规模加载数据集与保存检查点。
720GB/s
采用专属 WEKA 时,每计算单元的聚合读取吞吐量
数据传输
入站和节点间流量免费,并包含出站流量额度,便于提前规划运营成本。
20TB
每节点每月包含的出站流量
05为下一步投入算力
选择预留期限,比较算力配置,规划投入。从公开透明的价格开始沟通。
| GPU 与显存 | 月度合约按月度合约预留算力 | 年度合约更低的小时费率 |
|---|---|---|
NVIDIAHGX B300288 GB HBM3e 每 GPU | 月度 起价 获取月度报价US$ 83.20/小时 | 年度 起价 获取年度报价US$ 58.50/小时 |
NVIDIAHGX B200180 GB HBM3e 每 GPU | 月度 起价 获取月度报价US$ 72.80/小时 | 年度 起价 获取年度报价US$ 50.70/小时 |
NVIDIAHGX H200141 GB HBM3e 每 GPU | 月度 起价 获取月度报价US$ 44.20/小时 | 年度 起价 获取年度报价US$ 31.20/小时 |
NVIDIAHGX H10080 GB HBM3 每 GPU | 月度 起价 获取月度报价US$ 28.60/小时 | 年度 起价 获取年度报价US$ 19.50/小时 |
小时费率涵盖完整的 8 GPU 节点。选择预留期限,获取专属报价。
价格以美元计,按完整的 8 GPU HGX 节点每小时收费;机架级系统按机架报价。价格不含税,包含托管 Slurm 与 Kubernetes 控制平面。存储和 Direct Connect 按上述价格计费,可咨询长期合约方案。
获取我的方案AI 算力采购指南
从 GPU 云服务器租赁到大模型训练与推理,先明确工作负载,再比较配置与合约成本。
需要专属算力时,比较 B300、B200、H200 和 H100 的显存、节点互连与预留期限。HGX 价格按完整的 8 GPU 节点计算,月度和年度合约对应不同的小时费率。
比较 GPU 租赁价格提供模型参数量、训练精度、数据集规模和目标完成时间。全量训练与 LoRA 微调的资源需求不同,多节点训练还需要一起评估 GPU 间通信和存储吞吐。
了解 B300 集群配置推理算力应结合模型权重、上下文长度、KV 缓存和并发请求规划。用自己的模型测试首 token 延迟、输出速度与吞吐,再决定 GPU 数量和服务容量。
了解 H200 推理配置07安心向前
专属硬件、物理隔离与访问控制,支持项目走向生产。从第一个节点开始,安全就是基础设施的一部分。
范围:裸金属计算、网络与托管存储
所有数据中心站点均已认证
专属集群可提供业务伙伴协议(BAA)
欧盟区域提供所在国数据驻留
公布的 HGX 价格以美元计,按月度或年度预留合约中的完整 8 GPU 节点每小时收费。NVL72 系统按机架报价,价格不含税。
请比较显存容量、网络需求,以及训练或推理工作负载。硬件页面提供 B300、B200、H200、H100 与整机架系统。团队可根据模型、数据集与算力需求协助规划配置。
可以。TensorBay 提供用于模型训练、微调和推理的专属 NVIDIA GPU 基础设施。你可以使用 Slurm、Kubernetes 或 SSH,并根据工作负载配置软件环境。
提供所需 GPU、容量与预留期限,或介绍项目需求。团队将在评估后于 48 小时内准备方案,包括配置与交付时间,最终容量和条款在方案中确认。
请说明团队所在地区、数据存放地、目标部署地区和启动日期。具体数据中心、可交付 GPU 配置、网络访问方式和交付时间在项目方案中确认。部署前可按工作负载约定验收标准。
请提供具体模型版本、训练或推理目标与数据规模。结合显存、计算精度、上下文长度、并发和软件兼容性评估容量,再用实际工作负载验证延迟与吞吐。团队会根据项目需求核对可用配置。
GPU 预留费率与存储、数据传输和额外网络服务分项列出。请提供数据量、预计入站与出站流量,以及所需连接方式,并在方案中确认总费用、计费单位与税费。页面标价为美元,不是人民币。
08让创意拥有成长空间
告诉我们你的挑战。团队将协助确定 GPU、容量和时间安排,并在 48 小时内提供方案,支持项目启动或进一步扩展。