当前位置:首页>排行榜>B300三种形态:节点与整柜怎么选

B300三种形态:节点与整柜怎么选

  • 更新时间 2026-09-28 09:22:56
B300三种形态:节点与整柜怎么选

算力前沿 · B300

B300三种形态:节点与整柜怎么选

 一线看到不少团队在问 B300 时,第一个问题往往是"买哪种"。其实 B300 不是一个单一产品,而是 DGX B300、HGX B300、GB300 NVL72 三种形态共用同一块 B300 芯片。今天把这三种形态拆开,帮采购和技术负责人在"节点"和"整柜"之间做判断。 

一、先认芯片:B300 到底是什么

B300 即 Blackwell Ultra,单卡板载 288GB HBM3e(12-Hi 堆叠),显存带宽 8 TB/s,板载功耗 1,400W。作为对照,上一代 B200 是 192GB / 1,000W。显存从 192GB 提到 288GB,对长上下文推理和显存受限的负载是直接相关的提升——这也是 B300 被定位为推理与长上下文平台支点的原因。

软件侧是省心的一面:B300 沿用 B200 的工具链(CUDA 12.x、cuDNN 9.x、TensorRT-LLM),B200 上跑起来的代码基本可以直接上 B300,迁移成本不高。从 GB200 整柜迁移到 GB300 整柜,机柜级架构也大体兼容,已有 Blackwell 部署的团队切换代价可控。

二、三种形态一览

同样的 B300 芯片,落地成三种不同规模的产品,适合的人群差异很大:

形态

规模 / 显存

功耗 / 冷却

适合谁

DGX B300

8 卡整机,机电内存约 2.1TB

约 14kW / 液冷

要快、要稳的团队

HGX B300

8 卡基板,GPU 性能同 DGX

约 14kW / 液冷

有硬件团队、求省

GB300 NVL72

72 卡整柜,柜内显存约 20.7TB

132–155kW / 全液冷

超大规模训练推理

三、形态一:DGX B300,开箱即用的 8 卡节点

DGX B300 是 NVIDIA 直供的整机方案:8 张 B300 配 Intel Xeon 6776P,整机 8 张 ConnectX-8 800Gb 网卡,峰值功耗约 14kW。特点是"认证安装、交付即用",省去了自行集成散热和供电的麻烦,适合想少踩坑、快速上量的团队。代价是需要 NVIDIA 认证的安装服务,灵活度相对低一些。

四、形态二:HGX B300,自己选 CPU、散热和机箱

HGX B300 是 8 卡基板,GPU 性能和 DGX 完全一致,但 CPU、液冷方案和机箱由采购方决定。好处是灵活、整体预算通常更友好,也方便和既有基础设施对齐。需要自己承担集成与散热设计,适合有硬件团队、想把 B300 塞进现有机房的团队。在硬件到位的前提下,交付周期通常比整柜短,约 8 到 14 周量级。

五、形态三:GB300 NVL72,整柜级 72 卡一体

GB300 NVL72 是 48U 整柜:18 个计算托盘 + 9 个 NVLink 交换托盘,72 张 B300 加 36 颗 Grace CPU,通过第五代 NVLink 形成单一 72 卡域。整柜显存约 20.7TB,加上 Grace 一侧合计快内存约 37TB,整柜功耗 132 到 155kW,全液冷,柜重约 1.36 吨。

第五代 NVLink 在柜内聚合带宽约 130 TB/s,柜外每张卡走 ConnectX-8 800Gb。这是做超大模型训练、万亿参数推理和密集 Agent 负载的默认形态。交付周期也最长,通常 3 到 6 个月以上——这也呼应我们上一期聊的整柜散热供电门槛:整柜不是插上电就能跑。

六、怎么选:三个判断点

1. 看负载的通信范围。任务主要在单机 8 卡内闭环,DGX / HGX 就够;模型大到单柜装不下、或 Agent 多步推理要跨卡常驻显存,整柜才是正解。

2. 看机房条件。1,400W 单卡、整柜 130kW 以上,液冷是必选项不是可选项。没有液冷管路和 CDU 的机房,先补散热供电,再谈 B300。

3. 看交付窗口与团队能力。要快要稳选 DGX,要省要灵活选 HGX,要峰值密度和大规模互联选整柜——但整柜的交付与运维门槛最高,机房、供电、液冷、网络四线齐备才能落地。

 算力前沿栏目持续拆解 B300 从芯片到机柜的落地细节。想系统了解算力硬件的供货与交付实况,欢迎关注本号,每周二、周五更新一线观察。 

随机文章