全部 AI 推理芯片

GB200 NVL72 vs B200

本页对比 NVIDIA GB200 NVL72 NVIDIA B200 的纸面规格与价格,并链接到相同工作负载上持续测量的 LLM 推理基准测试。

纸面规格对比

GB200 NVL72B200GB200 NVL72 / B200
单芯片显存186 GB HBM3e180 GB HBM3e1.03x
内存带宽8 TB/s8 TB/s1.0x
稠密 FP8 算力5,000 TFLOP/s4,500 TFLOP/s1.11x
稠密 FP4 算力10,000 TFLOP/s9,000 TFLOP/s1.11x
TDP1,200 W1,000 W1.2x
小时租价(neocloud 档)$2.26/hr$2.07/hr1.09x
Scale-up 域规模72 芯片8 芯片9.0x

倍数为纸面规格对比;实测差距请见实时对比页面。

常见问题

GB200 NVL72 和 B200 谁的显存更大?
GB200 NVL72 单芯片为 186 GB HBM3e,B200 为 180 GB HBM3e,容量比约 1.03x。
GB200 NVL72 和 B200 的价格怎么比?
按 SemiAnalysis TCO 模型 neocloud 档费率,GB200 NVL72 约 $2.26/hr,B200 约 $2.07/hr。单看小时租价容易误导:每美元性能对比页面会用实测吞吐量除以这些费率。
GB200 NVL72 的 LLM 推理速度比 B200 快吗?
纸面上 GB200 NVL72 的稠密 FP8 算力是 B200 的 1.11x,但实际交付的 token 吞吐量取决于模型、推理引擎、精度和交互性目标。InferenceX 每日在完全相同的工作负载上测量这两款芯片,最新结果请见实时对比页面。

查看实时基准测试结果

以上都是静态硬件数据。实际交付的 token 吞吐量、每百万 token 成本和每 token 能耗在仪表板上持续测量:

通过 SemiAnalysis 行业模型深入研究

InferenceX 测量实际交付的推理性能,而 SemiAnalysis 机构级行业模型覆盖这些芯片背后的市场:谁在出货、谁在采购、拥有成本是多少。