B200 vs H200
本页对比 NVIDIA B200 与 NVIDIA H200 SXM 的纸面规格与价格,并链接到相同工作负载上持续测量的 LLM 推理基准测试。
纸面规格对比
| B200 | H200 | B200 / H200 | |
|---|---|---|---|
| 单芯片显存 | 180 GB HBM3e | 141 GB HBM3e | 1.28x |
| 内存带宽 | 8 TB/s | 4.8 TB/s | 1.67x |
| 稠密 FP8 算力 | 4,500 TFLOP/s | 1,979 TFLOP/s | 2.27x |
| 稠密 FP4 算力 | 9,000 TFLOP/s | 不支持 | 不适用 |
| TDP | 1,000 W | 700 W | 1.43x |
| 小时租价(neocloud 档) | $2.07/hr | $1.59/hr | 1.3x |
| Scale-up 域规模 | 8 芯片 | 8 芯片 | 1.0x |
倍数为纸面规格对比;实测差距请见实时对比页面。
常见问题
- B200 和 H200 谁的显存更大?
- B200 单芯片为 180 GB HBM3e,H200 为 141 GB HBM3e,容量比约 1.28x。
- B200 和 H200 的价格怎么比?
- 按 SemiAnalysis TCO 模型 neocloud 档费率,B200 约 $2.07/hr,H200 约 $1.59/hr。单看小时租价容易误导:每美元性能对比页面会用实测吞吐量除以这些费率。
- B200 的 LLM 推理速度比 H200 快吗?
- 纸面上 B200 的稠密 FP8 算力是 H200 的 2.27x,但实际交付的 token 吞吐量取决于模型、推理引擎、精度和交互性目标。InferenceX 每日在完全相同的工作负载上测量这两款芯片,最新结果请见实时对比页面。
查看实时基准测试结果
以上都是静态硬件数据。实际交付的 token 吞吐量、每百万 token 成本和每 token 能耗在仪表板上持续测量:
通过 SemiAnalysis 行业模型深入研究
InferenceX 测量实际交付的推理性能,而 SemiAnalysis 机构级行业模型覆盖这些芯片背后的市场:谁在出货、谁在采购、拥有成本是多少。