面向 LLM 推理的 AI 芯片

InferenceX 覆盖的每一款芯片的规格、云端价格与持续测量的推理基准测试。每个页面都将实时仪表板使用的硬件数据与 SemiAnalysis AI Cloud TCO 费率相结合。

芯片页面

NVIDIA H100 SXM

NVIDIA H100 规格、云端价格与实时 LLM 推理基准测试:80 GB HBM3、3.35 TB/s 内存带宽、FP8 Tensor Core、NVLink 4.0,每日在 vLLM、SGLang 与 TensorRT-LLM 上持续测量。

NVIDIA H200 SXM

NVIDIA H200 规格、云端价格与实时 LLM 推理基准测试:141 GB HBM3e、4.8 TB/s 内存带宽、FP8 Tensor Core 与 NVLink 4.0,每日与 Blackwell 及 AMD Instinct 对比测量。

NVIDIA B200

NVIDIA B200 规格、云端价格与实时 LLM 推理基准测试:180 GB HBM3e、8 TB/s 带宽、9,000 稠密 FP4 TFLOP/s 与 NVLink 5.0,每日在 vLLM、SGLang 与 TensorRT-LLM 上持续测量。

NVIDIA B300

NVIDIA B300(Blackwell Ultra)规格、云端价格与实时 LLM 推理基准测试:268 GB 可用 HBM3e、13,500 稠密 FP4 TFLOP/s、800 Gbit/s scale-out 网络,每日与 B200、GB300 NVL72 和 MI355X 对比测量。

NVIDIA GB200 NVL72

NVIDIA GB200 NVL72 规格、整机柜价格与实时 LLM 推理基准测试:72 颗 Blackwell 芯片组成单一 NVLink 域,单芯片 186 GB HBM3e、900 GB/s scale-up 带宽,每日在分离式 vLLM、SGLang 与 Dynamo TRT-LLM 上测量。

NVIDIA GB300 NVL72

NVIDIA GB300 NVL72 规格、整机柜价格与实时 LLM 推理基准测试:72 颗 Blackwell Ultra 芯片,单芯片 278 GB HBM3e(整柜约 20 TB)、15,000 稠密 FP4 TFLOP/s,每日在分离式推理方案上测量。

AMD Instinct MI300X

AMD Instinct MI300X 规格、云端价格与实时 LLM 推理基准测试:192 GB HBM3、5.3 TB/s 带宽、2,615 稠密 FP8 TFLOP/s、全互联 Infinity Fabric,每日在 ROCm 版 vLLM 与 SGLang 上测量。

AMD Instinct MI325X

AMD Instinct MI325X 规格、云端价格与实时 LLM 推理基准测试:256 GB HBM3e、6 TB/s 带宽、2,615 稠密 FP8 TFLOP/s、全互联 Infinity Fabric,每日在 ROCm 版 vLLM 与 SGLang 上测量。

AMD Instinct MI355X

AMD Instinct MI355X 规格、云端价格与实时 LLM 推理基准测试:288 GB HBM3e、8 TB/s 带宽、10,066 稠密 FP4 TFLOP/s,AMD 首款支持 FP4 的芯片,每日在 ROCm 版 vLLM、SGLang 与 ATOM 上测量。

芯片对比