DeepSeek V4 Pro 1.6T
B200
查看详情MI355X
相对 B200 −69%
B300
GB200 NVL72
无精确 @50 结果
GB300 NVL72
无精确 @50 结果
一眼对比各活跃模型在 MI355X、B200、B300、GB200 与 GB300 上的表现。
8K→1K · 单轮 · 每 GPU 输出 tok/s @50 tok/s/用户 · 仅推测解码 · 各平台最佳验证配置
数据库快照截至 7月22日
| 模型 | B200 | MI355X | B300 | GB200 NVL72 | GB300 NVL72 | 详情 |
|---|---|---|---|---|---|---|
DeepSeek V4 Pro 1.6T | 相对 B200 −69% | 无精确 @50 结果 | 无精确 @50 结果 | 查看详情 | ||
Kimi K2.5/2.6/2.7-Code 1T | 仅标准解码 | 仅标准解码 | 仅标准解码 | 仅标准解码 | 仅标准解码 | 查看详情 |
MiniMax M3 428B | 相对 B200 +37% | 仅标准解码 | 仅标准解码 | 查看详情 | ||
GLM5.2 | 无 8K/1K 数据 | 无 8K/1K 数据 | 无 8K/1K 数据 | 无 8K/1K 数据 | 无 8K/1K 数据 | 查看详情 |
Qwen3.5 397B | 相对 B200 −57% | 相对 B200 +10% | 仅标准解码 | 仅标准解码 | 查看详情 |
相对 B200 −69%
相对 B200 +37%
相对 B200 −57%
相对 B200 +10%
每格展示该平台在该模型上表现最好的已验证推测解码服务配置,并标注精度。相对 B200 的差值只在同精度、同版本结果之间计算——绝不将 FP4 与 FP8 互比。对比对象是完整服务栈,而非单独的芯片。
∞ = 无可比结果
各档位数据基于各配置官方 Pareto 前沿插值;不进行外推。