最快、最大、最强:NVIDIA Blackwell 横扫 MLPerf Training 6.0 基准测试
NVIDIA Blackwell 在 MLPerf 训练基准测试中创下纪录,证明其硬件能加速大模型训练,对追求高效训练的基础设施选型有参考价值。
每个突破性 AI 模型都始于一次训练任务,而训练基础设施决定了迭代速度、可构建的模型规模以及任务能否可靠完成。随着模型越来越大、越来越复杂,训练需求也在攀升。NVIDIA 的 Blackwell 平台在 MLPerf Training 6.0(行业标准训练性能基准测试)中取得了最快成绩,展示了其在大规模训练上的领先能力。
正文摘录
最快、最大、最强:NVIDIA Blackwell 横扫 MLPerf Training 6.0 每一个突破性的 AI 模型都以同样的方式开始:一次训练运行。运行这些训练任务的基础设施决定了一切:团队的迭代速度、可构建的模型规模,以及任务能否可靠地完成。 随着模型在规模、复杂度和智能程度上不断增长,对训练基础设施的需求也在上升。 在 MLPerf Training 6.0——一系列严格、经过同行评审的 AI 训练性能行业基准测试的最新版本——中,NVIDIA Blackwell 平台在每个类别中都领先,展示了: - 每个基准测试中 最快的训练时间 - 使用 NVIDIA Blackwell NVL72 系统在 8,192 块 GPU 上最大规模的训练 - 唯一一个提交了该套件全部七个基准测试 的平台 NVIDIA 在一个平台中集成了性能、规模和可靠性,通过极致协同设计,使 AI 模型构建者能够更快地启动前沿模型、最小化训练成本并尽早产生收入。 性能:每个基准测试的最快训练时间 MLPerf Training 6.0 新增了两个 [混合专家模型](https://www.nvidia.com/en-us/glossary/mixture-of-experts/) (MoE) 预训练工作负载:DeepSeek-V3 671B 和 GPT-OSS-20B,反映了 MoE 架构日益增长的核心地位。NVIDIA 平台是唯一一个在每个基准测试中都有提交的平台,并在全部七个测试中实现了最快的训练时间。