开源项目

MLPerf Training v6.0新增DeepSeek V3与GPT-OSS 20B训练基准

MLCommons Releases MLPerf Training v6.0 Results

模型评测模型架构AI 基础设施MoE模型部署基准与评测资源

概述

MLPerf Training v6.0新增两项MoE训练基准:DeepSeek V3覆盖671B总参数的大规模预训练工作负载,GPT-OSS 20B提供较小规模、可在单个8卡节点上评估的训练入口。基准测量完整模型、软件和硬件配置的训练表现,并要求达到规定的模型质量。 官方本轮总体结果来自24家提交机构、95种系统;这些是整个基准套件的参与范围,不代表每个机构都提交了两项MoE测试。GPT-OSS基准从随机权重起步,采用代表性的端到端训练片段,不能理解为完整复现原模型预训练。公告同时说明提交中存在不同FP4训练实现,应按对应质量门槛与工作负载比较。