AI基准MLPerf 6.1发布:AMD 512颗MI355X刷新纪录,英伟达Vera Rubin首秀
9月16日,MLCommons发布MLPerf Inference v6.1推理基准测试套件,AMD、英伟达等厂商同步提交了最新测试结果。该基准测试用于衡量不同硬件在AI推理任务中的吞吐量和延迟表现,最新版本重点考察AI推理吞吐、扩展效率及不同GPU配置下的表现。
AMD以512个Instinct MI355X GPU参与了DeepSeek R1测试,离线成绩为2,901,950 tokens/s,服务器成绩为2,405,310 tokens/s。AMD称,这是其迄今为止规模最大的MLPerf提交,并创下新的记录。英伟达方面提交了GB300和GB200的288 GPU配置,其中GB300离线成绩为2,705,130 tokens/s,服务器成绩为2,028,030 tokens/s。
此外,英伟达的Vera Rubin VR200首次进入MLPerf推理基准测试,共有36 GPU和72 GPU两种配置。在相同72 GPU配置下,Vera Rubin(VR200)比GB300快95%,而36 GPU配置版本比72 GPU的GB200配置更快。由于各厂商提交的GPU配置存在差异,以上数据仅供参考。
- 2026-09-17 14:31 | IT之家:AI 推理 MLPerf 6.1 发布:AMD 以 512 个 MI355X 刷新纪录、英伟达 Vera Rubin 首次现身阅读原文
感谢IT之家网友 华南吴彦祖 的线索投递! IT之家 9 月 17 日消息,科技媒体 Wccftech 昨日(9 月 16 日)发布博文,报道称在 MLPerf Inference v6.1 发布后,AMD、NVIDIA 等厂商同步提交结果。IT之家注:MLPerf Inference 是由 MLCommons 维护的推理基准测试套件,用于衡量不同硬件在 AI 推理任务中的吞吐和延迟表现。最新 6.1 版重点集中在 AI 推理吞吐、扩展效率和不同 GPU 配置下的表现。AMD 称以 575 万个 token / 秒的速度在 512 个 GPU 规模下创造了新的 MLPe...