MLCommons 发布 MLPerf Inference v6.1 推理基准测试套件。AMD 以 512 个 Instinct MI355X GPU 参赛,在 DeepSeek R1 测试中离线成绩 2,901,950 tokens/s,服务器成绩 2,405,310 tokens/s,创下 AMD 最大规模提交记录。英伟达提交 GB300 和 GB200 的 288 GPU 配置,其 Vera Rubin VR200 首次进入该基准测试。
北京时间9月1日晚,MLCommons发布MLPerf Storage v3.0基准测试结果,新增KVCache推理缓存专项测试。焱融科技全闪AI存储F9000X在3D U-Net训练、Checkpoint 70B断点续训等场景多项性能位居全球第一,实现三年三连冠。