2026-09-28 12:00
AI123

阿里AI安全大模型登顶CyberGym榜单 系首个中国冠军模型

9月28日,阿里巴巴伏渊息壤大模型(XekRung-27B)以88.9%的成功率登上CyberGym模型榜单榜首,成为该国际权威AI安全能力榜单历史上第一个来自中国的冠军模型。

伏渊息壤基于阿里自研Qwen3.8-27B多模态大模型,经过安全领域训练与极致智能压缩,27B参数量仅为同类模型的1/27~1/370。在取得最高成功率的同时,该模型显著降低了智能排查安全漏洞的算力成本。

CyberGym由美国加州大学伯克利分校研究团队运营,是一套AI安全能力基准测试框架,涵盖188个软件项目的1507个真实安全漏洞。榜单分为模型榜单和智能体榜单,本次登顶的是只使用通用Harness、不挂外部工具与知识库的模型榜单,更能纯粹反映安全智能水平。

在最新榜单中,排名第二至第五的模型分别来自谷歌、OpenAI、智谱和DeepSeek,成功率分别为86.3%、85.6%、84.5%和83.3%。阿里巴巴集团安全AGI实验室负责人黄龙涛表示,AI已大幅提升系统安全检测率,伏渊息壤未来将在对抗智能、自进化、Agentic等方向迭代升级,并将通过多种方式向社会开放安全能力。

来源
  1. 2026-09-28 11:10 | 新浪:中国模型首登CyberGym榜首!阿里自研AI安全模型实现“小强”突破
    阅读原文

    (来源:快科技)  快科技9月28日消息,日前,阿里巴巴伏渊息壤大模型(XekRung-27B)以88.9%的成功率登上CyberGym榜首,成为该国际权威AI安全能力榜单历史上第一个来自中国的冠军模型。  伏渊息壤在获得最高成功率的同时,还实现了"既小又强"的突破,27B的参数量仅为其他上榜模型的1/27~1/370,这意味着该"小强模型"极大降低了智能排查安全漏洞的算力成本。  据悉,CyberGym是目前国际上最权威的AI安全能力榜单之一,由美国加州大学伯克利分校专业研究团队运营,其背后是一套AI安全能力基准测试框架,涵盖188个软件项目的1507个真实安全漏洞。  Cybergym榜单...

其他新闻

查看全部