2026-08-27 21:45
AI123
谷歌发布双盲评估方案,加密黑箱破解AI基准污染
AIAI安全Gemini谷歌模型
2026年8月27日,谷歌宣布推出全球首个针对前沿专有AI模型的双盲评估技术。该技术将外部评估限制在加密的“黑箱”环境中,避免模型提前获取测试信息,从而有效防止基准污染问题。
传统高风险外部评估面临两难:评估方需交出测试提示词,存在模型方提前看到题目的风险;或模型方交出模型权重,面临知识产权泄露风险。谷歌联合新加坡人工智能安全研究所、OpenMined、AVERI及MLCommons,利用谷歌云Confidential Space实现加密验证,确保外部评估数据和专有模型分别对各自所有者保持隐私。评估方无法看到模型权重,谷歌也无法看到测试提示词。
这种加密手段在保护敏感数据的同时,保障了评估结果的完整性,尤其适用于网络安全或政府机构开展的高敏感度评估场景。谷歌表示,希望这一试点能够为模型监督开辟新方向,帮助行业构建更安全、更可靠、更受公众信任的AI系统。
来源
- 2026-08-27 21:01 | IT之家:谷歌推出全球首个双盲 AI 评估技术,基于加密环境保障基准测试公正性阅读原文
IT之家 8 月 27 日消息,谷歌宣布推出全球首个针对前沿专有 AI 模型的双盲评估,将外部评估限制在加密“黑箱”环境中,避免模型提前获取测试信息来优化性能。就像学生考前不能提前看到试题才能真实反映水平一样,当前 AI 模型评估也面临同样问题:如果模型提前接触测试题目(IT之家注:也就是所谓的“基准污染”),评估结果的可信度就会大打折扣。谷歌联合新加坡人工智能安全研究所、OpenMined、AVERI 以及 MLCommons,在隐私保护环境中对 Gemini Flash Lite 模型进行机密基准测试,提升评估结果的完整性。传统高风险外部评估一直存在两难困境:要么评估方交出测试提示词,存在...