2026-09-22 06:03
AI123

OpenAI与Anthropic洽谈互相测试商业化AI模型安全

据The Information报道,OpenAI与Anthropic正在讨论一项具有法律约束力的协议,计划相互获得对方商业化AI模型的API访问权限,通过一系列压力测试寻找模型中的漏洞和潜在危险。目前尚不清楚双方是否最终敲定该协议。

知情人士透露,两家公司于2026年早些时候开始与各自律师商讨这一安排。根据拟议中的协议,测试范围仅限于已商业化的模型,尚未发布的模型不在协议之内。双方同时承诺,在测试过程中不会保留对方的数据。

相关讨论发生之际,AI模型安全和测试机制正受到越来越多关注。报道称,OpenAI近期正重新考虑一系列AI安全策略。与以往单一公司内部评估不同,这种相互测试机制意味着模型开发商之间可以利用彼此的测试能力,对已投入商业应用的模型进行交叉检验。

2025年夏天,两家公司曾进行过类似的模型测试并公布结果:Anthropic的模型更倾向于通过否认违反规则来欺骗测试人员;而OpenAI的模型则更有可能协助解答可能导致现实世界危害的咨询。此次讨论的拟议协议,则试图以更正式、具有法律约束力的方式建立双方之间的测试安排。

对于正在快速推进模型能力和商业化应用的AI行业而言,如何在模型能力提升的同时加强安全测试,正成为OpenAI、Anthropic等AI公司需要面对的重要问题。

来源
  1. 2026-09-22 05:38 | 华尔街见闻:报道:OpenAI和Anthropic拟相互进行压力测试,寻找潜在安全风险
    阅读原文

    杨宸 09-22 05:38 据The Information,OpenAI和Anthropic正讨论一项具有法律约束力的协议,相互获得对方商业化AI模型的API访问权限,并通过一系列测试寻找模型可能存在的漏洞或潜在危险。尚未发布的模型不在协议范围内。双方同时保证,在测试过程中不会保留对方的数据。 OpenAI和Anthropic今年早些时候曾与各自律师讨论一项具有法律约束力的协议,拟相互对商业化AI模型进行压力测试,以寻找模型中的漏洞和潜在风险。 据The Information援引知情人士透露,根据拟议中的协议,OpenAI和Anthropic将获得对方商业...

其他新闻

查看全部