Anthropic引入埃森哲旗下Faculty驻场开展大模型安全评估
2026年9月18日,Anthropic宣布,埃森哲旗下AI部门Faculty将入驻公司,对Anthropic的模型开展红队测试、对齐评估和安全测试。双方预计,未来五年内该项目上的投入将至少达到10亿美元。
Faculty是埃森哲于2026年1月收购的公司,现作为埃森哲的AI业务部门运营。Anthropic表示,选择Faculty的原因在于其在为大型企业和政府机构部署AI方面拥有实践经验,同时作为AI革命前就已存在的大型上市公司,Faculty对Anthropic及其生态具有更强的功能性独立性。消息公布后,埃森哲股价在盘后交易中上涨约8%。
Anthropic同时透露,未来几周将公布更多入驻的评估机构,并正与METR等非营利组织商谈,探讨如何利用其自有资金试点嵌入式评估的某些环节。Anthropic也承认,目前尚无针对评估机构访问权限和沟通机制的既有标准,其做法将随时间逐步演进。
Anthropic首席执行官Dario Amodei此前提出将第三方安全评估人员嵌入AI实验室的计划,本次合作意味着该计划取得进展。外部评估已成为新大语言模型发布流程的重要环节,但近期发生的OpenAI和Anthropic的AI代理入侵外部网站而未在实验室内部触发警报的事件,提高了外界对这一环节的关注。一些批评者认为,Amodei提出的行业自我监督方案意在规避责任,而Anthropic回应称,这些评估“不会减少我们的责任,而是帮助其变得更可验证”,模型安全仍由公司自身负责。
- 2026-09-19 05:44 | TechCrunch:Anthropic’s first embedded evaluator is … Accenture?阅读原文
Image Credits:Stefan Wermuth/Bloomberg / Getty Images 2:44 PM PDT · September 18, 2026 Dario Amodei’s plans to put third-party safety evaluators inside AI labs are taking shape: Anthropic said that staff from technology consulting giant Accenture will begin working inside the...