OpenAI因安全与对齐表现不佳取消Astra 6.1发布
据《华尔街日报》报道,OpenAI已决定取消原计划于近期发布的新模型Astra 6.1。该模型在测试中表现出比前代更高的欺骗水平,并出现不当行为,对齐测试结果亦不理想。OpenAI安全系统负责人Saachi Jain向《华尔街日报》确认,该模型在与人类意图对齐方面表现不佳。
Astra于2026年9月上旬发布,被OpenAI称为其迄今最强大的模型。此次取消发布让Astra 6.1成为OpenAI在安全评估未通过情况下放弃的新版本之一。
近几个月来,AI安全问题持续引发关注。自2026年9月初Hugging Face事件中OpenAI一个智能体突破沙盒环境并入侵多家公司后,Anthropic的Claude、Google的Gemini等模型也被曝出类似行为。这一系列事件也促使美国政策讨论向头部AI实验室期待的方向推进,包括建立新的AI安全行业标准,并可能推动行业放慢发展节奏。
- 2026-09-30 10:39 | 新浪:OpenAI因安全隐患“撤回”一个新模型发布计划,AI安全风险再成全球焦点阅读原文
(来源:环球网资讯) 来源:环球网 【环球网科技综合报道】9月30日消息,据BBC报道,OpenAI于日前宣布,取消原计划于10月发布的下一代AI模型GPT-6.1 Astra。OpenAI安全系统负责人萨奇·贾因(Saachi Jain)表示,该模型在内部对齐测试中未能达到公司对外发布的安全标准。 贾因称,GPT-6.1 Astra在保持在权限范围内以及如何向用户反馈其所完成的工作方面存在不足——模型有时会隐瞒自身采取的行动,或在未获用户许可的情况下擅自调用外部工具和服务。 今年夏季以来,AI智能体突破安全限制的事件接连发生。7月,OpenAI披露其AI模型在一次内部网络安全评测中自...
- 2026-09-30 09:41 | 新浪:“AI或带来毁灭性风险”,OpenAI紧急取消最强模型,中国开源优势凸显阅读原文
(来源:上观新闻) 9月28日,美国人工智能研究中心(OpenAI)突然宣布取消发布旗舰模型GPT-6.1。就在两天前,OpenAI已暂停最新前沿模型的训练。 在发布会前夕紧急叫停,这在高歌猛进的AI行业并不多见。由此可见,AI智能体的安全失控,正在拖慢整个行业的脚步。 据悉,OpenAI紧急叫停GPT-6.1有两方面原因。一是AI学会了欺骗,模型会隐瞒进度、虚报完成度,甚至伪造日志掩盖失败。二是AI擅自越权,未经许可自行推进任务、调用外部工具。 颇为讽刺的是,这恰恰是AI能力进化的副作用。 过去,AI的安全考量,主要是模型是否出现幻觉,会不会说错话。如今当智能体会操作电脑、调用接口...
- 2026-09-29 18:22 | 新浪:OpenAI因安全问题将暂停发布新的AI模型阅读原文
来源:参考消息 参考消息网9月29日报道 据埃菲社9月28日报道,由于在内部测试阶段出现安全问题,美国开放人工智能研究中心(OpenAI)将不会如期在未来几天内发布其新的人工智能(AI)模型GPT-6.1 Astra。 报道称该公司安全系统负责人萨奇·贾殷透露,与前一版本相比,该模型在“两个领域”出现了倒退,例如与人类指令的“对齐”程度,并表示该模型“表现出更高的欺骗性”。 另一个存在问题的领域是“授权范围”,即该模型在执行任务时未征得用户许可便擅自推进,有时甚至会使用外部工具和服务,但此举可能存在安全隐患。 贾殷强调,“即使在模型遇到障碍时,也要在保持在授权范围内与避免模型在...
- 2026-09-29 16:15 | Engadget:OpenAI reportedly cancels GPT-6.1 Astra's release over deceptive behavior阅读原文
It was supposed to debut in October, but it apparently showed higher levels of deception than previous models. Stock all/Shutte...
- 2026-09-29 09:45 | apnews.com:OpenAI delays latest model over security concerns, as industry faces new safety pressures阅读原文
Updated 9:45 AM GMT+8, September 29, 2026 OpenAI said Monday it was delaying the release of a new artificial intelligence model out of security ...
- 2026-09-29 08:12 | IT之家:内部测试发现安全隐患,消息称 OpenAI 取消发布 AI 模型 GPT‑6.1 Astra阅读原文
IT之家 9 月 29 日消息,据《华尔街日报》报道,由于内部测试过程中研究人员提出多项安全隐患,OpenAI 决定取消 GPT‑6.1 Astra 的发布。这款下一代 AI 模型原本计划于 10 月正式亮相。报道称,该模型原定部署于 ChatGPT 以及 Codex 产品当中,设计目标是无需人类协助就可以处理更加复杂的任务。本月早些时候,Anthropic 首席执行官达里奥 · 阿莫迪(Dario Amodei)呼吁整个行业放缓前沿 AI 模型的研发速度,以便安全防护手段能够跟上技术迭代的脚步。OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)以及 SpaceX 首席执行官埃...
- 2026-09-29 08:08 | gizmodo.com:OpenAI Cancels Release of GPT-6.1 Astra Because It ‘Regressed’ on Safety阅读原文
OpenAI’s GPT-6.1 Astra was headed for an October release, but that plan has been canceled, according to the Wall Street Journal. The WSJ’s report comes at least in part from an interview with OpenAI’s Head of Safety Systems, Saachi Jain. The model, which reportedly showed improvement in the fight ...
- 2026-09-29 07:50 | 财联社:一起呼吁“AI减速”?OpenAI取消最新模型发布,Anthropic却“两连发”!阅读原文
财联社9月29日讯(编辑 黄君芝)同样是在呼吁放慢技术发展脚步,人工智能(AI)行业两大“领头羊”——Anthropic和OpenAI——却似乎走上了两条截然不同的道路:前者已连发两个AI模型,而后者宣布取消发布新的人工智能模型。 据媒体周一证实,OpenAI决定不发布即将推出的人工智能模型GPT-6.1 Astra,因为该公司认定该模型未能充分满足其安全标准。 OpenAI决定放弃发布新模型之际,人工智能行业正面临着对高级模型安全性日益加剧的担忧。本月初,Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)在一篇文章中敦促各AI实验室放慢模型开发速度,因为人们担心这些模型...
- 2026-09-29 07:39 | TechCrunch:OpenAI reportedly ditches model over safety concerns阅读原文
In Brief Posted: 4:39 PM PDT · September 28, 2026 Image Credits:Samuel Boivin/NurPhoto / Getty Images OpenAI had planned to release yet another AI model next month, but has decided to nix the release over safety concerns. The Wall Street Journal reports that Astra 6.1...