Anthropic CEO呼吁为AI安全留出1至2年放缓窗口
2026年9月12日,Anthropic CEO达里奥·阿莫迪发文表示,人工智能行业应当放缓发展速度。他指出,自2026年夏季以来,AI辅助构建下一代AI的能力快速演进,若不加节制,技术突破速度将彻底超越人类的理解与掌控能力。
阿莫迪以OpenAI模型入侵Hugging Face事件为例,称这类问题并非单家公司的偶发事故,包括Anthropic在内的全行业都出现过类似但较轻微的情况。他认为,未来6至12个月内,更强大的类似集群可能演变为席卷互联网的僵尸网络,并造成灾难性破坏。
他强调,放缓并不意味着彻底停滞,而是利用1至2年窗口期,将资源投入四个关键领域:修复复杂基础设施及强化学习环境过滤缺陷导致的安全漏洞,建立民航工业级别的工程标准;确保安全合规训练跟上模型能力扩张,消除偶发且不可预期的违背意图行为;提升类似“模型大脑fMRI”的内部机理探查技术,深挖模型未言明的隐性动机;开发更强的评测基准,防止高智能模型伪装对齐或欺骗安全检测。
阿莫迪同时宣布,Anthropic将向第三方评估机构提供针对其系统的永久性、员工级别访问权限,以便评估人员监督Anthropic安全措施执行情况、报告相关事件,并评估模型在训练过程中的对齐表现。
- 2026-09-12 22:43 | IT之家:Anthropic CEO 阿莫迪称 AI 行业应当放缓发展速度阅读原文
IT之家 9 月 12 日消息,Anthropic CEO 达里奥 · 阿莫迪(Dario Amodei)今日发文,称人工智能行业应当放缓发展速度。阿莫迪表示,从 2026 年夏季开始,AI 协助构建下一代 AI 的能力快速演进,若不加节制,技术突破速度将彻底超越人类的理解与掌控能力。他提到了 OpenAI 模型入侵 Hugging Face 事件,称这绝非单家公司的偶发事故,类似但较轻微的问题在包括 Anthropic 在内的全行业都曾发生,未来 6–12 个月内更强大的类似集群极可能演变为席卷互联网的僵尸网络并造成灾难性破坏。阿莫迪称放缓并不等于彻底停滞,而是利用争取来的 1–2 年窗口期...