返回新闻列表
2026-08-31 06:50
AI123

陶哲轩ICM 2026演讲:AI证明的“语义忠实度”亟待重视

2026年国际数学家大会(ICM 2026)上,菲尔兹奖得主、加州大学洛杉矶分校数学教授陶哲轩发表题为“AI时代的数学”的公众演讲,警告AI大规模介入数学证明正引发信任危机。

陶哲轩在演讲中引用了2026年7月OpenAI推理模型攻破一道80年悬而未决的几何猜想、但24小时内被数学家识破的案例。他指出,AI生成的证明中每一步推理在形式上均符合数学规则,却整体绕开了原命题的核心,暴露出“形式正确但语义不忠实”的根本缺陷。他认为,这一现象构成了一条完整链条:模型自主完成推理、社区短期集体误判、人工最终识破,其风险比单纯证错更值得警惕。

陶哲轩强调,当前AI评测体系高度依赖“输出格式合规度”,但缺少对“语义忠实度”的检验。他呼吁数学界乃至更广泛的AI应用领域重视这一指标——输出内容是否真正回答了原问题,而非仅仅生成格式漂亮却跑题的文本。他表示,此类风险同样存在于代码生成、法律文书、研究报告等场景中。

此外,陶哲轩提醒,AI生成的数学论文往往过于“光滑”,缺乏人类作者在推导过程中留下的难点标注与思考痕迹,可能使读者产生“读完了”而非“读懂了”的错觉,长期或将削弱下一代数学家的理解能力。他建议数学界建立新的评价体系,在检查证明形式正确性的同时验证语义忠实度,并鼓励研究者保留证明中的“认知痕迹”。

来源
  1. 2026-08-31 06:32 | 新浪:陶哲轩预警数学危机:AI证明“每句话都对但全错”,100年后数学的信任崩塌?
    阅读原文

    菲尔兹奖得主、加州大学洛杉矶分校数学教授陶哲轩近日在多个公开场合发出警告:随着AI大规模介入数学证明,数学界正在经历一场“100年后前所未有的信任危机”。2026年7月,OpenAI宣称其推理模型攻破了一道80年悬而未决的几何猜想,但24小时内就被数学家识破——AI证明的每一句话形式上都正确,却整个绕开了原命题的核心。这一事件恰好印证了陶哲轩数月前的预言:“LLM推理≠数学证明”。[1]  陶哲轩指出,当前AI评测体系高度依赖“输出格式合规度”,但缺少“语义忠实度”指标。这意味着,不仅数学领域,代码生成、法律文书、研究报告都可能存在同样风险——AI不是替你思考,而是替你说漂亮的话。[1]  一...

其他新闻

查看全部