OpenAI数学家对谈:大模型如何重塑数学研究新范式
9月9日,OpenAI全职数学家Mark Sellke与Mehtaab Sawhney接受a16z基础架构合伙人Lisha Li的采访,围绕AI数学研究新范式展开对话。两人曾共同师从数学家赵宇飞,于2025年夏天在看到模型推理能力飞跃后加入OpenAI,直接参与了近期多项数学突破的研发与选题。
采访中,两位数学家指出,AI在数学证明中具备独特优势:它能“死磕到底”,将抽象思路在技术细节上扎实做通;同时不受“思维污染”干扰,不会像人类那样因失败路径而陷入思维定势,并能并行开启全新的推理会话。他们观察到,AI给出的证明往往简洁优雅,例如用15页纯正典雅的经典数学工具驳倒近半个世纪未决的群论猜想,而人类反而常写出200页的冗长证明。
关于学术品味,两位研究员认为,能通过更具远见的战略判断更快解决问题,就是学术品味最硬核的度量。大模型不仅有极佳的解题直觉,在人类追问“能否推向极致”时,还能自发挖掘出深层的数学联系。他们预测,未来人机分工将发生转变:当硬核推导被AI接管,人类的核心价值转向搭建宏大框架、联通跨学科知识,以及把深奥结论解释清楚,群体的认知整合将成为核心舞台。
此次对谈的背景是OpenAI近期在FrontierMath基准和Navier-Stokes方程等数学难题上取得系列突破。此前,OpenAI发布的GPT-6 Astra模型在FrontierMath Tier 4上取得98%的正确率,并通过一万个AI智能体协同推演,给出了Navier-Stokes方程奇异性的机器验证证明。这些成果引发了学界对算力伦理和学术交流传统的讨论。
- 2026-09-09 01:39 | 36氪:GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率阅读原文
这两周数学界很不平静。围绕着 OpenAI 最新发布的 GPT-6 Astra,学术圈掀起了一场前所未有的风暴:模型先是在专家级数学基准 FrontierMath Tier 4 上跑出了 98% 的通关级分数;紧接着,OpenAI 又放出一篇长达 165 页的技术报告,宣布利用内部系统调度 10,000 个 AI Agent 协同推演 88 小时,给出了千禧年七大数学难题之一——纳维-斯托克斯(Navier-Stokes)方程光滑驱动下奇异性爆破的机器验证证明。 这一爆炸性成果随即引爆了学术伦理争议,纽约大学教授 Tristan Buckmaster 与 Anthropic 数学家公开质疑...