OpenAI宣布在普林斯顿高等研究院设立独立的数学与人工智能咨询委员会(AGMAI),并对外释放内部模型攻关纯数学前沿的惊人战果,声称已攻克纳维-斯托克斯千禧年大奖难题及百余道开放数学命题。与这份高调通报相伴的,是多位菲尔兹奖得主的联名抗议,以及一个几乎被剥夺实质约束权的象牙塔顾问团。
这绝非传统学术殿堂张开双臂拥抱机器智力,而是商业技术公司在逻辑推理高地上发起的一场声誉突围。这场合作看似给学者递上了麦克风,实则是科技公司用制度隔离带换取学术合法性,试图在传统同行评议体系反应过来之前,抢先确立科研难题的终审解释权。
虚实之间:百题突破与纳维-斯托克斯公关迷局
在商业通报中,解决纳维-斯托克斯方程存在性与光滑性这一千禧难题,被描述为内部推理模型的里程碑式胜利。但学术界的权威记录完全是另一番景象。克雷数学研究所设立的七大千禧年难题中,迄今官方唯一确认攻克的只有格里戈里·佩雷尔曼证出的庞加莱猜想。对于所谓的AI解法,克雷数学所没有任何认可记录。

官方源数据显示,AGMAI与OpenAI官方关于一百道以上的表述,本质是该委员会面向全球数学界征集、纳入考虑评估的研究题目规模与社区协作范畴,而非已经完成严格闭环推演的既定成果。这种将待评估题库偷换为已攻克战报的做法,模糊了测试题与真实科研未解题的边界。
在前沿测试中,OpenAI o3模型曾在FrontierMath专家级测试中拿下约四分之一的题目。然而,FrontierMath题目哪怕再难,也是人类学者已知答案但对模型保密的未见题;数学界百年未解的科研开放命题,不存在任何可以参考的隐藏答案,两者的认知难度存在本质断层。
无牙的护栏:被剥夺刹车权的学术安全阀
普林斯顿高等研究院建立AGMAI的初衷,表面上是设立一道伦理与学术护栏。首批9名委员会成员不拿企业报酬,可自主遴选新成员,并保留公开发表意见的权利。但合作框架里最致命的一行小字,抽干了这个机构的实质监管权:委员会无权放缓或重塑OpenAI内部的数学研发节奏。

允许公开批评却无权踩下刹车,象牙塔获得的只是一只没有机芯的听诊器。
普林斯顿高等研究院在声明中特别强调,自身在任何AI企业内部都不具备决策权,企业行为的责任完全由企业承担。这种急于厘清法律与学术责任的姿态,恰恰反映出学术共同体对商业节奏的被动防守。
在25位菲尔兹奖得主发起公开信控诉商业AI破坏优先权规则、威胁学者智力价值之际,这支9人委员会显得格外孤立。初代委员中,只有来自普林斯顿高等研究院的卡米洛·德·莱利斯签署过那封抗议信。AGMAI被赋予的实际职能,被严格圈定在挑选科研评估题目、核验推导过程是否为既有文献检索等技术辅助工作,其明确承认未经同行评议的输出不能直接视作学术结论。
- 风险.当商业机构借学术圣地设立缺乏实质否决权的咨询机构,传统同行评议机制容易在海量未经形式化验证的AI推导冲击下失去节奏掌控力。
证明的成色:形式化验证与自然语言大模型的鸿沟
纯数学之所以严苛,在于逻辑链条容不下千分之一的幻觉。当前解决前沿数学问题的AI路线,正在分化为两条截然不同的技术阵营。

一条是依托形式化语言的硬核验证。DeepMind的AlphaProof与AlphaGeometry 2在2024年国际数学奥林匹克中拿下28分达到银牌水平,依靠的是Lean交互式定理证明系统。在Lean内核的每一步机器代码审校下,推导没有逻辑跳步的藏身之处。
另一条则是依靠海量语料与强化学习驱动的自然语言大模型。大模型在语言表达上极具欺骗性,推导文本看起来条理清晰、术语考究,却经常在极深层的拓扑变换或连续性延拓中出现隐蔽断裂,甚至把数值上的逼近误判为数学上的完备解。
这正是让一线数学家感到紧迫的根源。如果科技巨头凭借模型生成的海量自然语言推导绕过预印本和专业期刊,直接面向公众单方面宣布解决世纪难题,学术界不仅要耗费巨大的智力成本去勘误,更面临优先权体系被工业级噪声淹没的困局。
- 建议.评价AI在基础科学中的突破,应盯紧其是否通过Lean等形式化内核的无人工干预检查,而非听信商业发布会上的命题宣称。
