人工智能巨头OpenAI批量发布AI数学成果的行为,引发数学界激烈抵制。

近日 ,菲尔兹奖得主陶哲轩在个人博客转发了人类数学协会(AHM)发布的联合声明,对OpenAI发起抵制,呼吁全球数学家停止与OpenAI的合作 ,重回以人类理解为核心的科学愿景。
本次学界抵制的导火索是OpenAI此前公开的大规模AI数学手稿成果及后续迭代操作 。
722篇AI数学手稿,一天之内撤回三篇
10月6日,OpenAI在代码托管平台GitHub上公开了722篇由一个尚未对外发布的“内部前沿模型”生成的数学研究手稿 ,按372个“成果家族 ”归类,涵盖数论、代数几何 、微分方程、理论计算机科学、数学物理等多个前沿方向。这些手稿处于不同的核验阶段。部分成果附有Lean形式化证明,可由计算机逐步检查逻辑推导的有效性;另一些则仅依赖非形式化论证 。
手稿中最引人注目的 ,是编号003的“准黎曼猜想”相关结果。黎曼猜想是数学界悬置百年的终极难题之一。罗格斯大学数学教授Alex Kontorovich在社交媒体上评论称:“如果这是人类做出来的,立刻就是一枚菲尔兹奖,毫无疑问 。”
手稿的发布一度引发科技圈对“AI颠覆基础数学 ”的热议。但公开后不久 ,这批被冠以“突破性成果”的手稿便暴露诸多问题,迫使OpenAI紧急纠错。
10月8日,OpenAI在官方math仓库发布首个成果更新日志,承认首批手稿存在瑕疵并完成大规模修订调整 。日志显示 ,OpenAI撤回3篇手稿,修订14篇,另有13篇更新了引用。仓库里的手稿总数从722篇降为719篇。其中 ,3篇撤稿的原因是一处“符号错误” 。这一错误使一篇论文中的论证失效,并连带影响到两篇依赖其构造的论文。被撤回的三篇论文均与代数几何领域的霍奇猜想相关工作有关。
数学界多次发声
这场冲突是近两个月学界争议激化的结果,此前数学界已多次集体发声预警。
9月8日 ,OpenAI宣称,其一款未对外公开的前沿大模型,仅耗时88小时 ,便解决了“千禧年大奖难题 ”之一的纳维-斯托克斯方程存在性与光滑性问题 。AI仅用数十小时便挑战百年数学难题的消息,迅速引爆全球科技界,但也引发数学界的强烈质疑。
9月11日 ,陶哲轩 、邓煜等25位全球顶尖菲尔兹奖得主便联合署名发布宣言《人工智能在数学中的严重错位》,发出“AI正在摧毁数学根基”的呼吁,提前预警AI介入基础数学研究的巨大风险。
此后几日,数学与人工智能询问 组(AGMAI)也发布建议 ,明确反对前沿AI实验室使用外界无法访问的内部模型测试高难度数学问题 。
早在2026年6月,16位知名数学家联合发布《人工智能与数学莱顿宣言》,宣言没有要求禁止 AI ,而是呼吁数学界建立清晰规范。宣言中明确了多项数学家的学术共识:证明是数学的基石,理解与表述的清晰性至关重要;研究者应透明披露工具的使用,保持结论正确性和引用完整性 ,且责任归属人类;结论应当能够独立复现验证等。
数学家为何抵制?
“发布超过700个数学文件不是展示学术,而是展示权力 。”陶哲轩转发的AHM声明中写道。
OpenAI将数学界视为展示算力的舞台,而非合作对象。数学家们抵制的原因不只是“AI解了数学题 ”这件事本身 。
陶哲轩将传统数学研究称为“数学1.0” ,他认为,在数学1.0中,针对一个长期悬而未决猜想的突破性证明 ,会在该领域催生大量后续研究,掀起学术热潮。
证明的提出者会受邀开展多场学术报告,与领域内其他专家交流;学界会举办专题研讨会,专门讨论这份证明以及该方向的最新进展。由此 ,新的学术关联与合作关系逐步建立,衍生问题被提出,新老数学家都被吸引进入这一研究领域 。
经过这一系列学术活动 ,这份证明会被学界充分理解、简化优化,与领域内其他研究成果建立关联,最终编入教材与讲义 ,传承给下一代数学研究者。
而对于类似OpenAI的做法,陶哲轩将其称为“证明消化不良”。AI能高速生成命题和证明,但人类来不及验证、理解 、写作、教学和吸收 ,结果出现大量“无人能消化的证明 ”。
学界认为,基础数学研究不在于快速得出一个标准答案,而在于人类在推演、论证 、思考过程中诞生的全新数学思想、概念体系与研究方法 ,这是人类思维的沉淀与传承 。在AI的介入下,可能会打乱学科研究节奏,甚至引发署名混乱、引用失当 、隐性抄袭等一系列学术伦理问题。
截至近来 ,OpenAI仍未对外公开生成数学成果的核心模型 ,仅通过仓库持续迭代修订手稿内容。

(文章来源:21世纪经济报道)