社区讨论 · 赛道

AI宣布数学突破,谁来替它背锅

龙记龙记9月12日2026/09/12 63 浏览

如果一家AI公司说它推翻了一个数学猜想,你该鼓掌,还是该把证明拿回去一页一页看?我这边先给结论,这条新闻值得关注,但我站数学家那边,重点在验证。OpenAI退出加州理工数学黑客松赞助,把AI做数学的信用问题摆到台面上,谁宣布突破,谁验证突破,谁为错误兜底。

过去一周,数学界和AI公司的紧张关系爆发。新晋菲尔兹奖得主Jacob Tsimerman在国际数学家大会上宣布转向AI安全研究并加入OpenAI,另一边有25位菲尔兹奖得主联名表达不满。再往前,公开报道说今年5月OpenAI用数论方法处理埃尔德什单位距离猜想。这类消息听起来很炸,流程比结果更容易引发争议。数学家抱怨的点很具体,AI公司把“突破”讲成发布会,数学界却要免费复算、修补、背锅。

我实际体验了一下。最近我用ChatGPT和DeepSeek-V4-Flash跑过几道组合和数论小验证,也拿Cursor写了个简单枚举脚本,在Terminal里核对输出。说实话,AI给思路挺快,尤其适合把一个大问题拆成先找小例子、再猜模式、最后写脚本排除这种路径。它不怕脏活,能把几种思路同时铺开,问题也明显,它太会装懂,语言干净,结论坚决,可一旦关键定义、边界条件或证明链条错了一点,后面看着都像对的。

这也是我这几天在Hacker News上刷到相关讨论时最强烈的感觉。很多人反对的是把“模型输出”当成“数学成果”。数学这行有个老规矩,同行验证说了算。一个猜想被推翻,至少要有可检查的论证、可复现的推理、可被不同背景的人挑战。AI的问题也在这里,它可以生成证明,但生成证明和证明正确是两回事。公司可以发博客,社区却不能只靠博客。

所以我看这次OpenAI退出赞助,更像是止损。加州理工新老学者联名抵制,黑客松又是年轻学生接触AI数学的前沿场景,继续挂名会把“赞助”变成“背书”。OpenAI如果真想被数学界接受,退出一个活动没用,关键是把验证权交出来。模型输出不能停在“我证明了”,最好能给出可拆解的假设、可运行的脚本、可被人类逐条检查的中间步骤。透明能降火,麻烦也真实存在,发布会没那么漂亮。

这件事也连着整个AI应用的老毛病。很多AI产品把“结果”卖得太早,把“代价”藏得太深。写代码、做搜索、做数学,都会碰到同一个问题。模型给你一段代码,能跑不代表安全;AI搜索给你一段摘要,通顺不代表准确;大模型给你一段证明,术语整齐不代表逻辑闭合。以前我们说AI是助手,现在有些公司把它包装成裁判,这就容易出事。

我的判断是,看情况。现阶段把AI当数学探索工具,我推荐;把它当成果发布器,不推荐;把它当数学权威,更是别碰。对普通读者来说,看到“AI推翻猜想”这类新闻,先别急着转发。去找原始材料,看有没有人复现,看社区是不是在拆细节,看公司有没有承认不确定性。对做AI数学产品的人来说,行动建议也很简单,别只秀结论,把可验证性做进流程。能给出可运行代码就给出代码,能列出假设就列出假设,能标注置信度低就标注置信度低。

数学界这次愤怒,有保守的成分,也在提醒所有AI公司,突破要经过验证才能变成信用,快也要经过同行检查才算数。OpenAI接下来要做的,是把验证权交出来,让模型输出能被人逐条检查。

1 条回复

?
Ctrl + Enter 快速回复
论文看不完

我试了下让模型推公式,它特自信地瞎编,这要是没人工复核,锅肯定得背稳了。