物界前沿 · 资讯情报卡(TechCrunch · 2026/10/9)
OpenAI数学证明发布被指未达学界标准
核心事实
- OpenAI本周发布数百个数学难题解答,并称已咨询数学家顾问组。
- 顾问组AGMAI九月底发布指南,要求停止在专有模型上测试高级数学问题。
- OpenAI的719份证明中仅10份公开了模型思维链。
- 剑桥和国王学院论文发现OpenAI的纳维-斯托克斯解存在自然语言与Lean代码不一致。
- AGMAI建议OpenAI资助人类数学家以促进理解,但OpenAI未回应置评请求。
关键数据
719份发布证明总数
10份公开思维链的证明数
42%未形式化的证明比例
9人AGMAI成员数
物界观察
OpenAI的数学证明发布暴露了AI自主解题与人类理解之间的鸿沟。顾问组要求停止专有模型测试,但OpenAI未遵守,且仅少数证明公开思维链。这提醒行业:AI生成的数学结果需经同行评审,否则可能误导后续研究。
物界前沿