SheepNav
新上线2天前203 投票

OpenAI 宣称攻克数学难题,数学家为何愤怒?

OpenAI 的数学宣言与数学家的怒火

昨天,OpenAI 发布了一项关于集合论的声明:Partition Principle 不蕴含 Axiom of Choice。消息迅速在数学圈和 Hacker News 上引发热议,相关讨论获得 190 分和 285 条评论。

然而,并非所有人都为此欢呼。一位长期研究该问题的数学家公开表达了他的愤怒——甚至拒绝了此前承诺的“如果问题被解决就送 Sam Altman 一瓶威士忌”的赌约。

为什么数学家不买账?

这位数学家在博客中写道,他“并非完全反对使用 AI”,也承认 LLM 在整理信息、生成图表、校对邮件等任务上很有用。但他强调,目前数学界缺乏使用 AI 的框架:如何判断作者的贡献?是否要求公开聊天记录?审稿人和编辑是否有权查看?这些问题尚未解决。

他仔细阅读了 OpenAI 发布的预印本(未看 Lean 代码,因为代码量巨大且他不熟悉 Lean 的实际使用),结论是:“它很糟糕。”

  • 论文结构混乱、表述不清
  • 术语“有点偏”,一些定理的陈述方式非常奇怪
  • Lemma 7.4 和 Lemma 8.1 出现在这样的论文中令人意外
  • 参考文献选择不当:他关于 Bristol model 的论文被引用于对称扩张的基础介绍,但这并非他会选择的引用
  • 至少三篇未发表、未经同行评审的文献被引用

更深层的争议

这并非 OpenAI 第一次涉足数学证明。此前已有 AI 系统在数学竞赛和定理证明中取得进展,但学术界对“AI 生成的数学证明”始终存在分歧。核心矛盾在于:数学证明的价值不仅在于结论正确,更在于证明过程的可理解性、可验证性以及它对后续研究的启发。

如果一份预印本结构混乱、引用随意,即使结论正确,它是否算作“数学贡献”?如果 AI 只是生成了大量 Lean 代码,而人类无法理解其思路,这究竟是突破还是噪音?

这位数学家呼吁社区认真讨论:我们是否需要要求公开 AI 聊天日志?审稿人是否应该看到提示词?arXiv 已经引入速率限制,许多论文也开始包含 AI 使用声明。但更根本的问题——如何评判 AI 辅助数学工作的学术价值——仍然悬而未决。

OpenAI 的这次发布,或许更像一面镜子,照出了 AI 与数学界之间尚未弥合的裂痕。

延伸阅读

  1. Anthropic无法可靠控制AI智能体,切断内部评估的实时互联网访问
  2. Prime Agent 用 Rust 重写:2000 个 AI 智能体协作完成自我重写
  3. 乌克兰无人机袭击俄罗斯AI数据中心,Yandex超级计算机受损
查看原文