Anthropic 未发布模型在数学难题上取得重大进展
摘要: 超过 150 年来,黎曼猜想一直是数学领域最著名的未解难题之一,它关乎素数分布的规律,至今悬而未决,悬赏 100 万美元。尽管当代 AI 模型尚未能完全证明该猜想,但 Anthropic 公司近日宣布,其一个未发布的模型在黎曼猜想上取得了显著进展,大幅提高了猜想成立的下界。更令人惊讶的是,这一进展是由一位没有深厚数学背景的 Anthropic 员工,通过提示模型自主尝试证明猜想而实现的。
模型自主探索,多智能体协作
这项突破并非来自人类数学家的精心指导,而是模型自主规划与执行的结果。Anthropic 的一名员工,本身未受过专门的数学训练,仅向模型下达了尝试证明黎曼猜想的指令,随后模型在一天半的时间内自主协调任务,共测试了 650 个不同的解题思路,动用了 60 个子智能体,消耗了 3100 万输出 token。其中,两个子智能体贡献了关键的数学思想,13 个提供了辅助思路,30 个尝试但未能提出新想法,13 个负责验证论证的正确性,最后两个帮助撰写了初步论文。这一成果已由 Anthropic 内部的两名数学家确认,并使用开源证明助手 Lean 进行了形式化验证。
AI 数学突破的浪潮
这一成果并非孤例。近年来,大型语言模型(LLM)在数学领域屡有建树。今年,AI 模型已解决了多个 Erdős 问题,而随着模型能力的增强,成果也愈发显著。OpenAI 近期发布了其内部 Astra 模型证明的 10 项重大结果,Anthropic 的另一个项目则推翻了一直以来的 Jacobian 猜想。这些成果在数学界引发了兴奋与担忧并存的情绪。今年 6 月,一批知名数学家签署公开声明,担心 AI 可能削弱该领域的核心价值——特别是数学证明应归功于具体作者,并由其承担责任的标准。
意义与展望
Anthropic 的这项进展再次证明,AI 在科学发现方面具有巨大潜力,但其方式与人类数学家截然不同。它能够以超乎寻常的广度探索解题路径,却也可能引发关于学术诚信和责任归属的讨论。未来,AI 与数学家如何协作,将是值得关注的话题。
