|用户侧智慧能源管理领航者 - AIoT驱动数字能源升级
Anthropic没能证明黎曼猜想,但60个子智能体破了科研纪录
- 分类:新闻动态
- 发布时间:2026-08-11 19:07:45
- 访问量:1
Anthropic没能证明黎曼猜想,但60个子智能体破了科研纪录
- 分类:新闻动态
- 发布时间:2026-08-11 19:07:45
- 访问量:1
来源:第一财经
2026.08.11

本文字数:1332,阅读时长大约2分钟
作者 |第一财经吕倩
当地时间8月10日,Anthropic披露,其未公开的研究版Claude模型在尝试解答数学界顶尖悬赏难题“黎曼猜想”时虽未直接通关,却借助多Agent自治协作,改进了黎曼ζ函数满足黎曼假设的零点比例这一长期存在的下界。
黎曼ζ函数的“非平凡零点”与素数分布密切相关。黎曼猜想认为所有零点都在一条特定的临界线上。但由于无法证明,数学家转而尝试确定一个保底比例,即可以严格证明至少有多少比例的零点一定位于该临界线上。这个被严格证实的比例数值被称为该比例的下界。此前人类数学家耗费数十年将其推进至41.6%,而此次Claude将其一举提升到了67.2%。
据披露,整个试验仅起始于Anthropic员工Jarred Sumner在晨跑时突发奇想,给Claude下了个任务:尝试证明黎曼猜想。黎曼猜想提出167年了,克雷数学研究所为它悬赏100万美元,至今无人能解。
Claude果然也没成功,但过程中,模型搭建起约60个子智能体,在Claude Code里跑了一天半,执行2400条Shell命令,写了数百个Python脚本。最终真正想出关键思路的只有两个Agent,整场消耗了3100万输出token(词元),将已知位于临界线上的黎曼ζ函数零点比例下界推到了67.2%。
Anthropic内部数学家验证了论文,Claude生成Lean形式化证明。但官方也强调:不指望这套方法最终能证明黎曼猜想。

Claude的发现并非孤例。5月,OpenAI内分享了对Erdős单位距离猜想的AI生成的反证,菲尔兹奖得主Timothy Gowers评价是“AI自主产生的最具趣味性的数学成果”。8月,OpenAI宣布推出面向学术研究人员的ChatGPT计划,为10万名科学家和数学家免费提供最出色的ChatGPT模型,同步披露OpenAI在高维几何、编码理论、算术电路复杂性、群论、算子代数等领域的研究成果。
上述成果串联起来指向同一个信号:AI4S(AI for Science,人工智能驱动科学发现)这个提多年的概念,在2026年从战略口号变成了真实的产出线。
2024年AI刚拿IMO金牌时,人们还在用“能解高中奥数题”衡量它的智力。到了2026年,它已经开始改写数学纪录,月均一个重大数学突破几乎成为常态。
人才流向更能说明问题。今年7月,新晋菲尔兹奖得主Jacob Tsimerman在领奖现场宣布加入OpenAI。这位多伦多大学数论学家曾是AI风险的严肃批评者,但在审阅了OpenAI模型构造的反例证明后被彻底说服,转而投身AI安全与形式化验证。
另外,AlphaFold核心人物、诺奖得主John Jumper离开Google DeepMind,加入Anthropic,带去了结构生物学领域最顶尖的实战经验。
AI公司从抢AI工程师,到抢菲尔兹奖得主、诺奖得主、理论物理学家和基因组学大牛,原因很简单:当AI从聊天进化到做科研时,决定天花板的,是那些最懂如何拓展人类知识边界的人。
而这背后的影响因素,一是AI角色变了。过去,AI可以是好用的计算器,跑数据、搜文献。现在,Claude已经能够自己组织60个Agent协同工作数十小时,发现问题、验证结论、写出论文,还建议人类专家复核。Anthropic CEO Dario Amodei表示:不要只把AI看作分析数据的工具,要把它看作能端到端完成科学家工作的智能体。其次,做科研的方式变了,AI科研能力的快速提升正在倒逼科研范式的变革。
此次Anthropic披露Claude模型在解答黎曼猜想过程中的成果,真正重要的不是67.2%这个数字,而是通过过程本身告诉行业:头部AI模型已经可以独立去做那些人类几十年推不动的事了。
就像Anthropic在博客最后所写:“也许Claude和我们许多人一样,低估了AI进步的速度。”
微信编辑| 七三
Anthropic没能证明黎曼猜想,但60个子智能体破了科研纪录
推动智能辅助驾驶平权 全新深蓝S05上市
山西大学承办智能计算理论与算法论坛
青豫特高压工程安全运行五周年
老挝230千伏马哈赛输变电工程开工
蒙西到京津冀特高压工程开工
