从”聊天”到”科学家”:Anthropic多智能体突破黎曼猜想下界背后的AI4S战略跃迁

企业 Anthropic
行业 信息传输、软件和信息技术服务业
年份 2026
难度 高级
适用课程 战略管理
核心概念 AI4S范式变革,多智能体协作,开放式创新,平台生态系统
来源 改编

案例摘要

一、案例背景 (一)AI4S:从口号到产出线的历史性转折 2026年8月10日,人工智能领域迎来一个里程碑式的时刻。Anthropic公司披露,其未公开的研究版Claude模型在尝试解答数学界顶尖悬赏难题”黎曼猜想”时,虽未直接通关,却借助多Agent自治协作,将黎曼ζ函数满足黎曼假设的零点比例下界从人类数学家耗费数十年推进的41.6%一举提升至67.2%。这一突破的意义不仅在于数字本身,更…

案例正文

一、案例背景

(一)AI4S:从口号到产出线的历史性转折

2026年8月10日,人工智能领域迎来一个里程碑式的时刻。Anthropic公司披露,其未公开的研究版Claude模型在尝试解答数学界顶尖悬赏难题”黎曼猜想”时,虽未直接通关,却借助多Agent自治协作,将黎曼ζ函数满足黎曼假设的零点比例下界从人类数学家耗费数十年推进的41.6%一举提升至67.2%。这一突破的意义不仅在于数字本身,更在于它标志着AI4S(AI for Science,人工智能驱动科学发现)这一概念在2026年从战略口号变成了真实的产出线。

黎曼猜想是数学界最著名的未解难题之一,由德国数学家波恩哈德·黎曼于1859年提出,至今已有167年历史。克雷数学研究所为其悬赏100万美元。黎曼ζ函数的”非平凡零点”与素数分布密切相关,黎曼猜想认为所有零点都在一条特定的临界线上。由于无法直接证明,数学家们转而尝试确定一个保底比例——即可以严格证明至少有多少比例的零点一定位于该临界线上。这个被严格证实的比例数值被称为该比例的下界。此前,人类数学家历经数十年努力,才将其推进至41.6%。

(二)突破的偶然性与必然性

这一突破的起点颇具戏剧性。Anthropic员工Jarred Sumner在晨跑时突发奇想,给Claude下了个任务:尝试证明黎曼猜想。Claude果然没有成功,但在过程中,模型搭建起约60个子智能体,在Claude Code里跑了一天半,执行2400条Shell命令,写了数百个Python脚本。最终,真正想出关键思路的只有两个Agent,整场消耗了3100万输出token,将已知位于临界线上的黎曼ζ函数零点比例下界推到了67.2%。

Anthropic内部数学家验证了论文,Claude生成Lean形式化证明。但官方也强调:不指望这套方法最终能证明黎曼猜想。然而,这一过程本身揭示了AI在科研领域的巨大潜力——头部AI模型已经可以独立去做那些人类几十年推不动的事了。

……

发表讨论

您的邮箱地址不会被公开。