DC娱乐网

167年的题,AI在解,人在喊加油 黎曼猜想没被证明,但事不小 这两天数学圈

167年的题,AI在解,人在喊加油

黎曼猜想没被证明,但事不小

这两天数学圈在传一件事。Anthropic一个叫Jarred Sumner的员工,本职不是数学家,拿公司还没发布的科研版Claude去试黎曼猜想。黎曼猜想是1859年提出的,167年了,悬赏100万美元,没人拿下。Claude这次也没拿下——要求是100%的零点都在临界线上,它没做到。但它把一个相关的"可证明比例下界"从41.6%推到了67.2%。这个数具体什么分量得搞数论的人来评,反正消息出来后,好几个真做这行的人都在转。

60个Agent自己组了个团队

过程有点意思。Claude自己协调了大约60个子Agent,一天半跑了约2400条命令、几百个脚本、几千次数值校验,烧掉3100万输出token。分工像个小公司——2个主攻,13个出主意,30个试别的路子试失败了,13个专门挑错,2个写论文。Sumner本人干了什么?他后来说自己主要在给AI做情绪支持,翻来覆去就是几句话:"继续""你可以的""相信自己"。

它干完第一件事是怀疑自己

结果出来以后,Claude没去邀功,先下载了54篇论文查重,反向推导,主动找反例,然后建议找人类专家再审一遍。现在这个结果过了Lean形式化验证,也请两位业内专家看过。我见过AI写代码、做PPT,但一个系统干完一件大事,第一反应是"我会不会搞错了",自己跑去翻54篇论文核对,这个比它推进了几个百分点更让我在意。

真正变的是做研究的方式

这事不是AI要取代数学家。是以后做研究可能变成这样:一个人提问题,几十上百个Agent同时试几十条路,人来拍板哪条值得继续走,哪条可以砍了。真到那一步,最值钱的不是算得快的人,是问得出好问题、敢叫停某条路的人。

AI Claude 数学