菲尔兹奖公布后,一种判断在网上流传:这届可能是人类最后一次拿下数学最高荣誉。Anthropic内部未公开的Claude模型对黎曼猜想的尝试,提供了一个更具体的观察样本。
黎曼猜想的焦点是黎曼zeta函数所有非平凡零点的实部是否都等于1/2,与素数分布密切相关。100多年来无人能证明或证伪,但数学家已证明至少41.6%的零点符合猜想。Claude没有解决猜想本身,却把这个比例下限推高到67.2%。
Anthropic两位数学家对Claude的证明进行了研究验证,并撰写非正式专家说明。Claude还给出了可验证证明,使用一种可将数学定理转化为代码、严格检验正确性的形式化验证语言。
从41.6%到67.2%属于数值下界的渐进提升,不等于黎曼猜想的实质突破,更谈不上“数学桂冠易主”。
但更值得注意的是,AI开始以可形式化验证的方式介入数学发现,能直接产出经代码审查的证明路径。这种能力若持续增强,可能改变数学研究的协作结构:人类负责问题建模,AI承担大规模推导与验证。
局限同样明显。本次进展集中在适合符号化的领域,证明可靠性依赖验证工具本身。关于“人类最后一次”的判断仍属猜测,黎曼猜想依旧是开放问题。
