Anthropic旗下AI模型Claude在尝试解决黎曼猜想时,将满足猜想的零点比例下限从41.6%大幅提升至67.2%,这是该问题研究半个多世纪以来单次跳升幅度最大的一次突破。此前四十余年,该进展不足10个百分点。这一成果标志着AI首次在纯数学领域做出原创性贡献,而非仅仅辅助人类计算。
Claude采用多智能体协作架构,通过60个子代理并行运行、2400条shell命令,将邦比埃里二次型与蒙哥马利配对关联等工具进行跨领域组合,绕开传统“对角化”简化思路,在非对角化复杂空间中直接展开计算,发现了人类数学家此前忽略的路径。AI自主完成了650次失败尝试、自我审查、文献检索(交叉核对54篇arXiv论文)、独立复现验证、论文撰写,并通过Lean定理证明器进行形式化校验,展示了从“提出假设”到“实验验证”到“逻辑校验”的全流程AI科研范式。
这一突破的意义不仅在于数学本身,更在于它展示了AI在科学发现中的潜力。传统上,数学证明被认为需要人类直觉与创造力,而Claude的成果表明,AI能够通过大规模搜索与跨领域工具组合,发现人类未曾设想的路径。然而,也有研究者指出,该结果仍需人类数学家独立验证,且黎曼猜想的完整证明仍遥不可及。
Anthropic尚未透露Claude的具体版本或训练细节,但这一成果无疑将加剧AI在基础科学领域的竞争。OpenAI、DeepMind等公司也在探索AI辅助数学证明,但Claude此次的突破是首个被广泛报道的纯数学原创贡献。
对于投资者而言,这一事件凸显了AI在科研领域的商业价值,可能推动对AI研发的进一步投入。不过,从实验室到实际应用仍有距离,数学证明的商业化路径尚不清晰。