Anthropic旗下AI模型Claude在嘗試解決黎曼猜想時,將滿足猜想的零點比例下限從41.6%大幅提升至67.2%,這是該問題研究半個多世紀以來單次跳升幅度最大的一次突破。此前四十餘年,該進展不足10個百分點。這一成果標誌著AI首次在純數學領域做出原創性貢獻,而非僅僅輔助人類計算。

Claude採用多智慧體協作架構,通過60個子代理並行執行、2400條shell命令,將邦比埃裡二次型與蒙哥馬利配對關聯等工具進行跨領域組合,繞開傳統“對角化”簡化思路,在非對角化複雜空間中直接展開計算,發現了人類數學家此前忽略的路徑。AI自主完成了650次失敗嘗試、自我審查、文獻檢索(交叉核對54篇arXiv論文)、獨立復現驗證、論文撰寫,並通過Lean定理證明器進行形式化校驗,展示了從“提出假設”到“實驗驗證”到“邏輯校驗”的全流程AI科研範式。

這一突破的意義不僅在於數學本身,更在於它展示了AI在科學發現中的潛力。傳統上,數學證明被認為需要人類直覺與創造力,而Claude的成果表明,AI能夠通過大規模搜尋與跨領域工具組合,發現人類未曾設想的路徑。然而,也有研究者指出,該結果仍需人類數學家獨立驗證,且黎曼猜想的完整證明仍遙不可及。

Anthropic尚未透露Claude的具體版本或訓練細節,但這一成果無疑將加劇AI在基礎科學領域的競爭。OpenAI、DeepMind等公司也在探索AI輔助數學證明,但Claude此次的突破是首個被廣泛報道的純數學原創貢獻。

對於投資者而言,這一事件凸顯了AI在科研領域的商業價值,可能推動對AI研發的進一步投入。不過,從實驗室到實際應用仍有距離,數學證明的商業化路徑尚不清晰。