xAI(現為SpaceXAI)旗下模型Grok 4.5在一次非正式的內部討論中,僅用8分鐘便推翻了一個困擾數學界約30年的圖論猜想,引發科技與投資圈廣泛關注。

事件起源於使用者Dmitry Rybin 23日在社交平台X上釋出的一篇帖子。他表示,Dinitz-Garg-Goemans猜想已被證偽——該圖論問題懸而未決長達約30年。據其描述,相關發現藉助AI完成,帖子附有具體的圖論反例資料。隨後,xAI創始人埃隆·馬斯克點贊並轉發,評論稱“Grok 4.5剛剛解決了一個懸而未決約30年的圖論猜想”。

這一事件迅速引發市場對AI前沿能力的關注。Grok 4.5 Medium版本以非正式渠道完成這一突破,尤其值得注意的是,這並非一次精心設計的基準測試,而是在團隊Slack頻道的日常討論中偶然觸發,進一步凸顯當前頂級AI模型在數學推理方面的實際落地能力。

賈斯汀·孫(Justin Sun)在X平台釋出的帖子披露,團隊將Rybin的原始帖子分享至內部Slack頻道後,Capy——一個執行在Grok 4.5 Medium之上的AI——主動嘗試求解,並在8分鐘內找到了一個新穎的反例,從而推翻了該猜想。這一過程的非計劃性使其格外引人注目:AI並非在受控的研究環境中被專門部署於該問題,而是在一次隨機的團隊討論中自主“介入”,並獨立完成了推理與驗證。

Dinitz-Garg-Goemans猜想屬於圖論領域,核心涉及分數流(fractional flow)與不可分割流(unsplittable flow)之間的代價關係。根據Rybin的描述,被找到的反例圖具有分數流代價58,而任何容量違反不超過15的不可分割流,其代價至少為60——這一差距直接否定了該猜想的成立。該猜想自提出以來懸而未決約30年,屬於組合最佳化與網路流領域的經典開放問題。

值得關注的是,Rybin本人在其帖子中提及,上述發現最初是通過與GPT-5的對話完成的,並附上了相關聊天記錄連結。而賈斯汀·孫隨後展示了Grok 4.5 Medium同樣獨立完成了這一推翻過程。這意味著,在同一數學難題上,OpenAI的GPT-5xAI的Grok 4.5在短時間內相繼給出有效解答,直觀呈現出當前頂尖AI模型在數學推理能力上的競爭態勢,也為市場評估兩家公司技術實力提供了新的參照維度。