OpenAI近期宣稱其最新大模型Astra在數學領域取得重大突破,解決了10項“長期開放問題”,且總token成本僅為2000美元。然而,這一成果迅速遭到數學界質疑,被指存在學術不端。8月6日,《科學美國人》發表報道,多位專家指出Astra的兩項核心成果未恰當引用已有研究,OpenAI隨後連夜修改論文措辭並補充引用。

據OpenAI本月初發布的公告,Astra在內部開發與測試中解決了10項“數學界高度關注的長期開放問題”,並強調這些問題“至少十年未獲解決,主要成果未見任何進展”。這一訊息迅速傳播,被視為AI潛力的又一例證。但數學界專家對這份近250頁的論文進行研讀後,發現其中兩項最令人振奮的成果存在引用缺失問題。

美國葉史瓦大學數學家史蒂文·米勒指出,Astra在球堆積問題上的證明,關鍵依賴於一個早在2016年就出現在他與合作者論文中的論證,但OpenAI的論文未恰當引用。米勒批評稱,這是“蓄意粗暴踐踏前人的工作”,並認為這並非偶發,而是系統性做法,已涉及學術不端。另一項關於群論中“索菲克性”的成果,也被指將2016年和2019年兩篇論文的思路拼接而成,缺乏真正的新穎性。

英國劍橋大學數學家弗朗切斯科·富爾涅-法西奧表示,Astra的發現起初令他震驚,但仔細審視後發現,它其實是“將數學文獻中已有的思路拼接起來”,並非深刻的智力飛躍。德國德累斯頓工業大學數學家安德烈亞斯·託姆(2019年論文合著者)則評價該成果“既富有創造性,又只需要相對基礎的數學方法”。

面對質疑,OpenAI發言人在宣告中表示:“我們對這些結果的正確性承擔責任,並遵循與人類數學家通常被要求達到的同等標準。”8月6日,OpenAI更新了論文,在球堆積一章補上了對亨利·科恩與米勒2016年預印本的引用,並在索菲克性一章的致謝中新增了昆和託姆等人的名字。同時,官網公告中“至少十年未獲解決”的表述被刪除,改為較謹慎的“長期懸而未決的開放問題”。

然而,此次更新未附帶逐條說明改動的勘誤記錄,OpenAI也未公佈模型嘗試過但未能解決的問題清單。託姆本人對更新持正面態度,表示“欽佩”OpenAI方法的高效。但富爾涅-法西奧強調:“OpenAI現在已經全面參與高水平研究,那麼就應該用和我們一樣的學術標準來要求他們。”

這一事件凸顯了AI在科研領域的雙刃劍效應:一方面,AI能以極低成本快速產出成果;另一方面,其學術嚴謹性可能落後於人類。對投資者而言,OpenAI的技術領先性固然重要,但其在學術倫理上的處理方式,可能影響其長期信譽與監管風險。