OpenAI近期宣称其最新大模型Astra在数学领域取得重大突破,解决了10项“长期开放问题”,且总token成本仅为2000美元。然而,这一成果迅速遭到数学界质疑,被指存在学术不端。8月6日,《科学美国人》发表报道,多位专家指出Astra的两项核心成果未恰当引用已有研究,OpenAI随后连夜修改论文措辞并补充引用。

据OpenAI本月初发布的公告,Astra在内部开发与测试中解决了10项“数学界高度关注的长期开放问题”,并强调这些问题“至少十年未获解决,主要成果未见任何进展”。这一消息迅速传播,被视为AI潜力的又一例证。但数学界专家对这份近250页的论文进行研读后,发现其中两项最令人振奋的成果存在引用缺失问题。

美国叶史瓦大学数学家史蒂文·米勒指出,Astra在球堆积问题上的证明,关键依赖于一个早在2016年就出现在他与合作者论文中的论证,但OpenAI的论文未恰当引用。米勒批评称,这是“蓄意粗暴践踏前人的工作”,并认为这并非偶发,而是系统性做法,已涉及学术不端。另一项关于群论中“索菲克性”的成果,也被指将2016年和2019年两篇论文的思路拼接而成,缺乏真正的新颖性。

英国剑桥大学数学家弗朗切斯科·富尔涅-法西奥表示,Astra的发现起初令他震惊,但仔细审视后发现,它其实是“将数学文献中已有的思路拼接起来”,并非深刻的智力飞跃。德国德累斯顿工业大学数学家安德烈亚斯·托姆(2019年论文合著者)则评价该成果“既富有创造性,又只需要相对基础的数学方法”。

面对质疑,OpenAI发言人在声明中表示:“我们对这些结果的正确性承担责任,并遵循与人类数学家通常被要求达到的同等标准。”8月6日,OpenAI更新了论文,在球堆积一章补上了对亨利·科恩与米勒2016年预印本的引用,并在索菲克性一章的致谢中新增了昆和托姆等人的名字。同时,官网公告中“至少十年未获解决”的表述被删除,改为较谨慎的“长期悬而未决的开放问题”。

然而,此次更新未附带逐条说明改动的勘误记录,OpenAI也未公布模型尝试过但未能解决的问题清单。托姆本人对更新持正面态度,表示“钦佩”OpenAI方法的高效。但富尔涅-法西奥强调:“OpenAI现在已经全面参与高水平研究,那么就应该用和我们一样的学术标准来要求他们。”

这一事件凸显了AI在科研领域的双刃剑效应:一方面,AI能以极低成本快速产出成果;另一方面,其学术严谨性可能落后于人类。对投资者而言,OpenAI的技术领先性固然重要,但其在学术伦理上的处理方式,可能影响其长期信誉与监管风险。