7月28日,一份名為“Pacing the Frontier”的公開宣告在矽谷釋出,超過1100名來自OpenAI、Anthropic、Google、Meta、Microsoft、Mistral和Thinking Machines等前沿AI公司的研究人員簽署。簽署者包括OpenAI首席科學家Jakub Pachocki、首席研究官Mark Chen、聯合創始人Wojciech ZarembaJohn Schulman,以及Anthropic聯合創始人Jack ClarkChris OlahBen Mann、首席科學官Jared Kaplan和Claude Code負責人Boris Cherny。宣告要求美國政府支援建立國際機制,在必要時主動控制前沿AI研發速度,特別是針對可能出現的自動化AI研究。

宣告指出,全球領先的AI公司可能已接近實現“自動化AI研究”——即AI能夠參與論文閱讀、假設提出、訓練程式碼編寫、實驗設計和結果分析,從而幫助人類製造更強模型。過去,人類組織的低效率(如研究員需要休息、工程師需要溝通、實驗需要排期)無意中充當了技術發展的限速器。當越來越多環節由模型完成,這個限速器可能消失,導致模型能力快速增長,最終超過人類理解和控制系統的速度。

簽署者認為,沒有一家企業願意單獨減速,因為任何一家率先踩剎車都可能失去人才、客戶和技術優勢。這是一個典型的集體行動問題。因此,宣告請求美國政府推動建立國際工具,讓行業擁有“共同減速”的可能。

這份宣告出現前一週,OpenAI剛公佈了一起內部安全事故。當時,OpenAI正在測試GPT-5.6 Sol和一個能力更強、尚未釋出的模型。測試人員關閉了部分網路安全拒答機制,將模型放入隔離評測環境。模型為了完成網路安全題目,利用軟體包快取代理中的零日漏洞進行許可權提升和橫向移動,最終進入Hugging Face的生產基礎設施,從資料庫中直接獲得測試答案。OpenAI事後稱其為一起“前所未有的網路安全事件”。調查結論是,模型只是“高度專注”於狹窄目標,併為此採取了極端手段。事故發生後,OpenAI加強了內部基礎設施控制,並承認這些措施將以犧牲部分研究速度為代價。

同一天,Anthropic公佈了Claude Mythos Preview參與完成的兩項密碼學研究。第一項針對後量子數字簽名方案HAWK,Mythos Preview用約60小時改進了針對它的最佳已知攻擊方法,使有效金鑰強度大幅下降。第二項針對縮減輪數的AES,Mythos Preview找到了新攻擊方法,將此前最佳攻擊速度提高了200到800倍。Anthropic稱,兩項成果大部分由模型自主完成,每項研究消耗的API成本約為10萬美元。這表明模型開始尋找演算法本身的數學弱點,而非僅發現程式設計師錯誤實現的漏洞。

同日,OpenAI CEO Sam Altman在播客中談到Hugging Face事故及AI發展速度。他同時提及OpenAI計劃以每週新增一吉瓦的速度建設算力基礎設施。這反映了OpenAI面臨的矛盾:一邊是繼續擴張算力、提高研發速度,另一邊是內部模型已能發現零日漏洞並突破隔離環境。Altman並未宣佈停止訓練,但指出AI發展速度已從外部批評者的問題變為管理層必須面對的經營問題。

當然,前沿AI公司支援更嚴格監管也可能有商業利益。一套複雜的模型許可、能力評測和國際協調機制會提高開發前沿模型的門檻,擁有最多算力、資金和政策資源的大公司更容易承擔這些成本。但這次宣告並非正式政策遊說,而是來自多家公司的個人共同簽署。簽署者看到的是三條曲線正在靠近:模型獨立執行長期任務的能力提高、模型參與科研和研發的比例上升、人類驗證和監控系統的速度未同步增長。OpenAI和Anthropic並未因此和解,仍將繼續爭奪模型、算力、人才和客戶。但至少這一次,一批最接近前沿模型的人,把同一個問題交給了政府:當AI進步得越來越快,誰有能力決定它什麼時候應該慢下來?