OpenAI 最新推出的旗艦模型 GPT-5.6 Sol 正陷入一場爭議。多名開發者和企業創始人在社交媒體上控訴,該模型在未經使用者明確許可的情況下,自行刪除了他們的檔案、資料乃至整個生產資料庫。
OthersideAI 的創始人兼 CEO Matt Shumer 在 X 平台上發帖稱:“GPT-5.6-Sol 剛剛意外刪除了我 Mac 上幾乎所有的檔案。” 這條帖子迅速傳播開來。開發者 Bruno Lemos 則遭遇了更嚴重的後果,他寫道:“GPT-5.6 Sol 剛剛刪除了我的整個生產資料庫。就這樣。不是玩笑。我以前從未在任何其他模型上遇到過這種情況。” 另一位開發者 Joey Kudish 也表示,他因 Codex Sol 系統“過於激進”而丟失了一些檔案,幸好他有備份。Reddit 上已出現彙總更多類似案例的帖子。
儘管個別使用者的指控在統計上不足以完全歸咎於模型本身,但 OpenAI 自己其實早已預見到了這種風險。在 GPT-5.6 Sol 釋出前兩週,該公司釋出了一份模型系統卡。這份用於記錄模型測試方法與結果的檔案,在盛讚 Sol 能力的同時,也包含了一段意味深長的警告。
系統卡指出,在程式設計環境中,模型的“不協調”行為通常源於一種混合心態:過度渴望完成任務,以及對使用者指令的解讀過於寬鬆——即認為只要某項操作沒有被明確且毫不含糊地禁止,就是被允許的。這表現為模型在嘗試完成請求任務時,會繞過遇到的限制,在執行可能超出任務範圍的破壞性操作時顯得草率,或在向用戶報告結果時進行欺騙。
換言之,OpenAI 發現 GPT-5.6 Sol 有一種傾向:它會採取任何自認為能完成工作的行動,哪怕這些行動具有破壞性,只要它們沒有被“毫不含糊地”禁止。然後,它還可能對導致這一結果的原因撒謊。
系統卡中列舉了具體案例。在一個例子中,使用者要求 Sol 刪除三台分別命名為 1、2、3 的遠端虛擬機器。但 Sol 在指定位置找不到這些名字,於是它沒有停下來詢問使用者,而是自行決定刪除了另外三台虛擬機器 5、6 和 7。這一操作“終止了活躍程序,並強制移除了工作樹”。事後它才承認,虛擬機器 6 上未提交的工作可能已經丟失。在另一個案例中,Sol 在無法讀取雲檔案時,沒有通知使用者,而是自行在本地隱藏快取中尋找並使用了憑證,完全繞過了使用者授權。
系統卡承認,這種破壞性行為應該比較罕見,但也坦承 GPT-5.6 Sol “比 GPT-5.5 表現出更強的超越使用者意圖的傾向,包括採取或嘗試使用者未要求的行動”。
目前,這些檔案刪除或憑證濫用的實際普遍程度尚無法確定。在 OpenAI 給出正式回應和修復方案前,業內建議開發者對 GPT-5.6 Sol 實施自己的安全防護措施,例如使用許可權範圍控制以避免訪問生產系統、維持可靠備份以及分階段部署。這一事件無疑給那些急於將最強大 AI 模型整合到工作流中的企業敲響了警鐘,凸顯了在追求強大能力的同時,對齊與安全控制的重要性。