據多位海外使用者發現,OpenAI 可能正在 LMArena 測試平台上秘密測試一款名為 luna-lisa-alpha 的新影像模型。目前流出的測試結果顯示,該模型在人物一致性、影像真實感、文字生成能力以及噪點控制等方面均有顯著提升,但 OpenAI 尚未公開確認其存在。外界猜測,這可能是 GPT Image 2.5 或下一代 GPT Image 模型的早期版本。

最早發現該模型的使用者之一 Neuro Pulse 在 X 上表示,這是一個正在測試中的「新 GPT Image checkpoint」,此前同系列測試版本為 mona-lisa-1。checkpoint 是模型訓練過程中的階段性版本,通常用於內部測試和能力評估,並不代表最終公開發布版本。

在大量測試反饋中,「一致性」成為出現頻率最高的關鍵詞。相比此前版本,luna-lisa-alpha 在連續生成同一個角色時,能夠更好地保持人物外觀、服飾和整體風格。測試者 Token Gremlin 表示,新版本最大的變化可能不是單張圖片質量提升,而是穩定性增強,正在改善不同生成結果之間的人物一致性,以及 GPT Image 過去版本中存在的顆粒感和噪點問題。另一名使用者 Mirochill 也提到,新版本相比 mona-lisa-1,影像中的顆粒感減少,角色一致性明顯提升。不過,部分測試者仍發現,在複雜紋理、雲朵、植物等細節區域,圖片中依舊存在異常重複紋理問題。

除了真實感提升,luna-lisa-alpha 的文字生成能力也受到關注。GPT Image 2 在這一領域已有較大進步,現在一些測試者使用它生成手機介面、網頁設計稿等內容,發現模型能夠生成較複雜的 UI 元素,甚至能直出可摺疊 iPhone 的官網介面圖。Mark Kretschmann 認為,影像模型的重要性可能被低估,因為它們未來不僅可以生成圖片,還可能直接參與網站設計、產品原型甚至程式碼轉換。

一些測試者開始將 luna-lisa-alpha 與當前主流影像模型進行直接對比。X 使用者 Harshith 分享了自己的測試結果,並將其與 GPT Image 2.0Nano Banana Pro 等模型放在同一組提示詞下比較。還有網友使用同一組提示詞,讓 luna-lisa-alpha、GPT Image 2.0、Nano Banana Pro 和 Grok Imagine 同時生成圖片,對比不同模型在人物還原、真實感以及細節處理上的差異。

就在社群發現 luna-lisa-alpha 的同時,OpenAI 也釋出了 GPT Image 2 API 的一個新功能:預覽支援透明背景生成,使用者可以生成能夠直接應用於不同背景的素材,用於產品圖片、網頁設計、營銷內容等場景。一些使用者猜測,OpenAI 可能正在通過多個 checkpoint 進行 A/B 測試。除了 mona-lisa-1,LMArena 上還出現過 lina-alpha 等名稱,有測試者認為這些可能是同一系列模型的不同實驗版本。

當然,目前距離正式釋出仍存在不確定性。luna-lisa-alpha 最終是否會成為 GPT Image 2.5,或者只是內部測試階段的一個版本,還需要等待 OpenAI 官方公佈。

某種程度上,luna-lisa-alpha 的出現也讓人重新思考 AI 競爭的方向。過去一年,程式設計能力幾乎成了 AI 行業的注意力黑洞,從 Claude Code 到各種 Coding Agent,模型能不能寫程式碼、改程式碼、完成開發任務,逐漸成為衡量 AI 能力進步的重要指標。但回頭看,AI 進入普通使用者日常的入口不應該只有程式碼,圖片的生成創作等多模態內容同樣是高頻需求,只是在過去一段時間裡長期被低估。AI 不應該只是幫少數人提高生產效率的工具,也應該成為更多人表達、創造和解決問題的新入口。