SpaceXAI(原xAI)於8月8日釋出Imagine Image 2.0,作為Grok的全新影像生成器,在Arena基準測試中位列全球第二,僅次於OpenAI的GPT-Image-2。該模型已在grok.com/imagine及Grok的iOS和Android應用中上線,API訪問即將推出。

根據截至2026年8月7日的Arena排行榜,Imagine Image 2.0的快速“低”變體在影像編輯和文生圖兩個類別均排名第二。在Image Edit Arena中,其Elo評分為1,439,落後於GPT-Image-2的1,463;在Text-to-Image Arena中,評分為1,320,同樣低於GPT-Image-2的1,380。其他競爭者如SpaceXAI的Reve 2.1、Meta的Muse-Image、阿里巴巴的Qwen-Image-3.0-Pro、谷歌的Gemini以及字節跳動的SeedDream均排名更後。新模型還大幅超越了其前代“Quality”變體。

Imagine Image 2.0配備多項編輯功能,旨在支援迭代式工作流。其中“Magic Wand”工具可僅修改影像的選定區域,分割功能允許使用者精確選取區域,背景移除工具可匯出透明背景的主體。Multi-Ref Editing功能支援將最多五張輸入影像合併為一次生成。“Smart Resize”可將現有影像轉換為任意寬高比,模型自動填充額外空間。

此外,SpaceXAI還引入了模板功能,將常見影像工作流打包為預設起點,涵蓋照片編輯、產品攝影、營銷材料、設計工具、遊戲資產和流媒體表情符號等類別。公司還展示了一項功能,可分別生成角色、場景和道具,同時保持所有影像的視覺風格一致,並定位為邁向完整影片製作工作流的墊腳石。SpaceXAI表示,Imagine 2.0能夠生成一致的視覺世界,為影片製作提供起點。

此次釋出正值AI影像生成領域競爭加劇之際,OpenAI、谷歌、Meta等公司均在快速迭代。SpaceXAI通過聚焦實用編輯工具和模板,試圖在創意工作流中佔據一席之地。儘管在基準測試中仍落後於GPT-Image-2,但差距相對較小,且新模型在編輯功能上展現出差異化優勢。未來API的開放可能進一步擴大其應用場景。