SpaceXAI(原xAI)于8月8日发布Imagine Image 2.0,作为Grok的全新图像生成器,在Arena基准测试中位列全球第二,仅次于OpenAI的GPT-Image-2。该模型已在grok.com/imagine及Grok的iOS和Android应用中上线,API访问即将推出。
根据截至2026年8月7日的Arena排行榜,Imagine Image 2.0的快速“低”变体在图像编辑和文生图两个类别均排名第二。在Image Edit Arena中,其Elo评分为1,439,落后于GPT-Image-2的1,463;在Text-to-Image Arena中,评分为1,320,同样低于GPT-Image-2的1,380。其他竞争者如SpaceXAI的Reve 2.1、Meta的Muse-Image、阿里巴巴的Qwen-Image-3.0-Pro、谷歌的Gemini以及字节跳动的SeedDream均排名更后。新模型还大幅超越了其前代“Quality”变体。
Imagine Image 2.0配备多项编辑功能,旨在支持迭代式工作流。其中“Magic Wand”工具可仅修改图像的选定区域,分割功能允许用户精确选取区域,背景移除工具可导出透明背景的主体。Multi-Ref Editing功能支持将最多五张输入图像合并为一次生成。“Smart Resize”可将现有图像转换为任意宽高比,模型自动填充额外空间。
此外,SpaceXAI还引入了模板功能,将常见图像工作流打包为预设起点,涵盖照片编辑、产品摄影、营销材料、设计工具、游戏资产和流媒体表情符号等类别。公司还展示了一项功能,可分别生成角色、场景和道具,同时保持所有图像的视觉风格一致,并定位为迈向完整视频制作工作流的垫脚石。SpaceXAI表示,Imagine 2.0能够生成一致的视觉世界,为视频制作提供起点。
此次发布正值AI图像生成领域竞争加剧之际,OpenAI、谷歌、Meta等公司均在快速迭代。SpaceXAI通过聚焦实用编辑工具和模板,试图在创意工作流中占据一席之地。尽管在基准测试中仍落后于GPT-Image-2,但差距相对较小,且新模型在编辑功能上展现出差异化优势。未来API的开放可能进一步扩大其应用场景。