据多位海外用户发现,OpenAI 可能正在 LMArena 测试平台上秘密测试一款名为 luna-lisa-alpha 的新图像模型。目前流出的测试结果显示,该模型在人物一致性、图像真实感、文字生成能力以及噪点控制等方面均有显著提升,但 OpenAI 尚未公开确认其存在。外界猜测,这可能是 GPT Image 2.5 或下一代 GPT Image 模型的早期版本。

最早发现该模型的用户之一 Neuro Pulse 在 X 上表示,这是一个正在测试中的「新 GPT Image checkpoint」,此前同系列测试版本为 mona-lisa-1。checkpoint 是模型训练过程中的阶段性版本,通常用于内部测试和能力评估,并不代表最终公开发布版本。

在大量测试反馈中,「一致性」成为出现频率最高的关键词。相比此前版本,luna-lisa-alpha 在连续生成同一个角色时,能够更好地保持人物外观、服饰和整体风格。测试者 Token Gremlin 表示,新版本最大的变化可能不是单张图片质量提升,而是稳定性增强,正在改善不同生成结果之间的人物一致性,以及 GPT Image 过去版本中存在的颗粒感和噪点问题。另一名用户 Mirochill 也提到,新版本相比 mona-lisa-1,图像中的颗粒感减少,角色一致性明显提升。不过,部分测试者仍发现,在复杂纹理、云朵、植物等细节区域,图片中依旧存在异常重复纹理问题。

除了真实感提升,luna-lisa-alpha 的文字生成能力也受到关注。GPT Image 2 在这一领域已有较大进步,现在一些测试者使用它生成手机界面、网页设计稿等内容,发现模型能够生成较复杂的 UI 元素,甚至能直出可折叠 iPhone 的官网界面图。Mark Kretschmann 认为,图像模型的重要性可能被低估,因为它们未来不仅可以生成图片,还可能直接参与网站设计、产品原型甚至代码转换。

一些测试者开始将 luna-lisa-alpha 与当前主流图像模型进行直接对比。X 用户 Harshith 分享了自己的测试结果,并将其与 GPT Image 2.0Nano Banana Pro 等模型放在同一组提示词下比较。还有网友使用同一组提示词,让 luna-lisa-alpha、GPT Image 2.0、Nano Banana Pro 和 Grok Imagine 同时生成图片,对比不同模型在人物还原、真实感以及细节处理上的差异。

就在社区发现 luna-lisa-alpha 的同时,OpenAI 也发布了 GPT Image 2 API 的一个新功能:预览支持透明背景生成,用户可以生成能够直接应用于不同背景的素材,用于产品图片、网页设计、营销内容等场景。一些用户猜测,OpenAI 可能正在通过多个 checkpoint 进行 A/B 测试。除了 mona-lisa-1,LMArena 上还出现过 lina-alpha 等名称,有测试者认为这些可能是同一系列模型的不同实验版本。

当然,目前距离正式发布仍存在不确定性。luna-lisa-alpha 最终是否会成为 GPT Image 2.5,或者只是内部测试阶段的一个版本,还需要等待 OpenAI 官方公布。

某种程度上,luna-lisa-alpha 的出现也让人重新思考 AI 竞争的方向。过去一年,编程能力几乎成了 AI 行业的注意力黑洞,从 Claude Code 到各种 Coding Agent,模型能不能写代码、改代码、完成开发任务,逐渐成为衡量 AI 能力进步的重要指标。但回头看,AI 进入普通用户日常的入口不应该只有代码,图片的生成创作等多模态内容同样是高频需求,只是在过去一段时间里长期被低估。AI 不应该只是帮少数人提高生产效率的工具,也应该成为更多人表达、创造和解决问题的新入口。