Imagine Image 2.0 靠分层编辑出圈,OpenAI 被曝测试 GPT-Image 继任模型

2026/08/10 15:44阅读量 2

马斯克主推的 Imagine Image 2.0 以分层编辑和表情包改造出圈,在 LMArena 两项生图榜单均列第二,但审核收紧引发争议。OpenAI 正以代号 mona-lisa-1 在 LMArena 测试 GPT-Image 2 的后续版本,测试图已通过 OpenAI 验证工具确认水印,但模型知识截止为 2025 年 5 月 22 日,具体定位仍是猜测。

事件概述

四月份发布的 GPT-Image-2 仍是当前 AI 生图领域的标杆,广泛用于信息图制作和简单修图。马斯克近期在 X 上频繁推广的 Imagine Image 2.0,则凭借表情包编辑能力出圈。在 LMArena(大模型竞技场)中,它的文本转图像生成和图像编辑两个类别均位列世界第二。

核心信息

Imagine Image 2.0 的分层编辑

  • 上传图片后,Grok 会自动分层图像,用户可以精确选择特定区域进行修改;右侧边栏会显示去除背景后的图层,例如“红色夹克”“白色 T 恤”“AI 公司 Logo”等元素。
  • 图层编辑时只能输入提示词,不能再引用其他图片信息,因此比较依赖模型的世界知识。精确编辑功能则可以把框选物体加入选区,或直接用提示词修改。
  • 点击图层的下载按钮,可导出任意主体为透明背景素材;魔棒工具还能补充编辑自动分层未覆盖的区域。
  • 多参考编辑功能一次最多处理 5 张输入图像,支持自动拼接。
  • 经典表情包如“分心男友”、会议室白板漫画,都能通过选区替换或填字快速改造。

与 GPT-Image 2 主要靠提示词控制的路线相比,Imagine Image 2.0 的交互更友好,但审核也更严:上传蜘蛛侠等受版权保护的内容会被拒绝,擦边内容同样有更强护栏。

OpenAI 新模型代号 mona-lisa-1

  • 有网友在 LMArena 上发现 OpenAI 正在测试 GPT-Image 2 的后续版本,代号为 mona-lisa-1
  • 部分测试者认为新模型在真实感和噪声方面略有改进,整体提升幅度不大;也有网友认为它减少了常见的“AI 感”,照片更接近真实手机拍摄效果。
  • mona-lisa-1 生成的图片放入 OpenAI 验证工具,结果显示包含 OpenAI SynthID 水印;同款广告牌照片也提示“此内容是由 OpenAI 生成”。
  • 不过,在 LMArena 的多次生成测试中,并未直接遇到该模型。

值得关注

mona-lisa-1 的知识只到 2025 年 5 月 22 日。当要求它绘制 Anthropic 发布记录时,Opus 4 之后的时间线出现明显错乱。因此有网友猜测它可能是 GPT-Image 2.0 Mini,也可能是 OpenAI 即将推出的开源生图模型。

在 GPT-Image 2 仍属第一梯队的情况下,新动向说明生图模型在一致性保持、密集文字、精准编辑和美学品质上仍有继续探索的空间。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。