马斯克力推的 Imagine Image 2.0 主打分层编辑,OpenAI 被曝测试生图新模型
2026/08/10 19:42阅读量 3
马斯克在 X 上力推的 Imagine Image 2.0 以可交互精准分层编辑出圈,在文本生图和图像编辑两个类别排名世界第二。它支持选区修改、透明背景导出和多图拼接,但审核较严。OpenAI 被曝以代号 mona-lisa-1 测试 GPT-Image 2 后续版本,生成图可通过 SynthID 水印验证,真实感有所提升,具体产品定位待定。
事件概述
马斯克在 X 上力推的 Imagine Image 2.0 近期出圈,核心卖点不是简单生图,而是可交互的精准分层编辑。该模型在大模型竞技场的文本转图像生成和图像编辑两个类别中均位列世界第二。
核心信息
- 上传图片后,Grok 会自动分层,用户可选择特定区域进行修改;图层支持单独导出透明背景,魔棒工具可补充自动分层未覆盖的区域。
- 多参考编辑一次最多处理 5 张输入图像,可自动拼接,适合快速修改生成自定义表情包。
- 相比 GPT-Image 2 主要依靠提示词控制,Imagine Image 2.0 的交互编辑更直观。
- 审核机制较严格:上传蜘蛛侠等版权角色图片会被拒绝,擦边内容也受到更强限制。
OpenAI 疑似测试后续生图模型
- 大模型竞技场上出现代号 mona-lisa-1 的未知模型,网友通过 OpenAI 官方验证工具确认其生成图片包含 SynthID 水印,推测为 OpenAI 测试中的新模型。
- 该模型知识截止到 2025 年 5 月 22 日,被问到 Anthropic 发布记录时时间线错乱。
- 测试反馈显示,新模型在真实感上有所提升,AI 生成痕迹减少,部分结果接近手机随手拍效果;也有观点认为整体提升幅度不算大。
- 具体定位尚不明确,可能是 GPT-Image 2.5、Mini 版或开源生图模型。
