GPT Image 2.5发布:强化多轮编辑能力,Arena评测包揽前三
2026/09/09 09:57阅读量 2
OpenAI发布GPT Image 2.5模型,核心升级在于精确局部编辑与多轮连续编辑的一致性,旨在解决此前修改导致画质劣化的问题。该模型分为主打速度的Flare和主打质量的Sunburst两个版本,在Arena评测中包揽文生图及图像编辑类目前三。尽管功能创新性被指滞后于竞品,但其在复杂指令遵循和透明背景生成等新玩法上获得用户认可。
事件概述
OpenAI于2026年9月9日凌晨发布GPT Image 2.5模型。此次更新重点提升了图像的编辑精度、多轮连续编辑的一致性以及生成速度。新模型API分为两个版本:Flare(侧重速度与默认使用)和Sunburst(侧重最高质量与控制力)。在最新的Arena盲测中,这两个版本分别包揽了文生图、单图编辑和多图编辑三个类别的第一名。
核心信息
1. 编辑能力大幅升级
- 精确编辑 (Precision Editing):新模型能够仅修改用户指定的局部元素,同时保持主体、构图、背景及品牌视觉不变,解决了以往“牵一发而动全身”的痛点。
- 多轮编辑一致性 (Multi-turn Editing Consistency):支持对同一张图片进行多轮连续修改,且已完成的修改内容会被保留,图片质量不会随编辑轮数增加而劣化。
- 性能提升:相比GPT Image 2.0,Flare版本延迟降低50%,同时在参考图主体保真度、自然光照和纹理表现上有所改善。
2. 定价与版本差异
- Flare:默认模型,追求更高质量的同时降低延迟,适合通用场景。
- Sunburst:牺牲部分速度以换取更精细的控制,主要面向广告素材、商品图等高精度需求场景。
- 价格:两者定价与GPT Image 2.0保持一致,图像输入8美元/百万token,图像输出30美元/百万token,文本输入5美元/百万token。
3. 新功能与交互优化
- 草图模式 (Sketch):移动端支持通过@Sketch直接输入手绘草图,由模型根据草图生成图像。此功能并非首创,国内多家厂商及Adobe Firefly早已支持类似交互。
- Prompt共享 (Pass your best ideas along):分享生成的图片时可附带原始Prompt,便于他人复刻或基于原图继续修改。
4. 用户反馈与新玩法
- 定格动画制作:开发者利用连续生成画面串成动画,甚至能从简单草图直接生成动作序列帧(如12帧GIF)。
- 透明底素材生成:Sunburst版本输出的透明背景图质量较高,受到游戏开发者和设计师关注,可直接用于UI图标、角色立绘等。
- 日常体验改善:用户反馈人物表情更自然、皮肤质感更好、透视和构图更合理,漫画分镜更具动态感。
值得关注
- 创新滞后性:尽管GPT Image 2.5表现强劲,但其核心的连续编辑功能早在一年前已被NanoBanana实现,谷歌随后也推出了可视化圈选及多主体控制等功能。OpenAI此次更多被视为“补课”而非颠覆性创新。
- 遗留问题:模型仍未彻底解决手部细节错误、高频噪声、过度锐化等问题。在严格还原产品场景的测试中,NanoBanana 2和Pro仍被认为更可靠;部分用户指出复杂指令偶尔会被错误理解。
- 评测局限性:Arena评测中的“多图编辑”主要指多图输入编辑,与OpenAI强调的“多轮图像编辑”概念存在差异,需结合具体应用场景评估实际效果。
