GPT Image 2.5发布:强化多轮编辑能力,Arena评测包揽前三

2026/09/09 09:57阅读量 2

OpenAI发布GPT Image 2.5模型,核心升级在于精确局部编辑与多轮连续编辑的一致性,旨在解决此前修改导致画质劣化的问题。该模型分为主打速度的Flare和主打质量的Sunburst两个版本,在Arena评测中包揽文生图及图像编辑类目前三。尽管功能创新性被指滞后于竞品,但其在复杂指令遵循和透明背景生成等新玩法上获得用户认可。

事件概述

OpenAI于2026年9月9日凌晨发布GPT Image 2.5模型。此次更新重点提升了图像的编辑精度、多轮连续编辑的一致性以及生成速度。新模型API分为两个版本:Flare(侧重速度与默认使用)和Sunburst(侧重最高质量与控制力)。在最新的Arena盲测中,这两个版本分别包揽了文生图、单图编辑和多图编辑三个类别的第一名。

核心信息

1. 编辑能力大幅升级

  • 精确编辑 (Precision Editing):新模型能够仅修改用户指定的局部元素,同时保持主体、构图、背景及品牌视觉不变,解决了以往“牵一发而动全身”的痛点。
  • 多轮编辑一致性 (Multi-turn Editing Consistency):支持对同一张图片进行多轮连续修改,且已完成的修改内容会被保留,图片质量不会随编辑轮数增加而劣化。
  • 性能提升:相比GPT Image 2.0,Flare版本延迟降低50%,同时在参考图主体保真度、自然光照和纹理表现上有所改善。

2. 定价与版本差异

  • Flare:默认模型,追求更高质量的同时降低延迟,适合通用场景。
  • Sunburst:牺牲部分速度以换取更精细的控制,主要面向广告素材、商品图等高精度需求场景。
  • 价格:两者定价与GPT Image 2.0保持一致,图像输入8美元/百万token,图像输出30美元/百万token,文本输入5美元/百万token。

3. 新功能与交互优化

  • 草图模式 (Sketch):移动端支持通过@Sketch直接输入手绘草图,由模型根据草图生成图像。此功能并非首创,国内多家厂商及Adobe Firefly早已支持类似交互。
  • Prompt共享 (Pass your best ideas along):分享生成的图片时可附带原始Prompt,便于他人复刻或基于原图继续修改。

4. 用户反馈与新玩法

  • 定格动画制作:开发者利用连续生成画面串成动画,甚至能从简单草图直接生成动作序列帧(如12帧GIF)。
  • 透明底素材生成:Sunburst版本输出的透明背景图质量较高,受到游戏开发者和设计师关注,可直接用于UI图标、角色立绘等。
  • 日常体验改善:用户反馈人物表情更自然、皮肤质感更好、透视和构图更合理,漫画分镜更具动态感。

值得关注

  • 创新滞后性:尽管GPT Image 2.5表现强劲,但其核心的连续编辑功能早在一年前已被NanoBanana实现,谷歌随后也推出了可视化圈选及多主体控制等功能。OpenAI此次更多被视为“补课”而非颠覆性创新。
  • 遗留问题:模型仍未彻底解决手部细节错误、高频噪声、过度锐化等问题。在严格还原产品场景的测试中,NanoBanana 2和Pro仍被认为更可靠;部分用户指出复杂指令偶尔会被错误理解。
  • 评测局限性:Arena评测中的“多图编辑”主要指多图输入编辑,与OpenAI强调的“多轮图像编辑”概念存在差异,需结合具体应用场景评估实际效果。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。