OpenAI发布GPT Image 2.5:强化多轮编辑与一致性,补齐图像修改短板

2026/09/09 18:59阅读量 3

OpenAI于2026年9月9日凌晨发布GPT Image 2.5模型,重点提升局部精确编辑、多轮修改一致性及生成速度。新模型分为主打速度的Flare和主打质量的Sunburst两个版本,在Arena竞技场测试中表现优异,显著改善了以往连续编辑导致画质劣化的问题。尽管部分功能如草图生成和Prompt分享被指缺乏创新,但整体编辑能力的增强使其更易于融入实际工作流,减少了“抽卡”成本。

事件概述

OpenAI于2026年9月9日发布GPT Image 2.5模型,核心升级方向为图像编辑能力。相比前代Image 2.0,新模型旨在解决局部修改不精准、多轮编辑后主体偏移及画质劣化等痛点,提供更高稳定性的迭代体验。

核心信息

1. 性能与版本划分

  • 双版本策略:API分为两个版本。
    • Flare(闪光):默认模型,主打速度与性价比,生成延迟较Image 2降低50%,同时保持高质量。
    • Sunburst(云隙阳光):主打最高质量与精细控制,牺牲部分速度以换取更优的光影效果和审美,适用于广告素材、商品图等对细节要求高的场景。
  • 竞技场表现:在LMSYS Arena最新结果中,Sunburst和Flare包揽文生图、单图编辑和多图编辑三个类别的前两名。相较于Image 2,Sunburst在多图编辑任务上得分提升81分,单图编辑提升59分;Flare分别提升47分和30分。
  • 定价不变:图像输入8美元/百万token,图像输出30美元/百万token,文本输入5美元/百万token,价格与Image 2保持一致。

2. 关键技术升级

  • Precision Editing(精确编辑):能够仅修改用户指定的元素(如商品、文案、局部),同时保持主体位置、构图、背景及品牌视觉不变,避免“牵一发而动全身”。
  • Multi-turn Editing Consistency(多轮编辑一致性):支持基于上一轮修改结果进行连续迭代,确保图片质量不随编辑轮数增加而劣化,保留已做出的有效修改。
  • 主体保真度提升:在参考图主体保真度、自然光照和纹理表现上均有改善,人物放入新场景后更易保留辨识度。

3. 新功能补充

  • Sketch(草图模式):移动端支持通过@Sketch指令,将手绘草图转化为生成依据,简化描述过程。
  • Pass your best ideas along(创意接力):分享图片时可附带Prompt,接收方可直接复用Prompt并替换细节进行复刻或继续生成。

值得关注

1. 社区反馈与应用场景

  • 定格动画制作:开发者利用其连续生成序列帧的能力,从少量草图快速扩展为完整GIF动画,大幅降低创作门槛。
  • 透明底素材生成:Sunburst生成的透明背景图质量较高,适合游戏开发、UI设计及电商素材制作。
  • 工作流优化:用户反馈显示,反复修改造成的画质衰减明显减少,使得AI绘图更贴合实际设计工作流,无需依赖单次“抽卡”成功。

2. 局限性与竞争对比

  • 功能创新性不足:草图控制和Prompt分享功能已被Google Nano Banana、Adobe Firefly及腾讯混元等竞品较早实现,OpenAI更多是跟进成熟交互。
  • 遗留问题:手部细节错误、棋盘格噪声、颗粒感及过度锐化等问题仍未彻底解决;复杂指令遵循能力仍有波动,偶尔出现理解偏差。
  • 竞品对比:在严格还原产品本身或极端复杂指令处理上,Google Nano Banana Pro/Flash及Seedream等模型仍被认为更具可靠性或优势。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。