OpenAI发布ChatGPT Images 2.5:生图速度提升,编辑更精准可控
2026/09/10 15:25阅读量 2
OpenAI正式发布新一代图像生成模型ChatGPT Images 2.5,主打生成速度提升与编辑稳定性增强。相比前代版本,Images 2.5将生成延迟最高降低50%,并新增xhigh和max质量档位以优化细节与材质表现。该模型支持直接在图片上批注修改、使用草图作为参考以及多轮编辑保持一致性,标志着AI生图从“抽卡”式生成向生产级定点修图转变。
事件概述
OpenAI正式推出新一代图像生成模型 ChatGPT Images 2.5。此次升级不仅提升了生成速度与画面自然度,更重点强化了图像编辑的精确性与多轮交互的一致性,旨在解决以往AI生图中“改一处坏全身”及指令理解模糊的痛点。
核心功能升级
- 性能与画质提升:
- 速度优化:相比 Images 2.0,生成延迟最多降低 50%,显著减少等待时间。
- 质量档位:在保持最高3840px分辨率的基础上,新增 xhigh 和 max 质量档位,进一步改善细节、材质纹理、光照效果及主体保真度。
- 交互式编辑能力:
- 图片批注修改:用户可直接在图片上圈选特定区域并添加文字指令(如“换成黑框眼镜”),AI能精准识别修改位置,无需冗长的文本描述。
- 草图参考:支持直接上传手绘草图作为视觉参考,结合风格与细节描述生成完整图像,解决构图构思阶段缺乏参考图的难题。
- 多轮编辑一致性:增强了长对话中的上下文记忆能力,确保在多轮修改(如换背景、改排版、抠细节)过程中,已确认的内容和画质保持稳定,避免反复修改导致画面崩坏。
开发者API与支持
OpenAI同步发布了两个面向开发者的API模型版本,采用相同的Token计费标准(文本输入$5/百万tokens,图像输入$8/百万tokens,图像输出$30/百万tokens):
- GPT-Image-2.5 Flare:平衡质量、编辑能力与速度,适用于社交内容、快速原型设计及大批量生图场景。
- GPT-Image-2.5 Sunburst:针对精细创作需求,如广告素材、产品图片及对画质要求极高的视觉内容。
实际表现与评价
- 优势:在电商换装、旅行海报制作等复杂场景中,人物主体特征保留较好,光影与材质(如皮革褶皱、立体感)表现扎实;批注功能大幅降低了操作门槛,使AI生图更接近传统“修图”工作流。
- 局限:部分测试显示,虽然整体细节提升明显,但在处理人物肢体比例或复杂阴影变化时仍可能出现瑕疵(如影子轮廓未随衣物改变而平滑过渡);手绘草图在比例关系上偶尔会出现偏差。
总体而言,Images 2.5通过强化可控性和编辑稳定性,推动AI图像生成从单纯的创意发散工具向可信赖的生产力工具演进。
