OpenAI 发布 GPT Images 2.5:强化精准编辑与 Sketch 手绘功能

2026/09/09 18:37阅读量 3

OpenAI 正式发布新一代图像生成模型 ChatGPT Images 2.5,重点提升了图片细节质量、生成速度及多轮修改的一致性。新模型增强了针对单一元素的精准编辑能力,并新增 Sketch 手绘参考、创作模板及图片评论编辑等功能,旨在让 AI 创作流程更贴近专业设计工作流。目前该模型已向 ChatGPT 用户开放,并提供面向开发者的两个 API 版本。

事件概述

OpenAI 突发上线新一代图像生成模型 ChatGPT Images 2.5。官方表示,新模型在图片细节质量、生成速度、编辑精度以及多轮修改过程中的一致性方面均有显著提升。目前,用户每周通过 ChatGPT Images 和 API 中的 GPT Image 系列模型生成超过 30 亿张图片。

核心升级点

1. 精准的局部编辑能力
相比上一代 Images 2.0,Images 2.5 最大的变化在于对“修改”指令的理解能力提升。过去 AI 绘图在调整细节时容易误改其他部分(如修改服装导致脸部变化),而新版本能够准确执行用户指定的修改,同时保留原有主体、构图和视觉风格。用户可以针对产品、背景、文字等单个元素进行调整,无需重新生成整张图片。

2. 增强的人物与风格保持能力

  • 人物特征保留:在改变摄影风格、服装和环境的同时,能让人物身份保持较高一致性,解决以往容易出现的人脸变化或比例错误问题。
  • 复杂逻辑理解:能够处理递归画面等复杂视觉嵌套关系(如“猫拿着显示同一只猫的 iPad”)。
  • 艺术风格深化:对黑神话风格、中国连环画等传统插画特征的理解更接近原画质感,而非简单堆叠符号。
  • 中文支持:在中文提示词下的表现依然亮眼。

3. 新增创作辅助功能

  • Sketch 手绘参考:允许用户直接在 ChatGPT 中绘制草图(如房间布局、服装轮廓),作为生成图片的视觉参考,解决文字描述空间关系的难题。该功能也支持 GIF 等动态内容创作。
  • 创作模板:提供海报、商品图片等常见设计场景的模板,用户无需从零开始编写提示词。
  • 图片评论与分享:用户可直接在图片上添加评论指定修改位置,并可分享提示词供他人复用。
  • 进度可视化:生成过程现在可通过数字直观显示进度。

开发者 API 更新

OpenAI 同步推出两个面向开发者的 API 图像模型:

  • GPT Image 2.5 Flare:默认模型,适用于社交内容、电商视觉、视觉搜索等大多数场景。相比前代,图片质量更高,延迟降低 50%。
  • GPT Image 2.5 Sunburst:面向高要求创意工作流程,强调更精细的控制能力,适用于广告素材制作、高端产品设计等场景。

现状与局限

  • 可用性:ChatGPT Images 2.5 已向 ChatGPT、ChatGPT Work 和 Codex 用户开放,覆盖桌面端、移动端和网页端。
  • 已知缺陷:部分测试指出,模型生成的图片仍存在噪点较多的问题;官方展示案例中也存在少量细节瑕疵。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。