OpenAI 于 2026 年 9 月 8 日发布 ChatGPT Images 2.5。它不是单纯把图片“画得更漂亮”的小更新,而是同时改动了生成速度、参考图保真、局部编辑和创作入口:用户既可以继续用文字描述,也可以直接画草图、在图片上留下批注,或从常用设计模板开始创作。

官方称,Images 2.5 相比 Images 2.0 最多可降低 50% 的生成延迟,并在自然光照、材质纹理、参考对象识别和连续编辑方面有所改善。它正向 ChatGPT、ChatGPT Work 与 Codex 的所有档位滚动开放,覆盖桌面端、移动端和网页端;“滚动上线”意味着同一天内不同账号或客户端看到入口的时间可能并不一致。
Images 2.5 主要改善了哪些生图环节
参考图中的人物和物件更不容易走样
参考图生图真正困难的地方,通常不是换背景或换风格,而是换完以后还能不能认出原来的人、宠物或产品。OpenAI 将这次更新的一项重点放在参考对象保真:在改变场景、构图与视觉风格时,模型更有机会保留人物姿态、面部特征和对象的辨识点,光照与纹理也会更接近真实环境。

图片来源:OpenAI 官方发布页;左侧为参考照片,右侧为换装后的生成结果。
这类改进对头像重绘、商品视觉、角色设定和品牌系列图尤其重要。它减少的是“每次改图都重新抽卡”的概率,并不等于所有身份细节都能百分之百锁定。涉及真实人物、商标或商业素材时,仍需要逐张核对结果。
局部修改与多轮编辑更强调“只改指定部分”
Images 2.5 的精准编辑目标,是修改一个产品、背景或文案元素时,尽量保留周围的主体、构图和品牌处理。较长对话中的后续编辑也会更好地继承前面已经确认的改动,降低画质随着轮次增加而持续退化的情况。
这并不等同于 Photoshop 那种可见图层、蒙版与非破坏性工程文件。ChatGPT 仍然生成一张新的结果图,用户需要检查文字、手部、边缘、品牌元素以及没有要求改变的区域。第三方作者 aiwarts 的对比观察也把“一致性”和“多轮修改”列为最明显的变化,但这属于个别案例,不应当替代具体任务中的验收。
复杂版式、风格和透明背景得到加强
官方还提到,Images 2.5 能更好地理解复杂视觉指令,处理包含现实信息的画面、较复杂的版式与透明背景,并在指定风格下减少方向漂移。这对海报、信息图、UI 概念图、商品展示和系列化素材都有直接价值。不过,透明背景或文字排版是否合格,仍应以导出的实际文件和缩略图检查为准。

图片来源:OpenAI 官方发布页。该案例同时包含演示文稿页面层级、说明文字、流程图标与主题图片,用来展示复杂信息版式能力。
原生透明背景可以直接交付 PNG
透明背景是这次更新里很实用、但容易被忽略的一项能力。你提供的实测截图记录了一个 1024×1024 的 PNG 输出,文件格式为 RGBA,alpha 范围为 0–255;杯子周围的棋盘格对应透明区域,核验结果也明确写着“没有绿幕或后期抠图”。这意味着商品图、贴纸、图标或海报元素可以直接叠加到其他背景上,少走一道手动抠图流程。

图片来源:用户提供的 ChatGPT Images 2.5 实测截图。截图中的核验结果属于这一次具体导出;实际使用时仍应打开导出的 PNG,确认确实为 RGBA 并存在有效 alpha 通道,不能只凭预览棋盘格判断。
Sketch、图片批注和模板改变了控制方式
Sketch 让草图成为提示的一部分
Sketch 允许用户直接在 ChatGPT 中画出房间布局、服装轮廓或简单涂鸦,再补充想要的风格和细节,由模型将这张粗略草图转成完整图片。官方给出的入口方式是在 ChatGPT 中输入 @Sketch。草图不需要精细,它的价值是把位置、轮廓和大致关系变成视觉约束,省去一部分很难用文字讲清楚的空间描述。
新版本还支持直接在图片上放置评论,用批注指出希望修改的局部。与“把右上角第二个人旁边的物体换掉”这类容易产生歧义的文字相比,位置明确的批注更适合精修。它仍然需要一句清楚的修改要求,但用户不必再用很长的方位描述告诉模型“改哪里”。
模板负责提供起点,提示词分享负责复用方法
模板面向海报、周边和产品照片等常见创作格式。选择模板以后,用户再补充要传达的信息、设计元素和风格,而不是从空白对话开始组织整套提示。模板解决的是结构起点问题,不代表同一模板会自动生成相同质量的结果。

图片来源:OpenAI 官方发布页。九宫格把标题字、几何图形与统一色板组合在同一系列中,可同时观察文字清晰度、版式变化和风格一致性。
图片分享也新增了可选的提示词附带功能。接收者可以在原思路上换成自己的照片与细节继续生成。这比只分享成品更接近“可复用的创作配方”,但分享前要检查提示词里是否包含姓名、客户信息、未公开项目或其他不适合公开的内容。
Flare 与 Sunburst:API 侧是两种不同取舍
ChatGPT 中的产品名称是 ChatGPT Images 2.5;开发者在 API 中看到的是两个独立模型,不能把三者当成同一个型号名称。
| API 模型 | 官方定位 | 更适合的任务 | 主要取舍 |
|---|---|---|---|
gpt-image-2.5-flare |
快速、高质量的日常图片生成,官方建议作为多数应用的默认选择 | 社交内容、商品体验、视觉搜索、快速原型和大批量生成 | 相比 GPT-Image-2 提供更高画质,并将延迟降低 50% |
gpt-image-2.5-sunburst |
更强调图片生成与编辑能力的高精度模型 | 成品广告、精修商品图和需要连续精准编辑的工作流 | 控制更细,但生成时间更长 |
两者都接受文字和图片输入,并输出图片;可用于 Image API,也可作为 Responses API 的图片生成工具模型。API 按用量单独计费,价格、限额和可用层级可能变化,接入前应以模型页与控制台显示为准。
现在谁能用,入口在哪里
截至 2026 年 9 月 9 日核对时,Images 2.5 正在向 ChatGPT、ChatGPT Work 与 Codex 的所有档位滚动上线,平台包括桌面端、移动端和网页端。没有立即看到 Sketch、模板或图片批注入口,不足以证明账号不支持;先更新客户端、重新进入图片创作入口,并等待滚动开放通常更合理。
普通用户可以从 ChatGPT 的图片创作入口开始,也可以直接调用 @Sketch。开发者则需要在 Images API 或 Responses API 的图片生成工具中明确选择 Flare 或 Sunburst。ChatGPT 订阅权益与 API 计费是两套体系,拥有 ChatGPT 订阅不等于 API 调用免费。
提示词没有失效,只是不再承担全部控制工作
第三方文章把这次变化概括为:过去需要塞进提示词的部分约束,现在可以通过草图、模板、图片批注和连续编辑来表达。这个判断基本符合产品方向,但“好提示词不再重要”说得过头了。
当任务涉及准确文字、品牌语气、多个主体关系、镜头、材质、禁用项或不可改变的细节时,清楚的文字仍然不可替代。更准确的说法是:提示词从唯一控制界面,变成了文字、草图、模板和局部批注共同组成的一层。对普通创作,这会降低起步门槛;对专业工作流,则意味着可以把不同类型的约束放到更合适的交互方式里。
Images 2.5 继续使用提示词与图片检查,并通过 C2PA 元数据和不可见水印帮助识别由 OpenAI 工具生成的内容。这些标识并不替代版权、肖像权、商标和隐私审查。上传真实人物、客户素材或未公开产品图前,仍应确认授权与数据处理边界。
官方入口与参考资料
OpenAI 发布页:https://openai.com/index/introducing-chatgpt-images-2-5/
GPT-Image-2.5 Flare 模型页:https://developers.openai.com/api/docs/models/gpt-image-2.5-flare
GPT-Image-2.5 Sunburst 模型页:https://developers.openai.com/api/docs/models/gpt-image-2.5-sunburst
第三方实测参考:https://x.com/aiwarts/status/2097486484588872156













暂无评论内容