ChatGPT 图片模型升级 2.5:出图快一倍,能看懂手绘草图

OpenAI 于 9 月 8 日推出 ChatGPT Images 2.5,这是该公司图像生成模型的一次重要迭代,主打更锐利的细节、更精准的编辑和更快的生成速度,同时新增了手绘草图输入、模板、图片批注等创作工具。

官方披露的数据显示,目前用户每周通过 ChatGPT Images 和 API 中的 GPT-Image 系列模型生成的图片数量已经超过 30 亿张。在这一体量下,迭代重点从”能不能生成”转向了”能不能稳定地改到满意”。

延迟最多降低一半

相比上一代 Images 2.0,Images 2.5 的图像生成延迟最多降低 50%。对需要反复试错的设计流程来说,等待时间减半意味着单位时间内的尝试次数明显增加。

画质方面,官方称新模型的光照更自然、纹理更丰富,对参考照片中主体的还原度更高——人物、宠物这类”必须像”的对象,在新场景下依然能保持可辨识的特征。

只改想改的地方

精准编辑是这次升级的核心。Images 2.5 更倾向于只修改用户指定的部分,而保留画面其余细节,即便主体和背景比较复杂也是如此。

多轮编辑的一致性同步改善。在较长的对话中,模型对连续多次编辑指令的遵循更可靠,先前的修改更不容易被后续操作覆盖,图像质量也不会随着轮次增加而明显衰减。这对需要按品牌规范批量产出素材的团队尤为关键。

模型对复杂视觉指令的理解能力也有所提升,包含现实世界信息的图片内容更准确,能处理透明背景等更复杂的版面,对指定艺术风格的还原度更高。

新增 Sketch、模板与图片批注

创作工具层面,OpenAI 引入了 Sketch 功能。用户可以在 ChatGPT 中直接绘制草图作为参考——房间布局、服装轮廓或随手涂鸦都可以,再配合文字描述风格与细节,由模型生成完整图像。在对话框输入”@Sketch”即可调用。

此外,模板功能覆盖海报、商品图等常见图片格式,帮助没有明确思路的用户快速起步;用户可以直接在图片上添加批注,指向需要修改的局部;生成使用的提示词也能分享出去,让其他人用自己的照片和细节复现同样的效果。

Images 2.5 面向所有 ChatGPT、ChatGPT Work 和 Codex 用户开放,覆盖桌面端、移动端和网页端。

开发者侧:两个模型分工明确

面向开发者,API 新增两个模型。GPT-Image-2.5 Flare 承接了画质、编辑和速度方面的全部改进,被定位为大多数应用的默认选择,延迟约为上一代模型的一半,适合创作者内容、产品体验、视觉搜索、快速原型和高并发生成。

GPT-Image-2.5 Sunburst 则面向对精度要求更高的专业视觉工作流,例如可直接投放的广告创意或精细产品图,代价是生成时间更长。据 OpenAI 定价文档,两个模型的按 token 计费标准一致。

Adobe、Manus 和 Higgsfield AI 等早期用户已经开始在自家产品中测试这两个模型。

在安全层面,新模型延续了此前的溯源与安全措施,包括 C2PA 内容凭据和谷歌 DeepMind 的 SynthID 隐形水印,发布前也经过了针对图像模型的安全评估。

从竞争环境看,谷歌 Gemini、Midjourney 等对手近几个月同样在加速迭代图像编辑能力。OpenAI 把速度和可控性作为这次的突破口,意图很明确:让用户留在 ChatGPT 内部完成生成与修改,而不是切换到独立的设计工具。