# 科技

OpenAI 放出图像新模型:改图只动指定位置,手绘草图也能直接当参考

2026-09-10 23:46 卓科技 👁 13
OpenAI 放出图像新模型:改图只动指定位置,手绘草图也能直接当参考

OpenAI 上线了新一代图像生成模型 ChatGPT Images 2.5。官方给出的升级点集中在四处:图片细节、生成速度、编辑精度,以及多轮修改时的一致性;同时加入 Sketch 手绘参考、创作模板、图片评论编辑等功能,让创作流程更接近专业设计。OpenAI 称,用户每周通过 ChatGPT Images 和 API 中的 GPT Image 系列模型生成的图片已超过 30 亿张。

改图终于能指哪打哪

相比 Images 2.0,2.5 变化最大的地方在于对「修改」的理解。以前 AI 绘图擅长从零画一张图,一旦要动细节就容易连带改坏别处:换衣服可能把脸改了,调背景可能把整体风格带跑。新模型在这方面做了优化,能更准确地执行指定修改,同时保住原有的主体、构图和视觉风格,用户可以只调产品、背景或文字里的某个元素,不必整张重来。

OpenAI 放出图像新模型:改图只动指定位置,手绘草图也能直接当参考

官方展示的案例中,一张普通头像能被改造成复古摄影棚写真,宠物照片也能换成新的视觉主题,同时保留人物与动物的关键特征。我也试了多类任务:要求模型在换风格、换服装、换环境的同时守住参考人物的面部特征,结果身份一致性比上一代更稳;用「马斯克与教父在片场自拍」这类场景测试时,脸部结构、表情、姿态的保持也不容易跑偏。

从递归画面到连环画

它对复杂视觉逻辑的理解也有进步。一道提示词要求「一只橘猫坐在办公室椅子上拿着 iPad,iPad 屏幕里又是同一只猫拿着同一个 iPad,如此循环」,模型能识别这种嵌套关系,把多层递归画出来。产品向测试里,它按要求生成了一只完全由柔软毛绒材质构成的可乐罐。艺术风格上,黑神话风格的画面更接近游戏概念原画,而不是符号的简单堆叠;《三国演义》连环画风格则抓住了黑白线描、淡彩上色、老式纸张质感这些特征。和前代一样,它在中文表达上依旧亮眼。

OpenAI 放出图像新模型:改图只动指定位置,手绘草图也能直接当参考

手绘草图与创作模板

围绕创作流程,ChatGPT 也补上了一批新功能。Sketch 允许用户直接在对话里画草图,把它当作生成图片的视觉参考——随手画出房间布局、服装轮廓或创意草稿,AI 再据此生成完整画面,省掉了用文字描述空间关系、反复改提示词的麻烦。草图同样可用于 GIF 等动态内容。模板功能则让人从海报、商品图这类常见场景起步,选好模板再补文字、风格和要求。此外,用户现在能直接在图片上留言,指定需要修改的位置,也可以分享自己用的提示词,让别人基于同一创意生成各自的版本。

两款 API 模型同步上线

  • GPT Image 2.5 Flare:面向大多数应用场景的默认模型,在质量、编辑能力和速度上都有升级。官方称相比 GPT Image 2 画质更高,延迟降低 50%,适合社交内容、电商视觉、视觉搜索和大规模生成。
  • GPT Image 2.5 Sunburst:面向要求更高的创意流程,强调更精细的控制能力,用于广告素材、高端产品图片等场景。

体验上还有个小变化:生成进度能用数字直观显示,有网友测试时甚至趁生成的空档玩起了贪吃蛇。短板也在,噪点问题依旧被不少人吐槽,有人翻官方展示案例也找到了细节瑕疵。从网友 @aimlapi 的实测看,对上 Nano Banana Pro,Images 2.5 的艺术风格更足。

OpenAI 放出图像新模型:改图只动指定位置,手绘草图也能直接当参考

ChatGPT Images 2.5 现已向 ChatGPT、ChatGPT Work 和 Codex 用户开放,覆盖桌面端、移动端和网页端;API 用户则可调用 Flare 与 Sunburst。它的意义不只是一次版本更新——一个能看懂视觉内容、维持上下文一致、并跟着反馈持续调整的图像模型,本身也是 AI 理解世界的一部分。

相关阅读

更多 →