从草图到大片,再到精准改图,GPT Image 2.5 这次真有点狠
OpenAI 新推出的 GPT Image 2.5 带来 Sketch 手绘分镜、图片标注和多轮局部编辑,让 AI 图片从一次性生成变成可反复迭代的创作流程,真正进入可控制的生产力阶段。

OpenAI 又突然更新了。
这次是 GPT Image 2.5。
更快、更清晰、人物一致性更强,多轮改图也更稳定,同时还加入了 Sketch、Templates、图片标注修改等新的创作方式。
但体验下来,我觉得这次最值得聊的,不是:它又画得更好了。
而是:我们用 AI 做图的方式,正在发生变化。
以前更像是在“生图”。
现在开始有点像真正“做图”了。
为了验证这件事,我直接拿两个自己平时真正会遇到的场景来测试。
第一个:随手画一个分镜,让 AI 直接把它变成电影镜头。
第二个:用我的照片做一张公众号封面,然后一轮一轮继续修改。
随手画一个分镜,直接变成电影镜头
试这次我觉得最好玩的功能:Sketch。
我平时做 AI 视频,经常会遇到一个问题。
脑子里明明已经有画面了,但是很难准确描述出来。
比如我想要这样一个镜头:
一个男人站在天台右侧,背对镜头。左边是城市夜景。远处有一块巨大的广告屏。镜头从人物身后拍过去,人物只占画面一小部分。
这种东西当然不是不能写 Prompt。
真正麻烦的是:人物到底站哪里?占多大?广告牌放在哪?地平线多高?整个镜头空间怎么分?
这些信息如果全部翻译成文字,可能写两百字都不如自己画五秒钟。
所以这次我直接打开 Sketch。

然后随手画了一张极其潦草的分镜。
画成这样,我已经尽力了。

人物就是一个火柴人。
建筑就是几个方框。
左边再画一个广告牌。
核心不是画得好不好,而是把大概的位置和空间关系表达出来。
然后我直接告诉它:
根据我上传的草图生成一个电影感镜头。
严格参考草图中的人物位置、主体大小、建筑分布和画面空间关系,但不要保留任何手绘线条。
场景为雨后的未来城市天台,夜晚。
一名年轻男性背对镜头站在画面右侧,人物只占画面约 20%,看向远处城市。
左侧和背景是高楼与城市灯光,远处有一块巨大的发光广告屏。
地面有雨水反射,空气中有轻微雾气。
电影摄影质感,真实光影,广角镜头,有明显纵深感。
不要赛博朋克元素堆砌,不要夸张霓虹,整体真实克制。
生成结果:

这个效果让我觉得,Sketch 的意义可能比想象中更大。
以前我们和 AI 沟通画面,本质上是在干一件挺别扭的事情:先把脑子里的视觉信息翻译成文字,再让 AI 把文字翻译回视觉。
现在中间这一步开始可以直接省掉。
位置说不清?画。
大小说不清?画。
镜头关系说不清?还是画。
哪怕只是火柴人和几个方框,只要把空间关系表达清楚,AI 就可以继续把画面完成。
对于 AI 视频创作者来说,这个能力尤其有意思。
以后做分镜可能不一定需要先给每个镜头写一大段复杂 Prompt。
完全可以变成:剧本 → 手绘分镜 → AI 生成关键帧 → 视频模型生成镜头。
以前是:用文字描述镜头。
以后可能越来越像:直接设计镜头。
再来一个我每天都会遇到的真实需求
Sketch 解决的是:怎么把脑子里的画面告诉 AI。
接下来我更想测试另外一个问题:第一张图出来以后,到底还能不能继续改?
这才是过去 AI 生图最让我头疼的地方。
所以这次我直接拿自己最高频的需求来测试:做一张公众号封面。
我先上传自己的一张照片。

只给了一个很简单的需求:
使用我上传的人物照片,制作一张介绍「GPT Image 2.5」的公众号封面。
整体简洁、高级、有科技感。
人物放在画面右侧,保持本人真实五官和身份特征。
左侧留出标题区域,核心视觉突出 GPT Image 2.5。
不要做成电商海报,4:3 横版。
生成效果:

第一版其实已经可以用了。
但今天单张图生成得漂亮,已经没那么稀奇。
真正的问题是:能不能继续改。
过去最抓狂的情况就是:第一张好不容易满意了。
然后你告诉它:“把人物往右移动一点。”
结果它直接给你换了个人。
你再说:“把衣服上的 Logo 去掉。”
结果背景、五官、构图一起变了。
所以我继续改。
第一轮,我告诉它:
保持人物长相、表情、服装、背景和其他内容不变。
只把人物整体向右移动,给左侧标题留更多空间。
除人物位置之外,不要重新设计画面。

接着把衣服上的 Logo 去掉:
只删除衣服上的 Logo。
保持衣服颜色、材质、褶皱以及人物其他部分不变。

除了通过提示词修改,还支持是另一种改图方式:
直接在图片上标出来。
点击图片进入详情页面上方可以看到有标注和评论功能。

比如我直接画出修改的指定区域并备注。

生成结果:

连续几轮下来,一个明显的感受就是:
它开始更能理解“我只让你改这个地方”。
官方这次也专门强化了精准编辑,以及连续多轮修改时的细节一致性:
改变场景、风格或者构图时,尽可能保留原图中的其他信息。
这件事看起来可能没有那么炸裂。
但真正拿 AI 做设计的时候,其实特别重要。
因为绝大多数真实需求都不是:
重新帮我画一张
而是:
这一版已经很好了,再帮我改一点。
过去 AI 生图更像“抽卡”。
不满意,就重新生成。
现在则开始有点像真正做设计:先有第一版,再在第一版上继续工作。
这才是我认为 GPT Image 2.5 很关键的一次变化。
它不只是更会“生成”。
而是开始更会“修改”。
最后
体验下来,我觉得 GPT Image 2.5 这次其实发生了两件事。
第一件事是:模型本身更强了。
更快、更清晰,参考人物保持得更好,连续改图也更稳定。
Sketch 让你直接把构图画出来,Templates 帮你跳过从零开始,图片标注让你直接指出哪里有问题,再加上更精准的局部编辑和多轮一致性,这些能力开始真正连成了一套工作流。
以前做 AI 图片更像:写 Prompt → 生成 → 不满意 → 再生成。
现在越来越像:想法 → 草图 → 第一版 → 修改 → 局部调整 → 最终成品。
这意味着以后想用好 AI 生图,可能越来越不需要先成为一个“提示词专家”。
说不清楚的,直接画。
哪里不满意,直接指出来。
第一版不够好,就继续改。
所以如果一定要总结 GPT Image 2.5 这次真正做成的一件事,我觉得就是:它开始把“生图”,变成了“做图”。
第一张图不再是终点,而只是创作的开始。
而这可能才是 AI 图片真正进入生产力阶段的标志。
感谢你读完。
很高兴与你相遇,我们下期见。
本文由人人都是产品经理作者【陈宇明】,微信公众号:【码个蛋】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。
题图来自Unsplash,基于 CC0 协议。
- 目前还没评论,等你发挥!

起点课堂会员权益




