从草图到大片,再到精准改图,GPT Image 2.5 这次真有点狠

0 评论 134 浏览 0 收藏 11 分钟

OpenAI 新推出的 GPT Image 2.5 带来 Sketch 手绘分镜、图片标注和多轮局部编辑,让 AI 图片从一次性生成变成可反复迭代的创作流程,真正进入可控制的生产力阶段。

OpenAI 又突然更新了。

这次是 GPT Image 2.5

更快、更清晰、人物一致性更强,多轮改图也更稳定,同时还加入了 Sketch、Templates、图片标注修改等新的创作方式。

但体验下来,我觉得这次最值得聊的,不是:它又画得更好了。

而是:我们用 AI 做图的方式,正在发生变化。

以前更像是在“生图”。

现在开始有点像真正“做图”了。

为了验证这件事,我直接拿两个自己平时真正会遇到的场景来测试。

第一个:随手画一个分镜,让 AI 直接把它变成电影镜头。

第二个:用我的照片做一张公众号封面,然后一轮一轮继续修改。

随手画一个分镜,直接变成电影镜头

试这次我觉得最好玩的功能:Sketch。

我平时做 AI 视频,经常会遇到一个问题。

脑子里明明已经有画面了,但是很难准确描述出来。

比如我想要这样一个镜头:

一个男人站在天台右侧,背对镜头。左边是城市夜景。远处有一块巨大的广告屏。镜头从人物身后拍过去,人物只占画面一小部分。

这种东西当然不是不能写 Prompt。

真正麻烦的是:人物到底站哪里?占多大?广告牌放在哪?地平线多高?整个镜头空间怎么分?

这些信息如果全部翻译成文字,可能写两百字都不如自己画五秒钟。

所以这次我直接打开 Sketch。

然后随手画了一张极其潦草的分镜。

画成这样,我已经尽力了。

人物就是一个火柴人。

建筑就是几个方框。

左边再画一个广告牌。

核心不是画得好不好,而是把大概的位置和空间关系表达出来。

然后我直接告诉它:

根据我上传的草图生成一个电影感镜头。

严格参考草图中的人物位置、主体大小、建筑分布和画面空间关系,但不要保留任何手绘线条。

场景为雨后的未来城市天台,夜晚。

一名年轻男性背对镜头站在画面右侧,人物只占画面约 20%,看向远处城市。

左侧和背景是高楼与城市灯光,远处有一块巨大的发光广告屏。

地面有雨水反射,空气中有轻微雾气。

电影摄影质感,真实光影,广角镜头,有明显纵深感。

不要赛博朋克元素堆砌,不要夸张霓虹,整体真实克制。

生成结果:

这个效果让我觉得,Sketch 的意义可能比想象中更大。

以前我们和 AI 沟通画面,本质上是在干一件挺别扭的事情:先把脑子里的视觉信息翻译成文字,再让 AI 把文字翻译回视觉。

现在中间这一步开始可以直接省掉。

位置说不清?画。

大小说不清?画。

镜头关系说不清?还是画。

哪怕只是火柴人和几个方框,只要把空间关系表达清楚,AI 就可以继续把画面完成。

对于 AI 视频创作者来说,这个能力尤其有意思。

以后做分镜可能不一定需要先给每个镜头写一大段复杂 Prompt。

完全可以变成:剧本 → 手绘分镜 → AI 生成关键帧 → 视频模型生成镜头。

以前是:用文字描述镜头。

以后可能越来越像:直接设计镜头。

再来一个我每天都会遇到的真实需求

Sketch 解决的是:怎么把脑子里的画面告诉 AI。

接下来我更想测试另外一个问题:第一张图出来以后,到底还能不能继续改?

这才是过去 AI 生图最让我头疼的地方。

所以这次我直接拿自己最高频的需求来测试:做一张公众号封面。

我先上传自己的一张照片。

只给了一个很简单的需求:

使用我上传的人物照片,制作一张介绍「GPT Image 2.5」的公众号封面。

整体简洁、高级、有科技感。

人物放在画面右侧,保持本人真实五官和身份特征。

左侧留出标题区域,核心视觉突出 GPT Image 2.5。

不要做成电商海报,4:3 横版。

生成效果:

第一版其实已经可以用了。

但今天单张图生成得漂亮,已经没那么稀奇。

真正的问题是:能不能继续改。

过去最抓狂的情况就是:第一张好不容易满意了。

然后你告诉它:“把人物往右移动一点。”

结果它直接给你换了个人。

你再说:“把衣服上的 Logo 去掉。”

结果背景、五官、构图一起变了。

所以我继续改。

第一轮,我告诉它:

保持人物长相、表情、服装、背景和其他内容不变。

只把人物整体向右移动,给左侧标题留更多空间。

除人物位置之外,不要重新设计画面。

接着把衣服上的 Logo 去掉:

只删除衣服上的 Logo。

保持衣服颜色、材质、褶皱以及人物其他部分不变。

除了通过提示词修改,还支持是另一种改图方式:

直接在图片上标出来。

点击图片进入详情页面上方可以看到有标注和评论功能。

比如我直接画出修改的指定区域并备注。

生成结果:

连续几轮下来,一个明显的感受就是:

它开始更能理解“我只让你改这个地方”。

官方这次也专门强化了精准编辑,以及连续多轮修改时的细节一致性:

改变场景、风格或者构图时,尽可能保留原图中的其他信息。

这件事看起来可能没有那么炸裂。

但真正拿 AI 做设计的时候,其实特别重要。

因为绝大多数真实需求都不是:

重新帮我画一张

而是:

这一版已经很好了,再帮我改一点。

过去 AI 生图更像“抽卡”。

不满意,就重新生成。

现在则开始有点像真正做设计:先有第一版,再在第一版上继续工作。

这才是我认为 GPT Image 2.5 很关键的一次变化。

它不只是更会“生成”。

而是开始更会“修改”。

最后

体验下来,我觉得 GPT Image 2.5 这次其实发生了两件事。

第一件事是:模型本身更强了。

更快、更清晰,参考人物保持得更好,连续改图也更稳定。

Sketch 让你直接把构图画出来,Templates 帮你跳过从零开始,图片标注让你直接指出哪里有问题,再加上更精准的局部编辑和多轮一致性,这些能力开始真正连成了一套工作流。

以前做 AI 图片更像:写 Prompt → 生成 → 不满意 → 再生成。

现在越来越像:想法 → 草图 → 第一版 → 修改 → 局部调整 → 最终成品。

这意味着以后想用好 AI 生图,可能越来越不需要先成为一个“提示词专家”。

说不清楚的,直接画。

哪里不满意,直接指出来。

第一版不够好,就继续改。

所以如果一定要总结 GPT Image 2.5 这次真正做成的一件事,我觉得就是:它开始把“生图”,变成了“做图”。

第一张图不再是终点,而只是创作的开始。

而这可能才是 AI 图片真正进入生产力阶段的标志。

感谢你读完。

很高兴与你相遇,我们下期见。

本文由人人都是产品经理作者【陈宇明】,微信公众号:【码个蛋】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。

更多精彩内容,请关注人人都是产品经理微信公众号或下载App
海报
评论
评论请登录
  1. 目前还没评论,等你发挥!