GPT Image2.5悄悄上线,靠提示语提升AI生图可控性的时代要过去了
OpenAI 深夜突袭发布 GPT Image 2.5,生成速度、清晰度大幅提升,多轮编辑一致性显著增强,还新增涂鸦绘图与模板功能。本文通过多组对比实测,展示其在 Logo、人物、建筑等场景的升级效果,并探讨交互方式变革如何降低 AI 生图门槛。

来不及解释了
OpenAI不讲武德突然把Image 2.5发出来了,这次更新主打一个生成速度更快,更高清,多次编辑还可以保证一致性,还能标注图片里某几个不满意的地方精确修改。
还有一个新的绘图功能,简单来说就是能让我们想用蜡笔一样现在画布上写写画画,gpt会参考我们给的画面信息来生成图片。


除了GPT Image 2.5本体之外,在API上还发了两个新的图像模型,我称之为中杯和超大杯,中杯GPT-Image-2.5 Flare,在保持Image 2.5同款质量的同时提升了50%处理速度,超大杯GPT-Image-2.5 Sunburst有更高的生成精度但生成时间会更长一点。
还有一个对比效果我觉得巨离谱的,同一个蓝色立方体的150次生成里面,Image2.5的形变少的可怜。以前为了让生成结果稳定,我还要写结构化提示语,还要图生图,还要加各种固定视角固定光照的约束条件,现在模型自己就能做到。

其实还有一个雷霆换装换场景的对比视频来着,但是我看到真的没有绷住,这个人脸有种莫名的喜感。
不过openai居然没有把Image 2.5留到29号的OpenAI DevDay 2026上讲,GPT-6 Astra也刚发,总不能开发日当天视频模型重新复活,或者一口气发五款自己的AI硬件吧。
因为Image2.5用的是滚动上线的策略。所以我需要一个稳定的方式来判断我现在用的是image2还是image2.5,在codex调用图像模型用到的是imagen这个skill,如果你有留意的话,image2是无法直接生成原声透明背景的,但是image2.5把这个明确补充上了,所以一个提示语就可以判断出来是2.5还是2了。
…
用 $imagegen 生成一张 1024×1024 PNG:一只白色杯子,纯透明背景,不要绿幕/抠图,不要白底。生成后告诉我:1) 是否原生 transparent2) 文件路径

在测试更多case之前,我发先这里有一个巨坑,先不要用codex,用网页版chatgpt才能用上新的那些绘图功能,我在codex反复@了十几次sketch,然后又更新又重启都没有生效。

绘制这个画板的功能是很常规了,就是线条,字体,基础的框框和橡皮擦以及常规的颜色切换,我尝试了一下用长方体画了一个牛来,也想看看里面的文字是会保留还是作为对图片生成的补充说明。

从这里的效果上看更像是补充说明。
还有一个模版功能也是让我找了一大轮的,看上去是抢了设计agent的活。


这个功能还是只在chatgpt网页版上有目前,而且直接输入什么海报,logo在对话框是没用的,要我们点左下角加号然后选创建图片才有。

第一批给到的模版有15个,海报、室内设计、Logo、插画、头像照、图标、产品图、周边、信息图、宣传单、书籍封面、App样机图、包装设计、广告图、视频封面。

有模版我就想试试看能不能给我做的AI提示语案例网站goodcase做一个新logo和宣传海报,上次我办了一个线下摊位,结果发现隔壁max的摊位准备了非常多A4大小的物料,最后为了保证清晰度临时用svg做的,没有用生图模型体现出来水平有点小可惜。

切换不同的模版会在对话开头加上不同提示语,同时生成的过程也是会有比没有模版的状态下更详细的配置方案。


最后,轮到从goodcaseai里面挑一些难的case来对比一把gpt image 2.5和原来gpt image2的更新了,提示语是公开的。

先来看看logo类,

左image2右image2.5,下面的都是左右区分
用image2.5基于这个logo做点周边出来也确实是可以做到的。

就是从画面以及构图上看没太大的区别,主要还是在图片的清晰度上能看到image2.5有拉开距离。
再看看人物类,我特意挑了一个给AI视频用的角色身份固定参考图,基本上一个角色所有的细节都会会在这个图里面画出来。
这个是image2做的,

这个是image2.5做的,

这样一对比话,隔壁Grok在同样提示语上写出来的字简直糊到没法看。

为了极限测试,我还在这个图里面标注了几个点,给人物的右眼下方点了一个痣,是一次成功的。
然后看看定格动画类,测这个是因为我看到有人说用image 2.5可以直接做出来一个毛毛虫的动画风格,虽然没有公开工作流但是我有点好奇是不是就是简单生成几十张图然后一帧一帧拼在一起。
按照gpt6给的建议是12张/秒来做定格动画,所以最近大家为了测gpt6有没有降智用的鹈鹕骑单车,我做出来定格版了,还把主角换成了鳄鱼。
定格动画是最能看到模型生成前后物体有没有形变的case之一了,非常带劲。

再就是建筑类的了,用的是@小小东的提示语,还是左边image2,右边image2.5。




最后来几个风格迁移类,我反而是觉得image2.5这次的风格化做得没有image2好,变得更加柔和了点。






最后,再来一个经典的尺寸挑战,让image2.5用1:1,3:4,4:3,9:16,16:9,21:9生成封面图来看看能不能精确控制画面元素。

对image2.5来说简简单单啊。
最后的最后,还有一个小细节,现在做完的图片分享出去还可以带上提示语,openai自己分享一个80年代造型的提示语,我也来凑凑热闹。

我后面还发现分享的不只是提示语本身,openai做成了提示语模版,就拿刚刚的折纸提示语来看,是按照case、风格、场景等等做了二次拆解。

总的来说,Image2.5扩展了玩法和模版,还有一致性和清晰度。多轮对话下来图片还是能保证一致,之前image2我最多只改五轮再改就重新生成了。
真正的变化在交互方式上。
涂鸦让你用画的替代用写的,模版让你跳过从零构建提示语的过程,标注精修让我们用点点替代文字描述,一致性的提升意味着我们不用再往提示语里塞各种稳定性约束。
每一个新功能都在做同一件事,把原来需要写进提示语里的东西,变成更直觉的操作。
提示语当然还有用,复杂场景下精确的文字描述仍然不可替代。
但对大多数人来说,好的提示语不再是用好AI生图的前提条件了。
还有加码,隔壁Nano Banana估计也要更新了,再加上最近那么kuku在用gpt6和blender做3D建模。
测都要测不过来了,发新模型是好事来的,就是能不能别再在睡觉时间发了。。。
测完都天亮了,很困啊很困,还有隔壁DeepSeek还没测呢。
本文由人人都是产品经理作者【卡尔的AI沃茨】,微信公众号:【卡尔的AI沃茨】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。
题图来自Unsplash,基于CC0协议
- 目前还没评论,等你发挥!

起点课堂会员权益



