Open AI官网首发提示词教程,教你玩转GPT Image 2.5

0 评论 222 浏览 1 收藏 23 分钟

GPT Image 2.5 上线,生图能力再突破。本文结合官方指南与实测,拆解手绘角色、带字海报、照片换装、线稿转写实、界面生成五大玩法,手把手教你写提示词、调结果,让设计师和产品经理都能快速上手。

最近,GPT Image 2.5 上线,又刷新了生图大模型的天花板。看着这次展示的效果,很难不调侃一句,设计师离失业又近了一步

手绘插画、带字海报、照片换装,这次有不少值得试试的玩法。我自己用下来,比较有感的是手绘画图,也想借这次更新,把它的使用方法好好梳理一遍

我也第一时间找到了 OpenAI 官网的 Image prompting 使用指南。这篇文章就结合官方教程和自己的使用体验,挑几个有意思又实用的场景,把提示词和对应的生成图片放在一起,讲清楚该怎么描述需求、怎么修改结果,让大家看完就能拿自己的想法试一试

图 01|OpenAI Image prompting 使用指南页面截图

01 先画一个手绘角色,再让故事接着发生

OpenAI 将 Sunburst 定位为画质优先,将 Flare 定位为速度优先,两者都支持图片生成和编辑。

想给自己的小故事配图,可以从下面这个水彩风格的森林小英雄开始。先把角色定下来。绿色兜帽上衣、棕色靴子和小腰包,是辨认他的外貌特征;保护森林里的小动物,则交代了他会做什么。画风也往下写了一层,水彩质感、柔和轮廓、温暖的大地色,都比单独一个手绘更具体

第一轮,画出主角

创作一张儿童绘本插图,介绍主角。

角色:一位年轻的童话风格森林小英雄,灵感来自小小的森林侠客。穿简洁的绿色兜帽上衣、柔软的棕色靴子,带一个小腰包。表情友善,眼神温和,勇敢又亲切。带一把小木弓,只用于帮助别人,绝不用于伤害。

主题:他保护和救助松鼠、小鸟、兔子等森林小动物。

风格:儿童绘本插画,手绘水彩质感,轮廓柔和,温暖的大地色,充满童趣、亲切友好。采用适合绘本的比例,头部略大,面部表情丰富。

约束:原创角色,不使用受版权保护的现成角色。不出现文字和水印。使用简单的森林背景,让人物清楚地呈现出来。

图 02|通过 ChatGPT 图片入口生成的手绘森林小英雄

主角有了,再换场景。把第一张图作为下一轮输入,让他到冬天的森林里帮助被倒木困住的松鼠。动作和环境可以变,绿色兜帽、五官与身体比例需要沿用

第二轮,沿用角色继续故事

沿用同一个角色,继续这个儿童绘本故事。

场景:冬季暴风雪过后,同一位森林小英雄正在温柔地帮助一只受惊的松鼠,从倒下的树木中脱困。角色跪在松鼠旁边,安抚它。

角色一致性:保留同样的绿色兜帽上衣、五官、身体比例和配色。延续温和、勇敢的性格。

风格:儿童绘本水彩插画,柔和光线,积雪覆盖的森林环境,温暖、令人安心的氛围。

约束:不要重新设计角色。不出现文字和水印。

图 03|通过 ChatGPT 图片入口生成的连续角色雪地救援图

对照两张图,绿色森林变成了雪地,人物伸手去帮助松鼠,绿色服装、棕色头发和水彩质感仍然能联系起来

换成自己的故事,先替换第一轮的人物设定。满意的主角图要单独保存,后面每页都带上它,并对照脸型、发型和衣服检查是否还是同一个人

02 做一张带字海报,把文案也写进提示词

活动海报上,标题、日期和地点需要准确呈现,确定的文案应当随画面需求一起交给模型

官方示例是一张街头服饰广告,品牌名设为 Thread。画面是一群朋友相聚,面向年轻街头服饰受众。英文标语也给出了原文,并要求只出现一次、清晰可读,融入广告版式

为名为 Thread 的品牌创作一张有当代文化气息的广告或时尚摄影图。

这是一个时髦的年轻街头品牌。画面是一群朋友相聚,标语为“Yours to Create.”。

画面面向年轻街头服饰受众,呈现成熟广告作品的感觉:时髦、当代、有活力,而且有品位。

使用干净的构图、明确的色彩方向、自然的姿势和高品质时尚摄影的视觉特征。

标语必须恰好出现一次,清晰可读,并融入广告版式。

不要增加额外文字、水印或无关标志。

图 04|通过 ChatGPT 图片入口生成的 Thread 街头服饰海报

这张图把品牌名和标语分成上下两层,放在较为空旷的天空区域。朋友们占据画面下方,文字没有挤进复杂的衣服纹理里

需要准确出现的文案,直接给原文。在提示词里用引号标明文字内容,再说明出现次数和排版要求。这里的英文标语连最后的句号都已经给出,拿到结果后可以逐字对照

做自己的活动海报时,把标题、日期和地点按用途排好,说明哪段最醒目、哪段放在便于阅读的位置。文案太多就先删。活动介绍、详细规则和联系方式都挤进一张图,会让小字难读,也增加逐项核对的负担

生成后把所有文案单独读一遍。日期、金额、品牌名要重点核对,错了就指出具体哪几个字需要修改,并说明其余文案和布局保持不变。如果工具提供画质选项,小字或多字体场景也可以比较较高画质下的结果

03 给照片换一套衣服,把要保留的部分也说清楚

想看几件衣服搭在一起的样子,可以同时上传人物照片和服装参考图。先给图片分工。我按官方示例的图片分工重新生成了一张人物参考图和三张单品图。人物照片负责提供相貌、姿势和博物馆场景,衣服款式则看对应单品图

图 05|通过 ChatGPT 图片入口生成的米色外套参考图

图 06|通过 ChatGPT 图片入口生成的白色背心参考图

图 07|通过 ChatGPT 图片入口生成的灰色长靴参考图

把脸、肤色、体型和姿势列为保留项,背景与取景也同样交代,明确这次只替换服装

衣服还要适应原来的姿势。抱臂时袖子需要弯折,靴子要跟随腿部角度。提示词还要求布料表现自然,并匹配原图的光线和阴影

编辑人物照片,让图中的女性穿上提供的服装参考图中的衣服。

不要以任何方式改变她的面容、五官、肤色、体型、姿势或人物身份。准确保留她的相貌、表情、发型和身体比例。

只替换服装,让衣物自然贴合她已有的姿势和身体结构,呈现真实的布料表现。

匹配原照片的光线、阴影与色温,让服装自然融入照片,不要像贴上去的。

不要改变背景、拍摄角度、取景范围或画质,也不要添加配饰、文字、标志或水印。

人物参考图与自有预览结果,检查服装变化与人物细节

图 08|通过 ChatGPT 图片入口生成的博物馆人物参考图

图 09|通过 ChatGPT 图片入口生成的服装风格人像

结果里,浅色毛衣、黑裤子和白鞋换成了另一套搭配,抱臂、双腿交叉的姿势仍然能和人物参考图对应。这是自有素材的风格预览,不是把同一张人物原图上传后得到的严格身份保持结果

检查时先放大脸部和手部,看看有没有被顺带改动;袖口、靴口和衣服边缘也要能接得上

自己的原图要能看清脸部、姿势和衣着。如果这次只换外套,就把内搭、裤子和鞋都列为保留项。这类图适合预览颜色和款式,实际尺码是否合身、面料穿着是否舒服,仍要看商品信息或试穿

04 把简单线稿变成有照片质感的画面

文字说不清构图时,先画几笔

真正作为输入的草图,不需要画成完成的线稿。山、河流、太阳和右侧的大树先占住位置,线条粗细不一、比例略松,模型就能据此理解构图。我把这一步改成了一张低完成度的手绘示意,删掉了精细阴影和装饰细节。下面的写实图沿用同一组构图描述,用来说明草图与提示词各自负责什么,实际操作时应把草图作为输入图上传

图 10|低完成度手绘山谷草图,本地绘制的输入示意

草图提供位置,文字说明处理方式。这里要求的是照片质感。提示词仍然写上保留布局、比例和透视,把允许模型补充的内容放在材质与光线上

把这张画转成具有真实照片质感的图像。

精确保留原有布局、比例和透视。

选择符合草图意图的真实材质和光线。

不要添加新的元素或文字。

图 11|通过 ChatGPT 图片入口生成的山谷写实画面

现有写实图补出了积雪、岩石和草地的材质,低处的阳光在水面形成反光。它是按同一组文字描述独立生成的结果,没有上传上面的新草图,因此只能作为风格参考,不能算作这张草图的实测转写结果

真正做草图转写实时,要把草图和这段提示词一起上传,再对照主体位置、画幅和透视是否保留。当前这组素材先把输入要求讲清楚,实测结果需要补做

自己照着操作时,先确定最终需要横图还是竖图,草图尽量按这个画幅来画。工具如果提供尺寸选项,就选与草图相符的比例。出图后对照主体的位置和大小,偏移明显的地方再指出来修改

如果对山谷里的光线有明确想法,就补充太阳的位置和照射方向,出图后再检查山体阴影与水面反光是否一致

05 有个应用想法,先生成一张界面图

做小程序或小工具时,可以先用一张首页图讨论内容和布局。官网示范了一个本地农夫市集应用。用户打开它,要能查到今天有哪些摊主,并看到商品小图和分类。特价、地点和营业时间也各有位置

写这类提示词,先把页面内容交代具体。内容确定后,再说明白色背景、自然色点缀和清楚的文字等视觉要求。官网还要求把界面放进手机边框,便于看出它是一个移动应用的设计图

为一个本地农夫市集创作逼真的移动应用界面效果图。

展示今天的市集,包括简洁的页头、一小段附有缩略图和分类的摊主列表、一个小型“Today’s specials”今日特价区域,以及地点和营业时间等基本信息。

设计要实用、易用。白色背景,以自然色作轻微点缀,文字清楚,尽量少用装饰。

它应该像一个真实、设计良好且美观的本地小型市集应用。

把界面效果图放在 iPhone 手机边框里。

图 12|通过 ChatGPT 图片入口生成的农夫市集应用界面

图里每个摊主都配了商品小图,名称和类别分成两行,便于逐个浏览。今日特价被放进浅绿色区域,和上面的列表区分开;地址与营业时间则排在页面下方

换成自己的项目时,把内容按希望的阅读顺序写出来。比如最希望用户先看到营业信息,就明确要求把它放在顶部。生成后把效果图缩到手机上实际浏览的大小,检查小字是否读得清楚,重要内容有没有被挤到角落

图中的商家、价格和地址仅为示意,制作自己的页面时要替换为真实资料,并逐项核对。搜索、摊主详情和地图入口如何工作,还需要在后续交互设计和开发中落实

06 把商品单独提取出来,保存成透明图片

做商品海报或演示文稿时,先把产品从照片里单独提取出来、保存成透明图片,之后就能放到新的底色上继续排版

我先生成一张带有 BOTANICA 标签的洗发水产品图,再把它作为抠图输入。目标是移除周围场景,保留瓶身形状和标签。提示词只允许轻微润饰,并明确不要新增背景、阴影或棋盘格

图 13|通过 ChatGPT 图片入口生成的洗发水产品原图

从输入图片中提取产品,把它单独放在完全透明的背景上。

输出要求:产品居中,轮廓清晰,没有光晕或边缘杂色。

精确保留产品的几何形状和标签可读性。

只做轻微润饰,不要添加纯色背景、棋盘格、场景或阴影。

不要重新设计产品,只移除背景,保留干净的 alpha 透明通道。

图 14|通过 ChatGPT 图片入口编辑生成的透明产品图

结果文件里有真实的透明区域。产品细节仍要对照原图。瓶盖、瓶身轮廓和标签文字都应检查,避免移除背景时一并改掉产品特征

官方示例在提示词之外,还通过 API 开启了透明背景,使用其他工具时先确认它支持透明输出。下载时保留带透明通道的 PNG 或 WebP 文件,另存成 JPG 会失去透明信息

把文件放到新底色上看一次。深色、浅色都试一遍,观察产品周围能否透出底色,再放大检查瓶盖边缘和瓶底有没有白边、漏抠或残影。如果灰白棋盘格也跟着图片盖住底色,保存下来的文件里就包含了格子图案,需要重新检查透明输出

图 15|透明背景检查方法,文章整理示意

后续继续修改这张图时,也把保留透明背景的要求带上,避免下一轮又加回场景或底色

07 提示词怎么写,出图后怎么改

把前面的提示词当作起点,替换人物、商品和用途。官网的提示词原则建议先定义需要的结果,再描述主体、构图和具体细节。编辑任务还要单独写明修改范围

图 16|提示词需要交代的五类信息,文章整理示意

下面这份填空模板根据这些原则整理,填入已经明确的要求,没有涉及的项目可以删掉

用途:这张图用于【具体用途】,主要给【目标读者】看。

画面:主体是【人物或物品】,正在【做什么】,周围环境是【场景】。

构图:使用【横版、竖版或方图】,主体放在【位置】,为【需要的内容】预留空间。

风格:采用【水彩、写实摄影等风格】,配色为【颜色】,光线从【方向】照来。

文字:准确呈现【完整文案】,放在【位置】,不要增加其他文字。

参考图:图一用于【具体用途】,图二用于【具体用途】。

限制:必须保留【关键细节】,不要出现【不需要的内容】。

风格和细节尽量写成能在画面里辨认的东西。前面森林小英雄的绿色兜帽、棕色靴子,就能直接用来对照角色是否延续。需要人物做动作时,把手放在哪里、眼睛看向哪里也说清楚

第一张图出来,先看主体和布局。保存较满意的版本,把它作为下一轮输入,一次集中修改一个明确的问题。修改时重申需要保留的细节,可以使用下面这段根据官网方法整理的模板

以上一张图为基础,只修改【具体对象或区域】。

把【当前状态】改成【目标状态】。

保留【人物外貌、产品形状、文字、构图等需要保留的细节】。

不要改动其他区域。

每次修改后,把结果和上一版放在一起看。除了确认这次的问题有没有解决,也检查原本满意的部分是否被带着改了。某个版本开始偏离原图,就回到较满意的一版,重新说明要改的地方

如果使用的工具提供画质选项,可以固定提示词、参考图和尺寸,只调整画质档位来比较结果。每次改变一个条件,方便判断这次调整有没有帮助,达到自己的使用要求后再比较生成速度

满意后,把最终图片、使用过的参考图和提示词一起保存,下一次延续同一个角色或同一套风格时,就从这组素材继续修改

本文由 @AI陆小凤 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自Unsplash,基于CC0协议

更多精彩内容,请关注人人都是产品经理微信公众号或下载App
海报
评论
评论请登录
  1. 目前还没评论,等你发挥!