AI都能直接转绘了,用 Skill 会更好看吗?我用GPT和国产模型实测了一下
我拍了很多照片,但回头翻相册总觉得差点意思。刷 X 看到有人分享的风格 Skill,普通照片放进去就变成水彩和手账。于是试了两种做法:一种拿参考图做风格迁移,一种装上 Skill 再调用,分别在 GPT、豆包、千问和 WorkBuddy 里各跑一遍。

我拍了很多照片,但回头翻相册,总觉得自己拍得不太好看。
风景是好看的,饭也挺好吃,怎么到了我的照片里,就差点意思。直接发吧,感觉有点普通,又想看看能不能弄得高级一点。
后来刷 X,看到小小东分享的风格 Skill。普通照片放进去,出来就成了水彩、拼贴、手账,看着确实比原来有意思。
我本来想装几个试试,但又想到:图像模型不是可以做风格迁移吗?
那我直接把他的 Skill 宣传图拿来当参考,再加上自己的照片,让 AI 照着改,不就行了?为什么还要安装 Skill 呢?
说实话,找 Skill、安装,再让工具调用,我觉得有点麻烦。如果发两张图就能解决,那我肯定想选省事的。
但这两种方法做出来,到底有没有区别?装了 Skill,是不是就更能还原宣传图里的设计?
出于这个好奇心,我从相册里挑了一张风景、一张烤肉,分别放到 GPT、豆包、千问和 WorkBuddy 里试了试。一种直接拿参考图做风格迁移,另一种用 Skill,看看多出来的这些步骤,到底值不值得。

01 先拿一张风景试试
先看我拍的原图。蓝天、白云、树林,还有一大片草地。

skill是这种带水彩、纸纹和邮戳的旅行票券,我找了官方的参考图片来做测试。

一种做法,是把这两张图一起发过去,让它照着转换。另一种,是用小小东的xxd-panel-013skill,就是图片这个风格。
下面都按同一个顺序排:左上 GPT,右上豆包,左下千问,右下 WorkBuddy。先看直接迁移。

这么放一起,区别就比较明显了。
GPT、千问和 WorkBuddy 都做出了左边画、右边信息栏的票券。豆包则画成了一整幅水彩,更像明信片,参考图的信息栏没有保留。
但放大看,豆包邮戳、千问信息栏里,还写着布达佩斯。千问连参考图的日期、坐标和编号也留了下来。我的草地怎么就被贴上这个地点了?
GPT 这张没有沿用这些信息,不过这里得说明:助手展开的指令里明确要求不要编日期和地点,不能全算成模型自己的判断。WorkBuddy 换成了草地、林缘的描述,日期则写了本次测试当天的日期,也不能因此就当作拍摄日期。
WorkBuddy 这次还给了英文票券和纯水彩,四宫格里选的是中文版本,不是把三张当作三次测试。
再看 Skill。

这组都变成了上面摄影画面、下面水彩票券,整体形式比迁移组接近。
GPT 的水彩比较明亮,文字也比较完整。但第一版同样编过日期,重新生成才去掉,圆章小字仍有失真,上下也没有严格对半。
豆包的信息栏空得比较多,DATE 和 SUBJECT 还出现了重复。千问换成了中文,“林边草地”“阳光与夏天”都能读,不过日期、编号和全零坐标仍需核对。
WorkBuddy 的票券颜色更淡,英文排得比较清楚,但日期和编号也不能直接当成真实信息。
看完这两组,相比直接转绘我觉得skill的效果会更好,但文字、日期这些地方,一样得检查。
02 再换成一桌烤肉
这张就复杂了。肉盘、陶罐、蒜片、蘸料、蘑菇,再加上右边的烤盘,满满当当。

这也是xxd-panel-115skill官方案例:手绘蜡笔风+贴纸便签风格

先看直接迁移。

GPT 把木桌和烤盘去掉了,主要留下食物,再加浅蓝、浅绿纸片和蜡笔纹理。它不只是把照片描一遍,也做了删减。
豆包基本把整桌画了下来,颜色浓,描边明显,还加了花、爱心和便签。单看挺热闹,但比参考图挤得多,部分手写英文也看不太明白。
千问在桌子四周留了纸面,搭配便签和格纹胶带,英文改成了聚餐相关的内容,已经有我想要的手账感觉。
WorkBuddy 这次换了 HY4,只生成一张。桌面关系保留得比较完整,蜡笔和撕纸也有了,不过食物仍然画得比较细,没参考图那么简练。
再用小小东的 xxd-panel-115skill,看它的蜡笔拼贴会怎么处理。

这里效果最好的是gpt,可能写skill的时候作者是根据image模型来调整的。
豆包把颜色统一成了粉橙色,效果显示很一般,skill很大可能不适配。
千问这张变化更明显。只留下两盘肉、陶罐、调料碟和叶子,拆开摆在纸上,东西之间的空隙更大。比较适合做什么呢,手帐?
WorkBuddy 的这一版本和原图基本一致,但是吧原图拍的角度不好,这张图也感觉比例有些问题,并没有达到我想要的效果。
如果只问哪个好看,每个人可能选得不一样。但我这次还想看:有没有还原 Skill 原本的设计?
GPT是最接近的。
03 这几组里,我会怎么选?
这轮看下来,风景我更喜欢 Skill,烤肉则更喜欢直接风格迁移。

风景的 Skill 版,上面是摄影画面,下面是水彩票券,这种把照片和设计放在一起的形式,更合我的心意。直接迁移也有好看的,但有些没保留票券布局,有些连参考图里的地点也照搬了。
烤肉就不一样了,四个工具的迁移结果我都觉得挺好。GPT 去掉了桌面背景,豆包画得浓一些、热闹一些,千问和 WorkBuddy 也各有拼贴的感觉。虽然不同,但都有让我想留下来的地方。
反而烤肉的 Skill 版,没有让我觉得更好。有些画面太满,有些没做出原本要求的小主体和大留白。既然直接迁移已经满意,这张我就没必要多折腾。
不过,我更喜欢风景的 Skill 版,主要是喜欢它的成品形式,不代表已经证明它更准确、更稳定。两种方法的输出要求也不完全一样,这里说的是我的选择。
速度上,这次我的感觉是豆包最快,其次 GPT,然后千问,WorkBuddy 最慢。没有统一计时,WorkBuddy 还出过三个版本、中途换过模型,所以只作个人体验参考。
对我来说,不用先决定站哪一边。同一张照片,哪种做出来更喜欢、改起来更省事,就用哪种。
04 模型再进化下去呢?
试完之后,我还是会想:以后直接给参考图就能做得更好了,这类风格 Skill 还值得装吗?
如果我只是偶尔改一张照片,可能会越来越少需要。参考图已经能说清楚我想要什么,结果又满意,我肯定更愿意直接发图。
但这次风景的结果也提醒我,有时候我喜欢的,不只是水彩笔触,而是一整套搭配好的设计。Skill 如果能把这些要求整理好,让我换张照片也方便继续做,那它还是有用的。
只是“能做出来”和“每次都能做好”,不是一回事。

所以我觉得,模型进步以后,单纯描述一种画风的 Skill,可能会变得没那么必要。但如果它能把一套我喜欢的设计反复做好,确实比我每次发参考图更省心,我还是愿意用。
毕竟我最开始只是想让相册里的照片好看一点。但其实好与不好是对比出来的,很多时候只做了一两版觉得不错就用了,普通人可以直接用生图模型即可,对于专业的人来说skill可以锦上添花。
作者:月鹿造物 公众号:月鹿造物
本文由 @月鹿造物 原创发布于人人都是产品经理。未经作者许可,禁止转载
题图来自 Pexels,基于CC0协议
- 目前还没评论,等你发挥!

起点课堂会员权益



