AI绘画革新了什么?从抽卡到可控,三年操作差异的真实对比
我的判断是:这轮革新改的不是画质,是可控性。画得好看早就不是门槛,画得准才是。2023年我出一张能用的图平均要抽四十多次,现在同样的活,三次以内就能定稿。
2023年冬天,我为了给一个公众号文章配图,一晚上抽了一百三十多张,手指头点生成按钮点出了肌肉记忆,最后选用的那张其实也就勉强及格。上周我又接了类似的活,从头到尾只出了九张图。两件事放在一起,我才真正咂摸出这几年AI绘画革新到底落在哪——不在宣传页上,在你手上的操作流程里。三年时间,中间隔的不是玄学,是一套完全不同的干活习惯。
第一步的操作就变了:从整张重抽到只修一块
革新最实在的落点是修补方式:以前错一根手指就得整张重来,现在圈住那块重画,其余像素原封不动。
过去的工作流是「生成—不满意—改词—全部重来」,运气成分占七成。现在的流程是「生成—圈选问题区域—局部重绘」,一张图上的小毛病逐个击破就行。这个变化看着不大,实际干活的心理状态完全不同:以前是买彩票,现在是修钟表。
我实测里最重要的一条参数经验:局部重绘的重绘幅度别拉太高。我一般压在0.35左右,修手指、修檐口都很稳;有一回我拉到0.7,想重画一块招牌,结果招牌旁边的整面砖墙纹理全跟着变了,等于白干。幅度这个旋钮,宁小勿大,小了可以再来一次,大了直接毁图。
选区范围同样有讲究。我吃过亏:修一只手的时候,选框开得太宽,把半张桌子也框了进去,重绘完桌上的咖啡杯换了形状。后来我养成习惯,选框贴着要修的边缘走,宁可修三次小区域,不开一次大区域。修补的颗粒度越细,成品越稳。
提示词的话语权在下降,参考图在上升
现在出图的话语权一半在参考图手里:垫图加短提示词的组合,比纯堆形容词稳得多。
我做过一组对比实验。同一个目标——黄昏的便利店门口,要胶片质感。A组纯提示词,写了四十多个词,抽二十张,能用三张;B组用一张实拍便利店照片垫图,提示词只写十来个关键词,抽十张,能用六张。B组的效率是A组的四倍,而且画面构图稳定得多。
这说明什么?说明模型听懂图比听懂字在行。词是间接的,图是直接的。所以我现在接单,第一步是先跟客户要参考图,没有参考图的活我报价还会往上浮一点——纯靠文字对齐审美,沟通成本实在太高。
不过垫图也有反面:参考图给得太强,会把你自己的构图意图整个冲掉,出来的图几乎就是参考图的复刻。我的折中办法是把垫图的影响调低一档,再靠提示词把偏掉的方向掰回来。参考图定大方向,提示词做微调,各管各的。
别把可控当成躺赢:验收线也跟着抬高了
工具可控之后,看图的人的眼睛也变尖了:以前交氛围图能过关,现在甲方会放大到栏杆检查穿模。
这是革新里最容易被忽略的一面。可控性普及之后,客户的要求水涨船高,我去年有个单子,交付图被放大检查出第三根栏杆是断的,返工两次。放在抽卡年代,这种级别的瑕疵没人计较,因为大家都知道AI就这样。
所以我的态度偏保守一点:革新让入门变快了,但没让交付出变轻松。以前拼手气,现在拼眼力。省下来的重抽时间,我都花在放大镜式的检查上,一寸一寸过。老实讲,这样反而更累,只是成果更稳定。
我还观察到一件事:可控性把报价体系也搅动了。有人说工具省事,价格就该往下走,我偏反向操作,涨了。因为客户买的不只是那张图,还有你验收把关的时间。同一套工具,有人拿来卷价格,有人拿来卷质量,我选后者,事实证明走得慢的那条路反而稳。
回头想2023年那个抽了一百三十多张图的夜晚,我不觉得那是在吃苦,那就是当时的常态。如今圈一块修一块的顺手,是三年里一次次工具迭代攒出来的。它没有把谁变成大师,只是把「等运气」改成了「动手修」。你要是想亲手感受这轮变化,最直接的办法就是翻出一张旧图,试着只修一个局部,别动其他地方——修完那一刻你就懂了。对了,抽卡年代攒的提示词笔记也别急着扔,里面的结构词照旧管用,该扔的只是赌运气的心态。
常见问题
新手还有必要背大量提示词吗?
没必要照着词典背。我的用法是维护一个自己的小本子,只记实测有效的结构词和风格词,三十来个就够日常用了。参考图时代,提示词更像是微调旋钮,写清主体、光线、质感三件事,剩下的交给垫图。
老电脑跟得上这些新玩法吗?
分情况。局部重绘和垫图这类功能,走网页端基本不吃本地配置,我这台用了五年的笔记本照样跑。要是打算本地部署大模型,那显存就得真金白银地算,八G显存以下会比较勉强。
可控性上去之后,出一张图反而更慢了吗?
单张看确实可能变慢,因为多了圈选和检查的步骤。但算总账是赚的:重抽次数从四十多次降到个位数,返工率也低了。快慢要看流程,不能只看生成那一下。