喂ai绘画图生图怎么喂参考图?三种喂法与重绘幅度的平衡心得
先喂一张,是图生图最直接的起点:喂构图就压低重绘幅度保住骨架,喂风格就放开幅度让模型自己长肉,喂局部就靠蒙版圈地盘。参考图本身干净、来源清楚,出图才稳。动手前先想清楚,这张图到底想让AI抄什么。
喂ai绘画这件事,图生图比纯文字提示词更讲手感:同一张参考图,喂法不同,结果能差出一个次元。结论先放这儿——想清楚你要AI抄的是构图、风格还是局部,再定喂法和重绘幅度,顺序反了,显卡白烧。我踩过的坑,大多不是模型不行,是我压根没想明白自己要它抄什么。
去年冬天我拿一张咖啡馆窗边的随手拍当构图参考。座位靠窗,光从左边斜进来,人物只占右下三分之一。重绘幅度压到0.4,站位和光影还原得相当好,连窗框的分割线都留住了;招牌上的字全成了乱码。这种小地方后来都用局部重画补的,比整体重来省一半时间。
三种喂法各管一段:构图、风格、局部
构图参考抄骨架,风格参考抄质感,局部参考圈地盘;三种喂法别指望一张图全包,先定要抄什么,再定怎么喂。很多人一张图喂进去就许愿全都要,出来的东西往往四不像,三个方向互相打架。
构图参考,抄的是画面的骨架:主体站哪、视线往哪走、留白怎么切。喂这种图,重绘幅度要压低,提示词围绕布局来写。我一般直接描述构图关系,比如"左光源、右下角人物、大面积负空间",比堆一堆风格词管用得多。
风格参考正好反过来,抄的是笔触、色调、材质这些皮相。幅度就得放开,0.6上下比较常见。有个惨痛教训:有次我喂了一张网上找来的插画当风格参考,幅度开到0.75,出的图构图几乎把原图复刻了一遍,朋友一眼认出来源,我当场社死。从那天起立了规矩——风格参考只用自己拍的,或者明显无主的老素材。
局部参考最像做手术。蒙版圈住要改的区域,其余地方锁死。我改得最多的是主角手里的道具:剑柄的握法、杯子的倾斜角度。蒙版边缘记得羽化,我习惯开8像素左右,不然接缝处光影对不上,像贴了块补丁。圈内幅度压到0.4上下,一次只改一件事,贪多必糊。
| 喂法 | 让AI抄什么 | 重绘幅度参考 | 常见翻车点 |
|---|---|---|---|
| 构图参考 | 站位、透视、留白 | 0.35-0.5 | 抄走了配色,构图却跑了 |
| 风格参考 | 笔触、色调、质感 | 0.55-0.7 | 连构图一起复刻,像换皮 |
| 局部参考 | 圈定区域的细节 | 圈内0.4左右 | 蒙版边缘生硬,光影接不上 |
重绘幅度调到多少,像与自由才不打架?
重绘幅度0.35到0.5保构图,0.55到0.7放手让AI改,0.75以上基本等于重画;想更像就压低,想更新就抬高,每次只动0.05。这个旋钮,本质上是参考图和提示词之间的话语权分配器。
我的理解是这样:幅度低于0.4,参考图是老大,提示词只配打下手;过了0.7,提示词接管一切,参考图只剩一点氛围残留。中间那段,是两个人拉扯的地带,也最容易出好图。别嫌来回试麻烦,这一步没有捷径。
做过一个小实验。同一张雨夜街头的参考图,我固定提示词,从0.3到0.85每隔0.05跑一张,一个下午跑了三十多张,本地出图单张约15秒。0.35那张构图纹丝不动,雨没下起来;0.55开始出现水洼反光,霓虹的颜色也活了;0.8那几张,雨夜的氛围全对,街道的走向已经完全不认识了。
所以我的习惯是两头试:先0.45,看骨架保没保住;再0.65,看自由度够不够;然后往中间磨。幅度每动0.05就是一轮新抽奖,千万别从0.3一口气跳到0.9,那样你永远不知道好图是哪个刻度出的。
喂自己拍的图,晚上睡得着
喂自己拍的照片最安心:版权干净、没有肖像纠纷,喂得再猛也不心虚;网图参考要克制,复刻别人构图拿去商用是大坑。这条原则,是我用一次差点出事的教训换来的。
自己拍的图还有个隐藏好处:你能拍出提示词写不出来的东西。提示词写"黄昏逆光、麦田、人物剪影",出十张有十种黄昏;你举起手机对着真实的麦田按一张,光的角度、尘土的颗粒感都是现成的,AI只需要在这个底子上做加减法。手机随手拍完全够用,长边过1024就行,太小的图会先被放大一遍,糊。
喂别人的作品要留个心眼。画风参考的商用边界、垫图到底侵不侵权,是两个经常被混着聊的问题,我在这篇里专门画过线:ai绘画材料怎么用才不侵权?画风参考与垫图的商用边界,一篇画清楚。一条笨但有效的自查:这张参考图要是被原作者看到我拿它做了什么,我会不会脸红?会,就换。
回到开头那句:喂ai绘画出图,先想清楚让AI抄什么,再动手。构图压幅度,风格放幅度,局部靠蒙版;来源拿不准,就用自己的照片顶上。这些刻度和习惯都是一张张图跑出来的,你照着试两轮,手感很快就是你的了。
常见问题
一次喂好几张参考图会更准吗?
不一定。多张图意味着权重要拆着分,构图参考和风格参考同时喂,经常互相拉扯,出图左右不是。我最多同时喂两张,一张管构图、一张管色调,再多就乱了。
参考图的分辨率有讲究吗?
有。长边低于768的图,进模型前会被先放大一遍,细节已经糊了,AI等于照着一张模糊的复印件作画。尽量找长边1024以上的原图,实在只有小图,先自己超分一次再喂。
喂朋友的照片给AI画可以吗?
先问一句。人脸出图牵扯肖像权,成品要发网上或商用时尤其敏感。熟人愿意配合最好,不愿意就换背影、换侧影,或者干脆自己当模特,自拍一张喂进去,问题全消。
重绘幅度和提示词打架时听谁的?
看幅度。0.4以下参考图说了算,提示词负责补细节;0.7以上提示词主导,参考图只剩氛围。夹在中间时,把两者往同一个方向描述,矛盾会小很多,别让参考图朝东、提示词朝西。
图生图跑出来的图能直接商用吗?
分两层看:平台条款允不允许商用是一层,参考图来源干不干净是另一层。喂自己拍的照片,风险小得多;喂了别人作品、幅度又开得高,成品和原图长得像,麻烦就大。拿不准就压低幅度重新抽。