ai绘画定型怎么做?给小说角色定妆的锚点法实测
省流版:ai绘画定型靠两步——先用五件套锚点词把角色钉死,再用垫图锁脸。只写发色瞳色这种做法,换个动作就换张脸。表妹小说女主的定妆,我用这套流程把换场景后的还原率从三成拉到八成。
ai绘画定型这件事,是表妹把我拽进去的。她写小说,女主是个银灰短发、左眼下有颗泪痣的少女,写到第八章想配几张插图。要求一句话:每张都得是同一个人。
我拍胸脯接了,然后被现实教做人。正面头像 Perfect,一换侧脸或者换个场景,头发漂成深棕,泪痣时有时无,眼距也变了。她指着第三章的图问我:这位是谁?
整整十一轮重跑之后,才攒出下面这套东西。
角色为什么总是长着长着就变样
模型没有「角色」的概念,每张图都是独立生成的,提示词里没写的细节全部交给随机性,头发渐变、痣的位置这类小特征漂移得最快。
先把账算明白。你写「银灰色短发的少女」,模型要做的事是:从「银灰」「短发」「少女」三个标签的数据分布里各抽一次样,再组合。每张图都是重新抽签,签筒一模一样,手气每次不同。
漂移最快的是什么?小而具体的特征。泪痣在两成图里消失,发色在暖光场景下容易偏棕,衣服花纹几乎每张都在重新设计。反而是「短发」「马尾」这种大结构词,稳定得多。
我的翻车案例:表妹要求「琥珀色眼睛」。头十张里,七张实际出的是普通棕色。后来在颜色后面加了「金黄色的反光、透光感」,琥珀的透亮感才站住。可见写颜色不够,得写颜色的「物理表现」。
定妆照怎么定:五件套锚点法
锚点五件套是发型结构、颜色细节、面部记号、固定配饰、固定服装,五项各一到两个词组写死;其中固定配饰是性价比最高的一项,一件不换位置的耳饰能顶半张脸。
发型结构写「层次感短碎发、左侧分缝」,别只写「短发」。颜色细节学上一节的写法,把「琥珀色眼睛」扩成带反光的完整描述。面部记号是泪痣、美人痣、疤这类,写明位置:「左眼下方的泪痣,约一粒米大小」。
重点说固定配饰。我给表妹的女主定了一枚「银色月牙耳骨夹」,这是原小说里没有的道具,专门加的。理由很简单:耳饰位置固定、形状好认,出图偏一点立刻能看出来,等于给角色装了个定位标。后来那张耳骨夹成了读者的记忆点,算是意外收获。
五件套写好之后,先出一张正面定妆照。这张图本身就是资产——挑一张最贴的,存好原图和提示词,这是后面一切的基础。定妆照阶段别心疼额度,我们跑了两百多张才选出那张,前一百五十张全是废的。
定型之后,换个动作还能是她吗?
能,路径是垫图加重绘:拿定妆照当参考图,控制强度在合理区间,动作场景随便换,脸不会跑;纯文字重写提示词的方式只适合风格类似的远景。
定型后的批量出图,我的流程是三步。第一步,把定妆照垫进去当参考,参考权重从中低档起试,高了画面死板,低了脸又跑了,表妹那组图最后定在中等偏低的档位。第二步,动作和场景用新增的提示词段来推,锚点五件套原封不动保留在前面。第三步,出图后先查锚点——泪痣在不在、耳骨夹在不在,两项都在再看别的。
这套流程跑下来,换场景的还原率从最早的三成上下提到八成左右,剩下的两成主要崩在特别刁钻的角度,比如仰头大笑这种脸型大变形的动作。遇到这种镜头,我的办法是退一步,用侧脸或背影带过——插图是为故事服务的,不是给脸拍证件照。
还有个笨但有效的招:建角色卡。把五件套提示词、定妆照、常用负面词存成一个文档,每次开工直接调用。三个角色以上的项目,没有角色卡就是灾难,你会忘记上一轮到底写了「锁骨」还是「肩线」。
定稿那天我把三张图发过去,表妹回了句「是她了」。就三个字,比什么夸奖都实在。回头看,定型这事说难不难——模型记不住角色,那就由你来记,把她的脸拆成词、钉成锚、存成卡。角色活在作者心里,AI只是替你把她请出来。请得准不准,看你心里那张脸描得细不细。
常见问题
不同工具的角色一致性差别大吗?
挺大的。有的工具自带角色参考功能,垫图之后还原率天然高;没有这功能的,靠垫图加重绘也能做到七成上下,但流程要自己搭。选工具时把「角色参考」当一条硬指标去查。
锚点词写太多会不会把画面写死?
五件套的量级是安全的,真正要控制的是别往里塞情绪和氛围词。锚点管「她是谁」,氛围词管「这一幕」,两段分开写、位置放对,互不打架。
角色卡应该存哪些内容?
至少四样:五件套提示词全文、定妆照原图、经过验证的负面词、这套参数下的成功样例两三张。换设备或换工具时,这份卡就是你的角色档案。
可以让AI自己设计角色再定型吗?
可以,流程反过来跑:先放开抽卡二三十张,找到一张「有感觉」的,再反推它的特征写成五件套。先定型再出的图,一致性思路不变,只是发色瞳色这些决定权交给了运气。