前阵子群里有个做漫展周边的兄弟问我:怎么用AI画出靠谱的小舞?他说试了三十多组提示词,不是发型崩成杀马特就是兔耳朵位置飞到天上去了。这事儿我太有发言权了——去年年底我答应给表妹做一套小舞的QQ头像,结果前20张图有18张像盗版周边,耻辱啊。踩了无数坑之后,现在终于能稳定产出85%可用率的小舞图了。
小舞角色的核心视觉锚点
AI画动漫角色最大的挑战是保持角色辨识度。小舞的视觉锚点有五个:蝎尾辫、粉色系服装、兔耳朵发饰、修长身材比例、以及武魂柔骨兔的元素。这五个点缺一个,画出来的就是"某个粉头发路人"而不是"小舞"。我做过一个对比实验:去掉"scorpion braid hairstyle"之后,30张图里没有一张能被辨认出是小舞。反过来,只要蝎尾辫和粉白配色到位,其他细节稍微跑偏也不太影响识别。
精准提示词模板
经过63次迭代,我给小舞整理了三套不同风格的提示词方案:
动画原版风格:Xiao Wu from Soul Land, donghua art style, long scorpion tail braid hairstyle, pink and white outfit, bunny ear hair accessory, elegant feminine figure, soft facial features, gentle smile, pastel pink color palette, gradient pink hair tips, flowing fabric, magical energy aura, transparent rabbit spirit behind her, full body shot, detailed character design sheet --ar 2:3 --niji 6
这套用了--niji 6参数后,风格的还原度瞬间拉高了一个档次。Niji对亚洲动画角色的面部理解比标准Midjourney好太多了,尤其是眼睛的弧度和鼻梁的高度控制。
写实半写实风格:realistic cosplay photography of Xiao Wu from Douluo Dalu, scorpion braid pink long hair, pink hanfu-inspired dress with white trim, rabbit ear hair clip, translucent flowing ribbons, soft studio lighting, porcelain skin, slender body type, cherry blossom petals floating, 85mm portrait lens, f/1.8 shallow depth of field --ar 3:4
写实风格里最头疼的是蝎尾辫——AI老是把辫子画成普通的麻花辫或者高马尾。反复测试发现加上"braid that curves like a scorpion tail with the end pointing outward"能解决60%的问题,剩下的40%靠img2img修。
战斗风格:Xiao Wu combat stance, martial arts pose, soft bone rabbit martial soul manifested, pink energy trails, dynamic wind effect on hair and clothes, intense expression, fighting game splash art style, dramatic rim lighting, ground cracking effect --ar 16:9
角色一致性控制技巧
如果你要做系列图——比如同一套小舞的不同姿势和场景——角色一致性是最难攻克的关。我的方法是:第一张出满意图后,用那张图的seed值锁死,后续所有图都在同seed基础上微调提示词。Midjourney用--seed参数,Stable Diffusion用固定seed+ControlNet的reference_only模式。
还有一个取巧的办法——先把小舞的脸部单独生成一张满意的headshot,然后以这张图为参考图(image prompt),权重设成--iw 0.7左右,再叠加场景描述。这样脸部一致性保持得好,背景还能灵活切换。
小舞不同形态和场景的切换
斗罗大陆里小舞的形态变化极多——幼年期、成长期、献祭形态、战斗形态,每一种在AI里都是不同的提示词思路。幼年期重点在"younger version, innocent expression, smaller body proportions, simplified outfit";献祭形态加"glowing ethereal body, sacrificial divine aura, translucent light particles, floating in starlight";战斗形态强调武魂具象化的柔骨兔虚影,描述词用"colossal translucent soft bone rabbit spirit manifestation behind her, pink energy threads connecting to her body, dynamic battle stance with afterimage trails"。
场景方面,我接过最头疼的一单是星斗大森林的场景——甲方要求小舞站在森林中,周围是发光的蓝银草。AI把"Blue Silver Grass"理解成各种奇奇怪怪的东西,不是蓝色草坪就是银色铁丝。最后我用"bioluminescent blue spirit grass, Avatar-like glowing forest flora, ethereal cyan light particles floating in dark woods, Tang San's Blue Silver Grass domain aesthetic"才勉强过关,出片率大概只有40%。不过一旦成片,那个视觉效果确实比普通森林场景震撼得多。
还有一个容易被忽略的点:小舞的武魂附体状态。这个形态下她的眼睛会变成粉色发光,身体周围有淡粉色的魂力波动。提示词加"pink glowing eyes during spirit possession, soft pink soul power aura radiating from body, floating pink spirit rings behind her back, translucent rabbit ears energy projection above her head"效果就很到位。我拿这套提示词做了一批手机壁纸,在群里分享后被转了快200次。
小舞AI绘画在不同平台的表现差异
同一个角色在不同平台上画出来效果天差地别。我用完全相同的小舞提示词分别在五个平台上跑了对比测试。Midjourney Niji 6对蝎尾辫的理解最准确,但妆容偏日系萌化风格,眼睛偏大。Stable Diffusion搭配国风LoRA模型对服饰质感处理最好,但需要更长的反向提示词来控制崩坏。WHEE的中文理解确实厉害——用中文写的提示词,小舞的五官比例和发型还原度是所有云端平台里最高的。LiblibAI的墨心LoRA对小舞的粉色系配色还原最到位,颜色很正不偏桃红也不偏紫。通义万相对兔耳朵发饰的位置理解最准,很少画歪。个人结论:追求整体还原度用MJ Niji,追求色彩准确用Liblib+墨心,追求中文便利性选WHEE。我又试了一下把三个平台的图放到一个PSD里分层叠加,取各自最好的部分——Niji的脸、Liblib的服装、WHEE的氛围光——合成出来的效果秒杀任何一个单平台输出。这种跨平台拼图的方法虽然麻烦,但对最终成品的画质提升是实打实的。
篮球主题的AI绘画也有类似的人物动态控制问题,可以参考我们的篮球主题AI绘画教程。古风角色方面,古风美女提示词教程对服装材质的描述思路很值得借鉴。
FAQ
为什么我用AI画的小舞总像另一个人?
根本原因是提示词里缺少角色专属锚点词汇。只写"pink hair anime girl"当然不行,必须加入"scorpion braid""bunny ear accessory""Soul Land character"这些具有排他性的描述。我的建议是最少包含3个以上的专属锚点词,否则AI就会用训练数据中的平均脸来糊弄你。
小舞的兔耳朵发饰经常画歪怎么办?
这是一个高频bug。比较有效的修法是加"bunny ear hair clip perfectly centered on top of head"并在反向提示词里加"asymmetric accessories, tilted headpiece"。实测成功率能从30%提到70%左右。
Niji模式和普通模式画动漫角色差别大吗?
非常大,大到建议你每次画动漫角色都优先用Niji。普通模式处理亚洲动漫角色时会混入太多美式卡通的特征,导致面部比例和上色风格跑偏。Niji 6对中日韩动漫的美学体系理解明显更在行。