ai 少女绘画别只磨脸:动作和场景才是耐看的关键
我的判断是:ai 少女绘画的耐看度,七成在动作和场景,三成才是脸。一张站得笔直、五官完美的图,一眼就是机器出的;让少女蹲下来逗猫、举着半杯奶茶,图立刻就活了。改图别先磨皮,先让她动起来。
聊ai 少女绘画之前,先说一件打击我的事。上个月我给朋友看两组图,A组是我精心磨了两小时的完美少女肖像,B组是随手出的、女孩蹲在便利店门口吃关东煮的侧影。她指着B组问这个在哪拍的。脸明明是A组精致,她却记住了B组。
这件事之后我复盘了很久,结论写进标题了。少女图最重要的不是「好看」,是「像活的」。而活得假的根源,往往就出在我们最执着的那个部分——脸。
少女图为什么总显得「塑料」?
塑料感来自三件事:姿势太端正、皮肤太干净、场景太空。模特一样的站姿加影棚打光,是AI图最标准的指纹。想破这个指纹,从让人物「失态」开始。
展开讲讲我的依据。我做过一个小对照:同一张脸的参数,一个词不动,只换姿势,跑了三十张。十张站姿正面,十张走路或回头的动态,十张带场景互动的。发给五个不玩AI的朋友盲选,站姿组一张都没人要,动态组被挑走了七张。理由五花八门,「像要跟我说话」「抓拍感」,没人提脸好不好看。
原因其实不玄。真人几乎不会正面站着一动不动还微笑,我们记忆里的「人」是动态的、有毛边的。AI的默认审美恰恰相反——它太会摆拍了。所以你要做的不是让模型更努力,是让它「失误」得像人:头发被风吹乱几缕、裙摆不对称、视线不落在镜头上。
光也有份。逆光、窗边的侧光、傍晚的路灯光,都比均匀的正面光耐看。我自己偏爱傍晚路灯下那个色调,偏黄里带一点青,出图十张里能成两张,成的那两张跟影棚图完全是两个物种。
我改图的顺序:先动线,再动光
拿到一张不满意的少女图,先改姿势词,再调光源词,最后才是局部重修手部和脸,顺序反了会白干。脸是最后一步,不是第一步。
具体流程摆一下。第一步,把姿势描述换成具体动作:「蹲着」「回头」「跑起来裙摆扬起」,重绘幅度给到0.55左右,脸基本不会崩。第二步,光源词跟上,窗边光、路灯、夕阳,选一个就够,别堆。第三步,整体满意了再检查手和脸,手崩了就单独框选那块做局部重绘,别整张重跑——整张重跑等于把你磨好的构图全扔了。
翻车案例必须交代。我让一个女孩「递出奶茶」,出了个神图:奶茶杯长在手背上,五根手指头围着杯子转了一圈。这张我存着当反面教材,前后返工了四次,最后老老实实把动作拆成「单手握着杯子」才过。教训是动作越复杂,越要拆成一个关节能完成的简单动作。
说个玄学的点,不一定对,但我记下来了:带生活道具的图,废图率反而低。桌上摊开的笔记本、半瓶汽水、校服外套搭在椅背,这些词加上之后,模型像是知道了这张图要干嘛,手都画得规矩了几分。可能是场景词给了它更多上下文,纯猜了。
几组亲测好用的动作场景词
「蹲下逗猫」「便利店门口吃关东煮」「窗边趴着打瞌睡」这类动作加场景的组合词,出片率明显高于站姿加形容词。照抄就能用,再按你的题材换皮。
把我出片率最高的几组直接列出来,都是跑过至少十次验证过的:
- 「蹲在路边逗流浪猫,傍晚路灯」——生活感天花板,出片率我记的大概三成。
- 「便利店玻璃门前回头,手里塑料袋」——回头的动态最自然,塑料袋还能挡住一只手,一举两得。
- 「窗边趴着打瞌睡,午后阳光」——适合安静挂的图,翻车率最低的一组。
- 「跑起来裙摆扬起,樱花道上」——动态最强,但手容易崩,建议后手兜里揣着的写法。
这些词的共同点:全是「人真的会做的事」。你写词之前先问自己,这个动作你上街见过真人做吗?见过,模型大概率也见过,画起来就顺。没见过,那就等着开盲盒。
回到开头朋友选B组那件事。她后来跟我说,A组的脸很好看,「但那种脸我看八张就腻了」。这话我琢磨到现在。ai 少女绘画走到今天,精致的脸是最不缺的东西,缺的是那一口关东煮的热气。下次你的图差点意思,先别动脸,让她动起来。
常见问题
加动作词之后脸容易崩怎么办?
重绘幅度压在0.5到0.6之间,先出整体,脸崩了再单独局部重修。一步到位不现实,两步走稳得多。
手部翻车有什么补救办法?
框选手部单独重绘,或者用道具遮挡——袋子、杯子、口袋,能藏一只手就藏一只手,别硬画十指交扣。
场景词加多少个合适?
两到三个就够,一个动作、一个场景、一个光源。堆太多模型会打架,画面反而乱。
动漫风和写实风哪个更适合这套思路?
都适用,写实风收益更大,因为写实图的塑料感更扎眼。动漫风本身允许夸张,动态词的加成相对小一点。