ai人类绘画为什么总差一口气?皮肤、眼神、微表情,把假人脸推过恐怖谷
先说谷:ai人类绘画卡在恐怖谷,多半不是五官画错,而是皮肤、眼神、微表情这三层微观真实缺了货。五官管"像谁",微观层管"是不是活人"。先干两件事:关掉默认磨皮习惯,局部重绘眼神。
ai人类绘画这件事,五官其实早就不是难题了,眉眼口鼻都能对上参考图,真正露馅的地方在别处:皮肤像打了层蜡,眼神像截图,嘴角永远端着。结论先放这儿——差的那口气不在"画得对不对",在"微观层真不真"。
前阵子我拿 Flux 跑了小一百张人像做测试,最后能直接发出去的只有六张。淘汰理由五花八门,归类完就三条:皮肤过曝、眼神涣散、表情摆拍。这跟画男画女没关系,之前写过一篇男性ai绘画,讲的是性别特征怎么立住;这篇不挑性别,就盯着一件事——怎么把"像人"推成"是人"。
皮肤是第一道坎,默认磨皮就是假脸的起点
AI脸第一眼假在皮肤:毛孔抹平、高光糊片。纹理 LoRA 权重 0.55-0.7,负面词加 airbrushed。展开讲讲为什么。真人的皮肤是"反光不均匀"的:T区出油、两颊偏哑、眼下有细纹接住一点光。模型默认往精修海报那个方向收敛,因为训练数据里精修图占比太高。你要做的不是加细节,是把模型从美颜习惯里拽出来。
我试过的组合里,最省事的是挂一个皮肤纹理 LoRA。权重 0.4 以下基本没存在感,0.8 开始毛孔大得像橘皮,0.55-0.7 这档最舒服——凑近看有皮纹,退后看还是干净的。没 LoRA 的话,负面词也能扛一阵:airbrushed、smooth skin、plastic skin、waxy skin 这几个词我常驻负面池。
后期还有一招土办法:整图叠 1.5%-2.5% 的胶片颗粒。别小看这一步,均匀的数字噪点会打散那种渲染感,跟你手机拍照的成像逻辑是一回事。加过头会显脏,2.5% 是我的上限,再高就 dirt 而不是 texture 了。
为什么AI的眼神总在"假装看你"?
眼神假在两处:双眼反光点对不上,焦点落在镜头上。局部重绘眼区,denoise 卡 0.30-0.40,手动统一神光。人的大脑对眼神挑剔到苛刻,差一点点就能察觉。真人两只眼睛的反光来自同一个光源,位置、大小、亮度是对应的;AI 经常左眼一个点、右眼两个点,光跟从脑子里照出来似的。还有瞳孔:环境明明是傍晚,瞳孔却开成大白天。这两处单看都找不出来,合在一起就是"这人在看我,但魂不在"。
做法是眼区单独 inpaint。mask 比眼眶大一圈就行,别贪大——mask 漫到颧骨,脸型会被一起改掉。denoise 我卡在 0.30-0.40,高于 0.5 眼型容易漂。提示词里补一句 one light source,反光点打架的概率小很多。改完放大看双眼:两个反光点能不能连出同一个光源方向?连不出来就重跑,没商量。
恐怖谷这个词本来是机器人学家造出来骂机器人的,用在 AI 图上一样成立,之前那篇ai 绘画邪门恐怖谷把谷里的各种诡异感扒得更细,眼区翻车的案例可以翻那篇对照。
微表情和不对称,是"像"与"是"之间最后一厘米
真人脸没有完全对称,嘴角高低差、单边法令纹才是活人证明。提示词写 asymmetrical expression 就行。展开说说。AI 的默认表情像证件照预备动作:嘴角对称上扬一个固定角度,眼睛平静,全身肌肉待机。真人哪怕在发呆,脸也是"正在发生什么"的状态——准备笑没笑,刚笑完还挂着,想说什么又咽回去。
我的写法是在表情词上做减法。不写 smiling,写 faint smirk(将笑未笑)、lips slightly pressed(抿嘴)、expression caught mid-motion(抓拍感)。不对称直接用 asymmetrical expression。这里有个翻车记录:我给 asymmetric face 加过 1.3 的权重,出来的图五官整体错位,像照片拍歪了,所以这个词不给权重,白送就行。
| 修法 | 关键参数或词 | 改的是哪层 | 翻车点 |
|---|---|---|---|
| 皮肤纹理 LoRA | 权重 0.55-0.7 | 皮肤 | 超 0.8 出橘皮油光 |
| 眼部局部重绘 | denoise 0.30-0.40 | 眼神 | mask 太大改脸型 |
| 不对称提示词 | asymmetrical expression | 微表情 | 加权重直接五官错位 |
| 后期颗粒 | 1.5%-2.5% 胶片颗粒 | 整体质感 | 超 2.5% 显脏 |
再说个我自己的偏好:我让 AI 模仿抓拍,不模仿摆拍。摆拍出来的再完美也是恐怖谷,抓拍那零点几秒的松弛,模型反而学得像。想治"网红脸那种精修僵"的,文末挂了篇专讲改法的,两篇配合用。
回到开头那句:ai人类绘画差的从来不是五官,是微观层。皮肤给纹理,眼神给光源逻辑,表情给不对称的"正在发生感",三层补齐,谷就翻过去了。这三层没有先后顺序,但守着同一个原则:反完美。模型拼命想给你的那张完美脸,恰恰是你要躲开的。
常见问题
换最新的模型能直接跳过恐怖谷吗?
能缓解,跳不过。新模型五官和手部确实更稳,但默认审美还是往精修收敛,皮肤和眼神的问题只是从九分假变成八分假。参数和提示词层面的活儿,省不掉。
皮肤纹理加强之后,人显得特别老怎么办?
纹理权重降 0.1 左右,提示词里补 youthful skin 或 twenty years old。显老通常不是纹理本身的错,是纹理叠加了默认的高对比光影,把阴影打重了,先动光影再动权重。
牙齿和手要不要也单独重绘?
建议要。笑露齿的图,牙列崩的概率比眼区还高,处理方式一样:小 mask、低 denoise、多跑几轮。手部如果没拿东西,构图阶段就让它藏进袖口或背后,比重绘省事得多。
这套参数用在二次元图上合适吗?
不合适。恐怖谷是写实向的病,二次元压根不在谷里。风格化图硬上颗粒和皮肤纹理反而毁风格,这篇只管真人写实这一条线。