AI绘画AI头像定制流程实录:九步砍成四步之后
头像翻车,八成不在画风在照片。我的建议只有一条:先选片,再开模型。下面是帮同事做AI绘画AI头像的完整记录,九步砍成四步,含三次返工教训。
上个月帮同事做AI绘画AI头像,第一版出来,她盯着屏幕看了半天,来了句:好看是好看,但这不是我的脸。当时我还挺不服气,眉眼比例都对得上,怎么就不像了。后来她翻出素颜自拍放旁边一对比,我闭嘴了——那张图谁都像,就是不像她。搞头像这事儿跟我原来想的完全不是一回事,它考的不是画技,是观察和取舍。她要的不是一张漂亮的脸,是一张放进五十人工作群里、大家一眼就知道是她本人的头像。
头像定制的落地流程,其实就四步
选片、定基准、生成加筛、微调收尾,四步走完,选片要占掉一半工夫。顺序别乱,前面偷的懒后面全要还。
第一步选片,我最后固定用五张:正脸一张、左右侧各一张、微仰一张、笑的一张,全是同一天同一光线拍的。光线不统一是新手最容易忽略的坑,阴阳脸照片喂进去,出来的人脸也阴阳。第二步定基准,就是看着这五张,用一句话把她的特征钉死:圆脸、单眼皮、右脸有颗痣。第三步生成加筛,一次跑四十多张,初筛留五张,别一张张细看,看久了会麻木。第四步微调,圈定两张后小范围改,这一步才轮到提示词出场。
我自己第一次做的时候顺序是反的,抱着提示词大全调了一晚上,越调越像陌生人。后来才想明白,提示词管的是风格和氛围,"像不像"这个事在选片那一步就定了大盘。风格词倒是好伺候,扁平、厚涂、赛璐璐随换,脸不变;反过来脸跑偏了,换什么风格都救不回来。
垫图和练小模型,到底差多少
同样的照片,垫图直出约六成像,练二十张图的轻量LoRA能到八成像,代价是十倍时间。头像这个用途,我的答案是垫图够用。
我拿她的照片做过对比。垫图那边,重绘幅度压到0.35,跑四十八张,挑得出三张她点头认可的。LoRA那边,二十张图练了差不多两个小时,出来确实更稳,角度怎么变脸都认得出来。但要老实讲,两小时换这两个提升,对头像这种一次性的活儿,值不值各人自己掂量。我的观点偏向明显:除非你后面还要量产这个角色的表情包、周边,不然别碰练模型,把省下的时间花在选片和微调上,性价比高得多。
还有个中间方案试过:垫图加低重绘幅度反复迭代,相当于自己手动"练"了三轮,能摸到七成像左右,不花钱不花卡,就是费手。判断该走哪条路有个粗标准:成品只当头像用,垫图;要衍生出表情包、壁纸、多个场景的同一角色,才考虑练模型,这时候两小时回本。
我翻过三次车的地方
三次事故:磨皮磨掉了她的痣、眼睛只像形状不像神态、耳环被生成成对称两只。都是小事,但每一件都能让本人当场否掉整张图。
第一辆最冤。我嫌照片光线糙,加了一堆柔肤词,结果把她右脸那颗痣磨没了,她说那是她的标志,直接打回。从那以后我给自己的负面提示词里常驻一句避免过度磨皮。第二辆是眼睛,形状、双眼皮都对,就是没神,试出来一个土办法:选片里专门留一张带笑的眼睛特写,生成时强调眼神方向,命中率明显上去。第三辆最好笑,她只戴一只耳环,模型规规矩矩给配了一对,说不上谁对谁错,模特世界默认对称。
三次车翻下来,我记住一件事:头像不是画得好不好,是"是不是这个人",后者的标准苛刻得多,也具体得多。顺带说个筛选窍门,最后定稿前,把成图和照片缩到指甲盖大小并排看,轮廓和神态还能对上的才是真像,放大看细节像不算数,毕竟头像挂出来就是指甲盖那么点。
那批被否掉的图我还留着,时不时翻出来看看。头像定制这门手艺,说穿了就是替本人观察她自己:她认哪颗痣,认哪种眼神,认哪道笑纹。模型认不出这些,只有喂照片的人认得出。所以流程再怎么砍,四步里的第一步永远省不掉。对了,她最后选定的那张已经用了一个多月,群里真有人一眼认出是她,这大概就是这活儿最好的验收标准。
常见问题
用自己照片做头像,会存在泄露风险吗?
本地部署的流程照片不出机器,风险小。用在线工具就要看清条款,重点确认两点:照片是否拿去训练,删除后是否真删。不放心就把背景和手上的标识遮掉再传。
手机上能走完这套流程吗?
能,思路完全通用,只是选择少一些。手机端更依赖垫图加筛选,跑图的量会比电脑端吃亏,建议把第一步选片做得更狠,五张里再挑,宁缺毋滥。
照片最少要几张?
垫图三张是底线,五张比较稳,角度覆盖正脸加两侧就行。想练LoRA再翻倍,二十张上下,角度拉开的收益比数量大。
做一个能用的头像大概要多久?
顺手的话一个晚上。我第一次做了三天,第二次做了三小时,时间大头都花在选片和返工上,跑图本身反而很快。