AI绘画小舞宁荣荣:双人同框的一致性处理
结论放在最前面:双人同框,优先一次生成并写清相对位置,分开生成再合成十有八九光线上对不齐。两个角色的特征要分组写死,串味了就用局部重绘分开救。7月那批同框图我磨出一条经验:双人图的功夫,一大半花在把两个人的关系写明白。
AI绘画小舞宁荣荣这类双人同框需求,最近在几个同好群里出现得越来越密。单人图和双人图是两种难度:单人图比的是角色还原度,双人图多了一层「关系」——站位、互动、光线得分毫不差才自然。我7月帮群头图活动出了一批,把双人图特有的坑捋成两节,都有实打实的次数记录。
先把难的原因说透:模型看提示词是整段理解的,两个角色没有天然边界,特征词一多就互相渗透。所以双人图的所有技巧,本质都是在帮模型划清楚「哪段词管谁」。想通这一层,后面的做法都不神秘。
一次生成还是分开合成,我的账在这
优先一次生成,把相对位置和互动写进提示词;实在要分开生成再合成,得接受后期对光线的额外开销,时间成本反而更高。
7月那批我做了个笨对比:一次生成的同框,12张里能用7张;分开生成再抠图合成的,2张里勉强能用1张,还是熬到凌晨修光才救回来的。差距出在光和透视——分开生成的两张图,光源方向、色温、透视灭点全对不上,合成的时候人物像贴上去的,一眼假。
一次生成的写法关键是把关系词给足。站位写「并排」「一前一后」「背靠背」,互动写「递东西」「看向同一个方向」「一人笑着指向远处」。互动词是同框图的灵魂,有互动的两人才像认识,没有互动就是两个人的合影摆拍。我固定在提示词里放一个站位词加一个互动词,再多就乱。
构图上有几个现成配方可以直接抄:肩并肩看镜头,合影感,最稳;一人坐一人站,高低错落,画面有节奏;追逐打闹类,动感最强但崩率也最高。我7月写过一次「手拉手」,出来四只手缠成一团,后来老实改成一人在前回头、一人在后跟上,手的问题绕开了。
景别也顺带说掉:中景是双人图的舒适区,上半身加一点环境,特征都能交代清楚。全景里人物太小,脸部细节糊成一团;特写又装不下两个人。我那批成图全是中景,不是巧合。
顺带交代身高差,问的人不少:写清「一高一矮」「差半个头」比写具体数值管用,模型对比例词的响应比对数字好,这是试过才知道的事。
两个角色的特征,分组写死别让它们串味
两个角色的特征词分开成组,一前一后写清楚,别混着来。发色、发饰串味是最常见的翻车,修的时候局部重绘分开锁色。
我翻过最离谱的一次车:兔耳长辫的那位和长直发的那位同框,出图两个人的发色互相沾,一个发尾泛粉,一个辫梢发白,像刚从同一个染缸里捞出来。原因也好猜,两组特征词挨得太近又没分组,模型自作主张取了中间值。
改法是把特征词按人分组:前一组集中写完甲的发色、发饰、服装主色,紧接着一组写乙的,中间不留含糊的过渡词。负面提示词里再挂上「发色混合」「特征融合」这类描述。改完之后串味率明显降下来,10张里最多出一两张轻度的。
配色上再给一条:两个人一暖一冷最稳,一位主色偏粉、一位偏蓝白,模型分得清清楚楚;同色系双人是最容易串的组合,非要画,就把两组词的间隔拉大,中间插一段背景描述当隔断。裙摆、袖口相接的位置是串味高发区,修图时优先检查那里。
真串了别整张重抽。局部重绘分两步走,先锁住甲的发色只修乙,再反过来,重绘幅度压低,两三轮能干净。急不得,一次性圈两张脸一起修,大概率越修越混。
最后交代一下工作量预期:双人图的修图时间大概是单人的两倍起,抽卡数量也是。帮人接图的话,报价别按单人乘二算,要再松一点,7月那批我差点把自己饿着。
双人图的乐趣和难度是一体的:写清关系,特征分组,剩下的交给抽卡和修图。7月那批图最后选出来当群头图的那张,两个人看向同一个方向,光从侧面打过来,一次生成,几乎没修。写明白的时候,模型其实比你想象的好说话。
常见问题
同框图只有一张脸崩了,怎么修影响最小?
只圈崩掉的那半边做局部重绘,另一张脸用蒙版完全遮住,幅度调低慢慢试。千万别两张脸一起重画,容易把好的那张也带崩。
这类同人图发布到平台要注意什么?
标明二创和AI生成,别冒充官方物料,也别接角色周边类的商单。平台对AI内容的标注要求越来越明确,老实勾选比被举报省心。
同框图能裁成两个单人头像吗?
能,而且这是同框图的隐藏福利。生成时就把两个人拉开一点距离,给各自留出裁切空间,一张图出两套头像,同好群活动里特别受欢迎。
提示词里写角色名有用吗?
有名气的角色名有一定作用,但不能全指望它。名称加特征词双保险最稳,光写名字,模型经常给你一个「神似但不认识」的陌生人。