ai 绘画合照怎么弄?多人同框不再脸崩的做法

ai 绘画合照怎么弄?多人同框不再脸崩的做法
ai 绘画合照效果:多位朋友肩并肩同框的温暖合影画面

先泼盆冷水:ai 绘画合照翻车是常态,两个人同框还算稳,四个人往上成功率断崖式往下掉。想一次出图就完美基本不可能,正确姿势是先控人数、再喂脸、最后修局部。

毕业十周年聚会之前,我们宿舍群里有人提议:人都凑不齐,能不能用AI画一张「全宿舍合影」发群里应景。这事落到了我头上,因为群里的都知道我天天在玩AI绘画。结果这张六个人的合照,我前后改了11次才敢发出去。所以你看,ai 绘画合照这件事,难的不是像不像,是让几个人乖乖站在该站的地方,还都长着该长的脸。整个过程我用即梦跑了七八成,最后那版的质感交给Midjourney收尾,两家各有各的活儿。

人数是合照的第一道坎

提示词里的人数必须写死,「六个人」比「一群人」靠谱得多;六人以上建议拆成两排构图,并排站一行AI基本排不明白。

我踩的第一个坑就是人数。写「一群朋友合影」,AI理解的一群有时候是四个,有时候是七个,有张图里甚至冒出来九个人,多出来的三个还长得一模一样。改成「六个人、两排站位、后排三人」之后,人数一下就老实了。但并排站一行超过四人还是容易翻,我那张六人图改成三前三后之后,人数错误从几乎每张都有降到三四张才出一次。

还有个小语言坑:中文提示词里人数用汉字比用阿拉伯数字稳。我有阵子写「6个人」总出五个,换成「六个人」之后反而准了。听着挺玄学,但我重抽了二十来张对比出来的结论。站位词我固定用「前排三人坐姿、后排三人站姿」,坐站结合比全员立正自然。

同框人数我实测的大致成功率私评
2人七八成闭着眼出,偶尔修下手就行
3-4人四成上下能出,但手指开始放飞
6人及以上两成不到必须分排站位,做好改十次的准备

脸要像本人,得靠参考图而不是形容词

想画出认识的人,上传正面参考图比写一百个外貌词管用,一人一张、光线均匀的正面照效果最稳。

群友一开始给我发的是侧脸照、逆光照,还有一张十年前的杀马特旧照,出来的脸全不对。后来我让他们重拍:正面、平光、别笑太夸张,一人一张传进去。即梦和可灵这类支持参考图的工具,配上「保持参考人物面部特征」这句话,出来的像像度肉眼可见地涨。Midjourney那边是用cref参数垫人物参考,思路一样。

有个细节提一嘴:戴眼镜的朋友最好也戴眼镜拍参考。我没提眼镜,出来那位哥们儿的脸是像了,鼻梁上那副没了,群里说他「术后重生」。提示词不会搭的话,可以参考我之前整理过的合照提示词写法,把人物外观和站位分开描述会顺很多。

构图和景深,合照自然感的一半

写清站位关系和镜头距离,再加一句浅景深,合照才有随手拍的感觉;人人正脸对镜头反而假。

真合照没人会站得像仪仗队。我会加「有人侧头说话、有人手搭在旁边人肩上、离镜头近的人略微虚化」这类词,画面一下子就不僵了。镜头词我用的是「手机随手拍视角、轻微仰角」,比「专业摄影」出来的自然。脸崩的那些,单独裁出来局部重绘,幅度0.35到0.45之间,我自己习惯先用0.4试。

那次毕业主题我们让所有人都穿学士服,服饰统一之后,画面的整齐度也跟着涨。AI处理「一群穿同样衣服的人」明显比各穿各的稳,衣服款式一多,它就开始自作主张给谁加件外套。

还有个省事路子:人不多的场景,先一人出一张单人图,再用局部重绘或者图生图把两张往一张底图上合。慢是慢点,比硬抽一张四人同框省心,适合给长辈做那种必须像的金婚合照。背景也别空着,「宿舍楼下的台阶」就比「户外背景」有真实感,场子一具体,人就更容易站进去。

那张合照最后发进群里,安静了半分钟,然后有人开始接龙抱怨自己被画胖了。争论胖瘦这件事本身,说明脸是真的像了。工具是现成的,耐心是自己的,人数、参考图、构图,按这个顺序来,翻车会少很多。下一次聚会要是还凑不齐人,我们打算把那位老师说破了也不肯露面的,也给他画进去。

常见问题

能把自己和明星画进同一张合照吗?

技术上可行,垫一张明星的公开照片当参考就行。但拿去公开发布或商用有肖像权风险,自娱自乐发朋友圈也要想清楚,更建议用「神似气质」的泛化描述代替真人脸。

合照里只有一个人脸崩了,整张重抽吗?

不用。把崩掉的脸单独框出来做局部重绘,重绘幅度从0.4开始试,两三次基本能救回来。整张重抽等于把其他几张好脸也押上赌桌,不划算。

多人合照用什么比例出图好?

两排站位用4:3或3:2,竖版全家福用3:4。横图硬塞一排六个人,每个人只有巴掌大,脸的细节根本糊掉了。

为什么画出来的合照里大家身高都差不多?

AI默认把人物「摆」在同一水平线上。在提示词里写明身高差和站位,比如「最高的站在后排中间、有人坐着」,会比干等着模型自己分配靠谱得多。