AI绘画画给人洗脚这类动作总崩?交互姿势实测

AI绘画画给人洗脚这类动作总崩?交互姿势实测
AI绘画双人洗脚交互动作的实测场景插画

长话短说:双人交互动作崩,根源是模型把两个人当成两张脸各画各的,谁对谁做什么它没有方向感。写清动作双方、接触点和镜头视角,通过率能从一成拉到八成。我为一张足浴店海报跟"给人洗脚"这个动作磨了三天,四十多张废图换来的改词公式,全在这篇里。

AI绘画画给人洗脚这类动作,是我今年碰过最难缠的需求。事情起因很简单:老同学开了家足浴店,让我帮忙出一张开业宣传插画,画面就是最普通的场景——技师蹲坐在小凳上,给顾客洗脚。就这么个动作,我三天崩了四十多张,手指多长、脚踝反折、水盆悬空,什么怪相都见过了。

结论先押在这儿:双人交互崩,不是模型不会画人,是它把两个人当成两张独立的面孔在拼贴。"谁对谁做什么"这个方向感,提示词不写明,它就靠抽。

为什么双人交互最容易崩

三个原因:近距离接触的训练素材少、接触点常被身体遮挡、"给某人做某事"这种方向关系模型天生不敏感。

单人图模型见得多了,闭着眼都能画。但两个人贴在一起、手和脚互相穿插的画面,训练数据里本来就少,模型对这类构图的想象力明显单薄。更要命的是接触点——洗脚的灵魂在"手捧着脚"这一下,而恰恰这个位置被手、脚、水盆叠在一起,是模型最不想细画的地方。

废图堆里能总结出一部"崩法图鉴"。脚踝反折成直角的七张,左脚六个脚趾的三张,水盆里的水清得能看见盆底花纹、但脚是干的四张——脚悬在水面上方两厘米,热气倒是画得挺足。最绝的一张,技师的双手规规矩矩捧着一个空盆,顾客的脚踩在盆沿外面,两人隔着半米互相微笑,那画面安静得像谈判现场。

我第一版提示词写的是"一个人给另一个人洗脚",十张里九张手指数目不对,剩下那张好手好脚,结果是技师在给顾客剪指甲。模型只知道"附近得有两个人",至于谁服务谁,它真不在乎。

我的救图四轮记录

改词公式:主体+姿态+客体+接触点+视角,五段一个都不能省。词序换了,出图是从抽卡变成点菜。

第二轮,我把双方身份写死:"一位穿深蓝制服的女技师跪坐在木凳上,双手捧着一位男顾客的右脚"。十张里四张方向对了,但脚经常悬空,水盆飘在半空当装饰。问题找到了——只有双方,没有接触。

第三轮补接触点:"双手捧脚、双脚浸在木盆热水里、毛巾搭在膝上"。六张方向正确,崩法收敛到细节层面。第四轮加视角"侧面全景",把两人之间的位置关系钉死,十张里八张能用。剩下两张,一张多出了第三个人的手——负面词里补"多余的人物、多余的手"才按住。

对了,还有个容易漏的细节:家具高度。不写"矮凳",技师经常被画成站着弯腰九十度,腰折得吓人。写上"跪坐在矮凳上",姿态立刻自然。这类地面支撑的词,比你想的管用。

其他交互动作也一样救吗?

同一套公式适配大多数双人动作,难度排序大致是:递东西最稳,握手次之,梳头和拥抱最难。

我拿调通洗脚的那套结构顺手测了三个动作。递杯子,十张过七张,物件明确,接触点单一,模型最擅长;握手,过六张,偶尔两只手交叠成鸡爪,负面词拦一下就好;梳头,只过三张,手要穿过头发、头发要压住手,两层接触叠一起,模型就犯糊涂。拥抱最难,只过两张,我干脆放弃了,换成"并肩靠坐"这种弱接触的写法。

规律摸出来就一条:接触点越少越明确,成功率高;接触面积越大、身体穿插越多,越难救。策划画面的时候,能选递东西就别选拥抱,能给侧面就别给背面。客户要是坚持要难的动作,就把省下的额度预支给局部重绘。

回头看我那四十多张废图,心疼归心疼,账算得值:双人交互的崩,崩在关系不明,不是崩在画工。身份写死、接触点点名、视角钉住、家具高度别漏,这套五段式走完,"给人洗脚"从十不存一到八成能用。你要是也在画双人场景,先把这五段补齐,再谈抽卡手气。同学的海报最后也交了,他没看出那六个脚趾的曲折历史,挺好。

常见问题

为什么AI画的脚经常比手还怪?

脚在训练数据里出现时多半穿鞋、被遮挡,模型对裸脚的结构掌握确实差。洗脚题材等于专挑它的短板,能救的办法是让脚处于"被捧着、泡着水"的状态,遮挡反而降低了画错概率。

画面里人数控制不住怎么办?

正面词写死人数,负面词拦"多余的人、多余的手"。我实测正负面两边都点,十张里七八张能保住两个人。

用真人照片垫图能提升交互动作吗?

有帮助,垫一张姿势相近的参考图,比纯文字稳。但要垫构图不垫风格,不然模型把参考图的水印和质感也学走了。

三人以上的场景还能用这套公式吗?

能,但要给每个人单独一段"身份+姿态+接触点",段落顺序就是你要的站位顺序。人数越多,越要狠心简化动作。

延伸阅读