意间ai绘画人和狗狗怎么出图?一人一狗实测
别绕了:一人一狗的图,难的不是人,是狗。品种跑偏、腿被拉长、表情僵硬,这仨问题解决了,其余都是顺手的事。
用意间ai绘画生成人和狗狗的同框图,是我今年玩得最上头的一个题材。家里那只柯基叫年糕,两岁,脾气好得很,我给它跑了几十张同框图,手机相册里专门有个文件夹。踩过的坑不少,能用的经验就几条,都在下面,全是我拿它当了两个月模特换来的。
品种词写不写,差距一跑就知道
只写"狗狗",模型给你抽奖;把品种、毛色、体型三样写死,还原度立刻不一样。这是几十张图换来的结论。
第一轮我偷懒,就写"女孩和狗狗在草地上",出来八张,狗是什么品种全凭模型心情,有金毛有萨摩耶,还有一只看不出血统的卷毛。年糕是双色柯基,橘白配色,一个都没对上。第二轮我把词固定成"双色柯基犬、橘白相间、短腿长身、立耳",品种命中率肉眼可见地上来了,八张里能出五六张像模像样的柯基。
毛色词比品种词还关键。柯基里也有黑白的,光写柯基还是抽奖,"橘白相间"这五个字才是年糕的身份证明。后来我干脆存了一个"年糕词组":双色柯基、橘白、白围脖、立耳、微胖。每次出图整组复制,比自己攒词快得多。这个词组我到现在还在用,属于一次性投入长期回本。
场景词跟狗的颜色也得搭。5月我试过一批秋日落叶场景,橘白柯基混在黄叶子里,毛色和背景融成一片,图是好看但狗不显眼;换成青草地,双色立刻跳出来。浅色狗配深背景,深色狗配亮背景,这个理儿跟穿衣服一个样。
人和狗抢戏怎么办
两个主体的图,注意力得有主次:狗放前景占三分,人占七分靠后,画面才不乱。
早期出的图经常出现怪事:人和狗各站一边,中间隔着老远,像刚好同路的陌生人。问题出在构图词缺失。补上"女孩蹲下搂着狗狗的脖子"这类互动动作,两张脸凑进一个画面,关系立刻有了。蹲姿、伸手摸头、狗狗抬头回望,这几个动作词我轮着用,出图自然。
还有一版翻得离谱:模型为了突出狗,把人画得特别远特别小,远看像狗牵着隐形人散步。这之后我学会在关键词里写清位置关系:"狗狗蹲坐在画面右下角前景,主人站在其后方轻抚狗背"。位置写明白了,画面秩序就有了。话说回来,人和宠物的图,最动人的反而是那个"正在互动"的瞬间,摆拍姿势倒不重要。
道具是另一味调节剂。飞盘、网球、牵引绳,加一样画面就多一层故事。但道具也翻车:我写过"牵着牵引绳",模型给狗画了两根绳,一根通向主人手里,另一根通向画面外不知道谁的手。后来只写"狗狗叼着飞盘",省事,还不容易冒出多余的线头。
柯基的短腿,模型非要给它拉长
短腿犬种最容易失真,模型默认按标准犬类比例画,得在关键词里反复强调体型特征。
柯基的精髓在腿短身长,模型恰恰最爱在这方面自作主张。我跑出来的柯基十张里有六张腿是普通狗的长度,看着像套了柯基毛皮的柴犬。对策是把"短腿、长身、低位身形"写进词组,还不够就加"贴地"这类夸张词。即便如此,十张里仍有一两张腿偷偷变长,只能靠挑。年糕要是知道自己总被AI拉腿,估计也不乐意。
表情是个隐藏难点。狗脸在AI手里容易僵硬,要么呲牙太凶,要么眼神发直。加"吐舌、歪头、耳朵立起"这类活泼动作词,僵脸率能降不少。4月我出过一张年糕歪头看镜头的,配的文字是"你在吃啥",发到家庭群里,我妈以为我真给它拍了照。那算我这几个月跑图跑得最得意的一次。
毛发质感也值得单独写一句。柯基是双层毛,脖子一圈炸开的"狮子领"是它的门面,加"蓬松双层毛、颈部饰毛丰厚",出来的狗立刻精神。我对比过加与不加的两版:不写的那版毛像塑料,写的这版像能下手撸两把。宠物图要的就是这个手感。跑题一句:年糕现实里只在听到"罐头"两个字时才歪头,AI倒是随叫随到。
一人一狗出图这事,说难不难,就是把狗当主角之一去写关键词:品种、毛色、体型、表情,一样别省。年糕那三十多张图,能打的两只手数得过来,但每一张都值得。家里的毛孩子不会摆姿势,AI替它摆,你负责挑。哪天模型把柯基的腿彻底画对了,我反倒要怀疑它没记住这个品种。
常见问题
生成的狗不像自己家的狗怎么办?
纯关键词只能到"品种像",要"长得像"得用参考图:挑一张光线好、侧脸清晰的狗照上传,再配上品种毛色词,相似度会明显提高。糊图、逆光照当参考,出来也是糊的。
狗狗的表情总是太凶或太僵,怎么调?
加情绪和动作词:吐舌、歪头、耳朵放松、张嘴喘气笑。单独写"开心的狗"效果一般,具体到动作和神态,模型才接得住。
人和狗同框,什么构图最出效果?
三七开最稳:狗占画面三分之一放前景,人占三分之二,中间用互动动作连起来。对半开最容易散,两个主体各玩各的。