AI绘画巨兽怎么画出体量感?参照物、仰角与雾气的实操拆解
开门见山:巨兽画不大,八成是画面里缺参照物,跟模型好坏关系不大。参照物、仰角、雾气三件事做对,普通模型也能出电影级体量感。下面把我接怪物设计单攒下的参数和翻车修法全摊开。
先交代个背景:AI绘画巨兽这个题材我今年接了小十张单,游戏侧的怪物立绘和小说封面都碰过。最早交付的那批被甲方打回来三次,理由很统一——"这是个四十米的怪,画得像个两米八的壮汉"。
当时我不服气,把图放大两倍交回去,更糟了。问题根本不在尺寸,在于画面里没有一样东西能让观众比对大小。这事想通之后,后面几张的返工率基本归零。
所以这篇不聊玄学,就讲三件我每张单子都会过一遍的事:参照物怎么塞、镜头怎么趴、雾怎么遮。顺带把我救图的参数笔记原样贴出来,你可以直接对着调。
巨兽画不大,先补参照物
巨兽的体量感七成来自参照物。人、树、城墙、飞鸟,任何观众知道实际尺寸的东西放进画面,比例马上被锚定。没有参照物的巨兽图,模型自己会把它当普通生物来分配画面占比。
我的做法很土:先出一张没有参照物的底图挑姿态,构图定下来之后,用局部重绘在崖边或前景塞一个火柴盒大小的人影。提示词写 a tiny lone human silhouette standing on the cliff,权重拉到 1.2 左右,防止被大色块吞掉。
翻过一次车。有张图我把小人画得太清楚,连衣服褶皱都出来了,甲方问"这个路人是谁"。人影要小、要逆光、要看不出脸,观众自己会脑补比例,脑补出来的永远比你画出来的更震撼。
城墙和树是备选。城墙适合横构图,树适合纵向延展的丛林场景。2026年9月这轮测试里,同一只巨兽加参照物前后的图放一起,十个朋友有九个说加了的那张"至少大三倍"。图明明没变。
仰角加雾气,最便宜的两台体量放大器
镜头压低到巨兽膝盖以下仰拍,再叠一层体积雾,同一条提示词的压迫感至少翻倍。这两招不用换模型,改两个词就见效,是我固定挂在提示词末尾的配置。
仰视的关键词我用 low angle shot、worm's eye view 这类,配 dramatic foreshortening 会更夸张——前爪占半张屏,头缩在雾里。俯视是反效果,从上往下看,再大的兽也像标本。
雾的写法有讲究。volumetric fog 加 mist shrouding the lower body,让雾只吃掉下半身,头和眼睛露着。我试过整只泡在雾里,氛围是有了,发群里被吐槽"这是怪兽还是雾霾预警"。雾遮七分露三分,眼睛那一点要留着,体量感和恐怖感都压在那双眼睛上。
参数层面没什么玄的:采样步数我固定 28 到 32,CFG 6.5,雾的浓度靠词条重复的次数控,写一遍偏薄,写两遍容易糊。这个手感只能自己养。
爪子牙齿崩了,别整张重跑
局部重绘比整张重画划算:蒙住崩坏的爪尖或牙齿,重绘幅度压到 0.30 到 0.35,步数不变,两三轮基本能救回来。整张重跑等于把选好的构图也扔进抽奖池,亏。
巨兽最容易崩的是爪尖和口腔。牙齿一旦超过五颗或者长短不齐,画面立马廉价。我现在的流程是先出 20 张小图挑构图,选定后放大到 1536 乘 1024 再精修,蒙版羽化开到 8 像素,重绘幅度 0.32。20 张里能挑出 3 张骨架没问题的,这个比例我早就习惯了,别指望一次命中。
鳞片是另一个坑。只写 scales 粒度太细,远看像磨砂。改成 thick overlapping plates、cracked hide,甲片感就出来了,还顺便带点旧伤的叙事。有张单子我加了 old battle scars,甲方专门问是不是参考了某部老电影,其实就是两个词的事。
回头想那批被打回三次的图,错的从来不是模型,是我没给观众一把"量尺"。下一只巨兽,先想清楚人站在哪、雾遮到哪、镜头趴多低,再动手。这三件事花不了十分钟,比事后放大十倍重画省事多了。
常见问题
画巨兽一定要用专门的怪物模型吗?
不用。我用的还是常驻那几个通用模型,参照物和仰角做对,照样出体量。专门的怪物模型色彩更脏更野,偏好这个味道可以换着试,属于口味问题。
巨兽皮肤纹理的提示词怎么写?
别只写 scales。我常叠 thick overlapping plates、cracked hide、wet sheen,前两个给结构,最后一个给活物的油光。太干净的皮肤反而假。
细节堆得越多是不是越显大?
反了。细节太密会把画面填满,观众失去判断大小的留白。显大的图都舍得空:雾、天空、渺小的人,留白越多兽越大。
手机上的App能画巨兽吗?
出氛围图可以,但局部重绘、蒙版羽化这类精细活多数App做不了,救图能力差一截。玩可以,接单还是建议回桌面端。