楼阁ai绘画总翻车?飞檐斗拱三个错误位置与改词实测

楼阁ai绘画总翻车?飞檐斗拱三个错误位置与改词实测
楼阁ai绘画飞檐斗拱古建筑出图实测

直接给结果:楼阁AI绘画最容易崩的是檐角、斗拱和柱网透视这三处,出图檐口耷拉、斗拱糊成鸟窝都算常规操作。先用方向明确的词替换泛泛的"飞檐",结构大错再进图生图局部修,两张图以内基本能救回来。

上个月我想换张桌面壁纸,题材挑了滕王阁,连跑十几张,张张檐角往下塌,像被雨泡过的旧楼。说实话那一刻我才反应过来,楼阁大概是古风题材里最欺负人的:亭子好歹几根柱子一个顶,楼阁是层层收分、斗拱成排、栏杆回廊全都要对位,模型错一点,整张图的古意就垮了。这篇把我踩过的坑和最后能用的改法摊开讲,你要是也被檐角气到过,接着往下看。

檐口下垂、斗拱糊团、柱网错位,楼阁到底错在哪

楼阁出图错在三处:檐角该翘反被压平、斗拱被当成浮雕糊成一团、高层柱网上下错位,根子是模型只学过楼阁长什么样,没学过它为什么立得住。

扩散模型看过的楼阁图角度太杂,特写有远景也有,它干脆画个中间值——檐不上翘也不下垂,看着说不出的别扭。斗拱更惨。真实斗拱是层叠悬挑的木构件,托着出檐的重量,图里它就理解成一坨贴在檐下的装饰,我见过最离谱的一张,斗拱悬空画在了檐口外侧,跟柱子彻底脱开,物理老师看了得晕过去。柱网错位多出现在三层以上的楼阁,二层柱子和一层对不上,越往上越歪,整栋楼像刚经历过地震。

为什么会这样?你把训练图翻出来看就懂了:楼阁的照片大多隔得很远,斗拱在图里就指甲盖那么大,模型学到的只是"檐下有一排深色纹样"这个印象,不是它一根根搭起来的构造逻辑。所以它画出的是楼阁的"印象画",不是建筑图。这三处错,一处毁氛围,两处毁结构,三处全占就纯属抽象画了。

改词实测:从十几张废片到能看,我只动了两轮词

把"飞檐"换成"翘角上扬层层出挑",再补"斗拱层叠、木构清晰",同一模型废片率从九成掉到四成左右,改动成本几乎为零。

我的原始提示词很偷懒:中国古建筑楼阁、飞檐、斗拱、夜景。SDXL跑了二十张,挑不出一张完整的。第一轮改法是把模糊词换成方向词——"飞檐"改成"飞檐翘角上扬""翼角起翘",出檐方向立刻稳了不少。第二轮补结构限定:"重檐歇山顶""面阔五间""木构斗拱层叠排列",柱子对位明显好一截。不夸张地说,就这两步,能用图从两张变成八张。

有两个容易踩的反面例子顺带说说。一是"对称构图"这个词别乱加,加上之后模型把两侧檐角画得笔直对称,古建的错落感全没了;二是"高清细节"纯属废话词,它不会帮模型理解结构,只会让它往斗拱上堆更多糊成一团的纹样。后来在Midjourney里我又试了加 --style raw,它自作主张加的雕花少了很多,画面干净不少。你要是用国风微调模型,这些词同样通用,不用推倒重来。

改不动就进图生图,局部重绘专修崩掉的区域

结构大错别指望改词,重绘幅度0.35到0.5的局部重绘专修檐角与斗拱区域,配合真实古建照片垫图,两三轮就能到位。

文生图改词改到头也就七八成水平,剩下的交给局部修复。我的流程是整图先出大形,把崩掉的檐角框出来,重绘幅度从0.35起步试,调太高了整层楼都跟着变,太低又纹丝不动,0.4附近是我用得最顺的档位。斗拱糊团这种硬伤,我会垫一张真实古建照片做ControlNet的lineart,轮廓对了再放开手绘感。有个意外发现:垫图选远拍的正面照效果最好,仰拍的照片会把透视也一起垫歪,我在这上面白耗了一晚上,你别重蹈覆辙。

还有个偷懒技巧留给不想折腾的人:修不动檐角,就换个取景把问题藏掉。远景剪影、雾天、黄昏逆光,这些处理对结构精度的要求低得多,檐角糊一点根本看不出来。我第一批废片里有两张就是这么救回来的,构图一换,废片变氛围片。

那张滕王阁最后成了,现在就挂在我桌面上,檐角翘得挺精神。回头看,楼阁难是真难,但它难得有规律:檐角方向、斗拱结构、柱网对位,三处盯死,改词加局部重绘双管齐下,出片率完全撑得起日常用。下次再出废片,先别删,对照这三处看一眼,大概率知道该从哪下手。

常见问题

楼阁ai绘画用哪类模型更省心?

带国风语料的微调模型对斗拱和瓦作的理解比底模好得多,底模出楼阁十有八九要靠垫图兜底。挑模型别看宣传图,直接搜作者放的楼阁样张,檐角翘不翘一眼便知。

为什么楼阁越画越高越歪?

层数越高,模型要对齐的结构就越多,出错概率翻着涨。建议词里控制在两到三层,真要画高塔,用正面视角加垫图锁住轮廓,比硬写"九层"靠谱得多。

楼阁配夜景要注意什么?

灯笼光源一多,模型爱把整栋楼染成暖橙色,轮廓跟着糊掉。我的做法是先出白天版定死结构,再用局部重绘换天色和灯光,结构保住了,夜景的味道也有。

延伸阅读