AI绘画古人总穿错朝代?朝代服饰词四组实测与改写法
先把话说在前面:AI画古人,服化道大概率是朝代大乱炖——只写"古人"两个字,混搭率能到七成以上。我按汉唐宋明四组各跑十张做了统计,又试出了补服饰名词的改写法,混搭率能压到三成以下。统计口径和改词清单都在正文,出图前过一遍能省不少返工。
AI绘画古人这个需求,看着和古风图是一回事,上手才发现差着一层:古风图要的是氛围美,古人图要的是"像那个朝代的人"。后者难得多。我起因是帮一家汉服社做活动海报,对方提的唯一要求是"别穿错朝代,社里都是行家",一句话把我逼成了考据党。
结果第一轮就翻车。唐代仕女的图,裙子形制是齐胸襦裙没错,衣襟上却钉着一排盘扣——盘扣这东西要到明代才流行起来,唐代人看不懂。更别提背景里凭空出现的太师椅了。社长的回复很客气:"美术可以夸张,文物不能乱来。"
四朝对照:光写朝代名到底行不行
只写朝代名,服饰混搭率超过七成;朝代名加上两三个标志性服饰名词,混搭率能压到三成以下。朝代词给的是大致底色,细节全靠名词往下压。
统计口径先交代:一张图里出现不属于目标朝代的服饰、发型、器物,记为混搭。四组各十张的结果——唐代组,齐胸襦裙基本能出对,但七张混进了宋明元素;宋代组,褙子出得意外稳定,问题多出在背景家具;明代组,立领和马面裙的命中率高,可发髻经常乱入清宫样式;汉代组最惨,曲裾深衣十张里只对了四张,模型对汉代的印象明显最模糊。
一个规律跑出来就藏不住了:越晚的朝代素材越多,出图越稳,明代最好画,汉代最难画。训练数据里的数量差距,直接写在了出图质量上。
生僻词还有个反直觉的现象:太冷门的术语反而不如白话好使。"曲裾深衣"能出图,"袿衣"这种更生僻的形制名,模型基本当没看见。拿不准的时候,用"交领长袍,衣襟绕身两层"这种描述性写法兜底,比赌它认识某个生僻字靠谱。
改词实验:名词要具体到"穿在哪"
补词要补到具体形制:写"圆领袍"不如写"唐代男子圆领袍,缺胯,革带",服饰名和朝代绑定出现,效果立竿见影。单甩一个服饰名词,模型照样自由发挥。
我做了三组改写对照。第一组只加"曲裾深衣",汉代组的正确率从四成升到五成,聊胜于无;第二组加"交领右衽,曲裾深衣,衣缘绣纹",七成;第三组再补发型器物——"垂髻,头戴巾帼,腰间玉具剑",八成以上。每加一层,模型的自由度就少一块,混搭自然就少了。
发型的优先级被严重低估了。前期我光盯着衣服改,后来发现一半的"穿帮感"来自头发——唐代该有的双环望仙髻,模型老给梳成现代半丸子头。把发型词提到服饰词前面,整体违和感降了一档。
负面词也能上考场。"盘扣、立领、马面裙、清宫发型"这类易混元素,在画汉唐时直接丢进负面列表,比正着描述省力。这条是从反复翻车里换来的,朴素但是真管用。
考据和出图的平衡点在哪
严格考据会牺牲画面美感,全放开又必然穿帮,我的取舍是主体服饰死抠,背景道具放宽。海报要的是不出错,不是进博物馆。
给汉服社的最终稿,我用的是这套折中方案:人物从发型到鞋履全部按形制词压死,背景虚化处理,太师椅这类乱入元素即使出现,虚化后也不扎眼。社长验收那天说了句"这回像话了",我松了口气,一晚上白头发是真长了。
几个高频穿帮点记一下,算是给大家排雷:一是椅子,唐宋之前的室内场景很容易凭空长出椅子,那会儿的人是席地跪坐的;二是折扇,它流行起来是明代的事,画汉唐人物时要特别小心;三是眼镜,隔三差五给古人架上,荒诞但常见。这三样看见了直接进负面词。
海报最后印了三百份,活动那天挂在汉服社的摊位上,没一个人挑出错。路过的人只觉得好看,只有社里的人知道这张图背后删了多少把椅子。AI绘画古人这件事,说难不难,说简单也不简单——你得多知道一点点历史,然后把它翻译成它听得懂的话。
常见问题
朝代词加上朝代绘画风格词会更准吗?
会有一点帮助,比如补充相应朝代的卷轴画风格词,整体气质更统一。但对具体形制的约束有限,服饰名词该补还得补,两者是配合关系。
同一套词换个模型还准吗?
方向一致,精度会漂。各模型的训练数据不同,混搭的偏好也不同,换模型后建议每组先跑三张摸底,再决定哪些词要加码。
武侠风格的图也按这个标准来吗?
看作品口径。武侠本就是架空混搭,没有严格朝代,重点全在气质;历史剧同人、博物馆宣传这类才有考据要求,先想清楚你的观众是谁。
哪里能查到可靠的形制名词?
博物馆官网的藏品说明和正规服饰史读物最稳,专门考据帖也可以参考,但存疑的信息别直接写进提示词,先交叉核对一条再用。