杜甫AI绘画为什么张张是课本同款脸?模型记忆现象实测

杜甫AI绘画为什么张张是课本同款脸?模型记忆现象实测
杜甫AI绘画实测:课本画像同款脸与秋风茅屋场景的对比插画

我的判断是:AI画杜甫十有八九是课本画像那张脸,不是它画得像杜甫,是它把流传最广的那张画像背下来了。我做了十轮对照实验,换掉人名、只留时代和处境描述,同款脸的出现率从八成掉到两成以下。数据和三组改写法都在下面。

杜甫AI绘画这个题目,来自我表弟的历史作业——老师让每人交一张"我心目中的杜甫"。他连出二十张,每一张都像从同一本语文课本里剪出来的:方脸、长须、皱着眉、头戴幞头。他问我:"AI是不是只认识这一个杜甫?"

还真差不多是。那张广为流传的杜甫画像,几十年来印在课本、挂在教室,是绝大多数人见过的唯一一版杜甫,也顺理成章成了训练数据里杜甫这个词的"标准答案"。模型不是在画杜甫,是在背那张画。

十轮对照:同款脸到底有多顽固

直接写"杜甫",同款脸出现率八成上下;把人名换成身份处境描述,同款脸降到两成以下。人名指向的是数据里最著名的图,描述指向的是画面本身。

实验设计不复杂。第一组直接写"杜甫,水墨风格",跑十张:八张是那张脸的变体,剩下两张虽不同款,也是套路化的古装老者。第二组写"杜甫在茅屋前望向远方",十张里九张还是同款脸,只是背景换了——名字一出现,脸就被焊死了,背景词撼不动它。

第三组是关键。我把人名整个拿掉,改成"安史之乱中流亡的清瘦中年文人,布衣草鞋,拄一根竹杖,眉间有愁苦,唐代水墨人物画"。十张里只有一张撞上同款脸,其余九张脸各不相同,有两张瘦骨嶙峋的,反倒比课本像更有乱世里熬出来的味道。表弟最后交的就是其中一张。

代价也说清楚:去掉人名后,得自己把时代信息补全,不然模型会给你明朝的服饰、清朝的家具。唐代人物、幞头改布巾、窄袖袍,这些词得手动列上,等于拿考据换多样性。

想画"课本外的杜甫",场景词比脸词好使

青年杜甫、流亡途中的杜甫、雨夜茅屋里的杜甫,区分度靠场景和年龄词,不靠换脸词。处境一变,画面气质立刻就变了。

我试过三组场景。"青年杜甫,裘马轻狂,齐鲁大地远眺",出来的画面眉眼是舒展的,真有点少年意气;"安史之乱途中,风尘仆仆的中年文人牵着瘦驴",愁是愁,但那是赶路的愁,不是课本上那种端着架子的忧国;"八月秋风吹破茅屋,诗人立在漏雨的屋前望天",这张的体态最生动,衣袂是被风吹起来的。

有个细节我印象很深:写"望天"和"仰望",出图的构图差很多。"望天"多是大远景,人缩在画面一角,天地压过来;"仰望"多是近景仰拍,脸占画面一半。同一个意思,景别完全不同,这种词感只能靠多跑积累。

年龄词也有类似杠杆。"两鬓斑白的晚年诗人"和"中年文人"出的图,体态和面部沧桑度差别明显,前者驼背含胸的比例高不少。杜甫一生跨度大,这一招正好用来出系列图——青年、中年、晚年各来一套,作业的完成度一下就上去了。

丑话说前头:这类历史人物实验图,自己练习、做作业用没问题,要是公开发布,标注AI生成是底线,别让人误以为是考据出来的历史形象。

同款脸现象,李白苏东坡一样逃不掉

凡是有"一张全民熟悉的画像"的历史人物,AI都会背诵那张脸,李白、苏轼、李时珍全在此列。想跳出来,解法是同一套:去人名、补时代、给处境。

顺手测了几个:李白十张里七张是举杯望月那个经典造型,苏轼六张是大胡子持杖形象,和教材、邮票、纪念馆里的版本高度重合。反倒是那些没有标准像的人物——比如大多数诗人词人——出图自由度大得多,因为模型没得背,只能按时代和身份现编。

这么看,同款脸不全是坏事。你想要"一眼认出这是杜甫"的图,直接写人名反而最有效,模型替你完成了大众认知的对齐。分界线在于你的用途:要共识,用它背下来的脸;要新意,把名字藏起来,只给它时代和命运。

表弟的作业得了个"优",老师还在班里展示了他那张拄竹杖的流亡杜甫。发图的时候他按我说的标了"AI生成"。那张课本画像陪我背了三年"茅屋为秋风所破歌",如今模型把它背得更熟——可诗人的样子本来就不该只有一张,你说是不是。

常见问题

为什么模型会把画像当成真人长相?

模型没见过杜甫,它对"杜甫"这个词的全部认知来自训练数据,而数据里这个词绑定的图像,就是那张传播最广的画像。出现频率最高的样本,就成了它的默认答案。

去掉人名后画面时代老穿帮,怎么办?

把朝代、服饰、器物写成明确的词列进去,比如唐代、圆领袍、幞头、酒肆。模型对具体朝代词的把握比想象中好,缺的是你不说它就自由发挥。

能不能把画像垫图后再改造?

可以,垫图加高重绘幅度能得到"神似但有变化"的脸,适合想要一点共识又不想完全撞款的场合。重绘幅度给多少得试,不同工具的刻度不一样。

这样做出来的杜甫图有版权问题吗?

AI生成图的版权认定本身还在发展中,各平台规则不一。个人作业和练习风险不大,商用前先查所用工具的授权条款,并保留生成记录。

延伸阅读