ai绘画打败绘画了吗?同题十轮PK的实测结果
先给结论:「打败」是个偷懒的词。十轮同题PK打完,比分咬得很紧,但赢的场次规律分明——AI赢氛围,人赢表达。争谁取代谁之前,先看看这组实测数据。
ai绘画打败绘画了吗?这问题我听人吵了一整年,吵的双方谁也没真坐下来比过。九月初我受不了了,拉上学美术的朋友阿岚做了场正经PK:同题、限时、盲评,十道题一轮打完。她是纯手绘,画龄八年;我出图用AI。打完那天我俩说了同一句话——结果跟赛前预想的完全不一样。
赛前的普遍预想是AI碾压。毕竟出图速度摆在那,40分钟能跑30张挑1张。真打起来,好几个回合阿岚赢得毫不费力。
PK怎么设计:同题、限时、盲评三件套
公平PK的三个前提:题目一样、时间一样、裁判不知道哪张是谁画的。缺任何一条,结论都站不住。
规则定得挺细。十道题提前一周抽签定好,从「雨夜便利店」到「外婆的缝纫机」,一半是纯氛围题,一半带叙事要求。每题双方限时40分钟交一张,AI方40分钟里跑了多少张随便,最终只交一张。评审请了12位同事,作品去掉署名打乱顺序,每人每题投一票,平票算平局。
40分钟对双方都不算宽裕。阿岚平时一张插画要画两三天,逼她40分钟交稿其实对她不公平;我这边40分钟倒是绰绰有余,能跑两轮词表。这个不对等我们在赛后专门聊过——快本身就是AI的核心属性,掐掉速度等于掐掉它的看家本事,这规矩没毛病。
十轮比分:赢的场次规律分明
氛围场景题AI四胜一平,人物叙事题阿岚三胜一平,剩两局各胜一场。题目越依赖情绪和故事,人这边赢得越稳。
| 题目类型 | 比分(AI:手绘) | 典型题 |
|---|---|---|
| 氛围场景类(5题) | 4:1 | 雨夜便利店、雾中灯塔 |
| 人物叙事类(5题) | 1:4 | 外婆的缝纫机、等末班车的人 |
氛围题的差距最没悬念。「雨夜便利店」阿岚画了40分钟,光影氛围只铺了一半;我这边第9张就跑出了湿润霓虹感的图,12票里拿了9票。这种题拼的是氛围还原度,恰好全在模型的舒适区里。
叙事题的走向反过来了。「外婆的缝纫机」我跑的图质感漂亮,缝纫机画得纤毫毕现,但12票只拿了3票。评委的评语很一致:图很美,但看不出「外婆」。阿岚那张技法糙得多,针线筐歪着放,一把老花镜搭在布料上,就这两个道具,评委全看懂了。她赛后说这句戳到点子上了:她画的不是缝纫机,是「有人常年坐在那里」的痕迹。我复盘自己的提示词才发现,词里只写了「缝纫机、老人、温暖光线」,从没交代过「外婆和老屋的相处方式」,模型拿什么知道?
最刺激的一题是平局:「等末班车的人」。我出的人物图败在手上,握站牌的手崩了两次,40分钟内没救回来;阿岚那边的图情绪到位但背景空了。评委投票6比6。两张平手的作品后来都贴在了我们群里,各有各的 supporters。
「打败」论错在哪:它只比了一个维度
速度维度AI确实碾压,但表达意图的维度上,不亲自到场的人赢面更大;两回事被压成一个「打败」,讨论就没法开展了。该问的是各管哪段。
打完这场PK,我对「打败」这个词祛魅了。它能成立的前提是把绘画约化成比拼出图速度和画面完成度,这两项AI赢得毫无争议——10倍20倍的效率差,没什么可辩的。可绘画还有另一半:你为什么画这个、把哪个细节当锚点、让看的人接收到什么。这部分AI目前接不住,因为它不知道「外婆」两个字的分量。
阿岚的转折发生在第九题之后。她主动让我教她跑图,回去就把AI用进了自己的流程:草图阶段的十几个构图方案,现在交给AI跑,选定方向后还是自己上手画完。用她的话说,AI把她最烦的「想构图」环节外包了,把她最喜欢的部分留给了她。我看的这十轮PK,说到底就是看了这个转变的现场版。
所以我的答案是:这场PK没有输家,只有分工。拿AI打氛围、打探索、打海选,把人的精力留给叙事和意图——这组合拳打出来,比争论谁打败谁有意思多了。
常见问题
这场PK的盲评真可靠吗?
12位评委事先都不知道作品归属,票数也匿名收集。样本不大,结论谈不上学术,但氛围题和叙事题截然相反的走向太清晰,偶然性解释不了这个分界。
给手绘方更多时间结果会变吗?
氛围题大概率还是AI赢,时间再宽裕,手绘铺一张复杂光影也要以天计。叙事题可能差距更大,阿岚说给她三天,外婆那张她能再加三处生活痕迹。
换个更强的模型AI会全面翻盘吗?
氛围题的上限会再抬高,但叙事题的短板不在画技在「知情」——它不知道该把哪个细节当锚点。这个信息得由人来喂,喂得越准图越对味,所以人的位置变了,没消失。
想复现这场PK要准备什么?
三样就够:提前抽定的题目清单、统一的限时、一组不知情的评委。最花时间的是找评委,六七位也够用,票数少注意别出现大量平票。