ai绘画大战人类?办了一场盲评后我的看法变了

ai绘画大战人类?办了一场盲评后我的看法变了
ai绘画大战人类盲评实验:两张风格相近的画作并排摆放供人投票的场景

我的判断先放这:论画场景,AI已经赢过大多数人;论画「人味」,它还差着一口气。这不是我猜的,是三十个人盲评投出来的结果。

ai绘画ai大战人类这个话题吵了三年,吵的双方大多没做过实验。我上个月干了件费劲的事:凑了十二张图,办了一场盲评。规矩很简单,不告诉投票的人哪些是AI画的,让他们凭感觉选。

结果出来那天,我把截图反复看了三遍。有几个数字确实出乎意料。

盲评怎么做的:样本、人数和规则

实验设计:六张AI图加六张人画图打乱排序,三十个非美术从业者投票猜「哪张是人画的」,猜对率五成说明分不出来。样本和规则全公开,你可以照着复刻。

AI那六张,我用了三款工具各出两张,题材刻意选了容易混的:雨夜街景、书房静物、水彩少女头像。人画那六张,一张是我美院毕业的朋友给的旧稿,两张买自一个自由插画师的闲置图库,剩下三张从美术社群的日常打卡里征来,作者都授权了。每张图统一裁成同样尺寸,抹掉签名。

投票人群是公司同事加朋友群,三十一个人,只有一个学过两年素描。规则就一条:给十二张图标了A到L的编号,每人挑出他认为「AI画」的六张。投票用了两天,收回来三十份有效答卷。

有个细节我事先没想到:有五个人在群里问我能不能看高清大图,说缩略图看不出笔触。我拒绝了——真实场景里大家刷手机看到的也就是缩略图。

票数揭晓:AI赢在场景,输在人物

结果分层很明显:两张AI场景图的「被识破率」只有两成多,而两张水彩人物有八成人一眼认出是AI。题材决定胜负,工具差距反而是其次。

题材AI图被识破率备注
雨夜街景23%霓虹倒影那张,好几个人坚持认为是照片
书房静物35%书脊上的假文字暴露了它
水彩少女头像81%手指数量和睫毛走向是重灾区
山间晨雾29%没人怀疑,评论区还有人问在哪拍的

六张人画图里有四张被 majority 误判成AI,最冤的是我朋友那张旧稿——画了三周的钢笔淡彩,十九个人认定是AI出的。她知道后的原话是「我该高兴还是该骂人」。这话我一直没忘,因为它比任何数据都扎心:技法上的差距已经抹平了,人们只能靠细节逻辑来找茬。

三十一个人里,平均猜对率是四成七。也就是说,整体上大家跟抛硬币差不多。但拆开看,学过素描那位猜对了十一张,全卷最高。

还有一个我没预料的现象:第二天有六个人私聊我要改答案,说晚上回家用电脑放大重看了一遍,信心全崩了。改完的四个人成绩反而降了——他们把两张真图改判成了AI。这个细节挺有意思,越较真越容易把「画得太好」当成机器的罪证。

人们靠什么识破AI图

投票后的追问显示,识破AI的线索排前三的是:手指和肢体结构、画面里的文字、细节之间的因果矛盾。质感反而不是主要破绽。

我给答对最多的十个人补了个追问:你凭什么判的?答案高度集中。七个人提到手,尤其持物的那只手——水彩少女拿茶杯的手,指节弯折方向不对,一眼假。五个人提到书脊上的字,AI爱生成那种「差一点是字」的伪文字,放大就露馅。还有三个人说得挺玄但我觉得在理:光影方向前后不一致,窗户在左,影子却朝右。

有意思的是,没有一个人提笔触。放在两年前,「没有笔触」还是AI图的死穴,现在没人靠这个判断了。AI模仿水彩的晕染已经以假乱真,模仿不了的是「手会画错」这件事——人画画会失误,AI的失误是另一种失误。

顺着这个思路想,往后插画师的价值可能恰恰在那些「不完美」里。我那位朋友后来说,她打算把草图的手稿过程也发出来,当作品的一部分卖。我觉得这招能成。

回到开头那场吵了三年的大战:它其实没有赢家,只有分工。要快、要氛围、要量产,AI现在就是好使;要经得起放大看的人物、要有作者痕迹的表达,人还稳稳占着。

盲评结束时我问自己,假如十二张图里只能留一张,我留哪张?我留的是那幅被冤枉的钢笔淡彩。理由说不清,大概因为它画错的那一笔,看着舒服。

常见问题

盲评结果能代表所有人的判断力吗?

不能。样本三十人且多为非美术背景,识别率肯定偏低。学过绘画的那位参与者成绩远超平均,说明眼力可以练,普通读者多看多对比也能接近。

现在AI画人物真的不行了吗?

没那么绝对。远距离、背身、动态大的人物图AI已经很能打,翻车集中在手部特写和面部微表情。挑题材使用,照样够用。

普通人怎么快速分辨AI图?

先放大看三处:手指、画面内文字、光影方向是否统一。三处都过关再看质感,这个顺序排下来,八成的图都能判对。

这场实验用的AI图是哪几款工具出的?

三款主流工具各出两张,具体名字不影响结论——同一题材下三家的被识破率差距很小,题材才是决定变量。

延伸阅读