用绘画AI鉴别AI图靠谱吗?误伤与漏判实测
这事得掰开讲:鉴AI工具能当参考线,当不了判决书。我凑了三十张图——二十张AI图加十张真人手绘,过了两个主流检测器,结果一边漏掉七张AI图,一边把三张水彩手绘冤枉成AI。误伤和漏判的明细、成因、自证办法,全在这篇里。
绘画AI鉴AI的争议,吵到现在已经分成了两拨:一拨把检测分数当铁证,一拨干脆全盘不信。我自己测完这轮,立场落在中间——分数要看,但不能只有分数。判断一张图是不是AI,目前还没有一锤定音的工具。
实验怎么做的先交代清楚:二十张AI图,覆盖写实、二次元、厚涂、水彩四种画风,出自我手里的三个工具;十张真人图,是五位画师朋友提供的板绘、水彩和素描,全都拿得到源文件,错不了。两张图混在一起编号,两个检测器盲测。
测出来的账:误伤比漏判更扎心
两个检测器加起来:二十张AI图漏判七张,十张真人图误伤三张。漏判让怀疑落空,误伤却是拿真人的名声陪葬。
先说漏判。二十张AI图里,写实风的几乎全被抓住,二次元平涂漏得最狠——十张二次元里六张被判"人类创作",卡通头像也常漏。检测器显然更擅长抓照片质感的图,风格化越重,它越瞎。
误伤那三张更让我难受。一张水彩街景,一张厚涂人像,一张彩铅宠物,全是朋友画了十几个小时的心血,双双被判成"高度疑似AI"。水彩那张的置信度还高达八成七。你说气人不气人——AI的风格本来就是从真人那儿学的,学得最像的,恰恰是真人里画风最"干净"的那批。
两个检测器,脾气还不一样
同一批图喂给两个工具,结论经常打架:一个偏严一个偏松,严格的那位误伤多,宽松的那位漏判多。单靠一家下结论更悬。
细看两家的风格挺有意思。甲检测器是"宁可错杀"型,真人图里冤枉了三张,好在AI图只漏了两张;乙检测器是"宁放过"型,真人图全放行,代价是二十张AI图漏掉七张。两个分数摆在一起,你根本找不到一个两全的裁判。
更麻烦的是它们还会翻供。同一张图,我压缩一次再传,分数掉了两成;换个文件格式,又涨回去一点。检测器看的不是"画",是画留下的数据痕迹,压缩、裁切、加滤镜都能把痕迹洗淡。这意味着什么?意味着分数可以被无意地改变,也能被有意地伪装——两头都让人不踏实。
为什么水彩和厚涂最容易被冤枉
检测器抓的是纹理均匀、边缘过度平滑这类统计特征,而水彩晕染和厚涂过渡天然就长这样。风格越"干净",撞上AI特征的概率越高。
把三张被误判的图放大看,规律就出来了。水彩的边缘晕开,颜色过渡没有笔触棱角;厚涂用软边笔刷,皮肤和布料的过渡也是糊成一片的。这些在检测器眼里全是"疑似生成"的指纹。反倒是笔触粗粝的素描和彩铅,因为纹理杂乱,全部安全过关。
这就引出一个不舒服的推论:画风越精致越平滑的画师,被冤枉的概率越高。群里一位专画厚涂的朋友,今年已经被质疑了三次,最后一次在某个社群被管理直接踢了群,理由就是"检测器说你是AI"。
被误判成AI,怎么自证清白?
最硬的证据是过程:分层的源文件、带时间的录屏、不同进度的截图。检测分数只能佐证,流程证据才能翻案。
那位被踢的朋友后来翻案成功,靠的不是申诉检测分数,是甩出了三样东西:PSD源文件里的未合并图层、绘画软件的历史记录截图、还有一张从草稿到成稿的五阶段对比图。管理看完当场道歉。这套流程不复杂,成本就是平时随手多存几步。
我的建议是给每个正式作品留三件套:开工前录屏几分钟,过程中存两三次带图层的文件,完稿导出一张带时间水印的过程图。做起来五分钟的事,遇上纠纷能省半个月的扯皮。
测完这三十张,我的结论没变过:鉴AI工具是个筛子,筛得出粗沙,漏得了细沙,还会把金子筛出去。看到"疑似AI"的分数,先想想水彩晕染那个误伤案例再开火;收到自己被质疑的消息,别急着自证清白式地吵,把过程证据亮出来。工具会迭代,但"分数即审判"这件事,今天还轮不到它。
常见问题
检测器说图有百分之九十概率是AI,可信吗?
高置信度也别全信。我那张误伤的水彩就是八成七。分数只代表纹理特征接近生成图,不代表来源,高分只能作为线索。
哪种画风的AI图最难被识别?
我这轮里是二次元平涂和卡通头像,漏判过半。风格化越强、纹理越干净的图,检测器越抓瞎。
有没有办法让AI图看起来像手绘来绕过检测?
加噪点、叠纸纹确实能骗过一部分检测器,这也说明检测本身不可靠。但发布AI图该标注还是要标注,绕检测和守规矩是两回事。
平台误判我的手绘是AI,申诉该附什么材料?
分层源文件、过程录屏或分阶段截图,有条件再附一段绘画软件的历史记录。材料的核心是"过程可回放",单张成品图说服力有限。