ai仿真绘画实测:布料金属皮革的材质仿真度,照片感绘画感那条分界线
直接给结果:仿真度的胜负手不在整体光影,在微观细节。麻布的褶皱频率、不锈钢的环境反射、皮革的毛孔磨损,这三样齐了照片感就立得住。我把三种材质各跑十六张做对照,结论和参数都摆在下面。
上周做了个土办法实验:挑三样家里最常见的物件——沙发上的麻布抱枕、早餐用的不锈钢勺、用了三年的棕色皮包,同一种写实模型,每样出十六张图,发到朋友群里让他们猜哪几张是拍的、哪几张是画的。三十八个参与的人,麻布抱枕猜对率只有四成,皮包五成半,勺子最惨,九成人一眼识破。这个结果挺有意思,说明材质之间难度差距极大,值得拆开说说。
布料:褶皱的频率比颜色重要
真布料每厘米都有细密褶皱和绒毛,AI爱画成光滑的塑料布;提示词里给足织物纹理和自然褶皱,真假立刻分层。颜色反而是最不用操心的一环。
对照里表现最好的抱枕图,提示词核心是"粗麻布织纹 细密自然褶皱 纤维绒毛 微距细节",十六张里十一张能骗过人。翻车的那几张有个共同点:褶皱大而少,像被熨过又随手揉了一下的塑料桌布。密度是关键,真实麻布的褶皱是细碎的、无规律的,一片叠一片。丝绸另算一路,它的高光是水波状的流动条纹,写"绸缎光泽 波状高光"比写"光滑"有用得多。
还有个讨巧的角度:逆光。布料边缘的透光和绒毛逆光一出来,材质的可信度跳一档。不夸张地说,一盏侧逆光顶十句纹理词。
金属:反射必须偷到环境
不锈钢自己没有颜色,全靠映照周围;画面里反射和环境对不上,大脑半秒内就会判假,这是金属最难的地方。光写"金属质感"基本等于没写。
勺子那批图全军覆没,原因后来想明白了:勺面映出的窗影、桌面的反光和它所处的环境是两套体系,人眼对这种矛盾极其敏感,就像看到影子方向不对的电影穿帮镜头,说不出哪里错,就是觉得假。补救思路是把环境写具体——"反射窗格光影 厨房暖光环境 磨砂拉丝表面",让反射有出处。出图率从零张能看升到十六张里五张,能及格,但离骗过人还有距离。
我的看法是,小件金属不如直接借场景:把勺子放进有明确光源和窗的构图里,反射有了参照物,假的比例明显降。孤零零摆在一块纯色背景上,怎么写都像渲染半成品。顺带一提,拉丝金属比镜面金属好画得多,磨砂表面把反射打散成雾状的明暗,模型糊弄的空间就大了。
皮革:毛孔和磨损才是本体
荔枝纹、边缘磨白、使用划痕,三样齐了皮革才立得住;光靠高光油亮,出来的永远是塑料感。旧皮包比新皮包好画,这是个反直觉的发现。
实验里骗过率最高的单张图,是那只旧皮包:提示词带"荔枝纹皮质 边角磨损泛白 表面细划痕 三年使用痕迹"。磨损是天然的使用证明,大脑看到磨损就自动盖章"这是真东西"。全新皮包反而难,均匀的荔枝纹容易画成重复贴图,十六张里只有四张过关。这个规律我觉得对别的材质也适用——新东西靠材质本身撑,旧东西靠故事撑,故事更好写。
照片感和绘画感的分界线到底在哪?
我的经验是镜头词决定阵营:八十五毫米、大光圈、胶片颗粒指向照片,明显笔触和纸纹指向绘画,两边的词混着堆,出图就悬在半空不伦不类。
我又加了一组对照:同一只皮包,左边堆镜头词"85mm f/1.8 浅景深 柯达胶片颗粒",右边堆绘画词"数码水彩 笔触 纸纹"。发群里复测,镜头词那组被当成照片的比例是七成,绘画词那组零,全部被认出是画。中间还有几张两边各沾一点的,评论区统一评价"像精修过的效果图"——这就是混堆的下场。
所以我的做法是先想清楚这张图要站在哪边,词只从一边的池子里拿。想往照片感推,就加镜头、景深、噪点;想往绘画感拉,就加笔触、纸纹、限色。中间地带没有红利,只有尴尬。
实验做完,那把不锈钢勺子我还留在桌上,吃早饭时偶尔瞟一眼它勺面里的窗格——真实世界的反射永远严丝合缝,这大概就是AI暂时追不上的地方。三种材质的参数都在上面了,你可以从抱枕开始试,那是上手最快的一条路。要是你也做了类似的猜真假测试,结果多半跟我差不多:人对"活的细节"宽容,对"错的物理"苛刻。
常见问题
仿真度高的图,商用有边界吗?
别生成真人肖像和可识别的名牌产品特写,材质研究、场景静物这类没指向性的图风险低。涉及商品宣传时注明AI生成,避开别人的商标和外观专利。
哪种材质最容易翻车?
金属和透明材质并列第一。它们的真实感来自与环境的光学互动,AI对这类全局一致性最不擅长。布料和皮革是局部细节取胜,相对好救。
需要很高的显存或者付费模型吗?
不需要。材质仿真吃的是提示词和光影设计,不是模型档次。我这次用的就是普通写实系模型加微距类提示词,参数采样三十步、CFG七,跟画别的题材没区别。
怎么判断一张图差在哪?
放大看接缝和边缘:布料的缝线、皮革的边油、金属的倒角。整体氛围骗人容易,边角细节骗人难,哪里糊就往哪里的材质词上补。