AI修图原理是什么?调了半年参数的玩家拆开讲

AI修图原理是什么?调了半年参数的玩家拆开讲
AI修图原理拆解示意图:人像照片被分解出识别蒙版、噪点生成和局部重绘三层,一只手正在拖动重绘幅度滑块

拆开讲:AI修图原理就是识别、生成、重绘三步接力的流水线。判断依据是调了半年参数、盯着滑块变化反推出的规律,全程不碰数学。想搞懂脸为什么会崩、背景为什么能不动,先从识别这一步看起。

AI修图的三步:先认、再画、后贴回去

AI修图原理拆开就三步:识别画面内容、生成新像素、把新像素重绘回选中区域,缺一步都出不了图。下面按我实际拖滑块的顺序,一步步拆给你看。说实话,我就是个下班折腾照片的普通玩家,没读过一篇算法论文,这些东西全是从滑块的变化里一点点试出来的。

最开始我把AI修图当「一键魔法」,按了按钮它自己知道该干嘛。今年3月我用的那款工具更新出一个「显示蒙版」的小开关,点开一看,照片上脸、头发、天空被涂成了不同颜色——原来它先把整张图「看」了一遍,把每块东西分好类,才轮到那些参数上场。那一刻我才发现顺序是反的:不是参数决定它改哪里,是它先决定改哪里,参数只管改成什么样。

从那天起,修图在我眼里就变成了三件事:看它认对了没、给它画什么当参考、控制它动手的范围。半年下来踩过的坑,绝大部分都能归到这三步里的某一步出了问题。

有人可能要问,它凭什么认得出脸?大白话讲,就是提前喂了几百万张标注好的照片,让它记住了「眼睛长这样、发际线大概在这个位置」这类特征。它不需要认识你拍的是谁,只需要认出「这是一张脸」。我试过拿自家猫的照片去点一键修复,识别框稳稳套在猫脸上,比套我妈的逆光照还准——原因不复杂,训练素材里猫脸样本多,而且猫不用管逆光。

蒙版从哪来:AI得先认出你在改什么

识别这一步,是把照片拆成一块块看得懂的区域:脸在哪、头发在哪、天空在哪,靠提前训练好的模型完成。你点「人像修复」,它先跑识别,才轮到修复本身。

蒙版就是识别结果的可见形态。我现在有个习惯动作:动手前先把蒙版显示出来检查一圈。有次修一张逆光人像,AI把亮部天空也圈进了「可修改区域」,我明明只想修脸,一键下去云被整个重画了一遍。识别错了,后面两步做得再好也白干。

发丝边缘更能看出识别的精度。工具里有个「蒙版模糊」滑块,默认4像素。我为了保住碎发把它拉到12像素,结果头发边上糊出一圈白边,像贴了层霜。改回6像素,再配合「扩展蒙版」设1像素,边缘才服帖。你拧的每一个像素值,其实都在替识别那一步擦屁股。

还有个更隐蔽的坑:低分辨率的旧扫描照。今年5月我修一张外婆的旧照,扫描件只有800×600,蒙版画得歪歪扭扭,人脸框都框不全,修复出来下巴位置多出一段阴影,怎么看怎么瘆人。把图放大到1600再修才恢复正常。识别这一步对画质是有底线的,太糊它就只能靠猜,猜出来的东西你没法验收。

重绘幅度一拉高,脸为什么就崩?

重绘幅度决定AI扔掉多少原图信息再从噪点重画:数值低是小修小补,数值高等于换个东西重画,脸自然崩。这是三个滑块里最凶的一个,也是翻车重灾区。

我拿同一张证件照做过一轮测试。0.3,五官纹丝不动,只有皮肤质感变细腻;0.5,脸还是那张脸,眼睛形状开始漂;0.75,出来的是个陌生人的脸;0.9那次本想换个背景,人物直接长出六根手指,工具没弹任何报错,就安安静静给我一张怪图。它像橡皮的力道:轻擦,纸上还留着铅笔印,照着描就行;使劲擦,露出白纸,它只能凭感觉画。所以我现在的习惯是先从0.4起跳,不够再一格一格往上加,加到满意为止,比一次拉满再返工省事得多。

顺带说个反向操作。6月有阵子我沉迷给朋友修照片,同一个蒙版、同样的0.5,提示词里加不加「奶油肌」三个字,出图能差出两个档次:加了,皮肤往白里走,毛孔全没;不加,它就老实按原图质感去补。提示词是递给生成那步的纸条,写什么它就往哪边偏。后来修男生照片我会特意写上「保留皮肤纹理」,不然人人都修成磨皮脸,亲妈都认不出。

生成这步本身,像隔着磨砂玻璃描图:从一片雪花噪点里慢慢显影成图。步数滑块我试了下从30提到50,出图时间几乎翻倍,画面变化小得要来回对比才看得出来,纯属白等。话说回来,那阵子我还顺手换着不同名字的采样器试了一圈,名字看着唬人,日常修图的差距真不大,别在这上面耗时间。

再看到「一键修图」的按钮,你大概能猜到底下压着什么了:先认出画面里有什么,再从噪点里画出新的,然后把新图贴回蒙住的那一块。半年前我以为这类工具是玄学,现在觉得它更像一台老实的机器——认错了会翻车,力道拧大了会换人,仅此而已。下次出怪图,先别急着怪AI笨,回头检查一下蒙版和重绘幅度,多半能自己找到答案。

常见问题

AI修图会把整张照片重画一遍吗?

看模式。整体重绘类功能会让全图参与生成,只是原图信息保留的比例高;局部修复类只重算蒙版圈住的部分,圈外的像素原封不动。想保住原图细节,优先用局部模式,并把重绘幅度压在0.4以下。

为什么每次点修复,出来的结果都不一样?

因为生成是从随机噪点起步的,起点不同,落点就不同。不少工具里有「种子」一栏,把种子数字固定住,参数不变的前提下每次出图基本一致;想多挑几个方案,就把种子留空让它随机跑。

手机上一键修图和电脑上拖滑块是一回事吗?

原理同源,开放程度差很多。手机App把三步打包成了预设,你摸不到蒙版和幅度;电脑端工具把每一步拆成独立参数。图省事用手机,想搞懂原理、做精确控制,还是得在电脑上把滑块挨个试一遍。

提示词写得越长,重绘效果就越准吗?

不是。局部重绘时提示词只管蒙版里那一小块,写清主体和质感就够,比如「顺滑皮肤,保留毛孔」。把整张图的氛围、光线全塞进去,反而可能把小块区域带偏。我的习惯是描述控制在15个字以内。

延伸阅读