AI人物修图的主体识别有多准?拍集体照的测试记录

AI人物修图的主体识别有多准?拍集体照的测试记录
AI人物修图在40人集体照上逐人识别修肤色的测试示意图

人多就考验识别:40人以上的集体照,AI逐人修肤色能认出九成多的脸,但路人消除和立牌印刷人像会明显出错。结论是逐人修肤可以放心交给AI,消除类操作必须逐张人工验收。

ai人物修图的主体识别在单人照上几乎不出错,可人脸一多准确率立刻往下掉——这是我拿8月30日单位工会秋季运动会集体照实测后的直接结论。那天运动会收尾拍的42人大合影,站位挤了三排,我是工会这边固定负责活动摄影的,回来当晚就把这张图丢进了两款网页版AI修图工具里,盯着它一张脸一张脸地跑。

先说整体成绩。42张脸,A工具识别框标出39张,B工具标出40张。漏掉的三张集中在第二排最左侧:两个人的脸被前排肩膀遮掉三分之一,还有一个戴宽檐遮阳帽的,帽檐阴影盖住了半张脸。这不是玄学,你把图放大看就明白,遮挡超过三成的脸在识别框里就是不稳定,时有时无。

逐人修肤色的体验倒是意外地好。A工具里有个「统一肤色」滑块,我拉到60%,41秒跑完全图,39张被识别的脸各自做了磨皮和均匀肤色,没把谁的脸修成别人的。色阶处理也稳,第一排站在树荫下的7个人没有被整体提亮成惨白,只是人脸和脖子交界处有轻微的断层,放大到100%能看出来,缩图发群里完全无感。手动修这42张脸,按我平时的速度至少两小时,AI给我省下的时间是真的。

漏掉的3张脸有补救入口。A工具的「手动添加识别框」藏在右上角第二个图标里,点一下在脸上拖个框就行,我每补一个框大概花20秒,3张全补完重跑修肤,前后多花6分钟。这里有个小坑:手动框要贴着发际线和下巴框,我第一遍框得太松,重跑后那张戴帽子的同事下巴被磨白了一条,把框收紧到边缘才正常。

路人消除为什么在人堆里就翻车?

人挤人的画面里,AI分不清谁是拍照对象谁是路人,重叠越严重消除越容易翻车,独立站在边缘的路人成功率反而最高。

合影之外我还给了它两张「场地照」——跑道边抓拍的,画面里有6个围观同事以外的路人。站得独立、和主体不挨着的那4个路人,两分钟内全部消干净,填充的背景连跑道线都接得上,这个效果我挑不出毛病。

麻烦出在另外两个和主体挨在一起的路人身上。一个路人的手臂搭在主体肩膀上,AI消除后那截肩膀直接被抹平了一块,补出来的衣料纹理和周围对不上,像一块打补丁的布。另一个更离谱,消除之后主体旁边多出半只悬空的手,明显是算法把「属于谁的手」判断错了。说实话,这种身体接触密集的画面,消除功能就是赌运气,我后来这两处都是手动用修补刷救回来的,前后多花了二十分钟。顺带一提,B工具在同一个接触场景干脆拒绝执行,弹了行提示「画面人物重叠,建议手动处理」——至少它知道自己不行,A工具是自信满满地修砸的,你反而要更防它。

所以我的用法现在是固定的:独立背景路人交给AI,有肢体接触的一律手动。话说回来,普通游客照里路人很少会搂着你的拍摄对象,这个短板在集体照场景才被放大得这么明显。

最乌龙的一单:立牌上的印刷人像被当成了真人

背景里的宣传立牌、展板上的印刷人脸,会被主体识别当成真人处理,这类「纸片人」必须手动排除,属于目前最典型的误识别。

这次测试最大的意外和修图软件无关,和现场布置有关。合影背景两侧立着两块工会先进工作者宣传立牌,每块印着3张人像照,一共6张印刷脸。AI跑逐人修肤的时候,把其中4张印刷脸也框了出来,认认真真地磨了皮——印刷网点被磨掉之后,立牌上的人像反而发糊了,远看像立牌褪色。

更好笑的是B工具。它不光框了印刷脸,还把其中1张判定为「可消除的背景人物」,按钮都给我亮出来了,差一点我就点了。你要是真点了,立牌上就顶着一个烂洞。我当时截了图发给工会主席,他回了三个字:「它挺忙。」

这事给我的教训很具体:凡是画面里有人脸的印刷品——立牌、横幅上的照片、背景板、别人手里的手机屏幕——都要在修图前逐个排查。A工具支持手动取消某个识别框,我是先取消4个印刷脸的框再跑的修肤,第二次结果就干净了。多说一句,如果是户外活动的合影,背景板反光、逆光这些问题又会叠加出现,处理思路可以参考之前写过的户外修图AI团建照那一篇。

整场测下来,我的判断没变过:ai人物修图的识别能力已经够格接集体照的逐人修肤,39/42的识别率加上两小时的时间节省,对经常拍活动的人来说是实打实的。但消除类功能在大合影里还嫩,接触重叠和印刷人像这两个坑,目前只能靠人盯着。先拿一张不重要的合影练手,把识别框挨个检查一遍再跑修图,比什么都管用。

常见问题

集体照多少人以内,AI逐人修肤基本不用人工干预?

按这次的经验,15人以内的单排合影识别框基本全对,勾一下就能跑。超过30人建议逐个检查识别框,重点看遮挡脸、戴帽子眼镜的人,40人以上漏识1到3张属于正常范围。

戴眼镜和口罩的合影成员,修肤色会不会出错?

普通透明眼镜不影响识别,墨镜有一半概率漏框。口罩这次没遇到,但按遮挡比例推断,口罩盖住面部中下部时大概率会漏识或识别框漂移,这种脸建议手动框选后单独修。

AI修完集体照,肤色会不会出现「一人一个色」?

统一肤色滑块能压住大部分差异,但树荫下和阳光直射两种光线下,人脸色温本来就差着一截,AI只能局部拉平。想要绝对统一,得在修图前先对全图做一次白平衡校正,再跑逐人修肤。

修集体照用什么分辨率导出比较合适?

逐人修肤建议在原图分辨率上做,导出时再压缩。这次42人的原图是6000×4000像素,AI处理耗时41秒,如果先把图压到2000像素宽再修,磨皮细节会糊掉一圈,发朋友圈没问题,冲洗放大就露馅。

延伸阅读