AI绘画不好看怎么办?出图丑的根因与修复
简单说:AI绘画不好看九成不是模型蠢,是提示词太空、底模不匹配、CFG和步数乱设。先把这三项调对,再用ADetailer修脸手,废图率能从七成掉到两成。
说实话,AI绘画不好看这件事我太有发言权了。去年刚碰Stable Diffusion那阵子,出图十张崩九张——手指多一根、脸歪、配色脏得像没洗的调色盘。折腾俩月才搞明白,丑不是模型蠢,是你没喂对。这篇把我踩过的坑和实测参数都摆出来,少绕弯路。
为什么你的AI绘画不好看?先认清这六个根因
AI绘画不好看基本跑不出这六个坑——提示词太空、底模不匹配、采样参数乱设、LoRA权重过高、没修手脚、后处理偷懒。挨个排查就能定位问题。很多人一出图丑就怪模型差,其实多数时候是你自己埋的雷。
我自己总结了个排查顺序,从上往下查。先看提示词是不是太空泛,"一个美女"这种词给谁都画不明白。再看底模方向对不对,出二次元非要拿写实底模硬凑,怎么调都别扭。
接着看采样参数。CFG和步数乱设,神仙模型也救不回来。然后是LoRA权重,很多人喜欢拉满,结果崩。最后两步是局部修图和后处理,省了就废一半。
提示词写法:正向要具体,负向要狠
正向词别只写"一个美女"这种废话,要给具体特征如"白色连衣裙、自然光、浅景深、胶片质感";负向把extra fingers、mutated hands、deformed、blurry、watermark这些常驻挂着。我个人的习惯是正向不超过120词,太长会互相打架。
老实讲,提示词是最容易被忽略的一环。很多人把模型当许愿池,堆一堆形容词就指望它懂你。其实模型是个死板的学生,你说得越具体它越听话。比如光线,写"golden hour侧光"比写"光线很好"强十倍。
负向词我建议存成固定模板反复用。手指、眼睛这些重灾区,负向里把"bad anatomy, extra digits, fused fingers"都挂上。一劳永逸。
如果你刚上手还不熟词表,建议先过一遍这篇AI绘画小白入门,把基础提示词结构弄明白再谈调参。
底模和LoRA选错,调到天荒地老也白搭
出二次元就别用写实底模,出真人就别拿动漫模型硬凑,底模方向不对后面全白费。LoRA权重建议从0.6起试,超过0.9就开始压坏底模风格。这是踩过最贵的坑。
我之前想出一张古风写实少女,结果手头只有个二次元底模,硬上了写实LoRA。权重拉到1.2想掰回来,出来的脸像打了蜡的塑料人偶,眼睛还一大一小。后来换了个写实底模,同样的LoRA权重0.7,立马正常。
根据 Civitai 社区 的模型热度,SDXL系列底模的下载量已经甩开SD1.5约两倍,出图清晰度和手指稳定性提升肉眼可见。底模选对,事半功倍。
不想本地折腾底模的,可以翻这篇AI绘画网站清单挑个现成的在线服务先试手。
采样参数实测:CFG、步数、采样器怎么搭
我实测下来最稳的组合是CFG 6.5到7.5、步数25到30、采样器DPM++ 2M Karras。CFG低于5画面软趴趴没力度,高于9又容易过饱和烧色彩。这组参数我跑过上百张图验证。
具体说,做人物头像时CFG我压到6.5,脸更柔;做风景和概念图拉到7.5要冲击力。步数低于20细节糊,高于35基本没增益还浪费时间,大约多花12秒换不来肉眼差别,不值。
采样器我换过七八个。Euler a快但偏软,DPM++ SDE Karras细节猛但容易出脏噪点,综合下来还是DPM++ 2M Karras最均衡。这玩意没有唯一答案,但作为起手式它最省心。
参数这东西,模型不同最佳点也会飘。我自己每个新底模都会做组对照测试,记下出图约15秒到22秒区间里最干净的那组配置。懒得记的话就先用上面这组当默认值。
修脸和修手:ADetailer和ControlNet救场
脸糊、手多指这种问题,与其反复抽卡不如直接上ADetailer做局部重绘,ControlNet的openpose则能管住肢体不崩。这俩工具救了我至少一半废图。真的,抽卡式出图是最低效的玩法。
ADetailer的原理是自动检测人脸和手部区域,单独高分辨率重绘一遍。我一般把重绘幅度设0.3到0.4,太高会跑偏原构图。手部检测模型选手专门的那个,默认的漏检率高。
ControlNet更狠。姿势崩就上openpose,构图乱就上canny或depth。我自己画双人互动图几乎必挂openpose,不挂的话两个人手都不知道往哪放。
顺嘴一提,做角色类头像的思路其实相通,可以参考这篇王者荣耀AI绘画可爱里讲的角色特征还原手法。
后处理:高清放大和微调别省
出图后别急着发,用Hires.fix放大1.5到2倍再轻微锐化,质感差别肉眼可见。我之前偷懒直接发原图,被朋友说像马赛克。后处理真的别抠。
Hires.fix我常用放大算法是R-ESRGAN 4x+,重绘幅度0.35左右。放大2倍后那张图瞬间从"能看"变"能存"。锐化别过头,过了会有塑料感。
进阶一点可以进Photoshop做局部调色和磨皮。磨皮强度我控制在60%到75%,再高脸就假了。这套组合拳下来,废图基本能救活七八成。
模型和算法本身也在迭代,关注 Stability AI 官网 能第一时间拿到新底模信息,新模型往往修了老版本的手指和构图顽疾。模型库可以从 Hugging Face 找开源版本下载。
常见问题
AI绘画不好看是不是模型不行?
大概率不是。同一套模型别人出图好看你出图丑,差在提示词、底模方向和采样参数上。先把这三样排查一遍再考虑换模型,别一上来就甩锅给底模。
CFG值调多少最合适?
多数场景6.5到7.5之间最稳。做人像偏柔就6.5,做需要冲击力的图可以到7.5。超过9容易过饱和烧色彩,低于5画面软趴趴没力度,都不建议。
没有好显卡能跑吗?
能。本地跑不动就用云服务或者在线网站,按张付费也不贵。重在把提示词和参数逻辑搞明白,换了环境照样能出好图。
提示词用中文还是英文?
英文为主。主流底模都是英文语料训练的,中文提示词识别率低、效果打折。实在想用中文,得找专门微调过中文的模型,否则翻译成英文喂更靠谱。
觉得有用的话分享给朋友吧。