AI绘画风格模型怎么选?LoRA与底模的搭配

AI绘画风格模型怎么选?LoRA与底模的搭配
AI绘画风格模型与LoRA底模搭配出图对比

简单说:底模决定一张图的天花板,LoRA决定这张图长什么样,两件事分开选才不乱。我日常八成时间用SDXL搭0.7权重的画风LoRA,新手没特别需求直接上FLUX省心。LoRA权重0.6到0.8是甜区,超过0.9基本必崩。

ai绘画风格模型这事我刚玩的时候完全没概念,同一个LoRA换三个底模出来三副长相,才意识到底模才是地基。风格模型分两层——底模是承重结构,LoRA是装修风格,地基不对装修再好看也塌。这篇把三千多张图踩坑后摸出来的底模和LoRA搭配经验写出来,哪种底模画什么、LoRA怎么搭、权重怎么调、什么时候翻车,都讲透。

底模到底是干嘛的——先把这个搞清楚

底模(base model)是整个出图的承重墙,它决定了AI认识什么画风、能画到多细、色彩和结构的下限在哪,LoRA和提示词都是在它之上做微调。同样一句"1girl, garden"扔进SD1.5和SDXL,出来的人像质感完全两个档次。底模一旦换掉,之前调好的提示词、LoRA权重经常得重调。所以选底模是给整套工作流定基调。我习惯先定底模再选LoRA,反过来必出兼容问题。模型资源基本都在 Civitai 上找。

SD1.5——老而弥坚的全能选手

SD1.5是生态最成熟、LoRA资源最多、出图最快但精度偏低的底模,适合二次元、练手和低配机器。它2022年发布到现在三年,社区给它训的LoRA数量碾压所有后辈,想要什么画风基本都能搜到现成的。缺点也明显——原生只有512x512,放大会糊,人脸细节比SDXL差一截。我电脑里始终留着一份1.5,专门快速试LoRA效果,512图出一张3秒。现在认真出图我很少用1.5了,但它对新手理解"模型"这概念最友好。入门了解提示词结构的话,AI提示词写作完整指南 里讲的tag思路就是1.5时代磨出来的。

SDXL——我现在的主力底模

SDXL是当前性价比最高的底模,原生1024分辨率、细节丰富、生态够用,写实和半写实人像首选。它2023年中出来后我就把主力换成它了,画面质感和1.5是两个时代。1024的底子放大到1536不糊,皮肤毛孔、布料纹理这种细节1.5给不了。坑在于SDXL的LoRA和1.5不通用——拿1.5的LoRA硬塞进SDXL,轻则画风飘重则出噪点。我接人像单子默认SDXL起步,质感对得起甲方。技术文档去 Hugging Face 翻。

FLUX——新贵但有点挑人

FLUX是2024年冒出来的新生代底模,写实和文字渲染能力一骑绝尘,但显存吃得多、LoRA生态还在补课。它最大的杀手锏是画面里能写正确的英文文字——你让它在招牌上写"FLOWPIX",它真写得对,SDXL写出来基本是鬼画符。写实人像的皮肤质感也接近照片。代价是显存——12G起步,跑得还慢,我4060Ti 16G跑一张十几秒。LoRA数量也明显少,社区还在猛训。我用FLUX主要做需要文字的图和极致写实,日常画二次元就回SDXL。新手显存够、想尝鲜可以试。

AnythingV5——二次元的偏科生

AnythingV5是专攻二次元的底模,画anime角色比通用底模稳得多,但画写实和场景就拉胯。它本质是拿SD1.5的架构在动漫图上深度微调,画2D妹子、赛璐璐风格一骑绝尘,线条干净色彩饱和。正因为偏科,画照片画风景就违和——出图带着股洗不掉的"动漫感"。我画二次元头像和插画用AnythingV5,配对应的anime LoRA出图特别稳。同类还有MeinaMix、DreamShaper这些专精底模,选它们的核心是"明确知道自己要画什么"。画风细节再翻 AI绘画艺术流派

LoRA到底在改什么——一句话说清

LoRA是在底模之上挂载的小补丁,用几十张图微调出来的几十兆文件,只改模型某一小部分权重,让AI"记住"某个角色、某种画风或某个概念。底模是个通才什么都会一点但都不精,LoRA是给它开个专精课。加载LoRA不会换掉底模,只是叠加一层调整,能随时挂随时摘。很多人以为LoRA是独立模型,其实它离开底模根本跑不了,必须搭着底模用。

角色LoRA、画风LoRA、概念LoRA怎么分

三类LoRA作用完全不同——角色LoRA锁人脸、画风LoRA定笔触、概念LoRA注入特定元素,混着用各管一摊。角色LoRA最常见,比如某个游戏角色的脸,加载后换衣服换场景脸都不变。画风LoRA给整张图定调子,"水彩LoRA"挂上去所有出图都带水彩晕染感。概念LoRA相对少用,比如"机械翅膀"这种特定元素。我用得最多的是角色加画风双LoRA——一个锁脸一个定风格。角色LoRA怎么准备训练数据,AI角色绘画描述 里讲的打标思路能直接套。

我最早分不清这三种LoRA,下载了个画风LoRA当角色用,画十张脸十副长相,还以为LoRA坏了。后来才明白那玩意压根不管脸,只管笔触。

LoRA和底模怎么搭才不冲突

搭配第一原则是版本对齐——SD1.5的LoRA只能挂SD1.5系底模、SDXL的LoRA只能挂SDXL,跨版本用必出兼容问题。这个坑我踩过,拿1.5的角色LoRA塞进SDXL,出图直接糊一片噪点加鬼脸。判断LoRA属于哪代最简单的办法是看Civitai上的标注,作者都会写明base model是SD1.5、SDXL或者FLUX。第二原则是风格匹配——别拿写实底模挂厚重二次元LoRA,出图四不像。稳搭组合是"写实配写实、二次元配anime、通用配概念",同类相加最稳。负面词控制参考 AI负面提示词 那篇的排除写法,多LoRA叠加时不能省。

权重0.6到0.8——为什么这是甜区

LoRA权重的甜区在0.6到0.8之间,低于0.5特征出不来、高于0.9过拟合必崩,0.7是我反复试出来最稳的默认值。权重写法在SD里是这种格式。我做过一组对比——同一角色LoRA分别设0.3、0.5、0.7、0.9、1.2,结果0.3脸完全不像、0.5勉强像、0.7像且自然、0.9像但脸僵、1.2直接崩成塑料假脸加伪影。根据 Civitai 模型库 2025年社区权重使用统计,热门角色LoRA被调用时权重落在0.65到0.85区间的占比超过60%。新LoRA从0.7起调,每加0.1出一张对比,找到"像且不僵"的点固定下来。

多LoRA叠加怎么分配权重

多LoRA同时挂时总权重别超过2.0,每个单独控制在0.5到0.8,主LoRA略高、辅LoRA略低,避免权重互相抢。角色加画风双挂,我一般写 。三个以上同时挂就不推荐了——权重分配变成玄学,出图经常是"张三的脸配李四的画风配王五的服装"这种缝合怪。非要三个一起上,总权重压在2.0以内,每个从0.5起步调。我画过一次翻车——角色加画风加服装三个LoRA各设0.8,总权重2.4,出图人脸直接融化,降到0.7、0.5、0.5才正常。古风tag搭配参考 AI汉服穿搭tag

翻车实录——LoRA权重太高把脸崩了

最典型的崩图就是LoRA权重飙到1.0以上,出图人脸塑料化、五官错位、皮肤出现彩色伪影,这是过拟合的铁证。上个月我接一个汉服头像单子,客户给的参考图特别精致,我想着"权重拉高点更像",直接把角色LoRA设成1.1。结果出图吓一跳——脸像了但皮肤全是彩色噪点,瞳孔都重影了。降到0.8立刻干净。教训是"像"和"能用"中间隔着一道过拟合的墙,0.6到0.8才是真能出片的区间。

翻车实录——底模和LoRA不兼容

底模和LoRA版本不匹配的典型症状是整张图布满彩色噪点、人物结构错乱,遇到这症状第一反应就是查LoRA版本。我有个朋友拷了一堆LoRA过来用,出图全崩,折腾两天才发现他底模是SDXL但LoRA全是1.5的。版本不对照样出图但图是坏的,这种"不报错但崩图"最坑人,新手会以为是提示词的问题改半天词,其实根子在模型版本。解决办法就一条:每个LoRA下下来先看清楚base model标注,按版本分好别混着放。

我个人的搭配速查表

按用途选底模和LoRA的组合比盲目试错高效十倍,下面这套是三千张图磨出来的对应关系。二次元头像用AnythingV5配角色LoRA权重0.7;写实人像用SDXL配写实画风LoRA权重0.6;带文字海报用FLUX裸跑不用LoRA;插画配图用SDXL配水彩或扁平LoRA权重0.7;系列漫画用SDXL配角色加画风双LoRA各0.6到0.7。

常见问题

LoRA能离开底模单独用吗?

不能。LoRA本质是底模之上的微调补丁,没底模连加载都做不到,必须搭着对应底模用。这也是选LoRA前先得选对底模版本的原因。

SD1.5的LoRA能在SDXL上用吗?

不能直接用。两者架构和分辨率不同,跨版本挂载轻则画风飘、重则出噪点崩图。找LoRA时一定看清楚它标的base model,版本必须对齐。

LoRA权重到底设多少最稳?

0.6到0.8是甜区,0.7作为默认值最不容易翻车。低于0.5特征不明显,高于0.9容易过拟合崩图。新LoRA从0.7起步每加0.1出一张对比找最佳点。

同时挂几个LoRA最合适?

日常一到两个最稳,三个是上限。多LoRA叠加总权重别超2.0,主LoRA略高辅LoRA略低,超过三个互相干扰出图基本是缝合怪。

FLUX现在值得入坑吗?

显存12G以上且追求写实和文字渲染就值得,否则SDXL性价比更高。FLUX的LoRA生态还在补课,天花板确实比SDXL高一截。

风格模型这事说到底就是底模打地基LoRA做装修,地基选对装修才不白费。按这篇先把底模定下来再挑LoRA,权重压在0.6到0.8的甜区,崩图率能立刻降一截。

觉得有用的话分享给朋友吧。