AI绘画专业术语有哪些?术语速查
简单说:AI绘画专业术语分三大块——提示词类(prompt、negative prompt、权重)、模型类(底模、LoRA、VAE)、参数类(CFG、步数、采样器、seed)。新手先记这十几个核心词,照着参数表抄就能出图,不用啃论文。
第一次打开WebUI看到满屏的CFG、Steps、Sampler、DPM++是不是头大?老实讲我刚开始接触ai绘画专业术语时也懵,查一篇翻译一篇,最后发现真正影响出图的就那么十来个词。这篇把这些词按"提示词—模型—参数"三块摊开讲,每个配实测用法。
提示词类术语是出图的命门
提示词类术语包括prompt(正向词)、negative prompt(反向词)、weight(权重)、token(词元)四个核心,决定画什么和不画什么。
prompt就是正向提示词,你想要什么写什么。negative prompt是反向提示词,告诉模型"别画这些"——比如"blurry, deformed hands, extra fingers"防糊防多指。权重是给某个词加强调,写法是"(keyword:1.3)",数字越大越突出,超过1.5容易把整图带崩。token是模型切词的最小单位,SD1.5上限75个token,超了会被截断。
想系统补提示词写法的,先翻 AI绘画提示词怎么写的万能词库 把基础公式过一遍,再来看术语。要找现成词条的,关键词素材库 按主题分类整理过几百个高频词。
模型类术语决定画风上限
模型类术语分base model(底模)、LoRA(微调模型)、VAE(变分自编码器)、Embedding(文本编码向量)四种,底模定大方向,LoRA调小风格。
base model是底模,比如SD1.5、SDXL、SD3,决定画质和画风的基础上限。我个人觉得新手从SDXL起手最稳,画面干净细节足,SD1.5虽快但出图容易塑料感。LoRA是微调模型,几百MB的小文件,专门训练某种画风或角色——比如"工笔LoRA""赛博朋克LoRA",叠在底模上用。VAE负责把潜空间还原成可见图,缺了它会发灰发雾。Embedding是把一段词压成一个向量标签,写起来短,比如把长长的人物描述压成"girl_A"一个词。
根据 Civitai模型库 的公开统计,截至2026年平台收录的LoRA微调模型已超过10万个,覆盖人物、画风、物件各类细分题材。这意味着你想画什么风格,基本都能找到现成LoRA直接套。
采样参数类术语是出图开关
采样参数类术语包括Steps(步数)、CFG Scale(引导系数)、Sampler(采样器)、Seed(随机种子)、Denoising(重绘强度)五个,直接管出图质量和随机性。
Steps是采样步数,一般20-40步够用,超50步边际收益很低还慢。CFG Scale是引导系数,控制模型听你提示词的程度——值低画面发散听不进词,值高画面死板过锐。我个人实测CFG 6-8是甜区,人物写实类CFG 7稳,二次元可以降到5.5。Sampler是采样器,名字最唬人——Euler a、DPM++ 2M Karras、DDIM这些,本质就是不同的去噪算法。
Seed是随机种子,固定seed能复现同一张图,调提示词时务必锁seed对比。Denoising strength是重绘强度,图生图时用,0.3小改0.7大改,超过0.85基本等于重画。
采样器到底选哪个
写实人物首选DPM++ 2M Karras步数30,二次元选Euler a步数28,要快选DPM++ SDE Karras步数25,这三组是我跑了上百张对比出来的稳定搭配。
采样器名字看花眼,其实就分两类。一类是"ancestral"结尾的(如Euler a),出图带随机性,每张都不同,适合探索性出图。另一类不带a(如DPM++ 2M),固定seed出图稳定可复现。我个人觉得做商业插画要可复现选后者,做灵感探索选前者。Karras是调度器后缀,比默认调度收敛更快细节更足。
想深入抠采样原理的,arXiv论文库 能找到Stable Diffusion原始论文和各类采样器的推导,看不懂不影响用,但能帮你理解为什么不同采样器出图手感差那么多。
新手最易搞混的几个术语
prompt和咒语、checkpoint和底模、Hires.fix和图生图这三组最常被混用,其实是同一概念不同叫法。
prompt和"咒语"是一回事,国内圈子里爱叫咒语,英文社区叫prompt,别被绕晕。checkpoint和base model也是同一个东西,checkpoint是训练保存的权重快照,底模就是它。Hires.fix(高清修复)和图生图不完全一样——Hires.fix是在文生图后自动放大再补细节一气呵成,图生图是拿任意图重画。这组区别搞清楚能少踩不少坑。
老实讲术语这东西,用过三五次就熟了,不用死记。我把高频术语整理进 词汇大全手册 了,碰到不认识的词随时翻。
出图尺寸和宽高比术语
出图尺寸术语有resolution(分辨率)、aspect ratio(宽高比)、upscale(放大)三个,512x512是SD1.5原生分辨率,SDXL推荐1024x1024起。
分辨率别乱设。SD1.5底模训练在512x512,出1024会人物重复崩坏。SDXL训练在1024附近,出512反而糊。宽高比影响构图——竖图人物、横图风景是约定俗成的。放大术语分两类:Hires.fix是模型内放大,Tiled Upscale是分块放大应对超高清,4x-UltraSharp、ESRGAN这些是放大算法名。
想抠宽高比和构图的,参考 出图比例怎么选 那篇,把不同比例适合什么题材讲得细。
常见问题
CFG值越大越好吗?
不是。CFG超过10容易过曝过锐,人物皮肤发塑料。我实测6-8最稳,7是人物写实甜区,二次元可以5.5。
步数越多画质越好吗?
边际递减。20步和40步差距明显,40步和80步肉眼几乎看不出区别还慢一倍。日常30步够用。
seed固定后改提示词还会变吗?
会变。seed固定的是初始噪声,提示词改了模型走不同路径,出图会变但构图大方向接近。锁seed是为了控变量调试。
LoRA和底模能随便叠吗?
不能。LoRA要和底模架构匹配,SD1.5的LoRA挂到SDXL上会报错或失效。下载时看清适用底模。
觉得有用的话分享给朋友吧。