AI绘画基础知识有哪些?入门概念扫盲
简单说:AI绘画基础知识就五块——模型是底子、提示词是命令、采样器是画法、CFG是听话程度、LoRA和ControlNet是细化工具,搞懂这些就能看懂所有教程。
第一次打开AI绘画软件的时候,满屏的英文和参数,我是真的两眼一抹黑——CFG是啥?采样器选哪个?LoRA又是什么鬼?这套ai绘画基础知识的扫盲,就是我当初最想有人给我讲一遍的东西。说实话,这些概念看着唬人,其实拆开了都是大白话,我一个个给你讲透,看完你再看任何教程都不会再懵。
模型:一切的地基
模型就是AI绘画的"脑子",里面装着它学过的所有图片和风格,选什么模型决定了能画什么、画出来什么味,这是地基中的地基。
打个比方,模型就像一个画师的大脑。SD1.5是学过几亿张图的中级画师,SDXL是看过更多图的资深画师,Flux是新一代顶配画师。你给它下指令,它调脑子里学过的东西来画。你让它画猫,它得先"认识"猫长啥样,这就是模型的本事。
模型分两类:底模和微调模型。底模是大基础,比如官方的SD1.5、SDXL。微调模型是别人在底模上"再教育"出来的,比如专门画国风的、画二次元的。我个人理解,底模是普通话,微调模型就是方言——会方言的画师画对应题材更地道。
模型去哪找?最主流的就是 Civitai 模型站 和 Hugging Face。C站偏社区作品,HF偏官方开源。新手先从官方底模入手,等跑顺了再换微调模型。根据 Hugging Face 公开数据,平台托管的AI模型已超30万个,绘画类占不小比例——可见这生态多大。
提示词:跟AI说的话
提示词就是你给AI的指令,正向词说要什么、反向词说不要什么,写英文更稳,关键词用逗号隔开,权重用括号调节。
提示词这事,新手最容易犯的错就是"觉得写越多越好"。其实不是。我早期写了一大串,三十多个词,结果画面乱七八糟主次不分。后来精简到十来个核心词,反而清爽。
提示词分两种。正向提示词(positive)写你想要的:1girl, hanfu, sunset。反向提示词(negative)写你不想要的:bad hands, extra fingers, blurry。反向词尤其重要,能挡掉一堆常见崩坏。
权重的写法是括号加数字,比如(hanfu:1.3)表示把hanfu的权重提到1.3倍,AI会更使劲画这个特征。但别贪,超过1.5容易崩,我试过开1.5脸直接变形。我个人习惯关键特征控制在0.8-1.2之间最稳。这块跟入门路径直接相关,想系统学走一遍 AI绘画小白入门 会踏实很多。
采样器与步数:AI怎么把图"画"出来
采样器是AI"下笔"的算法,步数是下笔的次数,常用DPM++ 2M Karras配28步,步数太少图糊、太多反而慢且可能过拟合。
这块是最玄乎的,我尽量讲人话。AI出图不是一笔成,是从噪点里一步步"去噪"还原出画面。采样器就是去噪的算法,步数就是去几轮。打个比方,就像雕塑家从石头里凿出人像——采几刀、怎么下刀,决定了成品。
采样器一堆名目:Euler a、DPM++ 2M Karras、DDIM……看得人头大。我个人最常用DPM++ 2M Karras,稳定、出图快、质量均衡。新手直接用它别犹豫。Euler a更快但偏柔,适合插画风;DPM++ SDE Karras细节猛但慢,适合出大片时用。
步数呢,20-30步够用了。我实测过,20步和40步出图差别肉眼不大,但40步慢一倍——所以别盲目加步数。不过步数低于15图会糊,欠拟合了。我一般卡在28步,这是反复试出来的甜区。
CFG:AI有多听话
CFG控制AI对你提示词的"服从度",数值越低越自由发挥、越高越死抠字面,一般6-8最平衡,超10画面发硬发糊。
CFG这参数我一开始完全不懂,乱调,开到15发现图全僵了,像蜡像。后来才明白——CFG低,AI自由发挥空间大,画面柔和但有随机性;CFG高,AI死抠你写的词,画面"硬"但容易过曝、塑料感。
打个比方,CFG低就像让画师自由发挥,CFG高就像拿鞭子抽着画师"必须按我说的画"。太自由会跑偏,太死板会僵,6-8是中间地带。我个人7用得最多,写实题材偶尔6,插画题材偶尔8。
别信网上说的"CFG越高画质越好",纯属误区。我专门对比过CFG 4、7、12各出一组,7的那组最耐看,4的偏柔但糊,12的硬得发亮像塑料。所以克制点,别往高冲。
LoRA与ControlNet:精细控制两件套
LoRA是给模型加"风格插件"强化特定特征,ControlNet是控制构图姿势的"骨架插件",前者管风格、后者管结构,进阶必备。
这俩是进阶概念,但很重要,得讲。LoRA理解成小补丁,加载到模型上让它更擅长某一类。比如加载"古典美人"LoRA,出来的脸就更国风;加载"赛博朋克"LoRA,出来的画面就霓虹感拉满。权重一般0.6-0.8,超1.0容易崩——我开1.3眼睛画歪过,血泪。
ControlNet更硬核,它能控制人物的姿势、构图、线稿。你给它一张参考图或者骨架,它逼着AI按这个结构画。比如让人物摆个特定pose、或者照着草图上色,都靠它。我个人觉得这是AI绘画从"碰运气"走向"可控创作"的关键工具。
这两者配合,能让出图从"盲盒"变成"半定制"。但别一上来就堆,先把模型、提示词、采样吃透再碰这些,不然参数太多反而乱。LoRA和模型一样,主要在 Civitai 找,挑下载量高、带预览图的下。
在线还是本地:新手该怎么选
纯新手先从在线网站上手找感觉,想自由调参再转本地部署,两者不冲突,搭配着用最舒服。
这问题被问烂了。我的建议是,你完全零基础,先去在线网站点几下,感受下"写个词就能出图"是什么体验,培养兴趣和直觉。等你想用ControlNet、想调LoRA、想跑特定模型了,再上本地软件。一上来就折腾本地环境,装不上、报错多,容易劝退。
在线网站的优点是省心,缺点是参数受限、要排队、有内容审核。本地的优点是全自由,缺点是门槛高、吃显卡。我个人是本地为主、在线为辅。在线选哪些好,可以参考 AI绘画网站清单,本地软件另说。
说个我自己的经历:我最开始就是在线网站玩了俩月,把提示词手感练出来,再转本地装SD WebUI,那时候已经能看懂一半参数了,上手快很多。循序渐进,别硬来。
常见问题
AI绘画一定要会写代码吗?
不用。本地部署会用命令行跑安装脚本就够,不用写代码。在线网站更简单,填提示词点生成。真正要写代码的是自己训练模型、做插件那批人,普通使用者碰不到。我个人一行Python没写也用了大半年,完全没问题。
提示词写中文还是英文效果好?
主流模型英文训练为主,英文提示词效果更稳。中文能识别但词表窄,经常理解偏差。建议正向词用英文,实在描述氛围用中文辅助。我自己的提示词九成英文,偶尔混一两个中文词描述特定概念,问题不大。
这么多参数记不住怎么办?
不用全记。新手记住三组就够:CFG 6-8、步数 25-30、采样器 DPM++ 2M Karras。这三组是起手式,能应付八成场景。其余参数等遇到具体问题再查,我至今也没全记死,需要的时候翻文档很正常。先跑起来比背参数重要。
想画特定风格,是靠提示词还是靠换模型?
换模型效果更彻底,提示词是辅助。你用写实底模硬塞"二次元"提示词,出来还是带写实感。所以想要什么风格,优先找对应风格的底模或LoRA,提示词负责细化。这点我深有体会——底模选对,事半功倍。想找轻松画风练手,不妨从 王者荣耀AI绘画可爱 这种题材入手。
觉得有用的话分享给朋友吧。