AI小说人物绘画进阶:网文角色立绘与场景插画的系统创作技法
上次写完基础教程之后,一位写玄幻网文的朋友跑来跟我说他用AI画了三十多张主角立绘,没有一张满意的——要么脸换了、要么气质不对、要么场景里的光线和人物根本不在同一个世界。我让他把Prompt发过来看,问题出在同一个根子上:他在用"画插画"的思路做"角色设计",这两件事的Prompt逻辑完全不一样。画插画追求单张效果好看,角色设计追求的是——这个角色穿越到任何一个场景里都必须长同一张脸。过去三个月我帮三个网文作者做了完整的主角视觉方案,每个角色平均出图超过两百张才把那一套"锚点Prompt"定下来。这篇就把这三套方案完整拆开给你看——从立绘到场景到多角色互动,每一步怎么想、怎么写、怎么改。
角色视觉锚点——让主角"去哪都长一样"的核心方法
AI画同一角色跨场景的最大障碍不是Prompt写得不好,是你没给AI一个"不可变的识别码"。人脸在AI里的稳定性和你描述的精度成正比——你说"帅气的黑衣剑客"它每次给你一张不同的帅脸;你说"剑眉入鬓、眼尾上挑的丹凤眼、左眉骨有一道两厘米的旧刀疤、下颌线锋利到能切纸"——它想跑偏都难。
我的锚点设计分了三个层级。第一层是"绝对不变的特征"——疤痕、痣、瞳色、眉形、脸型轮廓,这些在任何Prompt里都必须一字不改地出现。第二层是"场景允许微调的"——发型可以有风吹散和束起的区别,但发色和长度不变。第三层是"因场景而变的"——服饰、表情、姿态。核心原则:第一层的词是你角色的DNA,宁可Prompt长一点也不能删。在AI写实人像绘画教程里我详细讲过面部锚点的构建逻辑,这篇侧重小说角色的场景化应用。关于角色面部的光影参考,ArtStation上搜"character turn around sheet"能看到专业角色设计师怎么用多角度三视图锁死一个角色的所有面部特征,对写锚点Prompt极有启发。
修仙题材——"仙气"不是形容词,是光学方案
大多数修仙角色Prompt翻车的原因是作者把"仙气"当成一个形容词塞进去了——"full of celestial aura, very ethereal"。AI拿到这些词只能靠模糊联想随机发挥,结果不是背景里飘一堆莫名其妙的云就是人物周围套个发光滤镜。仙气在视觉上的本质是一套特定光学现象的集合:自发光不等于仙气——那是灯泡;半透明材质加微弱的内部散射光才等于仙气。
具体Prompt构建:服饰部分——"flowing silk robes with ethereal translucent layers, fabric edges softly catching an unseen celestial light source, inner glow visible through thin outer fabric, subtle floating movement as if underwater but in air"。环境部分——"floating luminescent particles like scattered starlight, gentle mist coiling around ankles, distant mountain peaks piercing through cloud sea"。气质部分——"serene yet distant gaze, slight melancholic elegance, stillness that contrasts with the flowing fabric around them"。三个部分合并时注意层次——人物主体清晰、服饰半透、环境飘渺,不要三个元素互相抢注意力。修仙角色的色彩搭配我习惯用冷调为主——银、白、浅蓝、淡紫——暖色只用在局部(如腰带、发饰、手中的法器)来制造视觉焦点。更多古风色彩逻辑在AI古风场景绘画教程中有系统拆解。
都市题材——材质词比场景词重要十倍
画都市网文角色的最大误区是拼命堆场景描述——"in a modern city, tall buildings, busy street"——结果建筑是画出来了但人物像个游客P上去的。都市感的本质是材质。玻璃幕墙、混凝土、不锈钢、柏油路面、霓虹灯管——这些材质的反光特性构成了一张都市画面的底层逻辑。
我的都市Prompt框架:先定材质再定场景。角色材质——"soft cotton hoodie with subtle fabric texture, denim jeans with slight distressing, sneakers with matte rubber finish, stainless steel watch catching ambient city light"。环境材质——"wet asphalt reflecting neon signs after rain, glass curtain wall buildings with blue-tinted reflection, concrete sidewalk with subtle puddles, warm LED glow from convenience store window"。光源类型——"mixed lighting: cool fluorescent from office windows above, warm sodium streetlamp below, neon pink and blue from store signs at eye level"。材质和光源一起写完,都市的氛围就自然出来了,不需要你专门写"modern atmosphere"这种虚空词。Steam创意工坊和Pinterest上搜"urban photography night rain"能积累大量都市材质的视觉参考,看到什么材质就把对应的英文词记下来。
关键场景插画——把小说"名场面"变成单张图
把一整章小说的核心情节浓缩成一张插画——这件事难在取舍。你不可能把一整段文字丢给AI让它自己选重点,你需要在Prompt里帮它决定"这一秒钟到底在发生什么"。
场景插画Prompt的三个必要构成:时间切片(精确到秒级的动作瞬间)——"the exact moment when sword tip touches dragon scale, sparks just beginning to fly, impact not yet complete but imminent";空间层次(前景中景远景各放什么)——"foreground: protagonist's back and raised sword in sharp focus, midground: dragon head turning in surprise, background: collapsing temple pillars in dust and motion blur";情绪锚点(用一个颜色或光线概括情绪)——"emotional tone: cold blue moonlight versus warm orange firelight, the clash of cold and warm lighting mirrors the moral conflict in this scene"。三个要素齐全,AI才能交出一个有叙事感的构图。关于场景构图的空间层次技巧,AI古风场景进阶教程里有更深度的透视和景深控制方法。
多角色互动——别让AI把两个人"融"在一起
两个角色同框的时候,AI最爱干的坏事是把两个角色的特征互相搞混——男主的发型跑到女主头上、女主的衣服颜色染到男主身上。不是你的Prompt写得不好,是AI在处理多人构图时会自动"平均化"所有描述。
解法的核心:物理隔离。用空间位置把两个角色清晰地分开描述——"left side of frame: male character with short black hair and red robe, right side of frame: female character with long white hair and blue robe, clear separation between them, no overlap of their bodies"。然后加一句"two distinct individuals with completely different appearances"作为全局约束。如果两人有眼神交流——加"they are looking at each other, clear emotional exchange visible in their eyes, but their physical features remain separate and distinct"。如果两人有肢体接触(牵手、拥抱)——加"their hands are intertwined but each person's skin tone and hand shape are distinctly different, avoid merging fingers"。多角色构图的训练参考,Civitai上搜"couple"或"duo"的LoRA模型能有效改善多人同框的翻车率。
常见问题
角色画出来总是"网红脸"没有辨识度怎么办?
因为你的Prompt里缺少"缺陷描述"。真正的辨识度来自不对称和不完美——在Prompt里加至少一个不完美的特征:"slightly crooked smile, one eye marginally smaller than the other, a tiny beauty mark under the left corner of the lip, nose with a subtle bump on the bridge"。AI美学默认倾向完美——你需要主动打破它。
角色的服装细节在不同场景里老变怎么办?
给服装也建锚点。比如主角的固定配饰:"always wears a worn leather bracelet on left wrist with three silver beads, a silver ring on right index finger with a small green gemstone"。配饰是比衣服更稳定的锚点——因为配饰面积小、AI更容易精确复现。衣服颜色和款式可以随场景变,但标志性配饰永远不变。
战斗场景的特效太抢戏把人物淹没了怎么处理?
加一句"visual hierarchy: character is the primary focus, special effects are secondary and translucent, effects should frame the character not cover them"。关键是frame这个词——它告诉AI特效是用来"框住"角色的、不是盖在角色上面的。另外降低特效的饱和度也有用——"muted special effects colors, desaturated energy glow, subtle rather than flashy visual effects"。
同一个角色的Q版形象和正常比例怎么保持一致?
Q版化时保留50%的锚点。原来的"剑眉丹凤眼左眉刀疤"变成"chibi version: same scar on left eyebrow, same amber eye color, same silver-white hair color, but in cute simplified chibi style with larger head-to-body ratio"。核心特征——疤痕、瞳色、发色——即使在Q版变形后也必须保留。
写了这么多,最后分享一个我自己踩过的坑:不要一上来就追求"完美成品图"。先用大量低分辨率快速出图跑通"脸的一致性"——同一个Prompt连续出二十张,看脸像不像同一个人。如果二十张里有十五张像——恭喜,锚点成立。如果只有三张像——继续细化锚点,直到像的比例超过70%。脸稳了再提升分辨率和场景复杂度。这个顺序千万别搞反,不然你会花三倍的时间在原地打转。