AI绘画火箭结构图翻车实录:级间段、整流罩与纠偏三轮实验

AI绘画火箭结构图翻车实录:级间段、整流罩与纠偏三轮实验
AI绘画火箭结构剖视插画:蓝图风格的三级火箭内部构造

直接给结果:AI绘画画火箭结构,单靠一句提示词基本画不对,我三十次生成里级数正确的只有五张。但垫真实参考图加分层生成之后,正确率能拉到七成以上,剩下的交给后期标注。

事情起于我侄子的科学作业:要一张AI绘画火箭结构示意图,讲三级火箭怎么逐级分离。我想着这不简单,十分钟的事。结果这一画就是两个晚上。

模型画火箭的「壳」没问题,流线体、尾焰、星空背景,张张好看。问题全在壳里面——该剖开的地方它不剖,剖开的地方塞的不是燃料箱是乱七八糟的管线。最好笑的一张,第二级和第三级中间凭空长出一截球形的神秘舱段,到现在我也没想明白那是什么。好看,但物理不及格。

AI为什么总画不对火箭结构

原因出在训练数据上:网上的火箭图绝大多数是发射照和渲染图,真正的结构剖视示意图既少又不统一,模型学到的是「火箭长什么样」而不是「火箭怎么拼」。它画出的是印象,不是图纸。

你可以这么理解:让一个只看过汽车照片的人画汽车底盘,他能画出四个轮子的印象画,你让他画出悬挂结构,他就只能编了。AI编起管线来还特别自信,每根管子都画得煞有介事,细看全是直觉涂鸦。

我第一轮的统计能说明问题。同一句提示词「三级运载火箭结构剖面图」连出三十张(每张约二十秒),结果是这样的:级数画对的五张,助推器数量没错的十一张,发动机喷管朝向正确的九张,整流罩比例看着顺眼的十四张。全部同时达标的——零。

三轮纠偏实验,正确率怎么一步步上去的

三轮实验:补专业术语把正确率拉到三成,垫真实剖视图垫到五成半,再拆成单部件分层生成,合计能到七成以上。一轮比一轮笨,但一轮比一轮管用。

第一轮只改词。把「火箭结构」换成带行话的版本:级间段、整流罩、贮箱、尾段、四台助推器。用词越具体,模型猜的成分越少。这轮三十张里级数对了九张,正确率从两成不到爬到三成。有意思的是,「四台助推器」这个数量词特别灵,写上之后基本不出两台或六台的了。

第二轮垫图。我找了张公开的三级火箭剖视示意做参考图,垫图强度先给0.5,画面构图立刻稳了,贮箱一节一节排得像样起来。代价是风格被参考图带跑,原图是工程手册风,出来的图就全是工程手册风,想要插画感得把强度降到0.3左右再靠词拉。这轮正确率五成半。

参考图哪里找,说一句:别在图库里搜,去公开的科普资料和百科词条的示意图里翻,那些图本身画得规范,垫出来的结构才立得住。我头一张参考图是从某短视频截图的,结果模型把截图里的水印阴影都学进去了,白跑一轮。

第三轮最笨也最有效:不追求一张全图,把火箭拆开,级间段、整流罩、发动机各画各的,再自己拼。单部件的图几乎不出错,因为每个部件网上都有足够的特写。拼图用了 PowerPoint,别笑,对齐加标注比专业软件快。

想要「能科普」的图,标注得自己来

AI生成的图里文字标注基本不可用,箭头乱指、字是乱码,结构名称老老实实用后期工具加。生成只负责画对形状,科普的信息层要自己铺。

我试过在提示词里要求「带中文标注」,出来的字全是鬼画符,个别像「火箭」「燃料」的词碰巧能认,其余一看就穿帮。英文标注也不行,spelling 错得随心所欲。

最后的成品是这么拼出来的:第三轮的部件图合成整图,在级间段、整流罩、尾喷管三个位置手工加了引线和文字,顺便在分离位置画了两条虚线箭头。侄子交作业那天,他们老师问图是哪本科普书里扫的。我当然没说这是两晚上、九十多次生成换来的。

这算不算作弊?我倒觉得这是正确用法——AI管「形」,人管「对」。就跟CAD画图一样,工具再好,尺寸标注还是工程师的事。

回头想,这两个晚上花的值。我现在手机里存着一套拆好的火箭部件图,下次侄子要画空间站,直接从贮箱和舱段起步,能省一半时间。画结构图这事,急不得,它和画风景不一样——风景画错了顶多不像,结构画错了是要误人子弟的。

常见问题

不垫图光堆术语,能到多准?

我实测卡在三成上下,够自己看个热闹,不够科普。术语解决「画什么」,解决不了「怎么排」,空间排布还是要靠参考图喂。

垫图强度多少合适?

结构图建议0.4到0.6,低于0.3参考作用形同虚设,高于0.7就是描图了,既没风格也没意义。我常用0.5起步再微调。

剖视图和外观图哪个更难?

剖视图难得多。外观图正确率能到八成以上,因为训练图管够;剖视要求模型理解遮挡和内部排布,这是它目前的弱项,短期内别指望。

部件拆开拼图,风格会不统一吗?

会,除非每个部件用同一套风格词和同一个模型版本。我那套部件图全用了同一句风格后缀加固定种子,拼起来基本看不出断层。

延伸阅读