ai命题培训上岗记:教研员第一次用AI出卷
先把分工说死:ai命题培训教的是三件套:双向细目表生成、题干初稿、难度预估参考,我的月考出卷从五天压到两天半。但答案与课本原文的核对、原创压轴题、保密环节,一步都不许AI沾。课程实测和校对流程都在这篇里。
我在区教研室做初中数学教研员,出卷这件事干了九年:一份月考卷,双向细目表、题干打磨、答案推演、难度预估,一套流程五天起步,遇上期中期末连轴转。今年春天市里组织命题信息化培训,AI命题是重头,我带着半个命题组去了。四周课上完,回来先在月考卷上试了水,现在期中卷的初稿已经用上了新流程。这篇把课上的干货、试水的误差和我的校对流程写下来——命题是良心活,用新工具,规矩得先立。
课程三件套,各管一段
细目表生成、题干初稿、难度预估参考,AI在命题流程里干的就这三段,课讲得比想象中克制。命题信息的公开依据,课程标准和学业质量要求的原文在教育部官网都能查到,数据统计的口径看国家统计局的教育年鉴,出卷前把依据备齐,争议来了才有底气。最值钱的是难度预估的用法,课上说透了一个误区。
双向细目表那节课省的是架构时间:把课程标准、教材章节、考纲要求喂给AI,十分钟出一版知识点和能力维度的分布表,我在上面做删改,过去半天的活变成一小时。题干初稿那块要泼点冷水:AI出的题干初稿像模像样,情境却常年悬浮——它爱出"小明购买商品"这类脱离本地学生生活的情境,我们后来统一让它按"本区年末质量检测的行文风格"改写,落地感强了不少。难度预估是误解最深的部分:课上的观点是AI的难度系数只能当"参考排序"用,不能当"定分"用——它对"哪个题学生容易在第二步卡住"毫无感知,这个感知只有批过几千份卷子的人才有。课上一位老教研员的话我记在了备课本上:AI替你打草稿,替不了你摸学生。
试水月考卷:误差和校对流程
第一次用新流程出月考卷,AI初稿里三处硬伤:一道题超纲、一道题数据自相矛盾、一道题的"标准答案"本身就是错的。这三处,就是校对流程存在的意义。
超纲那道,考了课程表里明确"选学"的内容——AI对本地教材版本和进度不敏感,这是它的天坑。数据自相矛盾那道更隐蔽:题干说总价三十六元,问题问的是"两件一共多少",AI给的答案按单价算了三件,逻辑链在生成时自己绊了自己。标准答案出错那道最险,是几何证明辅助线的画法给反了,要不是按老规矩让同组老师盲做一遍,这份卷子就进了考场。现在我们组的校对流程固定成四道:AI初稿、命题人逐题核对课标与教材、同组老师盲做全卷、最后人工推算预估分。四道走完,一份月考卷两天半,比老流程快一半,质量还更稳。命题工作的保密纪律也提一句:涉考材料按保密规定管理,AI工具一律不得接触未启用的正式试卷内容,这条红线谁碰谁负责,没有商量。
哪些题打死不能让AI出
我们的组规:压轴题、实验探究题、体现本地特色的情境题,AI只许提供素材,不许直接出题。这三类,恰恰是一份卷子的灵魂。
压轴题是区分度的命根子,AI出的压轴题"看着综合,实则拼盘"——把三个知识点硬摞在一起,缺乏那种层层递进的坡度,学生做到第二问就知道后面没好货。实验探究题要的是真情境真数据,AI给的"某小组实验数据"整齐得可疑,学生一眼假。本地情境题是我们的特色,课上说得好:命题的地气在命题人脚下,AI不知道你们区哪条河汛期涨水、哪座桥去年通车。所以我们的分工是:基础题和常规题,AI初稿效率翻倍;灵魂题,人写完拿AI查逻辑漏洞和表述歧义。这套边界跑了一学期,命题组没人再焦虑"被替代",因为替代不了的那部分,才叫命题。学校层面的培训怎么组织,教务主任的全校方案在 AI学校培训怎么落地?教务主任的师资培训记录,跟命题组的试点正好配套。考试与命题的规范口径,教育部官网有专门文件,命题制度上墙之前先对一遍。
期中卷发下去那天,有学生跑来问:老师这次的题怎么有点新?我说好题就该有点新。工具换了一茬又一茬,命题人心里那杆秤,还是得自己扶着。效率往前赶,规矩别松手,这句是我跟命题组同事互相提醒了大半年的话。
常见问题
AI出的题能直接用吗、会不会跟网上题库撞车、保密怎么处理、新手命题员适合学吗,下面挨个说。命题组的同行,留言说说你们组的规矩。
AI出的题能直接进卷子吗?
不能,一题都不能。初稿归初稿,核对课标、盲做试答、答案推演一道不能省,流程省了,考场上还的都是事故。
会不会跟网上题库撞车?
常规题型有撞车概率,我们的做法是AI初稿后必做"原创化改造":换情境、改数据、调问法。压轴题坚持人写,撞车风险几乎归零。
保密怎么处理?
铁律:未启用的正式试卷内容一律不进AI工具,练习一律用已考完的历史卷。命题环境的设备管理和保密协议按单位规定执行,这条没有弹性。
新手命题员适合学吗?
适合,但要先攒够"手艺"再上工具:自己独立出过三份完整卷子的,AI才是加速器;一上手就用AI的新手,练不出判断题的肌肉。