体育试讲备考产物生成器(pe-trial)
路由:何时用本 skill
基于教材(默认人教版《体育与健康》)为体育考编/教资考生产出可直接上考场的试讲备考产物时使用。覆盖:
- 开发新运动项目或新增子技术的完整产物五件套
- 单课生成(考生只要某一课的净稿+队形图)
- 对现有产物做独立评审与修复
- 汇总生成可打印的备考讲义 DOCX
不适用:非体育学科的试讲、纯笔试题解答——拒绝并说明。
角色分离铁律(先读,违反即返工)
| 角色 | 职责 | 禁止 |
|---|---|---|
| 生产者 worker | 只写自己负责的产物文件 + manifest_{worker}.json(产物清单+自检证据线索) |
评自己的稿、写进度/总报告、出现任何自评分 |
| 评审 judge | 按 references/scoring-rubric.md R1 逐项三态判定,每项给 文件:行号+教材页证据 |
给绝对分当结论、放过硬门问题 |
| 协调者(唯一) | 写进度文件与评审总报告、统计首次通过率/修复轮次/最终通过率 | 生成产物内容 |
- 生产者不得评自己的稿。评审必须由未参与生产的 judge 执行。
- 前向比较类评审用 3 名 paired judges 同时看改前/改后,多数决;绝对分只作诊断,不进结论。
- 评审报告只输出"通过/不通过/待演练"三态汇总,禁止数值总分、满分率、"返工0"式粉饰。
细则索引(一层 references,本文件只留流程)
| 文件 | 内容 |
|---|---|
references/exam-profile.md |
EXAM_PROFILE 字段定义、默认画像诊断值(10 分钟/1+2+6+1/1800–2200 字,非全国硬规则)、权威依据 URL、地方规则纪律、完整课 vs 面试片段 |
references/artifacts-spec.md |
五件套内容规范、考场净稿纯净性硬门、口令规范、健康课特殊结构、禁忌清单(T/S/C/E/F 系机检依据)、管理文件骨架 |
references/scoring-rubric.md |
R1 评分矩阵:VETO 一票否决、A–G 七维度稳定唯一 ID、[LIVE] 待演练项、三态判定与证据要求 |
Phase 0:EXAM_PROFILE 确认
- 按
references/exam-profile.md§2 逐字段确认(12 个字段全部落定,region_year=unknown等默认值须显式确认接受)。 - 学段年级、教材页码缺失时先向用户要;用户拒绝回答的必填字段 -> 只产出到"备课提纲",不出净稿,并在报告写明缺口。
- 权威依据只认
references/exam-profile.md§1 的两条全国性 URL(NTCE 面试大纲、2022 版课标印发通知);地方规则只进画像字段,标"未验证,以当地公告为准"。
🔴 CHECKPOINT-0:EXAM_PROFILE 未全部落定不得进入生产。
Phase 1:项目初始化(仅整库开发时)
- 建目录
{项目编号}{项目名}(如06体操)。 - 协调者写进度文件
进度_{项目编号}_{项目名}.md:项目概况表(子技术总数/已完成/首次通过率/修复轮次/最终通过率/状态)、子技术清单进度表、教材来源、特殊注意事项(安全间距/文化融入/术语对照/器材/示范面/保护帮助)。 - 更新产品内容大纲总览统计。
Phase 2:子技术识别
- 读教材 MD,按章节梳理技术体系,对照难度水平分类。
- 纳入:教材明确列出、可在试讲时长内完整呈现、有独立教学价值。
- 排除:纯理论/安全保护方法/战术配合、非技术教学项、需专业器材或对抗场景、套路过长。
- 每个子技术定 5 属性:编号(
{项目编号}-{两位})、名称(教材标准术语)、类别、难度水平、教材定位。
🔴 CHECKPOINT-1:子技术清单定位不唯一或超教材范围 -> STOP,列候选请用户定,不擅自筛选。
Phase 3:并行生产(五件套)
每个子技术产出五件(内容规范见 references/artifacts-spec.md,文件类型名沿用历史格式):
| 产物 | 文件类型名 | full_lesson | interview_segment |
|---|---|---|---|
| 考场净稿 | 试讲稿 |
必出 | 必出 |
| 备课提纲 | 备课提纲 |
必出 | 必出 |
| 板书设计 | 板书设计 |
必出 | 可并入净稿(自检表标注) |
| 队形器材与安全图 | 队形图 |
必出 | 必出 |
| 教研注释/自检 | 自检表 |
必出 | 必出(仅覆盖出现的维度) |
硬性要求(机检项,详见 artifacts-spec §2/§8):
- 净稿纯净性:不得混入 R1 评分 ID、
> 评分锚点:旧标注、EXAM_PROFILE 字段名、字数/分数自报、占位符(XXX/{}/待补/TODO)。 - 时长:各环节分钟数求和 =
trial_minutes(±0.5 分钟硬门);字数区间按语速 200–240 字/分钟换算(F1 为诊断级)。 - 口令四类全规范可直接念出;高危项目(体操/投掷等)保护帮助到人、方向统一,否则触发 VETO。
- 术语与
textbook_pages指定教材页一致;健康课按综艺式游戏结构(artifacts-spec §3)。 - worker 完成后写
manifest_{worker}.json:产物路径清单 + 每件的自检证据线索(行号),不含任何评分结论。
生产者指令模板(发给 worker):
【生产指令】
项目:{项目名} 负责子技术:{编号列表}
教材来源:{教材文件路径} EXAM_PROFILE:{画像 JSON}
规范文件:references/artifacts-spec.md
任务:每个子技术产出五件套,保存至 {项目目录}。
硬门:净稿纯净性 / 时长求和 / 口令规范 / 术语一致 / 高危保护帮助。
完成后写 manifest_{worker}.json(路径+证据行号,无评分)。
不得写进度文件与总报告。
Phase 4:独立评审(R1 矩阵)
- 输入:五件套 + worker manifest + EXAM_PROFILE + 教材。
- 每套先查两条 VETO(安全红线 / 知识错误),命中即整卷不合格,其余不再计分。
- 文本子项按
references/scoring-rubric.md三态判定(通过/不通过/待演练),每项必须给产物路径:行号+ 教材页回溯,无证据 = 不通过。 [LIVE]子项(口令音效、示范质量、教态眼神)只进"待演练清单",禁止文本给分。- 前向对比场景:3 名 paired judges 独立比较旧/新版,各自输出 verdict/margin/P0/evidence/reason,多数决。
- 协调者汇总评审总报告:逐套三态汇总表(无总分列)、P1/P2 清单、首次通过率、修复轮次、最终通过率、待演练清单。
🔴 CHECKPOINT-2:评审证据行号必须在最终稿上复核(行号漂移即证据失效重查)。
Phase 5:修复与复评
- P1(影响硬门:VETO、时长、纯净性、缺件、术语冲突、安全隐患)-> 修复后全量复评该套,不允许只改报告。
- P2(建议项)-> 修复后复核对应子项即可。
- 每轮修复由协调者累计"修复轮次";首次通过率与最终通过率分开统计,禁止用"返工0"粉饰。
- 连续两轮仅 slight/tie 改善即收手,如实记录。
Phase 6:备考讲义生成(DOCX)
脚本 generate_lecture.py 为显式 CLI(无配置文件、无占位路径):
python3 generate_lecture.py --base-dir <产物库> --out <讲义.docx> \
[--projects 01,06,07] [--only 06-10,07-10] [--font <中文字体>] [--check] [--dry-run]
--projects:按项目编号筛选(如01,06,07),非法项目号退出 2。--only:按子技术 ID 精确挑选(如06-10,07-10,09-04),用于冻结回归证据;与--projects叠加生效(先筛项目再筛子技术),非法子技术号退出 2。--check:只跑输入校验(零项目/缺文件/解析失败/不可写目录均非 0 退出,不写 final)。--dry-run:解析并打印将生成的章节统计,不写文件。- 正式生成:先写临时文件,校验可重开后原子替换
--out;封面数据(项目数/子技术数/日期)动态生成。 - 版式硬指标:A4 21×29.7cm、四边 2.5cm、表宽 ≤16cm、中文字体显式声明并记录到运行日志,目录页码可验证。
- 生成后必须跑结构审计(heading/section/images/a11y 四审计 + 渲染逐页检查),见失败恢复表。
检查点汇总
| 检查点 | 位置 | 不通过动作 |
|---|---|---|
| CHECKPOINT-0 | EXAM_PROFILE | STOP,补字段或降级为仅备课提纲 |
| CHECKPOINT-1 | 子技术清单 | STOP,列候选请用户定 |
| CHECKPOINT-2 | 评审证据 | 行号漂移即重查,未复核不得出报告 |
| CHECKPOINT-3 | 讲义审计 | 审计或渲染失败 -> 不交付 DOCX,按失败恢复表处理 |
失败恢复
| 触发条件 | 一线处理 | 兜底 |
|---|---|---|
| 教材文件缺失/非 MD | 🔴 STOP 报告缺失 | 请用户提供或改用已确认教材 |
| EXAM_PROFILE 必填缺失且用户拒答 | 降级:仅备课提纲 | 报告写明缺口字段 |
| 子技术定位不唯一/超教材 | 🔴 STOP 列候选 | 用户改选或确认筛选标准 |
| 净稿命中纯净性/时长/口令硬门 | 按 artifacts-spec §8 禁忌逐项修,重跑验证器 | 不放宽阈值、不删检查、不用外部常识补教材没有的事实 |
| VETO-SAFETY / VETO-KNOW 命中 | 整卷打回,修复后全量复评 | 连续 3 次同因失败 -> 标记该子技术"暂缓",换下一项 |
| 评审证据行号漂移 | 在最终稿重新核对 | 证据失效的判定一律重查 |
| 讲义 CLI 输入异常(零项目/缺文件/解析失败/不可写) | 非零退出,看 stderr 定位 | 不留 final 文件;修输入后重跑 |
| 讲义审计/渲染失败(方框字/截断/溢出/错页码/大块空白) | 按指标修版式后重生成重审计 | 不以"只读 XML 正常"宣称通过 |
文件命名与目录
- 产物:
{项目编号}_{项目名}_{子技术编号}_{子技术名称}_{产物类型}_v{版本}.md(产物类型用历史名:试讲稿/备课提纲/板书设计/队形图/自检表)。 - 管理文件(仅协调者):
进度_{项目编号}_{项目名}.md、评审总报告_{项目编号}{项目名}_{子技术数}套_v{版本}.md;worker 侧manifest_{worker}.json。 - 讲义:
{教材版本}体育试讲备考讲义_v{版本}.docx。 - 历史库(432 份旧产物)只读,不因本 skill 新规范回改。
{工作目录}/
├── references/ ← exam-profile / artifacts-spec / scoring-rubric
├── generate_lecture.py
├── {项目编号}{项目名}/
│ ├── …五件套…
│ ├── manifest_{worker}.json
│ ├── 评审总报告_….md ← 协调者
│ └── 进度_….md ← 协调者
└── 人教版体育试讲备考讲义_v1.0.docx
质量口径
- 交付标准 = 全部硬门通过 + 评审三态汇总无未解释的"不通过" + 待演练清单齐备。
- 禁止:自报满分/数值总分结论、锚点凑数、
skip/TODO、放宽断言、删测试、只换样式不修内容。 - 旧库中"平均分 4.8+/返工 0"类历史数据仅作背景,不得作为新产物质量证据引用。