# Pe Trial

> 生成体育试讲备考产物五件套（考场净稿/备课提纲/板书设计/队形安全图/教研自检），EXAM_PROFILE 可配考试规则，独立评审防自证评分，可出 A4 备考讲义 DOCX。触发词：体育试讲稿、试讲设计、PE-trial、教学设计、队形图、自检表、备考讲义、体育考编面试。

- Skill: `rshawn0307-maker/pe-trial` (Agent Skill, multi-file: 24 files)
- Install (CLI): `npx skillmds@latest add rshawn0307-maker/pe-trial`
- Raw SKILL.md: https://api.skillmd.com/api/skills/rshawn0307-maker/pe-trial/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Docs & Writing
- Author: rshawn0307-maker (https://skillmd.com/u/rshawn0307-maker)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/rshawn0307-maker/pe-trial

---


# 体育试讲备考产物生成器（pe-trial）

## 路由：何时用本 skill

基于教材（默认人教版《体育与健康》）为体育考编/教资考生产出可直接上考场的试讲备考产物时使用。覆盖：

- 开发新运动项目或新增子技术的完整产物五件套
- 单课生成（考生只要某一课的净稿+队形图）
- 对现有产物做独立评审与修复
- 汇总生成可打印的备考讲义 DOCX

不适用：非体育学科的试讲、纯笔试题解答——拒绝并说明。

## 角色分离铁律（先读，违反即返工）

| 角色 | 职责 | 禁止 |
|------|------|------|
| 生产者 worker | 只写自己负责的产物文件 + `manifest_{worker}.json`（产物清单+自检证据线索） | 评自己的稿、写进度/总报告、出现任何自评分 |
| 评审 judge | 按 `references/scoring-rubric.md` R1 逐项三态判定，每项给 `文件:行号`+教材页证据 | 给绝对分当结论、放过硬门问题 |
| 协调者（唯一） | 写进度文件与评审总报告、统计首次通过率/修复轮次/最终通过率 | 生成产物内容 |

- **生产者不得评自己的稿**。评审必须由未参与生产的 judge 执行。
- 前向比较类评审用 3 名 paired judges 同时看改前/改后，多数决；绝对分只作诊断，不进结论。
- 评审报告只输出"通过/不通过/待演练"三态汇总，禁止数值总分、满分率、"返工0"式粉饰。

## 细则索引（一层 references，本文件只留流程）

| 文件 | 内容 |
|------|------|
| `references/exam-profile.md` | EXAM_PROFILE 字段定义、默认画像诊断值（10 分钟/1+2+6+1/1800–2200 字，非全国硬规则）、权威依据 URL、地方规则纪律、完整课 vs 面试片段 |
| `references/artifacts-spec.md` | 五件套内容规范、考场净稿纯净性硬门、口令规范、健康课特殊结构、禁忌清单（T/S/C/E/F 系机检依据）、管理文件骨架 |
| `references/scoring-rubric.md` | R1 评分矩阵：VETO 一票否决、A–G 七维度稳定唯一 ID、[LIVE] 待演练项、三态判定与证据要求 |

---

## Phase 0：EXAM_PROFILE 确认

1. 按 `references/exam-profile.md` §2 逐字段确认（12 个字段全部落定，`region_year=unknown` 等默认值须显式确认接受）。
2. 学段年级、教材页码缺失时先向用户要；用户拒绝回答的必填字段 -> 只产出到"备课提纲"，不出净稿，并在报告写明缺口。
3. 权威依据只认 `references/exam-profile.md` §1 的两条全国性 URL（NTCE 面试大纲、2022 版课标印发通知）；地方规则只进画像字段，标"未验证，以当地公告为准"。

> 🔴 CHECKPOINT-0：EXAM_PROFILE 未全部落定不得进入生产。

## Phase 1：项目初始化（仅整库开发时）

1. 建目录 `{项目编号}{项目名}`（如 `06体操`）。
2. 协调者写进度文件 `进度_{项目编号}_{项目名}.md`：项目概况表（子技术总数/已完成/**首次通过率/修复轮次/最终通过率**/状态）、子技术清单进度表、教材来源、特殊注意事项（安全间距/文化融入/术语对照/器材/示范面/保护帮助）。
3. 更新产品内容大纲总览统计。

## Phase 2：子技术识别

1. 读教材 MD，按章节梳理技术体系，对照难度水平分类。
2. 纳入：教材明确列出、可在试讲时长内完整呈现、有独立教学价值。
3. 排除：纯理论/安全保护方法/战术配合、非技术教学项、需专业器材或对抗场景、套路过长。
4. 每个子技术定 5 属性：编号（`{项目编号}-{两位}`）、名称（教材标准术语）、类别、难度水平、教材定位。

> 🔴 CHECKPOINT-1：子技术清单定位不唯一或超教材范围 -> STOP，列候选请用户定，不擅自筛选。

## Phase 3：并行生产（五件套）

每个子技术产出五件（内容规范见 `references/artifacts-spec.md`，文件类型名沿用历史格式）：

| 产物 | 文件类型名 | full_lesson | interview_segment |
|------|-----------|-------------|-------------------|
| 考场净稿 | `试讲稿` | 必出 | 必出 |
| 备课提纲 | `备课提纲` | 必出 | 必出 |
| 板书设计 | `板书设计` | 必出 | 可并入净稿（自检表标注） |
| 队形器材与安全图 | `队形图` | 必出 | 必出 |
| 教研注释/自检 | `自检表` | 必出 | 必出（仅覆盖出现的维度） |

硬性要求（机检项，详见 artifacts-spec §2/§8）：

1. 净稿纯净性：**不得混入** R1 评分 ID、`> 评分锚点：` 旧标注、EXAM_PROFILE 字段名、字数/分数自报、占位符（`XXX`/`{}`/`待补`/`TODO`）。
2. 时长：各环节分钟数求和 = `trial_minutes`（±0.5 分钟硬门）；字数区间按语速 200–240 字/分钟换算（F1 为诊断级）。
3. 口令四类全规范可直接念出；高危项目（体操/投掷等）保护帮助到人、方向统一，否则触发 VETO。
4. 术语与 `textbook_pages` 指定教材页一致；健康课按综艺式游戏结构（artifacts-spec §3）。
5. worker 完成后写 `manifest_{worker}.json`：产物路径清单 + 每件的自检证据线索（行号），不含任何评分结论。

生产者指令模板（发给 worker）：

```
【生产指令】
项目：{项目名}　负责子技术：{编号列表}
教材来源：{教材文件路径}　EXAM_PROFILE：{画像 JSON}
规范文件：references/artifacts-spec.md
任务：每个子技术产出五件套，保存至 {项目目录}。
硬门：净稿纯净性 / 时长求和 / 口令规范 / 术语一致 / 高危保护帮助。
完成后写 manifest_{worker}.json（路径+证据行号，无评分）。
不得写进度文件与总报告。
```

## Phase 4：独立评审（R1 矩阵）

1. 输入：五件套 + worker manifest + EXAM_PROFILE + 教材。
2. 每套先查两条 VETO（安全红线 / 知识错误），命中即整卷不合格，其余不再计分。
3. 文本子项按 `references/scoring-rubric.md` 三态判定（通过/不通过/待演练），每项必须给 `产物路径:行号` + 教材页回溯，无证据 = 不通过。
4. `[LIVE]` 子项（口令音效、示范质量、教态眼神）只进"待演练清单"，禁止文本给分。
5. 前向对比场景：3 名 paired judges 独立比较旧/新版，各自输出 verdict/margin/P0/evidence/reason，多数决。
6. 协调者汇总评审总报告：逐套三态汇总表（无总分列）、P1/P2 清单、首次通过率、修复轮次、最终通过率、待演练清单。

> 🔴 CHECKPOINT-2：评审证据行号必须在最终稿上复核（行号漂移即证据失效重查）。

## Phase 5：修复与复评

- P1（影响硬门：VETO、时长、纯净性、缺件、术语冲突、安全隐患）-> 修复后**全量复评**该套，不允许只改报告。
- P2（建议项）-> 修复后复核对应子项即可。
- 每轮修复由协调者累计"修复轮次"；首次通过率与最终通过率分开统计，禁止用"返工0"粉饰。
- 连续两轮仅 slight/tie 改善即收手，如实记录。

## Phase 6：备考讲义生成（DOCX）

脚本 `generate_lecture.py` 为显式 CLI（无配置文件、无占位路径）：

```
python3 generate_lecture.py --base-dir <产物库> --out <讲义.docx> \
  [--projects 01,06,07] [--only 06-10,07-10] [--font <中文字体>] [--check] [--dry-run]
```

- `--projects`：按项目编号筛选（如 `01,06,07`），非法项目号退出 2。
- `--only`：按子技术 ID 精确挑选（如 `06-10,07-10,09-04`），用于冻结回归证据；与 `--projects` 叠加生效（先筛项目再筛子技术），非法子技术号退出 2。
- `--check`：只跑输入校验（零项目/缺文件/解析失败/不可写目录均非 0 退出，不写 final）。
- `--dry-run`：解析并打印将生成的章节统计，不写文件。
- 正式生成：先写临时文件，校验可重开后原子替换 `--out`；封面数据（项目数/子技术数/日期）动态生成。
- 版式硬指标：A4 21×29.7cm、四边 2.5cm、表宽 ≤16cm、中文字体显式声明并记录到运行日志，目录页码可验证。
- 生成后必须跑结构审计（heading/section/images/a11y 四审计 + 渲染逐页检查），见失败恢复表。

---

## 检查点汇总

| 检查点 | 位置 | 不通过动作 |
|--------|------|-----------|
| CHECKPOINT-0 | EXAM_PROFILE | STOP，补字段或降级为仅备课提纲 |
| CHECKPOINT-1 | 子技术清单 | STOP，列候选请用户定 |
| CHECKPOINT-2 | 评审证据 | 行号漂移即重查，未复核不得出报告 |
| CHECKPOINT-3 | 讲义审计 | 审计或渲染失败 -> 不交付 DOCX，按失败恢复表处理 |

## 失败恢复

| 触发条件 | 一线处理 | 兜底 |
|---|---|---|
| 教材文件缺失/非 MD | 🔴 STOP 报告缺失 | 请用户提供或改用已确认教材 |
| EXAM_PROFILE 必填缺失且用户拒答 | 降级：仅备课提纲 | 报告写明缺口字段 |
| 子技术定位不唯一/超教材 | 🔴 STOP 列候选 | 用户改选或确认筛选标准 |
| 净稿命中纯净性/时长/口令硬门 | 按 artifacts-spec §8 禁忌逐项修，重跑验证器 | 不放宽阈值、不删检查、不用外部常识补教材没有的事实 |
| VETO-SAFETY / VETO-KNOW 命中 | 整卷打回，修复后全量复评 | 连续 3 次同因失败 -> 标记该子技术"暂缓"，换下一项 |
| 评审证据行号漂移 | 在最终稿重新核对 | 证据失效的判定一律重查 |
| 讲义 CLI 输入异常（零项目/缺文件/解析失败/不可写） | 非零退出，看 stderr 定位 | 不留 final 文件；修输入后重跑 |
| 讲义审计/渲染失败（方框字/截断/溢出/错页码/大块空白） | 按指标修版式后重生成重审计 | 不以"只读 XML 正常"宣称通过 |

## 文件命名与目录

- 产物：`{项目编号}_{项目名}_{子技术编号}_{子技术名称}_{产物类型}_v{版本}.md`（产物类型用历史名：试讲稿/备课提纲/板书设计/队形图/自检表）。
- 管理文件（仅协调者）：`进度_{项目编号}_{项目名}.md`、`评审总报告_{项目编号}{项目名}_{子技术数}套_v{版本}.md`；worker 侧 `manifest_{worker}.json`。
- 讲义：`{教材版本}体育试讲备考讲义_v{版本}.docx`。
- 历史库（432 份旧产物）只读，不因本 skill 新规范回改。

```
{工作目录}/
├── references/            ← exam-profile / artifacts-spec / scoring-rubric
├── generate_lecture.py
├── {项目编号}{项目名}/
│   ├── …五件套…
│   ├── manifest_{worker}.json
│   ├── 评审总报告_….md    ← 协调者
│   └── 进度_….md          ← 协调者
└── 人教版体育试讲备考讲义_v1.0.docx
```

## 质量口径

- 交付标准 = 全部硬门通过 + 评审三态汇总无未解释的"不通过" + 待演练清单齐备。
- 禁止：自报满分/数值总分结论、锚点凑数、`skip/TODO`、放宽断言、删测试、只换样式不修内容。
- 旧库中"平均分 4.8+/返工 0"类历史数据仅作背景，不得作为新产物质量证据引用。

