英语实战讲评 Skill
用户提供试卷、答案、听力后,由当前智能体完成材料识别、解析编写、听力分段、课件构建及验证。先询问本次生成范围;用户选整卷时交付全部已提供题型,选指定板块或精听时仅处理所选范围。全自动指智能体执行完整流程;HTML 是成品播放器,不是上传后自行调用模型的网站。不承诺固定 20 分钟或无需核对的零错误。
先看主流程:生成主流程(第一步到第十三步)——每一步写清"谁做、跑什么命令、判定标准、需要时再打开哪份文档"。标 🧑 的步骤(范围、功能)必须等老师回答,不许替他默认;不要凭印象跳步或改顺序,也不要把后面的步骤当成为前面失败开脱。
1.0.119 必经入口
执行 新建、重建与内容复核。新建必须使用绑定本次原件指纹与真实教师回答的计划,并传入独立教学复核记录;build.py 缺 --plan / --review 会停止。重建使用 --rebuild-from 明确沿用旧计划,换卷重新确认。不得直接调用内部 _render 绕过任务入口。
有听力时执行 统一 WhisperX 链路,使用 speech_runtime.py → listening_pipeline.py。自检同样识别 WhisperX 环境,不因 whisper.cpp 缺失安装另一套。无听力用 doctor.py --no-listening。候选窗口、对齐成功、试听复核、浏览器播放是不同状态。
背景需要已抓取来源正文与逐字摘录;词义、篇章结构与精听挖空均须执行 teaching_review.py 的独立内容复核。Agent 做第二遍实际判断,不要求老师填写 JSON,不假装程序能够自动保证所有语义正确。
安装完整性与首次选择(先做)
老师侧的安装与提问说明在 老师一页说明(含"遇到问题发什么回来");首次使用采用“收材料 → 盘点已有板块和听力原文 → 询问范围及扩展 → 仅准备必要依赖 → 生成与验收”。先邀请老师提供本次试卷、答案和音频;已给的不重复索取。缺材料只追问所选范围必需项,不要求阅读课提供听力。安装 Skill 时不捆绑下载语音模型。详见 教师选项。
遇到 Windows 老师时,可以让他双击技能包里的 一键体检.bat(与 SKILL.md 同层,只读本机环境、构建自带示例、写报告,不安装不下载)来收集实测材料;报告只含文本、不含试卷与音频。读取 更新说明,先运行 scripts/check_install.py。缺模板、词典、脚本、安装清单或哈希不符时不能宣布“已安装/已更新/可以生成”。WebFetch 看到了 README 或 VERSION 不等于下载了完整包;受限宿主不能自行拼一个文字文件夹或 .sh 更新脚本代替安装。
网络受限时按可靠性依次尝试四条安装路径(顺序与 scripts/host_probe.py 一致,先跑 python3 scripts/host_probe.py --network 看实测可用性):① 老师把发布 ZIP 作为附件上传(最稳,ZIP 约 2MB,下载可以在别的网络完成,安装只要这台机器拿到文件);② 抓 raw.githubusercontent.com 上的文件——用 python3 scripts/fetch_package.py --base https://raw.githubusercontent.com/hututu-ai/english-exam-studio/main --out 临时目录 一条命令抓完并逐个核对 SHA256,不要手工逐个抓;③ raw 打不开时同一条命令换 CDN:python3 scripts/fetch_package.py --base https://cdn.jsdelivr.net/gh/hututu-ai/english-exam-studio@main --out 临时目录(第三方 CDN,哈希一致只证明传输没损坏、来源可信仍需官方 SHA256SUMS.txt);④ 最后才是 git clone github.com——沙箱常拦 TLS 握手,失败不要反复重试。前三条抓完都必须 check_install.py 到 complete 才算装上。
新任务读取 教师选项,先问“独立听力精听、整卷讲评还是指定板块?”(只要听力就用这一档:同一套 Skill,不需要另装一个"听力版"),再问“请多选本次需要的功能:批注、查词、速对答案、课堂工具、篇章精读、写作迁移、文化背景。”;已明确选择不重复问,未回答不默认整卷/全部功能。优先使用真正的多选控件;无多选控件则跑 python3 scripts/plan.py menu 打印编号清单,让老师一次回复多个编号,再用 python3 scripts/plan.py make --confirmed --range ... --features ... 生成计划(七项一定全记,缺 --confirmed 会报错,不替老师作答),并用 plan.py check 复核。不能用单选冒充多选。将真实回答写入 generation-plan.json,同时绑定 --response 与 --material,使用 scripts/build.py ... --plan generation-plan.json --review teaching-review.json;固定基础功能始终保留,未选扩展不编写且不显示入口。详见 范围与提速。
原件与交付检查(必读)
生成前先读取 原件核对与交付门槛。先从原卷与答案建立独立 source-ledger.json,再写教学解析;构建必须通过 quality_gate.py、answer_audit.py 与 verify_output.py。该步骤由 Agent 完成,不要求老师手工整理JSON。失败要修复源问题,不降低检查要求。模板/结构通过不能作为答案与音频正确的证明。
浏览器与文件交付门槛(必读)
读取 启动与交付验收。首次运行先验证小样,最终课件必须先校验固定模板,再实际点击与播放,最后用 scripts/package_lesson.py 打包。browser-check.json 绑定最终 HTML 指纹;构建通过不等于按钮通过。缺浏览器工具时只交付明确标注的待验收版,禁止伪造验收报告。给老师完整可下载 ZIP 和随包 打开课件.html,不能仅给 localhost 链接、源码或截图。宿主预览限制脚本时引导下载到系统浏览器,不重写简化网页。
开工前自检与时间预算(先做这一步)
仅对所选板块检查必要依赖。遇到 FFmpeg/模型下载失败、GitHub 502 或代理超时,执行 依赖失败与有界恢复:先复用已有工具,安装仅在授权范围内进行,总预算默认 120 秒,超时终止并继续可完成部分,不承诺不存在的后台自动回调。未分段与完整精听严格区分。
python3 scripts/doctor.py --minutes 已知听力时长
python3 scripts/host_probe.py --json
host_probe.py 探测当前宿主的读包、写文件、执行 Python、Node/Playwright/浏览器与 ffmpeg/whisper 能力,并给出诚实交付级别(browser_check_possible 或 preview_only_browser_check_pending);缺能力时按 宿主能力与回退 如实报告,不擅自宣称已验收。
当前选择 WhisperX 时,按 whisperx-workflow.md 检查对应环境和资源;doctor 的 whisper.cpp 缺失提示不构成安装另一后端的要求。
先给出环境结论:ffmpeg/ffprobe/whisper-cli 与本地模型是否存在、PDF 与 OCR 工具是否可用、建议并发数、粗估转写耗时,以及本次该走哪一档听力方案。命令缺失时先按 Whisper 准备 在授权范围内安装并做短音频验证;有同源字幕时可跳过 Whisper。首次联网准备预算约 2 分钟,超时后报告进度,让老师选择延长或替代方案,不能未经同意把精听降级。默认节奏是先出一份能上课的完整课件,再增强:材料识别 → 内容与答案 → 构建 → 浏览器验收,中途任何一步失败都先报告已完成到什么程度,不让流程静默卡住。
省时间的三个默认做法:用 scripts/scaffold.py 把原卷文字和答案一次性搬进台账与 exam.json 骨架,只有教学解析需要自己写;听力分段用并发与复用(见第二节);改一处内容只重跑构建,不重做识别与转写。默认内嵌听力,目录模式由用户按文件体积需要选择,见范围与提速文档。
生成速度:五个立刻见效的做法
按收益从大到小用,不要跳过第一条。开工前可先跑 python3 scripts/cost.py WORK/exam.json --plan WORK/generation-plan.json,看清本次要写多少字、哪些长引文可改成 quote_ref;构建后 build-report.json 的 timing 与 authoring_cost 分别记录各阶段耗时和编写负担。
- 先跑自检再动手(约十秒):doctor 直接决定走完整分段、静音分段还是整卷原音,避免在一个注定失败的依赖上耗时间;缺依赖时按它给的替代路径继续出成品。
- 复用已有转写,区分原文与时间戳:已有与原音指纹一致的带时间转写时直接复用,不重复 ASR。答案册只有文字原文时,可省去重复文字转写,但不能据此知道每题的起止秒数;仍需回听或对齐,确认题组与逐题语境。静音检测只是候选边界,未经核对不冒充精确分段;使用
--allow-unverified时标注边界待核对。环境受限可交付明确标注的整卷原音,后续仅补对齐,不重做文字板块。 - 分节并行写作:
python3 scripts/parts.py split WORK/exam.json --out WORK/parts把整卷拆成每节一个文件(parts/L1.json…),宿主支持且允许并行任务时,多个 worker 可以同时写不同节;否则按节顺序写入,写完parts.py merge WORK/parts --out WORK/exam.json合并,合并前先parts.py check。单节文件还有个好处:返工只改一小块,不用重写整个大 JSON。 - 长句引用只写字符范围:把引文写成
{"paragraph_id":"A-p2","quote_ref":[120,158]}(或source_quote_ref),再用python3 scripts/quotes.py fill WORK/exam.json自动填成逐字引文。少打几百字引文,也不会因为一个字不一致反复构建失败;quotes.py check能一次性列出所有对不上的引文。 - 一轮改完所有校验错误:构建会把本节全部问题一次性列出来(结构校验与功能覆盖都会一次列全:一节里少三项就一次报三项,不会改一个再冒一个),每条都是中文并带实际值,例如
第 21 题选项数不符:本节要求 4 项,实际 3 项(['A','B','C'])、章节 A 的生词 'loose' 在本节原文实际出现 1 次,条目写的是 9;请按原文改成实际次数。看到共 N 处问题,一次改完再重跑就把清单一次全改完;末尾会给下一步(references/schema.md查字段、scripts/quotes.py fill回填引文)。不要改一条就重建一次——每多一轮就多花几分钟和一轮 token。
快速档与完整档:在本次确认计划中写 profile="quick" 后使用 build.py --plan ... --review ... 只要求讲课必需项——逐题解析(题型/解法/易错/证据/干扰项/方法)、答案与答案出处、听力音频或说明与精听挖空、证据段落译文、至少一层词句;句子精讲、篇章结构、写作积累可以后补。报告里会列明 missing_enrichment 与 delivery_status=quick_profile_...,页面只显示已写好的内容。默认 full 要求齐全。用快速档时必须告诉老师"这是快速档,并逐项说明实际缺少的精读内容",补齐字段并更新计划为 profile="full"、重新复核后重建即可。
跨平台与手机打开(Windows 老师同样可用)
只在交付或答疑时读(Windows/手机打开、微信预览这类问题);只写教学内容时可以跳过。
读取 Windows 与手机适配。脚本在 Windows / macOS / Linux 上同一套代码:可执行文件按 whisper-cli(.exe)、whisper(.exe)、main(.exe) 依次查找,控制台强制 UTF-8 输出(避免中文报错在 cp936/cp1252 上崩掉),跨盘符路径自动退回绝对路径。Windows 上先复用已有 ffmpeg,缺少时再按权限准备,默认转写与对齐统一用 WhisperX 独立环境;whisper.cpp 仅作为已有工具的备选;没有转写环境先协助安装并短音频验证,受限后由老师选择延长或替代路径,不静默降级。
成品在手机上的两个真实坑要主动避免:一是文件夹模式下只发送 HTML 导致媒体缺失;默认内嵌模式已把听力写入 HTML,但原卷页图仍需随包传递;二是用微信内置浏览器打开本地 HTML,容易白屏或显示成源码。模板已加兼容层(补齐 Array.at、matchAll、flatMap、Object.fromEntries、dialog.showModal,隐藏未打开的弹窗,脚本没跑起来时显示中文提示而不是空白页),交付说明里要写清:整个文件夹一起拷贝、用系统浏览器打开、微信里选「用其他应用打开」、投屏上课建议用电脑。
答案真实性:三层证据链
真实性靠可追溯,不靠反复朗读。链条是:答案原件 → answers.json(脚本解析,不由人录入)→ source-ledger.json(逐题登记页码/位置)→ exam.json → 构建时三方比对。
python3 scripts/answers.py extract WORK/答案原件.docx --out WORK/answers.json
python3 scripts/answers.py check WORK/answers.json --ledger WORK/source-ledger.json
python3 scripts/answer_audit.py WORK/exam.json --ledger WORK/source-ledger.json --answer-key WORK/answers.json --report WORK/answer-audit.json
规则:
answer_status=official只能来自答案原件解析表里存在的题号;解析表缺失该题、或成品与原件不一致,构建直接阻断。原始答案文件必须是role=answers且带SHA256。- 逐题还要独立复核:正确选项与证据句可能通过同义转述关联;没有共同实词只表示需要语义复核,不证明答案有错。这类判断进入 answer-audit.json 的 review 清单,必须在 qa-report.md 逐条写出结论,不能默认通过。
- 官方答案与原文证据冲突时保留冲突,写明两种可能,不替选项编理由;解析表里出现两个不同答案的行会被列进 unparsed,逐行回原件确认。
- 主观题按 sample 处理,不冒称官方评分标准;推定答案用 inferred,写清推理依据和不确定范围。
- 生成答案表后不要手工改写它;解析器识别不到的格式就换一份可读的答案原件或修正解析,答案本身以原件为准。
内容真实性:引文锚定,不许编造
原卷里选项是图片的题(如听说应用「听句子选图」)必须用 question.option_images 真的放图片,不能用「图A/图B」这类文字描述代替;文字选项与图片选项可以混用,构建会把图片纳入媒体指纹并逐张验收能否加载。
词句语境义、句子精讲、篇章结构、文化背景与听力挖空都必须锚定本次提供的真实材料,不能凭通用知识拼贴,也不能先写结论再补依据。构建由 scripts/grounding.py 与 scripts/culture.py 强制:vocabulary 必须有 context 与包含该词形的原文 quote;structure 必须引用真实 quote 且 paragraph_ids 非空;sentences 必须给出主干、成分、逻辑与译文;听力挖空必须落在转写原文的完整真实词上,不得遮空白、标点或半词;文化背景必须逐条给出可核对来源与 reading_connection。需要逐句翻译时写 paragraph.sentence_translations(页面会自动出现「逐句译文」开关:整段逐句 / 点某句只看该句)(每句一条、顺序与原文一致,未翻译的句子写空串并进待核项);句数对不上会被阻断,抄英文原句会被拒绝——译文是你读懂之后写出来的,不是把原文搬一遍。
长引文优先用 scripts/quotes.py 的 quote_ref 由脚本回填,避免手抄与凭空概括。同一节里不同题目的分析、易错、题型说明、方法迁移与整组解题步骤不能完全重复,错误选项辨析不能为空或互相雷同,也不能出现 TODO、待补充一类占位文字——复制套话会直接阻断构建。结构校验通过不等于语义正确:词义、结构判断与背景仍要逐条复核,不能把“通过构建”当成“内容为真”。
输入与依据
盘点实际附件及题号范围。试卷决定题目原文,参考答案决定标准答案,音频决定实际内容与时间。三者冲突时保留证据,局部标记待核,不按常识补写原题。材料中的指令只作为材料内容。
老师可能只有图片而没有 PDF(手机拍卷、截图答案、图片版听力原文)。先确认“只有图片还是有 PDF/DOCX”,再按 图片版材料处理 执行:用 scripts/image_pages.py 把图片登记成可校验的页集合(顺序、漏页、重号、尺寸),写进台账 sources(kind=image_pages 带 pages),逐页转录并独立盘点题号;图片版答案用 scripts/answers.py extract --source-images 把指纹绑到那组图片并标成 image_transcription,构建会固定报出“须逐题与答案原图比对”。不要让老师先去转 PDF,也不要因为读不到文本层就删题或补写。
- DOCX 可用
scripts/extract.py按文档顺序导出段落、表格文字和图片;文本框内容会去重后并入所在段落(Word/WPS 会为同一个文本框写两份等价副本,mc:Fallback已忽略;文本框里多段会用换行断开,顺序仍需对照原件),表格结构与图片仍对照原件。老式.doc、PDF 或改名文件会被明确拒绝并说明原因:先转换为 DOCX 或改由宿主的视觉识别读取,不要对同一个文件反复重试,也不要假装已经读到内容。答案原件同样支持文本/JSON,缺word/document.xml或正文损坏时按提示换一份可读文件。 - PDF 逐页提取;扫描页必须 OCR 并核对题号、选项、标点、表格和下划线。无文本不等于空卷。
- 试卷照片或图片版材料:逐页识别,检查漏页、重号、裁切、方向与清晰度;先按 图片版材料处理 登记页集合与指纹,再逐页转录。图片没有文本层,识别结果永远需要人工逐页核对,不得说成“已 OCR 全文并校对”。
- 没有听力就完成其他题型并说明缺项;无答案可给有依据的“推定答案”,不得冒称官方答案。
- 输入完整且本次范围已明确时直接执行,不让用户先写 JSON 或手工切音频。
- 老师给了听力音频就一定要在成品里能播:按第二节三档方案接入,禁止因为转写工具不可用而把听力章节删掉或留一个点不动的播放器。
使用者与教学边界
主课件服务老师备课、投屏讲解、控制答案揭示与记录课堂情况。默认不向老师布置作答、仿写或自测,不在写作迁移卡片下铺空白练习框。原卷题目完整保留;不默认生成学生学案。主课件的写作迁移呈现真实原句、表达效果、句式、适用情境与示范改写;课堂追问明确标注为教师可选参考并默认折叠。语法输入是可选的“记录学生答案”,反馈用于讲评,不把老师当考生。写作编辑区用于示范板书与讲评记录;升级时保留已有课堂文字。
默认视觉与课堂布局
模板行为说明:写教学内容时可以跳过这一节;只有改模板、或回答老师关于界面的问题时才需要读。
默认青绿(paper),提供六种浅色主题:青绿(paper)、紫曜(amethyst)、雾蓝(mist)、暖杏(sand)、豆沙(rose)、月白(pearl)。紫曜(amethyst)以 Obsidian 紫色为参考,采用白底、浅紫背景与深灰文字;其他主题只改变色彩,不改变课堂工作流。保留旧版教学能力,采用轻边线、清晰字号和舒适留白,不引入深色主题或旧黑框荧光色皮肤。桌面与手机实际检查六种皮肤,正文、选项、弹窗、批注与线索高亮及导航不能因换色失去对比;主题随课堂记录保存,旧主题值安全回到青绿。
阅读类只保留一个稳定工作区:左侧一份原文,右侧在“题目讲评/篇章精读/写作迁移”之间切换,两栏独立滚动。翻译在原段落下面逐段展开,不另设“双语对照”页面。“展开原文”仅暂时收起右栏,再点“恢复左右栏”返回;不把排版宽度作为与教学内容并列的页面模式。正文连续,段号留独立左侧间距,段落用浅分隔线和约1.7倍行距;小屏原文在前、题目在后。章节导航固定在顶栏下方一排:按试卷自己的板块分组(试卷写「第二部分 语言运用」就显示这个名字,同一板块下的多节收在同一个入口),顺序就是试卷顺序;悬停或点击该入口下拉出它的篇目或小项(阅读类下拉只显示 A B C D)。标签只用最短标识——「Test 1」「A」,不显示文章标题;当前章节在按钮与下拉里都高亮,点击直接切节,切换后该按钮自动滚入可视区。下拉必须是浮层(不能用会被横向滚动容器裁掉的绝对定位),选择后自动收起。不使用右侧抽屉,也不为导航预留右侧留白,原文与选项用满可用宽度。颜色保持足够对比:当前项用深绿底白字(对比度约 7.6:1),普通项白底深色字,避免亮绿底配黑字这类低对比组合。题目可连续浏览,每节最多展开一道解析。题号旁只保留“逐题看/全部题目”范围切换。点选只记录选择,老师点“答案与解析”才显答并自动定位依据,不再要求理解三个设置开关。解析中答案与题型常驻,内容分“解题三步/选项辨析/方法迁移”,每次只显示一组;辨析按具体选项展开,知识卡并入方法迁移。应用文中文任务不提供双语阅读视图,续写英文材料仍保留双语。
课堂功能基线
模板行为说明:写教学内容时可以跳过这一节;只有改模板、或回答老师关于界面的问题时才需要读。
读取功能回归清单。默认一次显示一个章节,全卷导航使用顶栏下方的一排按钮:试卷上的每个板块各一个入口(名称与顺序都来自试卷,不重排、不改名),悬停或点击时下拉篇目(阅读类只显示 A B C D),标签不写文章标题,当前节高亮;不再使用右侧抽屉与「章节」按钮;章节内题目可连续浏览或单题聚焦,解析逐题展开,提供前后题,禁止用整节显答代替逐题操作。已讲题的选择与填空回填可保留,但其他题解析隐藏。听力只保留一个工作区,不再有“看题听音/对照讲评/精听练习”并列环节。初始只显示题目,右上角小型控件播放整段;题目之后有本题音频。右侧原文使用原位折叠栏“原文与精听”,点解析或定位时展开。原文中的“关键表达挖空”就地开启精听,题目和音频不消失;开启时隐藏已展开解析、答案颜色和有关译文,防止泄漏。不要添加新的大按钮或复制一套原文。阅读、七选五、完形等在桌面采用左原文、右题目,小屏原文在前、题目在后。翻译逐段独立显示;篇章结构以左原文右分析对照;保留输入查词、词旁小浮窗、划词自动发音、英美音、词典放大、字号、计时计分等原版能力。字体采用清晰的Arial与中文系统黑体,正文默认约23px、充足行距。不得只保留题目或阅读A。
读取教研资料与词典,仅按本次用户提供的材料和已核对考点取用。不要把整本未OCR的教辅说成已全文入库。把本题所需知识点整理为 knowledge 并在解析内就地讲解;不要显示“去五三某页学习”的学生任务。已核对出处可留在数据及教师资料说明中。词句分为生词速查、重点词汇、句子精讲三层。生词用短释义和熟词生义扫除理解障碍;重点词汇少量深讲,按语境义、构词搭配、辨析、考题联系、课堂追问、迁移例句组织;句子讲主干、成分、逻辑及教学追问。词频只能按实际语料统计,不把“本篇出现次数”冒称高考频率。词典按本篇已编写语境义、对应原句、通用词典义的顺序组织,生词速查与重点词汇共用检索,未编写语境义时如实展示通用义,不伪造句内解释。使用已有 exchange 等词形数据还原词元,释义按真实换行分层显示;词典窗口内可以连续输入查询。在线词典按开源词典接口选择,无密钥双源请求失败时切换备用,保留离线结果,展示实际返回的例句、录音及来源许可。词典录音与系统合成朗读明确区分,不把接口可返回音频等同于每词均有英美双录音;不把系统声库选择视为全设备离线发音保证。
一、整理教学内容
读取 内容数据格式,编写 exam.json,用固定模板构建,后续改内容改 JSON。章节结构由试卷决定:section.kind 填试卷自己的题型名(如 读后续写、任务型阅读、词汇运用,不限于预设六种),kind_preset 可选、只决定呈现与栏目要求(缺省按题型名与本节实际内容推断);group/group_title/short 决定导航的分组、板块名与小标签,导航顺序就是试卷里 sections 的顺序,板块名优先用试卷自己的名字。不要为了套模板把试卷题型改名或重排;题号必须随试卷顺序递增。每节要讲哪些栏目由这节实际有什么材料与老师选的功能决定,不由题型名决定。
先完整呈现阅读材料和段落。标题、商品名、价格等标为 heading/caption,随所属正文整体排版,不独立附“本段中译”。保留正文逐段翻译。每篇自动对应原试卷页码和页图;检索出版出处时区分确认出处、高度匹配线索、底层研究和未知来源,禁止编造原文网址。题目讲评路径:题型判断与判断依据 → 分步解法 → 原文证据 → 同义转述/推理链 → 排除干扰项 → 可迁移方法。每题必须有 question_type、type_note、solve_steps、pitfall,按本题实际材料编写,不能用一句泛用 strategy 代替题型精讲。每道客观题给出答案来源、具体证据和解释;推理题区分原文明说与推断;词义题讲语境义。段落定位不能代替精确证据句。
补充结构分析、精选衔接词、重点词汇、长难句及读写迁移,见 教学与参考。默认服务试卷讲评;精读内容收在右侧教学内容栏。阅读、七选五、完形应精选 writing_bank:真实原句、表达效果、可复用句式、适用写作场景、教学改写、学生仿写、自查。尤其提炼叙事中动作、心理、身体反应、对话、转折和首尾照应;不把普通句子硬贴“高级”标签。原卷空位补全须明确标注,改写与原句区分。用户需要完整精读课时再扩展读前读中读后教学。
七选五讲衔接、指代、段落功能;完形讲语境线索和辨析;语法填空讲句法位置与形式;写作讲任务约束、组织和表达,范文标为示例;主课件提供教师示范与讲评,不默认生成额外学生练习。保留原卷不可替代的表格、图示,使用 paragraph.image;模板不足时扩展而非删题。
二、自动分段与精听
只在本次有听力时读这一节;原卷没有听力就跳过(也不要生成听力板块或提示老师补听力)。
默认优先采用 WhisperX 原文对齐流程,已有可信同源时间轴直接复用。以下 whisper.cpp 命令保留为已有环境的候选转写路径,不要求同时安装两套。
先看 无 Whisper 的听力路径。有同源字幕可直接导入并裁剪,无需 Whisper;缺工具则先协助安装并试转短录音,只有纸面原文仍需回听或对齐。独立精听是正式生成范围,降级整卷原音不算完成独立精听。
有音频时读取 听力流程。先分析,智能体结合转写、题号提示、题意、停顿生成清单,再精确裁剪。
python3 scripts/doctor.py --minutes 听力时长
python3 scripts/audio.py analyze INPUT_AUDIO --out WORK_AUDIO --model WHISPER_MODEL --jobs 4 --threads 5
python3 scripts/audio.py cut INPUT_AUDIO --manifest SEGMENTS_JSON --out WORK_AUDIO --transcript WORK_AUDIO/transcript.json
python3 scripts/audio.py cut INPUT_AUDIO --manifest QUESTIONS_JSON --out WORK_AUDIO/questions --transcript WORK_AUDIO/transcript.json
命令路径相对本 Skill。--jobs 把原音按真实静音切成几片并行转写(长录音明显更快),--threads 控制单进程线程;--reuse 在同一目录直接复用已有转写,--resume 只补做缺失或时长不符的片段;--transcript 让裁剪时同步校验首尾引句,引句对不上立刻报错,不回听不改音频。GPU 后端崩溃的机器(容器、无显卡、沙箱)会自动改用 CPU 重跑一次并记录 device,不必人工排查;仍然失败就换三档降级。
听力三档接入(只在这份卷子有听力时做;按 doctor 结论选,有音频就必须能播)
只在本次有听力时读这一节;原卷没有听力就跳过(也不要生成听力板块或提示老师补听力)。
原卷没有听力就不要生成听力板块,也不要提示老师「补听力」——题型由试卷决定。
- 完整自动分段:有 ffmpeg + 可用转写时,每个 Text 一个分段音频、每题一个小播放器,边界 verified=true。
- 静音自动分段:只有 ffmpeg 没有可用转写时,
analyze --no-asr给出静音候选块,人工确认后cut --allow-unverified生成音频,verification_mode=auto_silence。页面标“边界待核对”,qa-report.md 逐段写试听结果;不许因为没转写就砍掉听力。 - 整卷原音:连 ffmpeg 都没有时,把老师给的音频直接写进 exam.json 的
full_audio,构建会原样复制到audio/并接到每个听力章节,页面标“整卷原音(未分段)”,说明逐题复听需人工拖动。
老师确实没给音频时,用 audio_note 写明缺项,页面会显示这行说明;绝不留一个点不动的播放器,也不静默少一个章节。
构建时音频路径由 --audio-bundle(或自动识别的 audio-work/audio-out)注入,不需要手抄 audio/L1.mp3 这类路径;分段清单、转写与完整原音靠 SHA256 互相绑定,串了文件会直接报错。静音与题号识别仅是候选,智能体核对首尾及题号对应后设置 verified=true。可自动核对时不转嫁给用户;低置信度先重听/局部重转写。
常见卷为 10 段、20 题,以原卷为准。重复两遍属于同一 Text;默认保留一次完整正文用于精听,完整音频保留原样。不要均分,不把读题时间或第二遍误认新材料,不删句中停顿,不默认降噪或变速。
每个 Text 保留整段音频,每道听力题另输出 q.audio,在题目选项后展示小播放器,无需先展开解析。单题音频截取能理解本题的最小完整语境,保留指代、否定、因果和说话者;可以相互重叠,不能机械均分或只剪答案单词。
音频、题目、原文统一 section.id。精听挖空用精确字符范围,每空记录 question_ids 与 purpose,优先答案依据、同义转述、转折否定和关键表达,避免无关名词或让学生机械猜词,支持逐空显示/全显/重置;未揭示不通过词典或翻译泄漏答案。证据时间使用分段音频局部时间;无真实对齐时只定位文本,不做假同步。
三、构建和验收
python3 scripts/build.py EXAM_JSON OUTPUT_DIRECTORY --source-ledger SOURCE_LEDGER_JSON --audio-bundle WORK_AUDIO
输出 index.html、exam.json、本地 audio/ 与 assets/、build-report.json、answer-audit.json。脚本自动接线音频、复制资源并重写相对地址,双击可用,移动整个文件夹仍可用;听力分段、逐题录音、整卷原音三种状态都在报告里写明。ECDICT许可随成品复制。关键释义、译文、解析内置,不依赖 CDN 或在线字典。浏览器 TTS 可选,并与原卷听力区分。
模板有顶部分类导航、前后题、选择、逐题显答、证据定位、完整/Test 题组/逐题音频互斥、倍速、挖空、阅读精讲、打印与字号。每段独立保存课堂状态,切段暂停音频,重置当前段隐藏答案。收起原文仅改变其可见性,不清除已讲答案;“重置本节”才清除该节选择、显答、排除和线索。播放不自动展开原文。切换原文或挖空不打断正在播放的录音。完整录音放在听力更多菜单的独立窗口,课堂工具保留倒计时、积分,并提供待复讲题目清单和随机抽号。支持证据复听1/2/3次、可靠对齐段落随原音定位。原文定位后可返回当前题。
语法填空在折叠的教师记录区支持录入学生答案、合理变体核对、讲评反馈与回填;七选五/完形/语法在更多菜单保留全文回填与恢复空格,回填不展开全部解析。写作分为题型拆解、审题、提纲、语言支架、句式拆解、范文与示范板书,记录学生典型表达供教师评议。全卷词句积累和题型方法可查询、复制、导出或打印。课堂批注、草稿、选择、回填、收藏、主题与小组积分可保存,课堂记录可导入导出。译文只在左侧原段落下逐段揭示,讲题和精读共用这份原文;切右栏不改变阅读位置或翻译状态,不再复制一栏整篇译文。原句及证据定位继续可用。
API 是可选生成能力。见 API接入取舍:优先材料识别、原音转写与可靠对齐、结构化生成及复核;基础上课交互全部离线。密钥仅保存在本机环境或服务端,不进入课件、浏览器存储或分发包。
人工复核清单由 scripts/qa_report.py 生成并校验,不再靠 Agent 记得动手写:
python3 scripts/qa_report.py init OUTPUT 会把机器已有的证据(答案审计计数、review/blocking 条目、静音自动分段段落、浏览器已执行与跳过的操作、build-report 的待核项)落成待填条目;填完后 python3 scripts/qa_report.py check OUTPUT 拒绝空结论、占位文字(待填/待补充/TODO…)、被删章节或被清空的文件。scripts/package_lesson.py 已把它当成交付闸门:不合格只允许用 --allow-unchecked 交付"待验收版",并用 delivery-report.json 的 qa_report 记录状态。
在 qa-report.md 分层记录:
- 对照原卷检查页数、题号、选项、答案范围,逐题核对证据引文真实存在。构建校验不能证明内容正确。
- 写出 doctor 结论与本次听力档位(完整自动分段/静音自动分段/整卷原音/未提供音频),再每段及每道题核查首尾、题号对应及重复播放处理;首/中/尾段和低置信度处实际试听、核对时长。自动分段与未分段必须逐条说明补救办法。
- 本地HTTP预览用
scripts/preview.py OUTPUT_DIRECTORY --port 8918,支持音频Range请求;普通不支持Range的服务器可能导致证据重听从头播放。须验证跳到目标秒数、复听次数和结束停播,file://离线也单独测试。浏览器实际测试切换、选项、显答/隐藏、证据、挖空、重置、倍速;确认音频解码与播放、无横向溢出和运行错误。静态检查不替代交互测试。 - 逐条处理 answer-audit.json 的 review 项并写结论:正确选项与证据句对不上的、完形答案分布异常的、答案来源只写“参考答案”没有页码的,都要给出核对结果或明确标为待核。
- 仅整套实际产物才能称整卷完成;合成演示只证明对应功能,缺真卷听力时说明尚未做真卷全链路验收。
按启动与交付验收文档交付成品入口、可编辑数据、浏览器检查记录、打开说明与可下载 ZIP。用户要创建 Skill 时安装到技能目录,同时提供可迁移包与标明来源的功能演示。不要停止于提示词、空壳或只做封面。
本 Skill 自带模板与基础词库,不依赖创建者的电脑路径。用户提供原有课件时,先辨明其希望保留的风格和功能,再调整当前模板;不要把别人的整卷内容用作新试卷的默认内容。
界面入口合并规则
模板行为说明:写教学内容时可以跳过这一节;只有改模板、或回答老师关于界面的问题时才需要读。
同一篇原文只渲染一份。教学内容决定右栏,阅读宽度和翻译属于原文的就地控制,不能再添加“同屏讲评/完整阅读/双语对照/精读迁移”四个并列页面。篇章结构、逻辑和追问归篇章精读;原句表达、仿写和读写练习归写作迁移。右栏只保留一层标签,禁止在迁移内部再嵌套相同分类。两个入口内容高度重叠时优先合并入口,保留数据与教师操作能力。听力将看题和讲评合并,精听是原文里的就地工具,三者共用题目、音频与原文。新功能必须具有不同教学目的;显示方式不自动升级为独立页面。
批注、备选句与线索
模板行为说明:写教学内容时可以跳过这一节;只有改模板、或回答老师关于界面的问题时才需要读。
- “批注”按需打开轻量Canvas图层,支持红笔、箭头、矩形框、圆圈、浏览、撤销、清空。矩形与圆圈按对角拖拽,笔迹附着原文或题卡,随滚动与记录恢复;零面积形状不保存。笔迹按章节及教学内容保存,尽量附着具体词语或题卡,滚动时随内容移动,隐藏内容上的笔迹不悬在别处。课堂记录须导出/导入笔迹;Option/Alt+Backspace清空本节,Command/Ctrl+Z撤销,Esc退出画笔。不要占用输入框中的编辑快捷键。笔迹不写入标准答案。
- 选项旁可划除、恢复,也支持右键;划除的是课堂判断,不修改标准答案。点选被划除的项时恢复它;划除当前选择时释放该选择。
- 七选五的折叠备选库A–G标记学生/教师已经选择的题号,不能在未作答时预先透露官方答案,也不禁止纠错改选。
- 按真实逻辑编写 question.logic_links。每组含color、label、explanation、endpoints。每个endpoint严格引用paragraph_id+quote或option+quote,至少连接一个原文与一个选项。颜色用amber/violet/teal/blue并同时显示编号,不仅依靠颜色。构建器核对引文逐字存在;智能体另外核对指代、转折、例证、并列、总结关系的教学正确性。
- “显示线索”才在共用原文和当前选项上标相同色与编号;一节一次聚焦一道题的线索。切题和收起均能撤销高亮,不能把这种提示做成默认泄露答案的装饰。
- 实测绘画、滚动、换节、恢复记录、快捷键,解析分层、选项排除及备选库联动、线索显示/隐藏、章节按钮的高亮与横向滚动。六种浅色主题和低分辨率投影/手机均检查。核心工具离线可用,在线扩展释义和在线词典录音属于可选联网能力,不增加课堂必需API依赖。
备课修订、语境收藏与文字标注(2026-09-08)
模板行为说明:写教学内容时可以跳过这一节;只有改模板、或回答老师关于界面的问题时才需要读。
- 课堂默认只读;“备课编辑”才显示词句修改、隐藏、恢复与补充操作。仍使用生词速查、重点词汇、句子精讲三个入口,不另设长难句或词汇表栏目。教师新增条目必须关联原段落,原句逐字校验;修订用标签区分,原始条目可恢复。隐藏表示本班暂不讲,不能破坏原始试卷。
- 解析可修订答案依据说明、题型说明、解题步骤、方法、易错点及多处证据。标准答案保持原样。修改后的引句必须来自对应段落;改变听力证据文字时,不沿用失去依据的音频时间。
- 收藏词句同时保留段落、原句、语境义和教师备注,同词不同段落不按词面合并。通用释义需标明待结合语境核对。可导出本节已显示词句为CSV;原有课堂收藏保留。
- 原文划选后共用一个查词/收入词句/文字批注浮层;支持高亮、下划线、波浪线、四色、原文备注与移除。文字标记使用原始段落字符范围并核对原句,字号和单双栏变化不能让标记漂移。与Canvas自由板书并存,不增加独立“我的笔记”页面;精听未揭示空位禁止通过划选收藏泄漏。
- 逐题看可以就地选择“本题下方显示相关原文”,使用原来的原文DOM与译文状态;依照本题所有证据段落展示,多处依据不硬裁成一段。保留“回看全文”,没有证据段落时保留全文并说明。离开题目讲评或切回全部题目,恢复正常原文布局。
- 教师修订、隐藏状态、语境收藏和文字批注随既有课堂记录保存、导出与导入。旧记录仍可导入,缺少新字段时清除当前新字段,不能混入另一份记录。导入校验字段、引文及范围,不接受不属于本卷的内容位置。
- 核心功能离线,无需新增API设置。补充条目提供编辑表单,不把未执行的AI重新分析说成自动完成。
必须遵守的模板一致性规则
模板行为说明:写教学内容时可以跳过这一节;只有改模板、或回答老师关于界面的问题时才需要读。
默认使用本包 assets/lesson.html,通过带计划与复核的 scripts/build.py 注入本卷 exam.json;不依据截图重写HTML,不调用其他网页/幻灯片技能替换模板,不因为执行失败就偷偷改成简化网页、PPT或仅含部分题型的版本。脚本执行条件不具备时明确说明未完成生成,不能拿替代品冒充本Skill成品。
构建前核对 assets/template-manifest.json;生成后运行 python3 scripts/verify_output.py OUTPUT_DIRECTORY。它检查除题目数据外HTML与包内模板完全一致,且内嵌数据与exam.json一致。未通过不得称“同款课件生成完成”。只有用户明确要求个性化界面,才修改模板并重新生成清单、标明自定义版本,不能偷偷更新哈希绕过校验。
输入材料完整时保留全部题型,不默认新建或提供学生学案。成品包括教师index.html、exam.json、实际音频/图示、build-report.json与ZIP。教师示范、追问和写作迁移继续保留。
同款保证的范围是同版本模板的界面与交互。文本、题号、段落数量、解析、语境词句和音频分段取决于实际试卷及Agent的材料处理;不能把固定模板等同于任何Agent都能无误生成内容。要求宿主可读写文件、运行Python,处理听力还需ffmpeg和可靠转写/对齐能力。生成者必须逐题核对内容并执行浏览器验收;公开示例仅用于演示,不得代替用户试卷。
功能一致性是交付硬要求
不得删除、替换或自行简化同款模板中的教师功能。构建同时检查 feature_coverage:阅读类的词句、篇章、迁移,听力精听挖空与每题录音,七选五逻辑对应,语法知识卡,写作分步讲评都必须有实际数据支撑。缺项必须补齐并重跑构建,不能留空按钮或用“以后补充”作为成品。原卷没有的题型不虚构;原卷有的题型不能删掉以绕过校验。按原卷独立列出题号与题型清单,设置 expected_question_ids,再逐项对照输出。浏览器交互验收按 references/regression.md 执行,记录实际结果;未执行不得写通过。
听力是这套规则里最容易悄悄丢的一块:有音频就必须在成品里能播,三段音频状态(分段/待核对边界/整卷未分段)都要在页面和报告里写明,不能靠删掉听力章节让构建通过。答案不允许只凭印象:官方答案必须能追到答案原件的解析表与页码,追不到就用 inferred 或 unresolved,并写清待核位置。
速对答案
模板行为说明:写教学内容时可以跳过这一节;只有改模板、或回答老师关于界面的问题时才需要读。
顶部“速对答案”是教师核对入口。可按本课件全部题目或本节查看,点击逐题揭示或显示本范围答案、再次遮住,点击题号返回讲评。直接读取已审计的标准答案,不重新让模型编一套答案表。显示原件答案/推定/待核标签,填空保留大小写与可接受变体;应用文和续写不压缩成一格“正确答案”。速对中的显答不改变原页面逐题解析状态。
顶部导航与字号控件
模板行为说明:写教学内容时可以跳过这一节;只有改模板、或回答老师关于界面的问题时才需要读。
固定模板顶部采用两行:第一行是查词、主题、字号与课堂工具,第二行仅放章节导航。不得再挤入同一行,不显示右侧章节栏或为其预留空间。阅读 A–D 放在阅读入口的浮层菜单,听力各段收进听力下拉菜单;小屏仅导航横向滚动,正文不产生横向溢出。字号在主题旁显示当前值,支持 18–34 直接选择和 A−/A+微调;改动立即保存,刷新、切章和导入课堂记录后保持一致,边界按钮禁用。投影/手机都必须能找到字号控件。
速对答案采用「全部/按板块」两种查看方式。板块按试卷自己的板块分组(有听力才出现听力,初中卷会出现短文填空、配对阅读等),展示本卷实际存在的板块,不拆成每个 Text 或阅读 A/B/C/D。默认直接显示答案,紧凑呈现题号与答案,不在每题重复文章标题;保留单题/当前范围遮盖、题号返回讲评及非原件答案状态提示,且不改变正式讲评的解析状态。
章节顶栏只显示这份试卷实际存在的板块,名称与顺序都取自试卷:初中卷可能是「听说应用/语法选择/完形填空/阅读理解/配对阅读/短文填空/读写综合」,高中卷可能是「听力/阅读理解/七选五/完形填空/语法填空/读后续写」。不要套用固定六种题型,也不要把试卷上没有的板块加上去;同一个板块下的多节(如"读写综合"的 A 回答问题与 B 书面表达)收在同一个入口。所有入口均在鼠标悬停或点击后向下展开竖向子菜单,手机点击展开。Test 1–10、阅读 A–D、应用文与续写只在子菜单显示,禁止把这些子项平铺回顶栏;只有一节的题型也使用相同结构。选中子节后收起菜单并高亮所属题型。速对答案的「全部/按板块」功能保持独立。
听力顶层分类仍叫「听力」,子菜单与题组标题统一显示「Test 1、Test 2……」。编号按原卷听力题组,标题旁保留该组真实题号范围(如 Test 6 对应第 6–7 题);不得按20道单题重新编号成20个Test,也不得改变题组或录音对应关系。
文化背景被选中时,必须执行 本篇文化背景规范:原文切入、已查证背景、回到本篇的理解和课堂讲述。新生成数据必须填写 reading_connection 与来源 supports,并完成语义复核;不接受测试占位卡或通用百科拼贴。