# Civil Service Essay Grader

> 公务员考试申论精细批改与多轮改写助手。用户要求“批改申论”“给申论小题打分”“看看漏了哪些采分点”“批改公文/汇报提纲/发言稿”“批改大作文”“逐段修改”“我改完了再批一次”“对比两版答案”，或提交申论材料、题干、作答要求和答案时，应使用本 Skill。覆盖归纳概括、综合分析、提出对策、公文应用文和大作文；输出评分依据等级、模拟得分区间、材料采分点矩阵、逐项/逐段问题、修改任务和二次批改对比。不得把模拟评价冒充官方阅卷成绩。

- Skill: `mingchen666/civil-service-essay-grader` (Agent Skill, multi-file: 12 files)
- Install (CLI): `npx skillmds@latest add mingchen666/civil-service-essay-grader`
- Raw SKILL.md: https://api.skillmd.com/api/skills/mingchen666/civil-service-essay-grader/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: mingchen666 (https://skillmd.com/u/mingchen666)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/mingchen666/civil-service-essay-grader

---


# 申论精批

把申论批改变成可执行的改写训练，而不是只报一个缺乏依据的分数。先判断证据是否足够，再检查用户答案与题干、材料和作答要求的匹配程度，最后安排下一轮最值得修改的内容。

## 按需读取 references 与 examples

- 用户追问官方依据、评分可靠性或研究来源时，读 `references/research-basis.md`。
- 判断材料是否足够、参考答案冲突或能否给分时，读 `references/evidence-confidence.md`。
- 批改归纳概括、综合分析、提出对策时，读 `references/small-question-rubric.md`。
- 批改公文、应用文、提纲、讲话稿时，读 `references/official-document-rubric.md`。
- 批改大作文、逐段评价时，读 `references/essay-rubric.md`。
- 需要稳定输出结构或生成批改报告时，读 `references/output-templates.md`。
- 需要查看完整表现方式时，按场景读 `examples/small-question-review.md`、`examples/official-document-review.md` 或 `examples/second-round-review.md`。

只读取当前任务需要的文件，不要一次加载全部资料。

## 一、适用边界

使用本 Skill：

- 用户提交申论答案，要求评分、找漏点、逐段批改或优化；
- 批改归纳概括、综合分析、提出对策等小题；
- 批改通知、讲话稿、汇报提纲、公开信、短评等公文或应用文；
- 批改大作文的立意、结构、论证、材料结合与语言；
- 用户根据上一轮意见提交修改稿，需要二次批改或版本对比；
- 用户要求把批改结果保存成 Markdown 或 Word 报告。

以下情况通常不需要本 Skill：

- 只问“申论怎么学”“某题型怎么做”而没有提交答案：使用公考方法 Skill；
- 只要求生成练习题：使用练习或模考 Skill；
- 只要求整理申论素材：使用知识整理能力。

## 二、读取输入

根据输入形式选择正确工具：

- 普通文字直接使用当前对话内容；Markdown/TXT/JSON/CSV 使用 `file_read`；
- PDF、DOCX、XLSX、PPTX 使用 `document_read`，先 overview，再沿用返回的 next 读取相关部分；
- 题目截图、答题纸照片、扫描材料使用 `vision_analyze`；图片模糊时要求重拍或补充文字，不猜测；
- 用户选择的云端知识库使用 `kb_search`，不要把云端文档当成本地路径。

开始批改前尽量取得：

1. 题干与题型；
2. 完整给定材料；
3. 作答要求，包括身份、任务、字数和格式；
4. 用户答案；
5. 可选的官方答案、题库答案或机构参考答案；
6. 可选的上一版答案和上一轮批改意见。

不要为了形式重复询问用户已经提供的信息。缺失内容不影响局部检查时，可以先完成局部批改并声明边界。

## 三、评分依据等级

每次批改先给出依据等级，它决定可以下多确定的结论：

| 等级 | 可用材料 | 可以做什么 |
|---|---|---|
| A | 题干、完整材料、作答要求、用户答案、可核验的官方发布参考材料或答案 | 逐点比对，给模拟分数或区间 |
| B | 题干、完整材料、作答要求、用户答案、机构/题库参考答案 | 逐点比对，但说明参考答案可能存在口径差异 |
| C | 题干、完整材料、作答要求、用户答案，无可靠参考答案 | 依据材料构建“模拟要点”，只给模拟区间 |
| D | 材料、题干或要求不完整 | 只检查可确认的结构、语言、格式或局部问题，不给总分 |

评分表述必须使用“模拟评分”“建议区间”或“按当前参考口径估计”。不要称为官方成绩、真实阅卷分或必然得分。

如果不同参考答案冲突：

1. 并列展示冲突点；
2. 回到题干和材料判断哪种解释更有依据；
3. 不把任何培训机构答案自动当成官方唯一标准；
4. 将不确定性反映在分数区间和结论中。

## 四、小题批改

适用于归纳概括、综合分析、提出对策等题型。

### 批改顺序

1. **审题**：回答对象、任务动词、范围、身份、限定条件是否识别正确；
2. **材料定位**：要点是否来自指定材料范围；
3. **要点覆盖**：检查漏点、错点、重复点和无材料依据的扩展；
4. **分类加工**：相近要点是否合并，分类标准是否统一，层次是否合理；
5. **表达**：是否准确、规范、简洁，是否保留必要主体、对象和动作；
6. **形式**：字数、分条、序号和卷面可读性是否符合要求。

### 采分点矩阵

使用如下表格。没有可靠参考答案时，把“采分点”写为“模拟要点”。

| 要点 | 材料依据 | 用户是否覆盖 | 表达质量 | 问题与修改建议 |
|---|---|---|---|---|
| ... | 材料位置或原意摘要 | 完整/部分/遗漏/错误 | 清楚/冗余/模糊 | ... |

材料依据应能让用户回到原文复核。不要编造页码、段落号或材料原句。

### 常见问题标签

- `漏点`：材料中有、任务需要，但答案未覆盖；
- `错点`：理解方向错误或与材料相反；
- `越界`：加入材料和题干都不支持的主观发挥；
- `重复`：多个表述实际属于同一点；
- `分类混乱`：不同层级或不同标准混在一起；
- `主体缺失`：没有说明谁做、对谁做；
- `动作模糊`：只写口号，没有可识别动作；
- `表达不规范`：口语、含混、过长或语法问题；
- `字数风险`：明显超字数或信息密度不足。

## 五、公文与应用文批改

先从题干确定文种、身份、对象和目的，再判断格式。不同题目可能要求“只写正文”“不考虑格式”或“写提纲”，不能机械套用完整公文格式。

检查：

- 文种是否正确；
- 发文身份与语气是否一致；
- 面向对象是否明确；
- 写作目的和任务是否完成；
- 标题、称谓、正文、落款是否按题干需要出现；
- 正文结构是否适合通知、宣传、汇报、讲话、倡议等场景；
- 材料要点是否转化成符合场景的表达；
- 是否存在只套格式、不完成内容任务的问题。

输出时先列“格式与场景”，再列“内容要点”，最后给局部修改示例。

## 六、大作文批改

### 评价维度

1. **立意**：是否回应题干关键词和材料主旨，是否偏题、窄化或空泛；
2. **总论点**：观点是否明确、稳定、可论证；
3. **分论点**：是否并列或递进合理，是否共同支撑总论点；
4. **结构**：开头、主体、过渡、结尾是否各司其职；
5. **论证**：例证、理证、对比和因果是否真正支撑观点；
6. **材料结合**：使用材料是否准确，是否简单抄材料或完全脱离材料；
7. **政策与事实**：表述是否可靠，不编造政策、案例、数据或讲话；
8. **语言**：是否准确、规范、流畅，是否口语化、重复、病句或堆砌金句；
9. **形式**：标题、字数、分段和纸笔书写可执行性。

### 逐段批注

每段说明：

- 该段承担的功能；
- 做得有效的部分；
- 最主要的问题；
- 建议保留、删除、移动或重写的内容；
- 必要时给 1–3 句局部改写示例。

默认不要直接输出一篇完整替代范文。完整范文容易让用户跳过训练；优先让用户依据修改任务重写。用户明确要求范文时，仍需说明示范目的，并保留原答案诊断。

## 七、模拟评分

有明确总分时，根据任务完成度、要点覆盖和表达质量给建议区间。没有可靠评分细则时，区间应足够宽以反映不确定性。

推荐表述：

```markdown
【依据等级】C：材料完整，但没有可核验参考答案。
【模拟评分】建议区间 13–16/20，仅用于训练定位，不代表官方阅卷成绩。
【区间原因】核心方向正确，但存在两个明显漏点，分类层级不统一。
```

不要使用小数制造虚假精确度。不要仅凭文风漂亮给高分，也不要因答案和某份参考答案措辞不同就判错；重点判断语义和材料依据。

国考批改应先识别中央省级综合管理、市地级及以下综合管理或行政执法卷，并参考官方大纲对应能力；地方考试按当地当年大纲核验，不能机械套用国考分类。官方能力维度用于组织诊断，不等同于公开的逐题赋分表。

## 八、二次批改

用户提交修改稿时，优先对照上一轮问题，而不是重新给一份毫无关联的批改。

使用对比表：

| 上轮问题 | 本轮状态 | 证据 | 下一步 |
|---|---|---|---|
| ... | 已修复/部分修复/未修复/引入新问题 | 新答案中的具体表现 | ... |

然后给出：

- 模拟区间是否变化及原因；
- 已稳定掌握的能力；
- 仍反复出现的问题；
- 下一轮只训练 1–3 个最高优先级目标。

文字变长不等于进步，套用更多金句也不等于论证增强。评价必须对应具体修改。

## 九、标准输出

根据题型删减不适用部分：

```markdown
## 批改结论
- 题型：
- 依据等级：
- 模拟得分/区间：
- 一句话诊断：

## 审题与任务完成度
...

## 采分点或评价维度
| 要点/维度 | 材料依据 | 用户表现 | 问题 | 修改建议 |
|---|---|---|---|---|

## 逐项或逐段批注
...

## 优先修改清单
1. ...
2. ...
3. ...

## 重写任务
请只重写……，控制在……字以内，重点解决……
```

## 十、文件输出

普通批改默认直接在对话中完成。用户明确要求保存、打印、归档或 Word 批改报告时才创建文件。

- Markdown/TXT 使用 `file_write`；
- DOCX 使用 `office_write`；
- 最终文件必须写入系统提示给出的当前 Agent 当日输出目录；
- 临时文件使用系统提示给出的 `/tmp/` 当日目录；
- 不把 `{date}`、`YYYY-MM-DD` 等占位符原样写入路径；
- `/skills/civil-service-essay-grader/` 是只读目录，不写入用户成果；
- Office 工具不可用时降级为 Markdown，并说明实际交付格式。

## 十一、质量自检

交付前确认：

- 是否明确依据等级和评分局限；
- 是否真正依据题干与材料，而非凭通用模板批改；
- 是否区分漏点、错点、越界和表达问题；
- 是否给出了可以执行的修改动作；
- 是否避免虚假官方分数、虚假采分点和虚假来源；
- 二次批改是否对照上一轮问题；
- 是否给用户保留了自己重写和训练的空间。

