# Systematic Review

> Strict systematic review per Cochrane v6.5 + PRISMA 2020 + AMSTAR 2: PROSPERO/OSF protocol, PRISMA-S search, dual-blind screening + Cohen's kappa, RoB 2 / ROBINS-I, GRADE, AMSTAR 2. Use when user requests "systematic review", "系统综述", "系统性文献综述", "循证综述（含 RoB/GRADE 等环节）", "PRISMA review", "Cochrane-style review". Trigger when user explicitly requires PRISMA 2020 / Cochrane / RoB / GRADE / AMSTAR 2, OR submits to BMJ / Lancet / Cochrane Library / Psych Bulletin. If user says only "循证综述" without RoB/GRADE/PRISMA/Cochrane, main agent MUST ask whether PRISMA is required; do NOT auto-enter 12-stage — the term may mean integrative review (use field-overview-review). If user has a literature set AND requires PRISMA, use this skill (skip L4-L5). Strict and learning modes. Do NOT use for: scoping (field-overview-review), narrative without PRISMA (field-overview- review/field-evolution-review), meta-analysis alone, theoretical reviews. Pair with meta-analysis for pooling.

- Skill: `o0000-code/systematic-review` (Agent Skill, multi-file: 58 files)
- Install (CLI): `npx skillmds@latest add o0000-code/systematic-review`
- Raw SKILL.md: https://api.skillmd.com/api/skills/o0000-code/systematic-review/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- License: PolyForm-Noncommercial-1.0.0 AND CC-BY-NC-SA-4.0
- Author: o0000-code (https://skillmd.com/u/o0000-code)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/o0000-code/systematic-review

---


# Systematic Review

严格 PRISMA 2020 系统综述工作流。在 12 阶段生命周期中全面执行 Cochrane Handbook v6.5 标准，含 PRISMA-S 检索文档化、双盲筛选 + Cohen's κ、双人提取、按研究设计选用 RoB 工具、GRADE 证据等级、AMSTAR 2 自评。

---

## 1 你产出什么、不产出什么

### 1.1 路径 A 产出（严格模式 / 默认）

| 交付物 | 必含元素 |
|---|---|
| 主稿 | PRISMA 2020 27 条全对接（IMRaD 六大块） |
| PRISMA 流程图 | 4 阶段 + 每阶段排除数与理由 |
| PRISMA-S 文档 | 16 项检索可复现性 YAML |
| 协议声明 | PROSPERO/OSF 注册号；未注册需显式声明 + 时间戳 |
| 纳入排除标准表 | PICO 三层 + FINER |
| 筛选记录 | 双盲 κ + 仲裁记录 |
| 提取表 | SSOT-EXTRACTION-FIELDS 六大类 + 双人一致性 |
| RoB 评估表 | 按设计选 RoB 2 / ROBINS-I / QUADAS-2 / NOS / JBI（单被试用 **SCED/RoBiNT，不是 SCRIBE**） |
| 综合 | SWiM 9 项 + Popay 4 元素（不能元分析时） |
| GRADE 证据等级 | 5 降 + 3 升 + SoF 表 |
| AMSTAR 2 自评 | 16 项 7 关键域，置信度等级 |
| 写作过程档案 | SubAgent 分工 + 双盲披露 + 模式选择 |
| 决策档案 | decisions/01-11_*.md（应用 §3.3） |

### 1.2 路径 B 产出（学习模式 / 课程提案）

学习模式按 §9.2 简化项执行，但保留 L1+L2+L11 + PRISMA 流程图 三条硬约束。具体披露见 §9.3。

### 1.3 不产出（边界）

- **定量元分析**（点估计合并、森林图、漏斗图、Egger 检验）→ 转 `meta-analysis` Skill 配套使用
- **范围综述**（领域映射、概念地图，PRISMA-ScR）→ 转 `field-overview-review`
- **叙述综述**（无双盲、无 PRISMA 流程图）→ 转 `field-overview-review` 或 `field-evolution-review`
- **理论建构综述**（构念分析、对立理论比较）→ 转 `theoretical-review`

详见 §13 与其他 Skill 的关系。

### 1.4 标准交付物清单（独立小表，便于一眼对账）

主稿 / PRISMA 流程图 / PRISMA-S YAML / 协议声明 / PICO 三层表 / 双盲筛选记录 / 双人提取表 / RoB 评估表 / SWiM+Popay 综合 / GRADE+SoF 表 / AMSTAR 2 自评 / 写作过程档案 / 决策档案目录（共 13 类）。

---

## 2 触发与适用场景

### 2.1 应触发场景

正向触发的关键场景：
- 用户明确说"系统综述"、"systematic review"、"PRISMA review"、"Cochrane-style review"、"循证综述"
- 投稿目标是要求 PRISMA 2020 / Cochrane 标准的期刊（BMJ、Lancet、Cochrane Library、JCE、《心理学报》系统综述栏目）
- 用户描述含"双盲筛选"、"RoB 评估"、"GRADE 等级"、"AMSTAR 2"、"PROSPERO 注册"
- 学位论文方法学章节、博士资格审核、循证临床应用（指南制定、HTA 报告）

潜在触发场景（即使用户不说 PRISMA，也应推荐本 Skill）：
- 用户**明示**需要 PRISMA / Cochrane / RoB / GRADE / AMSTAR 2 程序
- 用户提到"风险偏倚"、"证据等级"、"可复现的检索"
- 用户的研究问题是 PICO 形式（明确 Population/Intervention/Comparison/Outcome）

### 2.2 反向触发（Do NOT use）

| 用户场景 | 应转 Skill | 理由 |
|---|---|---|
| "探索某领域研究进展"、"做个文献综述了解领域"（无 PRISMA 关键词） | `field-overview-review` | 探索式综述，无双盲、无 RoB |
| "50 年研究发展史"、"领域演化" | `field-evolution-review` | 时间维度 + 5 维度检索 |
| "理论建构、构念分析" | `theoretical-review` | 论证为主、方法宽松 |
| "只做量化元分析"，无质性合成需求 | `meta-analysis` | 直接进 L9 量化（如已有完整数据） |

### 2.3 模糊地带路由（消除 LS / SR 重叠 — W5-1 §1.3 题 14/15）

**关键路由规则**：

- **用户已提供文献集 + 要求 PRISMA / Cochrane** → 用 systematic-review（本 Skill），跳过 L4-L5 检索；**不用 literature-set-review**
- **用户已提供文献集 + 要求"基于文献集写综述"，无 PRISMA 要求** → 用 `literature-set-review`
- **用户没有现成文献集 + 要求 PRISMA** → 用 systematic-review 完整 L1-L12

### 2.4 与 meta-analysis 的关系（联合工作流）

systematic-review 与 meta-analysis 是配套关系，不是替代关系：
- systematic-review 提供 L1-L8 + L11-L12 全部基础（PICO、检索、筛选、提取、RoB、报告、自评）
- 当数据可元分析时，L9 切换到 meta-analysis Skill 处理（详见 §4.2 L9 决策表）
- 联合工作流（**切 MA**）：systematic-review 完成 L1-L8 → **meta-analysis 完成 L9-L12**（含 GRADE / APA MARS 报告 / AMSTAR 2，由 MA 产 `10_grade_decision.md` / `11_reporting_standard.md` / `L12_amstar2.md`；锁4 §4.4 裁定：以元分析为终点的联合路径 MA 拥有 L9-L12）。**纯 SR 路径（不切 MA）则由 SR 完成 L9-L12。**

---

## 3 主 Agent 角色与责任

### 3.1 主 Agent 必读（启动即必读 —— G5：启动足迹从 ≈72k 三件套砍到 ≤10k digest）

主 Agent 在 Skill 触发后**立即加载 `review-methodology-foundations/references/LAUNCH-DIGEST.md`（启动即必读，正文 ≤10k）**——它蒸馏了原"启动即必读三件套"（SSOT-LIFECYCLE-12-PHASES + SSOT-METHODOLOGY-TERMINOLOGY + SSOT-AI-FAILURE-DEFENSES，≈72k）的**全部载荷条款** + §1.2-18 前沿条款 + Cohen / k→限定语 / I² / GRADE / 学科×数据库 / 构念方向六张查表。读完这一份即掌握全流程载荷红线。

> **为什么改（G5）**：实战审计实测三件套 66-72k"启动即必读"被跳过 2/3——从未打开；**被读率是主 Agent 派发 prompt 是否点名的函数，不是"必读"规定的函数**。故三层修复：①启动只读 ≤10k digest（真读）；②三件套 + 深层 SSOT 全文降级"按需下钻"（路径经 `SSOT-INDEX.md` 全库 resolver，见 §8）；③关键载荷投放到 SubAgent 靠 `PROMPT-COPY-BLOCKS.md` 复制块（§6 · 内容进 prompt 的构造性保证），不靠自觉去读深文件。

**SR 特定深层（不在启动加载，resolver 定位、按需下钻）**：`SSOT-PRISMA-S-TEMPLATE`（L5）/ `SSOT-PRISMA-FLOW-DIAGRAM`（L6 / L11）/ `SSOT-MODE-PROFILES`（L3）/ `SSOT-AMSTAR-2-CHECKLIST`（L12）——digest 给决策阈值，需完整模板 / 条目原文时按 resolver 路径下钻。**关键载荷已在 digest / §6 复制块，SubAgent 不必自行去开深文件**。

### 3.2 协调而非执行

主 Agent 在本 Skill 中是**协调者**，不直接调 MCP，不直接写综述章节。具体执行（检索、筛选、提取、写作、评估）全部外包给 SubAgent。

主 Agent 的核心动作：
- **理解**：与用户对齐研究问题、综述类型、模式（严格/学习）、字数、语言、引用格式
- **规划**：基于 SSOT-LIFECYCLE-12-PHASES 拆分阶段任务、识别依赖、决定串行 vs 并行
- **派发**：写明确的 SubAgent prompt（含必读文件 + 任务 + 输出契约 + 自检）
- **审核**：每阶段产出对照 PRISMA 2020 + AMSTAR 2 自检；发现问题派 Fix-Agent
- **整理**：跨 SubAgent 文档落盘到工作目录，最终主 Agent 整合主稿

### 3.3 跨阶段决策档案规则（强制，应用 C1 模板）

主 Agent 在每阶段产出后，将决策性结论写入 `decisions/` 子目录。这是 6 Skill 共享的工作流跨阶段决策档案机制，避免 L9/L11/L12 SubAgent 重新决策。SR 完整 11 类决策档案：`01_type_decision.md`（L1 类型 + 4 项判定矩阵）/ `02_research_question.md`（L2 三层 PICO + FINER）/ `03_mode_decision.md`（L3 严格 vs 学习）/ `04_search_strategy.md`（L4）/ `05_search_execution.md`（L5 PRISMA-S 16 项）/ `06_screening_dual.md`（L6 κ + 仲裁）/ `07_data_types.md`（L7 提取 ICC/κ）/ `08_rob_tool_decision.md`（L8 RoB 工具，SCED/RoBiNT 而非 SCRIBE）/ `09_synthesis_decision.md`（L9 含切换 MA 阈值）/ `10_grade_decision.md`（L10）/ `11_reporting_standard.md`（L11）。

每个决策档案使用统一 YAML frontmatter + 正文 + 上下游依赖 + 校验清单结构，完整模板见 `references/decision-provenance.md`。

**L9/L11/L12 SubAgent 必读 decisions/**：所有 L9/L11/L12 SubAgent prompt 必须显式列出 `decisions/01-11_*.md`（按阶段对应字段，参见 references/decision-provenance.md §3"消费者-生产者"映射）。不读决策档案直接执行 → 阻断；矛盾时主 Agent 仲裁。

> **追认①（G5 · 公理 8 好偏离追认）——规划文档=上下文容器**：实战 SubAgent prompt 未逐档点名上列 decisions（01/03 普遍缺席），而由主 Agent 用"每轮专属规划文档"承载上下文（内嵌决策档指针），效果更优。**规范承认此模式**：上列决策档必读可由"读本轮规划文档（内嵌所需 `decisions/*.md` 指针）"等价满足；构造性底线 = §6 派发复制块把关键决策载荷直接写进 SubAgent prompt（填空题），不依赖 SubAgent 自觉去开 decisions 档。**决策档案禁止自证式"`[ ] 已读 <文件>`"勾选**（G5 · R3 实测 decisions/01 虚假"[x] 已读"已发生、transcript 零访问）；"规定应读"改用模板 frontmatter `required_readings` 声明性机读字段，preflight `--gate readings` 一行 WARN 计数，差异表→v2。

**L11 写作前主 Agent 二次验证**：派发前主 Agent 验证当前 L11 SubAgent 计划的报告标准与 `01_type_decision.md` + `11_reporting_standard.md` 一致（SR 必为 PRISMA 2020 27 项；心理学场景叠加 APA MARS）。不一致即**阻断**。

### 3.4 不允许的妥协

- 不允许在 systematic-review 中"压缩到 PRISMA 2 条"——这是 AMSTAR 2 Critical Domain 失败
- 不允许擅自降级英文检索代替中文检索（参见 §11.1 检索回退：主路径 `paper-search-pro` / 中文人工导出题录 → `ingest_search_exports.py` 摄入）
- 不允许把 SCRIBE 误用作单被试 RoB 工具（应用 SCED Scale / RoBiNT Scale，参见 SSOT-ROB-TOOL-MAPPING）

---

## 4 完整工作流（12 阶段对齐）

### 4.1 12 阶段总览表

每阶段对应一个或多个 references/ 文件。当前阶段加载对应文件即可，不需要前置加载全部。详见 §6 何时加载哪个 references 文件。

| L# | 阶段名 | 关键产物 | 主 SSOT | 主 references |
|---|---|---|---|---|
| L1 | 类型识别 + 4 项判定矩阵 | 类型确认 + 模式建议 + Skill 路由 | SSOT-REVIEW-TYPES | references/L1-question-construction.md |
| L2 | PICO 严格构造 | 三层 PICO + FINER + 假设三分 | SSOT-PICO-FRAMEWORKS | references/L1-question-construction.md |
| L3 | 协议预注册 | PROSPERO/OSF 注册号 / 状态声明 | SSOT-REPORTING-STANDARDS §1.2.2 | references/L2-protocol-registration.md |
| L4 | 检索策略 | 数据库列表 + 同义词 + 布尔 + PRESS | SSOT-SEARCH-STRATEGY | references/L4-search-protocol.md |
| L5 | 检索执行 | PRISMA-S 16 项 + 去重记录 | SSOT-PRISMA-S-TEMPLATE | references/L5-prisma-s-execution.md |
| L6 | 双盲筛选 | 一致性 + Cohen's κ + 仲裁 | SSOT-AI-FAILURE-DEFENSES §1 | references/L6-screening-dual-blind.md |
| L7 | 双人提取 | 结构化字段 + 一致性 + LLM 披露 | SSOT-EXTRACTION-FIELDS | references/L7-extraction-dual.md |
| L8 | 风险偏倚评估 | 按设计选工具 + 完整域评分 | SSOT-ROB-TOOL-MAPPING | references/L8-rob-assessment.md |
| L9 | 综合（Synthesis） | SWiM 9 项 / Popay 4 元素 / 切换 MA | SSOT-SYNTHESIS-METHODS | references/L9-synthesis-swim.md |
| L10 | GRADE 证据等级 | 5 降 + 3 升 + SoF 表 | SSOT-GRADE-FRAMEWORK | references/L10-grade.md |
| L11 | 写作 + 报告 | PRISMA 2020 27 条 + 流程图 + APA MARS | SSOT-REPORTING-STANDARDS | references/L11-prisma-reporting.md |
| L12 | 自评 | AMSTAR 2 16 项 + ROBIS | SSOT-AMSTAR-2-CHECKLIST | references/L12-amstar2-self-assessment.md |

### 4.2 各阶段任务详解

#### 4.2.1 L1 类型识别 + 4 项判定矩阵（W5_FIX_PLAN E.P0.4 修缮）

systematic-review 的 4 项判定要素 + **判定矩阵**（替代原"任一不满足则建议切换"的硬条件）：

**4 项判定要素**：
1. 用户的研究问题可形式化为 PICO（Population-Intervention-Comparison-Outcome）
2. 用户接受双盲筛选 + RoB 评估 + GRADE 的工作量
3. 数据可得性可支撑结构化提取（不仅是讨论级别概览）
4. 用户接受 8,000+ 字综述长度（学习模式可降到 6,000-8,000）

**判定矩阵**（不再是"任一不满足切换"）：

| 通过项数 | 决策 | 操作 |
|---|---|---|
| 4/4 | **严格模式** | 默认完整 12 阶段 + AMSTAR 2 ≥ Moderate 目标 |
| 3/4 | **严格模式 + 显式披露** | 完整 12 阶段，但在 Limitations 显式披露未满足项及其影响。例：项 1 失败（PICO 弱），披露"研究问题接近但不严格满足 PICO 形式，影响 Eligibility Criteria 边界" |
| 2/4 | **学习模式 + 强烈披露** | 切到学习模式（§9.2），所有简化点必须按 §9.3 披露原文模板写入。同时建议用户考虑切到 FO/LS |
| 1/4 | **切到 FO/LS** | 不在 systematic-review 内做。主 Agent 显式向用户说明原因并推荐替代 Skill |

**示例**：
- 通过项 = {1, 2, 3}（4 失败：用户字数预算 4000）→ 3/4 → 严格模式 + 在 Discussion 显式披露"字数限制下，部分综合段落简化"
- 通过项 = {1, 3}（2/4：用户拒绝双盲 + 字数 5000）→ 学习模式 + 双盲降级披露 + 字数受限披露 + 询问是否切到 FO

判定结论写入 `decisions/01_type_decision.md`。

附加：**FINER 5 项过滤**（参见 references/L1-question-construction.md §3 + SSOT-PICO-FRAMEWORKS §5）。

#### 4.2.2 L2 PICO 严格构造（Cochrane 三层）

systematic-review 强制三层 PICO（Cochrane v6.5 Ch.2 §2.3）：
- **Review PICO**：综述层面的研究问题
- **PICO for each synthesis**：每个综合（如不同 Outcome 的 subgroup）的 PICO
- **PICO of the included studies**：每篇纳入研究实际的 PICO

三层间偏离必须在 Limitations 中显式报告。

#### 4.2.3 L3 协议预注册（强制声明）

强制规则：即使未注册，也必须在主稿 Methods 节"Protocol and Registration"中显式声明（参见 references/L2-protocol-registration.md §1.1/1.2/1.3 三种模板）。

未声明协议状态属于 AMSTAR 2 项 2（Critical Domain 1）失败，自评最高 Low。

#### 4.2.4 L4-L5 检索策略与执行（PRISMA-S）

systematic-review 严格模式必含：
- 4+ 学科核心数据库（如 MEDLINE / PsycINFO / EMBASE / CENTRAL）+ 灰色文献
- 引文追踪（forward + backward citation）
- PRESS 同行评审（推荐，Tier 2）
- PRISMA-S 16 项全部填写（YAML 模板）
- Bramer EndNote 6 步去重 + 记录每步去重数

学习模式可降级（≥ 2 库 + 简化布尔），但**必须按 §9.3 披露原文模板**显式披露简化点。

> **自动预筛（追认④，G5 · 公理 8）**：召回优先检索命中量大、噪音多（实战 ~80% 无构念词）时，双盲筛选前可加一步**验证式自动预筛**（构念关键词粗过滤，N_raw→N_prescreen）——但必须走三件套：**种子 100% 保全 + 双重假阴抽验（0 假阴）+ Methods 显式披露**，且**不替代**双盲（§4.2.5）与全文双人硬点。完整标准流程见 `references/L6-screening-dual-blind.md §12`。

> **检索执行外包（G6 · 外包交接包模式）**：L5 的检索**执行**（登录订阅库/粘贴检索式/逐库导出题录）是程序性外部劳动——**主 session 不做，即使派 SubAgent 也不做**（注意力经济）。L4 冻结签核后，主 session 生成**检索请求包 `search_request_pack/`**（`request.yaml` 机读 SSOT → `render_search_pack.py` 渲染 `per_db/*.md` 人读卡 + `export_contract.md` + `hit_log_template.md`），外包给可插拔执行器（人/Codex/另一 CC session/pending 检索 skill），回执经 **`scripts/validate_exports.py` 硬门**（复用 ingest 解析器 dry-run + 种子在场 + 命中一致性 + 无摘要披露 U-49；exit≠0 不摄入）验收后才交 `ingest_search_exports.py`。逐库导出陷阱见 `references/db-quirks.md`；模式规范见 `review-methodology-foundations/references/OUTSOURCING-HANDOFF-PATTERN.md`。**契约边界**：主 session 只产请求包 + 验收回执；"执行"是可插拔 executor 契约（入 `request.yaml` → 出 `L5_export_<db>_<date>.<ext>` + 命中记录 + `executed_date` 回写）。

#### 4.2.5 L6 双盲筛选（关键 LLM 防御 — 10/10 范本所在）

LLM 实现的双盲：
- 派发 **2 个独立筛选 SubAgent**（不共享上下文，独立 prompt）
- 各自筛选同一份文献集合
- 主 Agent 比对两份决策清单 → 计算 Cohen's κ
- 不一致项进入第三个**仲裁 SubAgent**判定
- 全部决策记录写入 `screening_log.csv`

**全文筛 = 双人硬点（U-16，2026-07-03 升硬点）**：**标题/摘要筛与全文筛两层都必须双人独立**——不是只有标题/摘要层双盲、全文层单人。实战教训：T/A 双盲花掉 16 SubAgent 后，**全文层退化成单人筛**（无 A/B、无全文层 κ），违反本规范且伤 AMSTAR 2 Item。故：**全文合格性判定同样派 2 个独立 SubAgent + 仲裁 + 算全文层 κ**（`fulltext_kappa`），落 `L6_kappa_fulltext.json`；SP2 签核门的 06a 以 `fulltext_kappa_json` 指针指向它（preflight additive 校验，缺则 WARN 起步——见 SUPERVISED-MODE-GATES §9.4）。Methods 披露须覆盖两层双人（若某层实际单人，诚实写单人、不得声称双人）。

**显式披露要求（强制）**：在主稿 Methods 节明示"双盲筛选（标题/摘要 + 全文两层）由 2 个独立 LLM SubAgent 执行 + 1 个仲裁 SubAgent 处理不一致项；每个 SubAgent 不可见对方决策"。完整披露原文参见 references/L6-screening-dual-blind.md §6.1（W5-4 唯一 10/10 范本，复制即可用）。

**Cohen's κ 阈值化决策（W5_FIX_PLAN E.P1.3）**：

| κ 值 | 决策 |
|---|---|
| κ ≥ 0.60（严格模式期望）/ ≥ 0.40（学习模式期望） | 仲裁不一致项即可 |
| 0.40 ≤ κ < 0.60 | 仲裁 + 重审 prompt（检查纳入排除标准歧义） |
| κ < 0.40 | **重做筛选**（检查 SubAgent prompt 隔离失败 / 纳入排除标准歧义重大） |

#### 4.2.6 L7 双人提取（含 LLM 实现披露）

> **全文获取+转换外包（G6 · 外包交接包模式）**：L6 纳入判定后、L7 提取前，纳入研究的**全文下载 + PDF→Markdown 转换**同属程序性外部劳动——**主 session 不做**。生成**全文请求包 `fulltext_request_pack/`**（下载清单 CSV + `download_policy.yaml`[Sci-Hub 预先点头 + 渠道白名单 + 依赖档位] + 自包含执行 Prompt）外包；执行器先 `paper-downloader-portable` 批量下（**渠道白名单显式 + Sci-Hub 类需生成期预先点头 + 逐篇记实际渠道**，治 U-08 不可追溯）→ 失败转手工逐库指引 → **接 `document-to-markdown` PDF→MD + 抽图 + 保页码锚点（`derive_anchors.py` 产 `anchors.json`）**。回执格式契约见 `meta-analysis/references/FULLTEXT-RECEIPT-FORMAT.md`，经 **`scripts/validate_fulltext.py` 硬门**（文件在场/命名/转换完成/锚点可派生/**MD 质量抽检：OCR 结构性掉行 + 元噪声**，exit≠0 不摄入）验收。渠道纪律 = 公开边界红线上游执行面（G10 对齐）。
>
> **消费面（治 A-Q6 头号 token 浪费）**：提取 SubAgent **默认消费 MD + 按锚点回 PDF 关键页**（`p.N Table M` 粒度）；**整本读 PDF 降为例外**（仅锚点降级/关键数值歧义时）。关键数值/方向一律回 `01_原始PDF/` 核对（MD 为 OCR），结论附页/表锚点——这是实战验证过的消费纪律。

systematic-review 严格模式：
- 派发 **2 个独立提取 SubAgent**
- 按 SSOT-EXTRACTION-FIELDS 六大类字段（R/P/I/C/O/M）+ X 类（编码者）
- 不一致项进入仲裁 + 报告 ICC（连续）/ Cohen's κ（分类）

**LLM 双人提取披露原文**（应用 C4 三段体例，复刻 L6 §6.1 范本）：完整三段披露原文参见 `references/L7-extraction-dual.md` §"双人提取的诚实披露"。SubAgent 在 L11 写作时复制到 Methods 节"Data Collection Process"。

学习模式：单 SubAgent 提取 + 主 Agent 抽样 20% 复核（披露见 §9.3）。

#### 4.2.7 L8 风险偏倚评估（按研究设计选工具）

按研究设计自动路由：
- RCT → RoB 2（5 域 + Cluster/Crossover 变体）
- 非随机干预研究 → ROBINS-I（7 域）
- 诊断准确性 → QUADAS-2
- 队列/横断 → NOS（Newcastle-Ottawa Scale）
- 质性研究 → CASP / JBI Qualitative
- 测量工具综述 → COSMIN
- **单被试设计 → SCED Scale 或 RoBiNT Scale**（**不是 SCRIBE** — SCRIBE 是单被试报告指南，不是 RoB 工具，参见 SSOT-ROB-TOOL-MAPPING §11.2/§11.3）

主 Agent 按纳入研究类型批量分配，每篇研究按对应工具完整域评分。RoB 工具默认选择披露见 §10.3。

#### 4.2.8 L9 综合（Synthesis） — 切换 MA 阈值决策表（W5_FIX_PLAN E.P0.5 修缮）

systematic-review 在 L9 默认走质性合成路径。**切换 meta-analysis 决策表**（替代原"k ≥ 5 且异质性可控"模糊表述）：

| 数据条件 | 决策 | 路径 |
|---|---|---|
| k ≥ 5 + I² < 75% + τ² 估计有效 | **推荐切换 meta-analysis** | systematic-review L1-L8 → **meta-analysis L9-L12**（切 MA 后 L10-L12 由 MA 完成，锁4 §4.4）|
| k ≥ 5 + I² ≥ 75% | **留 SR L9 SWiM/Popay** | 不合并效应量；走 §11.4 异质性故障决策 |
| k ≥ 5 + I² > 90% | **完全禁止合并 + 强制 subgroup / meta-regression** | 参见 §11.4 |
| k < 5（任意 I²） | **留 SR L9 SWiM/Popay** | 元分析统计推断弱（Cochrane v6.5 Ch.10 §10.10.4） |
| 数据类型异质（连续 vs 二分）/ 测量工具不可转换 | **留 SR L9 SWiM/Popay** | 不可元分析 |
| 质性证据综合 | **主题综合（Thomas-Harden 2008）/ 元民族志（Noblit-Hare 1988）** | 走 GRADE-CERQual |

关键约束：**禁止使用基于显著性的 vote counting**（Cochrane v6.5 Ch.12 §6.5/6.6 — 不可接受方法）。

L9 综合方法决策写入 `decisions/09_synthesis_decision.md`。

#### 4.2.9 L10 GRADE 证据等级

每个关键 Outcome 单独评 GRADE（Cochrane v6.5 Ch.14）：
- 起始等级：RCT = High，NRSI = Low（ROBINS-I 启用时可豁免到 Moderate）
- 5 降级因素：RoB / Inconsistency / Indirectness / Imprecision / Publication Bias
- 3 升级因素：Large Effect / Dose-Response / Plausible Confounders Reduce
- 输出 Summary of Findings 表（GRADEpro 格式）

质性证据综合走 GRADE-CERQual（4 维度：Methodological Limitations / Coherence / Adequacy / Relevance）。

#### 4.2.10 L11 写作 + 报告（PRISMA 2020 27 条）

主 Agent 整合各阶段产出，写主稿。结构对应 PRISMA 2020 27 条：
- Title (1) / Abstract (2) / Introduction (3-4) / Methods (5-15) / Results (16-22) / Discussion (23-26) / Other (27)

心理学场景叠加 APA JARS-Quant Table 9（MARS）12 处差异。

PRISMA 流程图（SSOT-PRISMA-FLOW-DIAGRAM）4 阶段强制：Identification → Screening → Eligibility → Included。

#### 4.2.11 L12 综述自评（AMSTAR 2 + ROBIS）

systematic-review 强制 AMSTAR 2 自评：
- 16 项 7 关键域逐条自评
- 输出置信度等级（High / Moderate / Low / Critically Low）
- 严格模式目标 ≥ Moderate（最好 High）
- 学习模式不强制（但鼓励）

ROBIS（综述自身偏倚风险）作为 Tier 2 推荐项。

---

## 5 SubAgent 任务模板

详见 `references/subagent-templates.md`。顶层映射：

- L1 type-identification-agent / L2 pico-construction-agent / L3 protocol-registration-agent（各 1，串行前置）
- L4 search-strategy-design-agent + press-review-agent（串行）
- L5 search-execution-agent + dedup-agent + citation-tracking-agent（可并行）
- L6 screening-agent ×2 双盲 + arbitration-agent（2 并行 + 仲裁串行）
- L7 extraction-agent ×2 双人 + extraction-arbitration-agent（同 L6 编排）
- L8 rob-assessment-agent（1 或按设计分多个，可并行）
- L9 synthesis-agent / L10 grade-assessment-agent（各 1，串行）
- L11 writing-agent + reporting-agent + **prisma-flow-agent** + **writing-process-archive-agent**（4 个，串行；后两个为 W5_FIX_PLAN E.P1.5 新增）
- L12 amstar-self-assessment-agent + robis-agent（Tier 2）

总计 ~16-18 个 SubAgent（双盲/双人提取为最大并行峰值）。

---

## 6 派发 SubAgent 复制块 + references 加载（G5：填空题投放，非选择题加载）

**机制（治病根，同 §3.1）**：实测一个 reference 被不被读，100% 取决于派发 prompt 是否点名它。故对载荷密集阶段（L6-L11），**派发时把复制块整段贴进 SubAgent prompt**（`review-methodology-foundations/references/PROMPT-COPY-BLOCKS.md §C`，前置其 §A 共享底座块 = `LAUNCH-DIGEST` §0/§2/§3）——关键载荷进 prompt（填空题），SubAgent 读不读深文件不再决定成败。**下钻路径经 `SSOT-INDEX.md` 全库 resolver 解析**（治 wrong-path；注意 `L2-protocol-registration.md` 实服务 L3、`L1-question-construction.md` 覆盖 L1+L2）。

| 阶段·动作 | 复制块 / references | 该阶段最高危载荷（一句） |
|---|---|---|
| L1 类型判定 / L2 PICO 构造 | references/L1-question-construction.md | 4 项判定矩阵；三层 PICO；FINER 5 项 |
| L3 协议起草 / 模式选择 | references/L2-protocol-registration.md（+ L3-mode-disclosures.md 披露） | 注册或显式未注册声明；协议偏离必记（禁 HARKing） |
| L4 检索策略 | references/L4-search-protocol.md | ≥4 库+PRESS；主题词+自由文本双轨 |
| L5 检索执行 | references/L5-prisma-s-execution.md | PRISMA-S 16 项；Bramer 6 步去重；命中数记录 |
| L6 双盲筛选 ×2+仲裁 | COPY-BLOCKS §C·L6 | **全文筛=双人硬点**；κ≥0.60 仲裁 / <0.40 重做；自动预筛标准流程（追认④，§4.2.4） |
| L7 双人提取 ×2+仲裁 | §C·L7 | 双人 κ≥0.7 / ICC；8 类信息全覆盖 + 信度字段 |
| L8 RoB 评估 | §C·L8 | 工具×设计必配（RCT→RoB2 / NRSI→ROBINS-I / 单被试→SCED 非 SCRIBE / 单组前后测→ROBINS-I UBA）；研究层×outcome 层两级 |
| L9 综合 SWiM/Popay | §C·L9 | **基于显著性的 vote count 禁令**（Cochrane）；PRISMA+SWiM 9 项；§4.2.8 切 MA 决策表 |
| L10 GRADE | §C·L10（`L10-grade.md` 住本 skill） | "研究数少"≠imprecision（用 OIS）；升级前先 5 降级；SoF≤7 |
| L11 写作 ×4 | §C·L11 | PRISMA 27 项 + 24-27 不遗漏；流程图 4 阶段；Limitations ≥4 维 |
| L12 自评 | references/L12-amstar2-self-assessment.md | AMSTAR 2 16 项 7 关键域；任一失分 Critically Low |
| 写/查决策档案 | references/decision-provenance.md + COPY-BLOCKS §D | 规划文档=上下文容器（追认①，§3.3）；**禁自证式"已读"勾选** |
| 任何 Review-Agent 前 | references/quality-control.md | 跨阶段交叉对账（§14.3）+ 四铁律 |

> `subagent-templates.md` = 各角色 6 段完整模板（on-demand 深潜；复制块 = 其"必读段"的即用压缩，主 Agent 无需先开模板即可派发）。

---

## 7 字数控制

字数公式与矩阵详见 `review-methodology-foundations/references/SSOT-WORDCOUNT-RULES.md` §3.1（综述类型 × 文献规模矩阵第 4 行：系统综述）+ §3.3（调整因子）+ §4（字数纪律）。本节不复制 SSOT 数字。

- **默认字数**：12,000 字（SSOT §2.2 系统综述行）；**下限** 8,000 字
- **三种确认模式**：A（用户已指定 → 直接采用）/ B（未指定 → 默认 12,000 + 通知 + 不阻塞）/ C（自适应 → L7 完成后按 SSOT §3.1 矩阵估算）
- **严格 vs 学习模式**：均按 SSOT §3.1 矩阵；严格模式下限 8,000 字
- **字数纪律**：不硬凑 / 不铺陈 / 质量优先（详细定义见 SSOT §4）
- **字数严重不匹配阈值**：参见 §11.6（应用 C2）

---

## 8 何时加载底座 SSOT（路径权威 = 全库 resolver）

> **路径唯一权威 = `review-methodology-foundations/references/SSOT-INDEX.md`（全库 file-resolver）**：阶段/关键词 → 唯一正确路径，覆盖三 skill 全部 references（治两次实战 wrong-path；跨 skill 归属陷阱见其 §B）。全文按需下钻时用 resolver 解析，不凭阶段编号直觉猜路径。SR 各阶段核心 SSOT：

| 阶段 / 决策点 | SSOT |
|---|---|
| 启动后立即（主 Agent 必读） | **`LAUNCH-DIGEST.md`（≤10k 启动即必读，蒸馏三件套载荷 + §1.2-18 前沿条款六表）**；三件套全文（AI-FAILURE / LIFECYCLE / TERMINOLOGY）降级为按需下钻 |
| L1 类型决策 | SSOT-REVIEW-TYPES |
| L2 PICO 三层 | SSOT-PICO-FRAMEWORKS |
| L3 模式选择 | SSOT-MODE-PROFILES |
| L4 检索策略 | SSOT-SEARCH-STRATEGY |
| L5 PRISMA-S | SSOT-PRISMA-S-TEMPLATE |
| L6 流程图准备 | SSOT-PRISMA-FLOW-DIAGRAM |
| L7 提取字段 | SSOT-EXTRACTION-FIELDS |
| L8 RoB 工具映射 | SSOT-ROB-TOOL-MAPPING |
| L9 综合方法 | SSOT-SYNTHESIS-METHODS（如切到 MA 加 SSOT-EFFECT-SIZE-DECISION） |
| L10 GRADE | SSOT-GRADE-FRAMEWORK |
| L11 报告标准 | SSOT-REPORTING-STANDARDS（心理学叠加 SSOT-PSYCHOLOGY-SUPPLEMENTS） |
| L12 自评 | SSOT-AMSTAR-2-CHECKLIST |
| 心理学场景 | SSOT-PSYCHOLOGY-SUPPLEMENTS |
| 中文场景 | SSOT-CHINESE-CONTEXT |
| 字数 | SSOT-WORDCOUNT-RULES |

---

## 9 严格 / 学习 / 监督模式

参见 `review-methodology-foundations/references/SSOT-MODE-PROFILES.md` v2.0.0（系统综述子集 §4.4 + 三模式定义 §1）。

> 三模式速览：**严格**（顶刊投稿，全自动 + 人最终验收一次）/ **学习**（课程作业，简化 + 抽样核查）/ **监督**（§9.4：发表级方法学完整度 + 人在 7 不可逆点逐一签字把关）。监督模式见 §9.4。

### 9.1 严格模式（默认）

目标：顶刊投稿、循证临床、Cochrane 标准、AMSTAR 2 ≥ Moderate。

完整执行 12 阶段，全部 Tier 1（25 项）。Tier 2 推荐：PRESS、AMSTAR 2 自评、Open Science 披露。

### 9.2 学习模式（用户主动声明或场景判断）

目标：课程作业、开题报告、学习方法论、时间预算 ≤ 1 周。

简化的 11 项 Tier 1：
- 保留：L1 / L2 / L4（≥ 2 库）/ L5（简化布尔）/ L6（关键字段）/ L8（简化 3-4 项 RoB）/ L9（基础综合）/ L11（PRISMA 核心 8-10 条 + 流程图）
- 跳过但披露：L3（声明未注册）/ L4（PRESS）/ L6（双盲降级为单 SubAgent + 抽样人工核查）/ L10（GRADE 不强制）/ L12（AMSTAR 不强制）

学习模式 ≠ 不规范。三条硬约束：
1. 保留 L1+L2+L11（类型识别、PICO、按报告标准写）
2. 保留 PRISMA 流程图
3. 综述末尾"Method Limitations"按 §9.3 披露原文模板逐条列出简化点

模式判定规则参见 SSOT-MODE-PROFILES §2.1（用户场景 → 推荐模式决策表）+ §4.2.1 L1 4 项判定矩阵。

### 9.3 学习模式 5 简化点的诚实披露原文模板（应用 C4 三段体例，W5_FIX_PLAN E.P0.6）

学习模式允许在 5 个简化点降级，但必须在主稿 Methods / Limitations 显式披露。每段披露含三段：教材原假设 / LLM 实现差异（≥ 3 处差异列举）/ 缓解措施 + Limitations 披露。

完整三段披露原文模板存放于 `references/L3-mode-disclosures.md`，主 Agent 在 L11 写作阶段加载该文件复制对应模板。5 个简化点：

| # | 简化点 | 嵌入主稿位置 | 教材依据 |
|---|---|---|---|
| 1 | 跳过 PRESS 同行评审（L4） | Methods §4.3 Search Strategy 末尾 | Cochrane v6.5 §4.4.5 |
| 2 | 双盲筛选降级（L6） | Methods §4.4 Selection Process 末尾 | Cochrane §4.6 + AMSTAR 2 Item 5 |
| 3 | 跳过 GRADE（L10） | Methods §4.11 Certainty Assessment + Discussion Limitations | Cochrane v6.5 Ch.14 |
| 4 | 跳过 AMSTAR 2 自评（L12） | Discussion Limitations 末尾 | Shea et al. 2017 *BMJ* |
| 5 | 协议未注册（L3） | Methods §4.0 Protocol and Registration | Cochrane v6.5 + AMSTAR 2 Item 2 (CD 1) |

每个简化点的完整三段披露原文（"段 1 教材原假设 / 段 2 LLM 实现差异 ≥ 3 处 / 段 3 缓解措施"）参见 references/L3-mode-disclosures.md。学习模式主 Agent 必须为本综述实际触发的简化点逐一嵌入对应模板（不允许"段 1+段 3"省略段 2）。

### 9.4 监督模式（Supervised Mode）

**一句话**：AI 把粗活干完（检索执行、双盲筛选、双人提取、初稿），人只在机器判不了的 7 个关键节点拍板——方法学和严格模式一样完整（PRISMA 2020 全 27 条 / AMSTAR 2 ≥ Moderate），但每个不可逆的决策都有人亲自签字担责。定义见 `review-methodology-foundations/references/SSOT-MODE-PROFILES.md` §1.4。

**什么时候选它**：教授/导师要的"AI 初编、人 check、确保不出错、达发表级"——既不放心让 AI 全自动一路跑过关键判断，又不能用课程级的随机抽查。一个研究者 + AI 协作产出可投稿的系统综述、但要逐点亲自把关时，选监督模式。

**它和严格模式差在哪**：方法学完整度一模一样（都是发表级 Tier 1 全覆盖），唯一区别是**把"最后人验收一次"换成"7 个不可逆点各审一次"**。系统综述侧，前几个签核点主要落在 L4 检索+纳排冻结、L6 筛选分歧、L7 提取校准/低置信（后续 L9/L11 解读与引用终审在切到元分析终点时由 meta-analysis 路径承接，见 §13.1）。每点产一张为它定制的审核卡，人看卡拍板"接受还是打回"。

**为什么是"真门"而不是"提醒一下"**：每个签核点的裁决落进 `decisions/` 对应文件的 `user_signoff` 标记。下游阶段启动前由 preflight 脚本读它——**没签字 / pending / 打回 → 脚本退出码 ≠ 0，下游根本启动不了**。同时 κ 由脚本算（不是 AI 心算）、可复现性硬检查（缺 sessionInfo / 退出码 ≠ 0 / κ 太低 / 种子召回不足）先于人审直接阻断。**7 门的运行时操作契约（每门触发时机、产物路径、preflight 命令、缺签阻断哪个下游、硬检查、审核面上限）见 `review-methodology-foundations/references/SUPERVISED-MODE-GATES.md`。**

**平衡（两边都不过拟合）**：不处处拦人审——双盲一致项自动放行、κ 判 pass 且无红灯则该点无人审队列、可逆中间产物不设门；也不放任 AI 跑过关键判断——7 个不可逆冻结点、筛选分歧/提取低置信/关键数值必审。每个签核点待审条数设上限，超限收紧上游过滤而非把长清单甩给人。

**签核体验（G1 vNext，2026-07-03 · 两段式）**：运行中=心流优先的知情确认（保留「(推荐)」预标+理由+后果+下钻+打回；不做负样本注入、不加考验摩擦），真正的独立人类审核在事后署名人审核包（L12.5）。**卡/gate 合一**（唯一人面文档=gate markdown 六段 a-f，HTML 卡为可选增强）；判断点由结构化决策块单一源头驱动，`signoff_ask.py` 是唯一合规提问/回填通道（agent 不许手写 signed）；preflight additive 强制同源 hash / 证据完备 / 叙事自洽 / 三字段。完整机制见 `review-methodology-foundations/references/SUPERVISED-MODE-GATES.md` §0.5。

**披露**：监督模式产出须披露"哪些步 AI 做、人在 7 签核点各审了什么"（RAISE：人类监督 + 透明披露 + 最终责任在人）。**披露强度由签核事实（`presented_via`/`evidence_opened`/签字页状态）机读生成、单调不超过事实、语义用 attestation**；两段式如实写作：`in-run informed confirmations with drill-down access + post-hoc independent audit via structured audit package`。详见 SSOT §6.6。

> **负责任使用（单一 SSOT）**：监督模式的立场、两段式监督模型、7 门与诚实边界的完整表述见发布仓根 `RESPONSIBLE_USE.md`——核心：AI 初编 + 人在 7 门签核 + 署名人负全责；运行中=知情确认（非独立判断），事后审核包=真正的独立人类审核；披露强度机读生成、单调不超过事实；不支持无人审核的自动投稿。

---

## 10 心理学场景与中文场景的特殊处理

### 10.1 心理学场景

触发条件：按 `SSOT-PSYCHOLOGY-SUPPLEMENTS.md §0.4` 4 类信号清单（APA 期刊 / 量表名 / 心理学构念 / 复制危机 + JARS 关键词）扫描，任 1 类命中即触发。判定结果（yes/no/boundary）写入 `decisions/01_type_decision.md` 心理学判定字段（决定 L11 是否叠加 JARS-Quant）。

参见 `SSOT-PSYCHOLOGY-SUPPLEMENTS.md`。SR 心理学场景额外要求：
- APA JARS-Quant Table 9（MARS）12 处差异（SSOT-REPORTING-STANDARDS §3）
- APA Thesaurus（PsycINFO）替代 MeSH
- 心理学元分析 8 议题（L9 切到 meta-analysis 时叠加）
- 复制危机响应：预注册声明、p-curve、Many Labs（SSOT-EXPERT-METHODOLOGY-INSIGHTS 维度 5）

按综合路径切换 JARS 子标准：L9 量化综合 → JARS-Quant Table 9（MARS）；L9 质性综合（SWiM / 主题综合 / 元民族志）→ **JARS-Qual Table 2** + ENTREQ；混合方法 → **JARS-MM Table 1**。

期刊投稿映射：*Psychological Bulletin* / *Psychological Review* → JARS-Quant Table 9 + APA 7 + Open Science；*心理学报* / *心理科学进展* → 参照 SSOT-CHINESE-CONTEXT。

### 10.2 中文场景

参见 `SSOT-CHINESE-CONTEXT.md`。中文 SR 特殊要求：CNKI 检索语法 + 主题词；中文核心期刊综述格式（《心理学报》《心理科学进展》《管理世界》）；GB/T 7714-2015 引用格式（vs APA 7）；预注册可选"预见（PRECISE-CHINA）"+ PROSPERO 中文版。**中文检索回退路径见 §11.1**（检索主路径 `paper-search-pro`；中文 0 命中 → 人工导出 CNKI/万方题录 → `ingest_search_exports.py` 摄入；关键约束：不擅自降级英文检索代替中文检索）。

### 10.3 默认 RoB 工具选择的诚实披露（应用 C4，W5_FIX_PLAN E.P1.4）

主 Agent 在 L8 阶段使用按研究设计自动路由的 RoB 工具选择策略（教材依据：Cochrane v6.5 §8 / §25 / §28），需在主稿 Methods 节"Study Risk of Bias Assessment"嵌入完整三段披露（教材假设 / LLM 实现差异 ≥ 3 处 / 缓解措施 + Limitations 披露）。完整披露原文模板参见 `references/L8-rob-assessment.md` §"默认 RoB 工具选择的诚实披露"。

**关键约束**：单被试设计使用 SCED Scale 或 RoBiNT Scale（**不是 SCRIBE** — SCRIBE 是单被试**报告指南**，不是 RoB 工具）。详见 SSOT-ROB-TOOL-MAPPING §11.2/§11.3。

---

## 11 故障诊断与回退（应用 C2 模板）

> 本章节按"诊断信号 + 阈值 + 回退路径"三件套组织。故障切换决策写入 `decisions/<阶段>_failure_switch.md`。

### 11.1 检索主路径与回退（含中文场景）

> **检索主路径 = `paper-search-pro` Skill**（OpenAlex / Semantic Scholar / CrossRef / PubMed 均走 HTTP API，需配置对应 API key，无需任何 MCP server）。**若运行环境未提供** `semantic-scholar` / `openalex` MCP server（常见默认情况）——故障诊断以"`paper-search-pro` 检索结果异常"为准，**不**以"SS/OpenAlex MCP 报错"为准（该环境下这类报错不会出现）。**中文检索**因 OpenAlex/SS/CrossRef/PubMed 覆盖中文文献有限，主路径 = 用户人工导出 CNKI/万方 → `scripts/ingest_search_exports.py` 摄入。

| 故障信号 | 回退路径 |
|---|---|
| 英文检索 0 命中 / 召回过低（关键词为英文，`paper-search-pro` 命中明显不足） | 扩展同义词 / 放宽布尔逻辑重检；跨源交叉（OpenAlex↔CrossRef↔PubMed）补召回 |
| **中文检索经 `paper-search-pro` 0 命中（0 命中 + 关键词为中文）** | (a) 用户人工导出 CNKI / 万方 / VIP 题录 → `scripts/ingest_search_exports.py` 摄入统一字段；(b) 已有文献集时转 `literature-set-review`。**关键约束：SubAgent 不擅自降级英文检索代替中文检索** |
| 检索整体不可用（HTTP 持续失败 / 网络受限 / key 失效，持续失败 ≥ 3 次） | 阻断 + 警示用户 + 引导人工导出题录后走 `ingest_search_exports.py` + **不强行降级到本地推理凭记忆编造文献** |
| 检索结果元数据不完整（abstract 缺失 ≥ 50%） | 派发 `firecrawl-abstract` Skill 补抽（见下注降级路径） OR 扩展同义词重检索 |

> **`firecrawl-abstract` 降级注**：**若运行环境无 `semantic-scholar` MCP server** → 该 Skill 的 `paper_details`（Semantic Scholar API / SS 法）通道**不可用**；默认走 **Firecrawl Scrape / Firecrawl Extract 两法**（Firecrawl key 在场可用），按 DOI / URL 抓取并解析摘要。

### 11.2 检索回报极端值（W5_FIX_PLAN E.P1.2）

- `identify_count > 50000` → **强制降级**（不允许继续作为 SR），扩窄 PICO 或转 FO
- `identify_count > 10000` → 强烈建议降级（PICO 扩窄 / 切到 FO）
- `identify_count` ∈ [5, 20) → 警示 + 询问用户是否扩展 PICO 或转 LS
- `identify_count < 5` → 阻塞 + 切到 LS 或扩展 PICO

引用 PRISMA-S Item 15-16 报告。

### 11.3 数据严重不足

- L7 数据可提取字段 < 50% → 主 Agent 仲裁；不能 → 切到 FO
- 含信度数据的研究 < 5（心理学元分析）→ 信度概化 sensitivity；Hunter-Schmidt 警示 + 抽样校正
- §4.2.1 4 项判定矩阵 = 1/4 → 切到 FO/LS

### 11.4 异质性极端 / 综合失败（W5_FIX_PLAN F.P1.4 协同）

- `I² > 75%`（合并阻断）→ 不允许仅合并效应；改用 subgroup / meta-regression
- `I² > 90%`（极端）→ **完全禁止合并 + 必须 subgroup / meta-regression / SWiM**
- `k < 5` 异质性高 → 不元分析，转 SWiM/Popay

应用 §4.2.8 L9 切换 MA 决策表执行。

### 11.5 双盲筛选 κ 异常 + 11.6 字数严重不匹配

- **κ 异常**（详见 §4.2.5）：κ ≥ 0.60 仲裁不一致即可；0.40 ≤ κ < 0.60 仲裁 + 重审标准歧义；κ < 0.40 **重做筛选**。
- **字数严重不匹配**（SSOT-WORDCOUNT-RULES §8）：偏差 ≥ 30% 报告用户 + 建议调整；偏差 ≥ 50% **强制调整或转 Skill**。

---

## 12 输出格式与文件命名

工作目录结构 `<task_root>/工作产出/`：

- `decisions/01_type_decision.md ... 11_reporting_standard.md`（决策档案 11 类）
- `L1_type_identification.md` / `L2_pico_construction.md` / `L2_synonym_groups.md` / `L2_finer_check.md`
- `L3_protocol_draft.md` / `L3_registration_statement.md`
- `L4_search_strategy.md` / `L4_database_list.md` / `L4_grey_literature_plan.md`
- `L5_search_records_<database>.csv` / `L5_search_documentation_<database>.yaml` / `L5_dedup_log.md` / `L5_final_records.csv`
- `L6_screening_log.csv` / `L6_arbitration_log.md` / `L6_excluded_studies_with_reasons.csv`
- `L7_extraction_<agentID>.csv` / `L7_extraction_final.csv` / `L7_extraction_consistency.md`
- `L7_to_MA_field_mapping.md`（SR L7 → MA L9.1 字段映射，W5_FIX_PLAN E.P1.6）
- `L8_rob_assessment.csv` / `L8_rob_summary_table.md` / `L8_traffic_light_plot.md`
- `L9_synthesis_results.md`
- `L10_grade_assessment.csv` / `L10_summary_of_findings.md`
- `L11_manuscript.md`（主稿）/ `L11_prisma_flow_diagram.md`（prisma-flow-agent 产出）/ `L11_writing_process_archive.md`（writing-process-archive-agent 产出）
- `L12_amstar2_self_assessment.md` / `L12_robis_assessment.md`（严格模式 Tier 2）
- `final_quality_check.md`

文件命名规则：`L<N>_<task>.<ext>`（与 LS PRES-016 NN_ 前缀风格平行）。

> **纯 SR 路径 L12 交付打包（G9 指针）**：纯 SR 终稿的交付打包与联合路径同一规范——①调 manuscript-typeset **默认产投稿四件**（docx / PDF man / PDF jou / 干净 md，不待用户追加；四元组见 §13.4）；②按 manifest 五节模板产 `03_交付/00_交付清单_manifest.md`（模板 = `meta-analysis/references/delivery-manifest-template.md`，**住 meta-analysis 被本 Skill 引用**；§3a 逐条覆盖①产出的 PLACEHOLDERS.md、§1 登记实产件数）；③与 L12.5 审核包的 `00_审核入口.md` **分离互链，不合并**（manifest = 投稿物索引；审核入口 = 署名人终审动线）。完整五步见 meta-analysis SKILL §12.4（联合路径 L12 归 MA，锁4 §4.4）。

---

## 13 与其他 Skill 的关系

### 13.1 配套关系（强推荐组合）

- **systematic-review + meta-analysis**：systematic-review 完成 L1-L8，**meta-analysis 完成 L9-L12**（量化合成 + GRADE + APA MARS 报告 + AMSTAR 2；锁4 §4.4：以元分析为终点的联合路径 MA 拥有 L9-L12）。投顶刊系统综述 + 元分析的标准组合。**联合工作流路由**：systematic-review L1-L8 → 应用 §4.2.8 L9 切换 MA 决策表 → meta-analysis L9-L12。
- **systematic-review + ma-plots 渲染器 / ssci-plots**：森林图、漏斗图属元分析路径（上条联合工作流，由 meta-analysis §13.2 内置渲染器产出）；**纯 SR 路径 L11 的 PRISMA 流程图 / RoB 图 = ma-plots 固定渲染器固定命令**（`prisma_flow.py` / `rob_traffic.py` + QC exit≠0，渲染器住 `meta-analysis/scripts/plots/` 被本 Skill 引用，四元组见 §13.4）；ssci-plots = 样式底座 + 非四件套通用统计图出口。

### 13.2 替代关系（用户选错时切换）

| 用户场景 | 应切换到 | 理由 |
|---|---|---|
| 只想探索领域、不要严格 PRISMA | field-overview-review | 探索式综述，无双盲、无 RoB |
| 想做 50 年发展史、领域演化 | field-evolution-review | 时间维度 + 5 维度检索 |
| 已有文献集、不再检索、**无 PRISMA 要求** | literature-set-review | 跳过 L4-L5、增加输入质量自审 |
| 已有文献集、**要 PRISMA / Cochrane** | systematic-review（本 Skill） | 跳过 L4-L5 检索、保留 L1-L3 + L6-L12（**消除与 LS 模糊地带**） |
| 理论建构、构念分析、对立理论比较 | theoretical-review | 论证为主、方法宽松、Psychological Review 风格 |
| 只做量化元分析 | meta-analysis | 直接进 L9 量化（如已有完整数据） |

### 13.3 降级路径

如果用户初始想做系统综述但发现不可行（如检索回报量 > 50000、研究异质性极高、文献不足），主 Agent 应推荐降级：
- 降到 `field-overview-review`（整合综述路径）
- 或降到 `literature-set-review`（手头文献集驱动）
- 不允许在 systematic-review 中"压缩到 PRISMA 2 条"

### 13.4 卫星依赖矩阵（四元组硬契约 —— G9）

> **定位**：同 meta-analysis SKILL §13.4——每个卫星调用锁成**四元组命令行契约**【何时调 / 命令或入口 / IO 契约 / 缺失时降级】，替代叙述性"联动"（E-Q4 病根：叙述性依赖可被合法绕开）。**每行"缺失时降级"给明确阻断/降级动作，禁静默**。路径 = skill-根相对路径；`<skill>` = 该 skill 根目录（**严禁** runtime `~/.claude/skills/` 与裸相对 `skills/`）。

| 卫星 | 何时调 | 命令或入口 | IO 契约 | 缺失时降级 |
|---|---|---|---|---|
| **paper-search-pro** | L4/L5 检索主路径（L4 冻结签核后执行检索） | Skill 工具显式加载并触发（HTTP API：OpenAlex / Semantic Scholar / CrossRef / PubMed，key 已配，无 MCP） | 进：检索式。出：题录导出（BibTeX/RIS/CSV）→ `scripts/ingest_search_exports.py` 摄入；外包路线时回执先过 `scripts/validate_exports.py` 硬门（exit≠0 不摄入，§4.2.4） | **→ §11.1 回退表**（中文 0 命中 → 人工导出 CNKI/万方 → ingest 摄入；整体不可用 → 阻断警示、不凭记忆编造文献）+ G6 检索请求包人工路线（§4.2.4）。本行指针即可，不复述 §11.1 |
| **document-to-markdown + paper-downloader-portable** | L6 纳入判定后、L7 提取前（全文下载 + PDF→MD 转换） | **G6 全文请求包机制（不直接调 CLI）**：主 session 产 `fulltext_request_pack/`（download_list CSV + download_policy.yaml + 自包含执行 Prompt）外包给可插拔执行器（§4.2.6；模式 = `review-methodology-foundations/references/OUTSOURCING-HANDOFF-PATTERN.md`） | 进：`download_list.csv` + `download_policy.yaml`（`allow_scihub` 一次性预先点头 / 渠道白名单 8 枚举 / 依赖档位）。出：回执按 `meta-analysis/references/FULLTEXT-RECEIPT-FORMAT.md`（8 字段 `fulltext_receipt.csv` + 人读清单；**住 meta-analysis 被本 Skill 引用**，resolver §B #9）；**`scripts/validate_fulltext.py` 硬门验收**（exit≠0 不摄入；`--receipt --policy` 渠道纪律 fail-closed） | **G6 依赖档位**（`download_policy.downloader.tier`）：本地 `paper-downloader-portable` **优先**；缺 → 第三方下载 skill（G10 依赖矩阵选定，档位占位）或 `manual-only` 手工逐库指引。d2m（执行 Prompt 必需转换器）缺 → 换具备 d2m 的执行器，或转换缺件如实进回执 + 主 session **阻断消费并披露**——主 session 不回退自己下载/转换 |
| **ma-plots**（**住 `meta-analysis/scripts/plots/` 被本 Skill 引用**，非独立 skill） | **纯 SR 路径** L11 的 PRISMA 流程图 / RoB 图（联合路径产图归 MA L11，见 §13.1） | `python3 <meta-analysis>/scripts/plots/prisma_flow.py --counts <prisma_counts.yaml> --out <stem>`；`python3 <meta-analysis>/scripts/plots/rob_traffic.py --data <rob_domains.csv> --labels <labels.csv> --tool both --out <stem>`（`--tool` 亦可 `rob2` / `robins`；**CLI 签名权威 = `meta-analysis/scripts/plots/README.md`**） | 进：`meta-analysis/references/prisma-flow-contract.md`（counts YAML）/ `rob-figure-contract.md`（domains CSV）。出：`<stem>.png` + `<stem>.pdf`；退出码 0/1/2/3，**QC exit≠0（码 2 非 warn-only）不落盘**。**labels 机械同源纪律**同 MA §13.2：`--labels` 从特征表 / ID 对照卡机械生成并落盘、**禁手造**；交付验收抽行核"显示名↔study_id↔数值三方一致" | **渲染器或其依赖缺失 → 阻断交付图并明确报告缺什么**（不静默、**绝不现场手写渲染代码顶替**）；缺 R / 官方包（`PRISMA2020` / `robvis`）→ **exit 1 明确报错**（`--warn-only` 不降）→ 装包后重跑 |
| **manuscript-typeset**（独立通用 skill） | **纯 SR 路径** L12 终稿交付打包（联合路径归 MA §12.4）；**默认产投稿四件，不待用户追加** | `python3 <manuscript-typeset>/scripts/typeset.py --request typeset_request.yaml --outdir <dir>` | 进：`typeset_request.yaml`（契约权威 = `manuscript-typeset/references/MANUSCRIPT-INPUT-CONTRACT.md`）。出：四件（投稿 docx / 投稿 PDF man / 发表预览 PDF jou / 干净 md）+ BUILD_NOTES / PLACEHOLDERS / STRIP_REPORT。退出码 0/1/2/3；**fidelity fail = exit 2 该件不落 + 阻断（无 `--warn-only`）** | 缺 `xelatex` → 降级出 docx + md 两件（exit 0 + BUILD_NOTES 声明）；缺 `pandoc` → **exit 1 阻断并报告**；fidelity fail **永不降级** |
| **academic-ref-check** | 引用终审（L11 终稿 + 引用表定稿后、交付前）；纯 SR 终稿同样 **100% 过核验**（academic-reference-verification Rule）；监督模式联合路径 = SP7 门 | `python3 <academic-ref-check>/scripts/verify_http.py --in L11_refs.json --out-dir decisions/ --topic "终稿引用"`（或 `--in-text L11_references.md` 自解析）；接线细节 = `meta-analysis/references/L11-mars-reporting.md` §8.3 | 进：终稿全部引用。出：`decisions/L11_ref_verify_report.md`（人读）+ `.json`（机读）；逐条核验存在/第一作者姓/期刊/年份 + 补回 DOI。退出码：有红→1 / 否则 unverified→3 / 否则有黄→2 / 全绿→0 | **核验能力缺失 ≠ 通过（fail-closed）**：改人工多源核验（OpenAlex / CrossRef 手查）且负担显式披露；unverified 须重跑至可判；**绝不"跳过核验照交付"** |

---

## 14 Skill 独有方法学章节

### 14.1 学习模式简化点的诚实披露

学习模式 5 简化点的完整 C4 三段披露见 §9.3。

### 14.2 默认 RoB 工具选择的诚实披露

按研究设计自动路由的披露见 §10.3（含 SCED/RoBiNT vs SCRIBE 修正）。

### 14.3 跨阶段交叉对账（PRES-004 多角度验证保留）

阶段间交叉对账机制（防漏防错）参见 `references/quality-control.md` §2-§3：
- L2 → L4 / L4 → L5 / L5 → L6 / L6 → L7 / L7 → L8 / L8 → L10 / L9 → L10 / L10 → L11 / L11 → L12

---

## 15 参考文档清单

**15.1 教材基础**：Cochrane Handbook v6.5（2024）/ Cooper 5e *Research Synthesis and Meta-Analysis*（2017）/ Higgins et al. *Cochrane Handbook* / Borenstein et al. *Introduction to Meta-Analysis* 2e（2021，配套 meta-analysis Skill）/ JBI Manual for Evidence Synthesis（2024，质性证据综合）。

**15.2 报告标准**：PRISMA 2020（Page et al. 2021 *BMJ*，27 条 + 4 阶段流程图）/ PRISMA-S（Rethlefsen et al. 2021 *Syst Rev*，16 项）/ PRISMA-P（Moher et al. 2015，17 项协议预注册）/ AMSTAR 2（Shea et al. 2017 *BMJ*，16 项 7 关键域）/ GRADE Working Group（Cochrane Ch.14 + GRADE Handbook）/ ROBIS（Whiting et al. 2016 *J Clin Epidemiol*）。

**15.3 风险偏倚工具**：RoB 2（Cochrane v6.5 Ch.8，RCT 5 域）/ ROBINS-I（Ch.25，NRSI 7 域）/ QUADAS-2（诊断）/ NOS（队列/横断）/ CASP / JBI Qualitative（质性）/ COSMIN（测量工具）/ **SCED Scale / RoBiNT Scale**（单被试设计 RoB 工具；**SCRIBE 是单被试报告指南，不是 RoB 工具**）。

### 15.4 SSOT 引用清单

本 Skill 通过引用而非粘贴使用 review-methodology-foundations 的 20 个 SSOT。完整 SSOT × 阶段映射参见 §8 + `review-methodology-foundations/references/SSOT-INDEX.md`。简表：SSOT-REVIEW-TYPES（L1）/ SSOT-LIFECYCLE-12-PHASES（全）/ SSOT-METHODOLOGY-TERMINOLOGY（弱）/ SSOT-AI-FAILURE-DEFENSES（全 必读）/ SSOT-EXPERT-METHODOLOGY-INSIGHTS（仲裁）/ SSOT-PICO-FRAMEWORKS（L2）/ SSOT-SEARCH-STRATEGY（L4）/ SSOT-PRISMA-S-TEMPLATE（L5）/ SSOT-PRISMA-FLOW-DIAGRAM（L6/L11）/ SSOT-EXTRACTION-FIELDS（L7）/ SSOT-EFFECT-SIZE-DECISION（L9 切 MA 时）/ SSOT-ROB-TOOL-MAPPING（L8）/ SSOT-SYNTHESIS-METHODS（L9）/ SSOT-GRADE-FRAMEWORK（L10）/ SSOT-REPORTING-STANDARDS（L11）/ SSOT-AMSTAR-2-CHECKLIST（L12）/ SSOT-PSYCHOLOGY-SUPPLEMENTS（心理学场景）/ SSOT-CHINESE-CONTEXT（中文场景）/ SSOT-MODE-PROFILES（L3）/ SSOT-WORDCOUNT-RULES（L11）。

---

## 16 变更记录

- **2026-06-10（v1.1.1）**：修复轮 F10–F17（依据 = 2026-06-10 实测审计）。新建 `review-methodology-foundations/references/SSOT-INDEX.md`（修复本文件 §8 / §15.4 的断链引用）；subagent-templates / L6 / L7 中的硬编码模型名参数化（规范性语句改为"当前可用的最强模型"，披露模板原文改为按会话如实填写的占位符）。
- **2026-06-20（S4 WP-C 编排修补）**：§2.4 / §4.2.8 / §13.1 联合路径 L10-L12 措辞消歧——按锁4 §4.4 裁定，以元分析为终点的联合路径由 **meta-analysis 完成 L9-L12**（GRADE/报告/AMSTAR2 由 MA 产），纯 SR 路径仍 SR 完成 L10-L12（原"回 systematic-review 完成 L10-L12"在切 MA 场景与 MA §12.1 交付物清单冲突，已消歧）。SR L7→MA L9.1 字段映射表（`L7-extraction-dual.md §11`）由 S4 同步重写对接 MA L9.1 §8.2 输入契约（关 BK-2）。
- **2026-06-23（S6B WP-E② 监督模式）**：关 BK-9。§9 标题改"严格 vs 学习"→"严格 / 学习 / 监督" + 三模式速览，新增 §9.4 监督模式（= 严格方法学完整度 + 人在 7 不可逆点 SP1-SP7 结构性强制门决策审核；何时选=教授诉求"AI 初编+人 check 达发表级"；SR 侧签核点主要落 L4 检索冻结/L6 筛选/L7 提取，L9/L11 在切 MA 终点时由 MA 路径承接；真门=preflight 缺签 exit≠0 + κ 由脚本算 + 硬检查先于软评；平衡=两边都不过拟合 + 审核面上限；披露=RAISE 人类监督+透明+最终责任）；指向操作契约 `review-methodology-foundations/references/SUPERVISED-MODE-GATES.md` + `SSOT-MODE-PROFILES v2.0.0`。用户面文字按 `meta-analysis/scripts/CARD_NARRATIVE_VOICE.md` 精神去黑话。仅改 §9（OWNER_MAP §2.2 段落 owner），未触碰其余章节。
- **2026-06-23（S7 WP-F Lane A 检索回退一致化）**：关 doc 12c P2-3/P2-4。§11.1 检索回退表去除运行环境不存在的 SS MCP 假信号（`batch_search` 报错 / phantom `limit` / `fields` 类型 / "SS MCP 不返回 CNKI"），主路径改为 `paper-search-pro`（HTTP，OpenAlex/SS/CrossRef/PubMed key 已配）/ 中文人工导出 CNKI 万方 → `scripts/ingest_search_exports.py` 摄入；保留真实回退（中文 0 命中→人工导出+摄入/转 literature-set-review、整体不可用→阻断警示不凭记忆编造、元数据补抽）与关键约束"不擅自降级英文检索代替中文检索"；§3.4/§10.2 检索回退 cross-ref 同步去 SS MCP 框架。新增 `firecrawl-abstract` SS 法降级注：运行环境无 SS MCP → `paper_details`(SS 法) 不可用，默认走 Firecrawl Scrape/Extract 两法。仅改 §3.4/§10.2/§11.1（OWNER_MAP §2.2 S7 段落 owner），未触碰其余章节。
- **2026-07-04（G5 必读投放与瘦身）**：治实战病根"references 39.3% 从未被读 / 三件套被跳 2/3 / 被读率=派发 prompt 点名的函数"。①**§3.1 启动即必读改指 `LAUNCH-DIGEST.md`（≤10k）**（蒸馏三件套 ≈72k 载荷 + §1.2-18 前沿条款六表，三件套/深层全文降级按需下钻）；②**§6 从"何时加载"改"派发复制块"**（关键载荷经新建 `PROMPT-COPY-BLOCKS.md §C` 整段进 SubAgent prompt = 填空题构造性保证，最高危载荷一句内联本表）；③**§8 路径权威改指 `SSOT-INDEX.md` 全库 resolver**（阶段→绝对路径，治 L10/L11/L12 住 SR 被 MA 引用的两次 wrong-path）；④好偏离追认（公理 8）：追认①规划文档=上下文容器（§3.3）+ 追认④验证式自动预筛标准流程（§4.2.4 指针 + `L6-screening-dual-blind.md §12` 新节：种子 100% 保全 + 双重假阴抽验 + Methods 披露，不替代双盲/全文双人）；⑤required_readings 保字段砍报表 + **禁自证式"已读"勾选**（模板删 + preflight `--gate readings` 一行 WARN）。仅改 §3.1/§6/§8/§3.3/§4.2.4/§16，未触碰 §9.4+§4.2.5（G1）/§11.1（S7）/其余章节。
- **2026-07-06（G9 集成接线）**：①新增 **§13.4 卫星依赖矩阵**（五行四元组硬契约：paper-search-pro[L4/L5 主路径，降级指针 §11.1 不复述] / document-to-markdown+paper-downloader-portable[G6 全文请求包 §4.2.6 + download_policy 依赖档位] / ma-plots[**住 meta-analysis/scripts/plots 被本 Skill 引用**：纯 SR 路径 L11 的 PRISMA/RoB 图固定命令+QC exit≠0+labels 机械同源纪律] / manuscript-typeset[纯 SR L12 默认投稿四件] / academic-ref-check[引用终审 fail-closed]；每行降级明确禁静默）；②§13.1 "systematic-review + ssci-plots" 行事实同步（森林图/漏斗图归 MA 路径；纯 SR PRISMA/RoB 图 = ma-plots 固定渲染器；ssci-plots = 样式底座 + 通用统计图出口）；③§12 尾新增纯 SR 路径 L12 交付打包指针 blockquote（manifest 五节模板住 MA 被 SR 引用 + 投稿四件 + 与 `00_审核入口.md` 分离互链；详 meta-analysis SKILL §12.4）。纯 additive/措辞事实同步：避开 §9.4+§4.2.5(G1)/§11.1(S7)/§4.2.4+§4.2.6 G6 blockquote/G5 owned §3.1/§6/§8/§3.3/L6 §12；S4 的 §12 命名规则行与 §13.1 联合工作流行一字未动。④**references 消费面同步**：`subagent-templates.md` L8 RoB 输出行（发表级图=rob_traffic.py）+ 11.3 prisma-flow-agent 步骤 6 改 prisma_flow.py 固定命令+失败回退改"明确报告缺什么、草稿不得当交付图" / `L9-synthesis-swim.md` :338 effect direction plot 指针化（ssci-plots 通用图出口正确角色）。⑤critic 交叉复核后加修：§12 打包指针 blockquote **调序**（typeset①→manifest②，治依赖倒置）；`L11-prisma-reporting.md` :152 与 `L8-rob-assessment.md` :189/:207/:327 漏网 ssci-plots 活指令改固定渲染器契约指针。

