# Research Evidence Synthesis

> 为重要决策设计可证伪研究问题、检索协议、证据台账、反证矩阵、不确定性说明和带引用的综合结论。适用于比较竞争性解释、审查多来源主张、建立证据图或决定下一步研究；不用于无需研究的稳定常识、单纯数据查询、伪造来源，或未经授权购买资料、联系研究对象和访问受限内容。

- Skill: `aaaaqwq/research-evidence-synthesis` (Agent Skill, multi-file: 2 files)
- Install (CLI): `npx skillmds@latest add aaaaqwq/research-evidence-synthesis`
- Raw SKILL.md: https://api.skillmd.com/api/skills/aaaaqwq/research-evidence-synthesis/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Research & Search
- Author: aAAaqwq (https://skillmd.com/u/aaaaqwq)
- Updated: 2026-09-09
- Page: https://skillmd.com/skills/aaaaqwq/research-evidence-synthesis

---


# 研究证据综合

将模糊问题转化为能改变决策的研究。优先一手证据、反证和可复现记录；无法确认时明确写 `UNKNOWN`。

## 收集最小输入

确认决策、决策人、截止时间、错误代价、现有信念、关键术语、范围、地区/人群/技术版本、所需证据强度、允许的来源、时间/成本预算和停止条件。

若请求是“证明 X”，将其改写为“哪些证据支持或反对 X，什么会推翻 X”。不得把模型记忆、搜索摘要、未打开页面或同源转载当成已核实证据。

## 工作流

### 1. 写研究决策契约

明确：要作什么决定、最晚何时、有哪些可选行动、什么信息会改变行动、错误结论的代价。研究产物服务决策，不以链接数量或篇幅为目标。

### 2. 操作化问题与假设

定义关键术语、观察单位、时间窗口、对比基线和判定标准。列出至少两个合理的竞争性假设，并为每个假设写明：

- 预期观察；
- 反向观察；
- 可推翻条件；
- 可能混杂因素。

### 3. 预先登记检索协议

记录查询主题、来源类型、日期范围、语言/地区、纳入与排除标准、去重规则、检索截止时间和未覆盖范围。按问题选择方法，不机械要求固定来源数量。

通常优先：原始数据、官方文件、标准、原论文和第一方技术资料 → 严谨综述或权威二手分析 → 可追溯报道 → 线索材料。一手来源仍需审查方法、样本和利益冲突。

### 4. 建立证据台账

| 主张 | 来源与定位 | 类型 | 日期/版本 | 方法/样本 | 独立性 | 方向 | 局限 |
|---|---|---|---|---|---|---|---|
| 可检验陈述 | 稳定链接、页码/段落 | 一手/综述/二手/线索 | 时效 | 如何获得结果 | 独立/同源/未知 | 支持/反对/混合 | 外推与偏差 |

对每条证据检查作者/机构、原始出处、利益冲突、定义、分母、样本、版本和适用范围。引用必须能定位到实际打开并核验的内容。

### 5. 主动寻找反证

搜索失败案例、负结果、不同地区/样本、方法批评和替代解释。多个页面若共同引用同一材料，只算一个证据源。没有找到反证不等于反证不存在。

### 6. 评级证据与不确定性

分别判断：

- **直接性**：是否直接回答问题；
- **方法质量**：设计、样本、测量和分析是否适当；
- **独立性**：来源是否共享数据或利益；
- **一致性**：结果一致还是存在可解释分歧；
- **时效与适用性**：是否匹配当前地区、人群和版本。

区分测量误差、模型不确定性、情景不确定性与根本未知。不用无依据百分比表示置信度。

### 7. 综合而非投票

按证据质量和直接性解释为何某项证据权重更高，不用“多数来源认为”代替综合。每个关键陈述标记：

- `FACT`：来源直接支持且上下文匹配；
- `INFERENCE`：证据推导，列出链条和替代解释；
- `JUDGMENT`：依据明确标准作出的评价；
- `UNKNOWN`：证据缺失、冲突或不可访问；
- `STALE`：时间或版本变化导致失效。

### 8. 决定停止或下一步

当新增信息不再改变行动、达到预设证据门或边际信息价值低于成本时停止。若关键未知仍可能改变决定，推荐成本最低、区分力最高的下一项验证。

## 证据门

1. 问题和判定标准可操作化；
2. 检索协议与截止时间可复述；
3. 核心主张尽量回到一手来源并完成同源去重；
4. 反证和竞争性解释已主动检查；
5. 结论强度不超过证据，统计显著、实际重要与因果不混淆；
6. 读者能定位来源并看到未覆盖范围。

## 交付模板

```markdown
# 研究决策备忘录
## 决策、范围与截止时间
## 术语、判定标准与竞争性假设
## 方法、纳入/排除和未覆盖范围
## 关键发现（FACT / INFERENCE / JUDGMENT / UNKNOWN）
## 支持证据、反证与替代解释
## 证据质量和不确定性
## 决策含义与不应外推之处
## 下一步最高信息价值动作
## 来源附录与修订记录
```

## 停止、批准与交接

关键一手证据不可得、来源严重冲突、时限不足、涉及私密数据/人类受试者/规避访问限制，或需要购买、登录、联系、提交和外发时，停止并请求人类决定。所有外部联系、付费和受限访问需事前明确批准。

数据质量交 CDO；法律、财务、安全、技术结论分别交 CLO、CFO、对应专家/CTO；传播材料交 CCO 且不得弱化证据边界；重大主张交 Governor 独立挑战。

