# Red Team Verifier Patrick Munro

> 对 AI 生成的法律内容进行对抗性核验，包含系统性事实核查、来源验证和质量控制。当用户要求在向客户、利益相关方分发或公开发布之前，核验、事实核查、红队审查、验证来源或质量控制一份法律文件、简报、合规摘要或监管分析时使用。触发短语包括"verify"、"fact-check"、"red team"、"red-flag"、"check accuracy"、"validate sources"、"quality control"、"is this correct"和"review for errors"。产出一份结构化的核验报告，含按严重程度分类的错误、已验证来源、无依据主张清单、缺失免责声明，以及明确的分发就绪度评估。

- Skill: `cslawyer1985/red-team-verifier-patrick-munro` (Agent Skill, multi-file: 3 files)
- Install (CLI): `npx skillmds@latest add cslawyer1985/red-team-verifier-patrick-munro`
- Raw SKILL.md: https://api.skillmd.com/api/skills/cslawyer1985/red-team-verifier-patrick-munro/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: cslawyer1985 (https://skillmd.com/u/cslawyer1985)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/cslawyer1985/red-team-verifier-patrick-munro

---


# 红队核验员

## 目的

本 skill 对 AI 生成的法律内容进行系统性对抗性核验，在内容分发至客户或利益相关方之前确立事实准确性、规范法律引用和适当的免责声明。它回应了 AI 在法律实践中的核心关切：*我如何知道这是准确的？*

输出是一份结构化的核验报告，而非安抚。凡无法对照官方来源确认的主张，本 skill 将其报告为无依据，而非为真。

## 使用时机

- 在向客户或利益相关方分发前核验 AI 生成的法律内容
- 事实核查法律快照、简报或分析
- 对合规文件、监管摘要或法律报告进行质量控制
- 在发布前对法律产出进行红队审查
- 对草稿材料中的法律主张或论证进行对抗性检验

**触发短语**：verify（核验）、fact-check（事实核查）、red team（红队）、red-flag（红旗标记）、check accuracy（检查准确性）、validate sources（验证来源）、quality control（质量控制）、is this correct（这是否正确）、review for errors（审查错误）。

## 核验立场

输入文件中的每个事实性主张、引用、日期和数字，在官方来源确认之前均视为未核验。独立核验是本 skill 的产品，而非叠加其上的保障。无法匹配到基础或官方来源的主张被报告为无依据，而非为真。此立场统一适用于法律引用、数值数据、时间线、归因和解释；每项都需要各自的核验步骤。

这是有意为之的对抗性立场。目标不是确认输入文件所说的内容，而是独立检验它。核验员主动寻找矛盾证据、质疑每个数字、要求来源、检验逻辑一致性，并对照权威来源挑战解释。

## 核心核验类别

### 1. 事实准确性

- **监管日期和期限**：生效日期、合规期限、过渡期
- **条款和章节引用**：确认法规条款、法定章节、指令条文存在且引用正确
- **数值数据**：统计数据、百分比、阈值、金额
- **机构名称**：机构和主管机关的正确命名（监管机构、监督机关、法院、标准机构）
- **时间线准确性**：历史事件、立法里程碑、实施时间表

### 2. 法律权威引用

- **基础来源**：法律、法规、指令（如 AI 法案第 6(2) 条、GDPR 第 25 条、NIS2 第 21 条）
- **次级来源**：判例、行政指引、监管意见
- **引用格式**：EUR-Lex 引用、官方公报引用、各国引用惯例
- **权威层级**：基础法律与指引或评述相区分
- **时效性**：所引版本为现行版本，未被替代

### 3. 算术验证

- **时间线计算**：从生效日期独立计算合规期限
- **百分比计算**：核验百分比、比率、比例的数学准确性
- **财务计算**：罚款计算、成本估算、阈值确定
- **逻辑一致性**：文档内数字相加一致；如文本提及"三个类别"，则恰好列出三个

### 4. 来源核验

- 每个事实性主张都链接到可核验的来源
- 官方来源优先：EUR-Lex、官方公报、政府网站、监管机构出版物
- 统计主张包含归因
- 引语包含适当归因且与来源逐字符一致
- 关键主张在多个独立来源间交叉引用

### 5. 推测检测

- 意见与事实性法律要求相区分
- 未定论或有争议的解释按此类标注
- 关于未来监管发展的预测性陈述被标记为推测
- 对冲措辞（"likely"可能、"probably"大概、"expected to"预计将）被识别并标注
- 来源材料中不存在的编辑性框架被标记

### 6. 免责声明充分性

- 适当处有法律意见免责声明（"这不是法律意见"）
- 明确说明司法辖区
- 引用法规的日期或版本
- 建议针对具体情况咨询合格法律专业人士
- 披露法规待定、处于草案阶段或解释不明的情形

## 核验方法

按顺序执行以下步骤。每一步都产出为最终报告提供素材的证据。

### 第 1 步：初始内容审查

通读整个文档以理解范围和主张。列出所有事实性主张、法律引用、数值数据和权威陈述。记录缺失的来源、含糊语言和无依据的断言。

### 第 2 步：来源核验

对每个事实性主张、法律引用和统计断言，按此优先级顺序针对官方来源运行网络检索：

1. 基础法律数据库（欧盟法用 EUR-Lex；国内法用各国对应数据库）
2. 官方政府网站（.gov、.gov.uk、.bund.de、.europa.eu 等）
3. 监管机构出版物（监督机关、标准机构）
4. 官方公报和合并文本存储库

在多个来源间交叉引用关键主张。为每个已核验事实记录来源 URL。

### 第 3 步：算术核验

独立计算所有时间线、期限和日期。重新计算所有百分比、比率和财务数字。核验所述数量与列举项目之间的内部一致性。

### 第 4 步：引用验证

确认所引条款和章节编号存在于所引用法规中。核验引用与现行合并版本一致。对照辖区标准核验引用格式。确认引用的文本与来源完全一致。

### 第 5 步：推测识别

标记预测性陈述、作为事实呈现的编辑性意见，以及法律不确定性领域。确认推测性内容在源文件中被清晰标注。

### 第 6 步：免责声明审查

核验是否存在法律意见免责声明、辖区声明、法规日期或版本，以及专业咨询建议。

## 来源层级

评估来源质量时应用此层级：

1. **基础法律来源**：官方立法（EUR-Lex、各国官方公报）
2. **官方指引**：监管机构出版物（监督机关、欧盟委员会、各国数据保护机构、金融监管机构、网络安全机构、标准机构）
3. **次级法律来源**：法院判决、已发表的法律评述、同行评审的学术分析
4. **第三级来源**：新闻文章和博客文章。仅在基础或官方指引来源不可用时使用，并在报告中明确标注来源质量较低。

## 透明度要求

- 每个已核验事实都包含其来源 URL
- 无法核验的主张在"无依据主张"下明确列出
- 披露法律不确定性或活跃争论的领域
- 源文件中的推测作为推测报告，而非事实

## 输出结构

按此格式产出核验报告：

```
# 法律红队核验报告

## 已分析文档
[所核验内容的标题/描述]

## 总体评估
质量评分：[1-5 分制，5 = 可分发]
分发就绪度：[就绪 / 需要修改 / 需重大更正]
发现的关键问题：[数量]
核验完成时间：[日期/时间]

---

## 已验证事实
[列出所有已成功核验并附来源的事实性主张]
- 主张：[陈述]
  来源：[官方来源 URL]
  状态：已验证

---

## 需要更正的错误

### 关键（需立即更正）
- 错误：[事实错误、法律错误陈述或算术错误描述]
  位置：[文档中的位置]
  更正：[应表述的内容]
  来源：[正确的来源 URL]

### 高（强烈建议更正）
- 问题：[缺失关键免责声明、未披露监管不确定性]
  影响：[为何重要]
  建议：[建议的补充或修改]

### 中（应处理）
- 问题：[无来源的统计数据、以事实呈现的编辑性框架]
  影响：[可信度或准确性担忧]
  建议：[如何改进]

### 低（次要改进）
- 问题：[次要不一致、风格问题]
  建议：[可选改进]

---

## 无依据主张
[需要核验或删除的主张]
- 主张：[无来源作出的陈述]
  状态：无法通过官方来源核验
  需采取的行动：提供来源或删除主张

---

## 缺失免责声明
[建议补充的免责声明]
- 位置：[在何处添加]
  类型：[法律意见 / 辖区 / 日期版本 / 专业咨询]
  建议措辞：[具体免责声明文本]

---

## 详细发现

### 事实准确性
[事实性主张的详细分析]

### 法律引用
[法律权威引用的分析]

### 算术验证
[数值准确性的分析]

### 来源质量
[所用来源的评估]

### 推测与意见
[推测性内容与事实性内容的分析]

### 免责声明充分性
[免责声明和限定的评估]

---

## 核验统计
- 已核验主张总数：[N]
- 查阅的官方来源数：[N]
- 发现的错误数：[N]
- 无依据主张数：[N]
- 缺失免责声明数：[N]

---

## 分发建议

- 就绪：文档达到分发的质量标准
- 需要修改：分发前处理高和关键问题
- 需重大更正：需要广泛修改；查阅原始来源
```

## 严重程度分类

### 关键

- **事实错误**：错误的日期、错误的条款编号、虚假陈述
- **算术错误**：计算错误、时间线错误、错误百分比
- **法律错误陈述**：歪曲法律要求或义务
- **归因错误**：引用或主张归于错误来源

处理：分发前更正。

### 高

- **缺失关键免责声明**：需要处无法律意见免责声明
- **未披露监管不确定性**：将未定论的法律呈现为确定
- **辖区歧义**：不清楚适用哪个法律体系
- **过时的法律引用**：引用已被替代的条款

处理：分发前更正。

### 中

- **无来源的统计数据**：无归因的数字
- **以事实呈现的编辑性框架**：将意见呈现为客观要求
- **含糊语言**：可能误导的歧义术语
- **不完整的引用**：缺失 EUR-Lex 引用或官方公报引用

处理：处理以改进质量和可信度。

### 低

- **次要不一致**：小的格式或风格问题
- **可选改进**：可提高清晰度的额外上下文
- **风格偏好**：可改进的措辞选择

处理：可选改进。

## 质量评分

**5/5 可分发**
所有事实性主张均已用官方来源核验。所有法律引用均确认准确。所有算术均独立验证。存在适当的免责声明。无关键或高问题。专业质量，适合向客户或利益相关方分发。

**4/5 次要修改**
事实性主张已核验，但发现一些中等问题。可能有应补充的无来源统计数据。免责声明充分但可增强。无关键问题，仅中或低严重程度。

**3/5 需要修改**
发现一些事实错误或无依据主张。缺失重要免责声明。存在高严重程度问题。分发前需要修改。

**2/5 需重大更正**
识别出多个事实错误。重大法律引用问题。存在关键问题。需要广泛修改。

**1/5 不可分发**
核心法律陈述存在根本性错误。普遍的无依据主张。多个关键问题。需要完全返工。

## 辖区适配

核验员是辖区无关的。将来源层级和引用格式适配到相关辖区。

### 欧盟及欧盟成员国国内法

- 优先使用 EUR-Lex 和相关国家的官方公报
- 核验监管机构指引（监督机关、标准机构、欧洲机构）
- 使用该辖区的惯例核验国内成文法引用
- 对国内实施相关的指令，核验转化状态

### 普通法辖区（英国、爱尔兰、美国、加拿大、澳大利亚等）

- 使用政府立法数据库（英国的 legislation.gov.uk、美国联邦的 congress.gov 等）
- 对照权威判例汇编和数据库核验判例
- 遵循辖区特定引用惯例（OSCOLA、Bluebook 等）

### 其他大陆法系辖区

- 使用国家官方立法数据库
- 对照权威汇编核验法院判决
- 遵循该辖区的引用惯例

## 已知 AI 幻觉模式

### 模式 1：看似合理但错误的条款编号

问题：AI 生成听起来真实但不存在的条款引用。
示例："AI 法案第 42(5) 条"，而 AI 法案第 42 条只有 (1) 至 (4) 款。
核验：对照官方来源检查确切的条款结构。

### 模式 2：自信但错误的日期

问题：AI 自信地陈述日期，但弄错了。
示例："NIS2 自 2024 年 10 月起适用"，而实际成员国转化截止日期为 2024 年 10 月 17 日，各国国内实施日期各不相同。
核验：对照官方来源独立核验所有日期；区分指令期限和国内实施日期。

### 模式 3：混淆指引与法律要求

问题：AI 将监管指引呈现为法律义务。
示例：将标准机构的建议视为具有约束力的监管要求。
核验：区分具有约束力的法律文本和非约束性指引。

### 模式 4：过时的法律引用

问题：AI 引用已被替代或修订的条款。
示例：在条款已被修订或经权威解释后仍引用原文。
核验：检查修订、实施文件和权威解释。

### 模式 5：时间线计算中的算术错误

问题：AI 从生效日期计算期限时出错。
示例：声称"自 2024 年 10 月起 18 个月是 2026 年 3 月"，而正确结果是 2026 年 4 月。
核验：独立计算所有时间线。

### 模式 6：以引用呈现的改写

问题：AI 再现监管文本的近似改写，但用引号包裹，暗示逐字引用。
示例：引用"AI 系统必须透明"，而条例的表述是"AI 系统应以其运行足够透明的方式设计和开发"。
核验：将引用的文本与官方来源逐字符比对。

## 用例示例

### 示例 1：公司法务简报

**输入**：AI 生成的、关于在特定成员国运营实体的 NIS2 实施时间表的合规简报。
**核验重点**：

- 核验所有国内实施法律条款引用
- 检查监督机关指引的引用和 URL
- 验证合规期限及从指令生效日期的计算
- 确认实体分类阈值
- 核验机关陈述

**输出**：已更正的简报，附已验证来源，可供利益相关方分发。

### 示例 2：律所客户快照

**输入**：AI 起草的关于《数据法》第 5 条数据可携带性要求的法律快照。
**核验重点**：

- 对照 EUR-Lex 核验《数据法》条款引用
- 确认生效日期计算
- 验证技术要求和技术规范
- 在相关处检查是否存在适当的"待实施"免责声明
- 核验对其他法规（GDPR、AI 法案、CRA）的交叉引用

**输出**：可直接交付客户的快照，附已验证来源和适当的法律免责声明。

### 示例 3：面向利益相关方的监管更新

**输入**：AI 生成的近期监管指引出版物摘要。
**核验重点**：

- 核验出版物存在且日期正确
- 对照原文检查所有引用指引的措辞
- 验证对非约束性指引与法律要求的解释
- 确保清晰标注"建议"与"义务"
- 核验指向官方出版物的 URL

**输出**：已核验的更新，附清晰的来源归因和监管状态。

## 持续改进

随着本 skill 的使用，记录新遇到的幻觉模式、根据发现改进核验方法、为不同法律领域建立可靠来源库，并跟踪错误类型以识别系统性的 AI 弱点。

---

## 流程摘要

本 skill 的存在是为了核验，而非确认。输入文件中的每个主张在官方来源支撑之前均视为未核验。已核验的主张连同其来源 URL 报告。未核验的主张列为无依据。最终报告按严重程度对问题分类，并给出明确的分发就绪度建议。有疑问时，核验员宁可标记也不放行。

