/multi-document-summarization — 多源文档归纳
核心概念
单文档摘要 vs 多文档归纳
| 维度 | 单文档摘要 | 多文档归纳 |
|---|---|---|
| 处理对象 | 一份文档 | 多份相关文档 |
| 核心任务 | 压缩信息、提取要点 | 交叉对比、整合关联 |
| 输出性质 | 对原文的忠实缩写 | 跨文档的新知识结构 |
| 关键能力 | 信息筛选 | 一致性识别、冲突发现 |
四层次分析
Level 1: 单篇理解
分别理解每篇文档的核心内容
Level 2: 共性提取
识别多篇文档共同涉及的主题、观点、事实
Level 3: 差异对比
识别文档之间的观点冲突、事实矛盾、表述差异
Level 4: 洞见生成
基于跨文档对比分析,生成新的综合性结论
文档关系类型
| 关系类型 | 分析重点 |
|---|---|
| 平行关系 | 整合各方面信息,形成全景视图 |
| 时间序列 | 梳理演变脉络,识别趋势变化 |
| 对立关系 | 客观呈现各方观点,标注冲突点 |
| 层级关系 | 梳理层级结构,识别核心与衍生 |
| 补充关系 | 整合互补信息,填补单篇盲区 |
工作流程
阶段一:准备与输入
步骤1:整理文档清单
| 编号 | 文档名称 | 类型 | 来源 | 日期 | 字数 |
|------|---------|------|------|------|------|
| D1 | 判决书A | 判决书 | 某法院 | 2024 | 3000字 |
| D2 | 判决书B | 判决书 | 某法院 | 2023 | 2500字 |
阶段二:Level 1-2 处理
步骤2:对每份文档生成摘要
调用 legal-document-summarization
步骤3:提取共性
识别全部文档共同涉及的主题、观点、事实
阶段三:Level 3 差异对比
步骤4:识别差异点
- 观点冲突
- 事实矛盾
- 表述差异
步骤5:标注冲突点
对每个冲突点,客观呈现各方立场
阶段四:Level 4 洞见生成
步骤6:生成跨文档洞见
- 趋势判断
- 规律识别
- 结构性结论
输出格式
## 多源文档综合分析
### 文档清单
[表格]
### 共性提取
#### 共同主题
- [主题1]
- [主题2]
#### 共同观点
- [观点1]
### 差异对比
| 维度 | 文档A | 文档B | 差异性质 |
|------|-------|-------|---------|
| [差异点] | [立场A] | [立场B] | [冲突/矛盾/不同] |
### 冲突点清单
1. [冲突点1]:客观呈现双方立场,不做真伪判断
2. [冲突点2]:...
### 跨文档洞见
1. [洞见1]
2. [洞见2]
### 趋势分析(适用于时间序列)
[梳理演变脉络]
引用说明
本skill方法论来自 THUYRan/Legal-Skills-Chinese/multi-document-summarization, THUYRan原版9500字,GCL精简至约180行。