文献综述
本参考用于把真实文献整理成综述脉络。豆包默认不运行 Bash、PowerShell、wc、Python、CrossRef 脚本或本地 PDF 解析脚本;也不能把普通搜索工具或学术元数据工具返回的条目当成已核验文献。文献来源来自用户提供材料、scholar_search 返回的英文元数据与引用格式、browser-task/浏览器任务回填的可见网络来源、CNKI/知网导出或用户手动回填。中文文献仍必须先走 browser-task;英文文献可先用 scholar_search 建立正式引用池,再按需要补 DOI、出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料。
一、硬门控:先有来源,再写综述
涉及文献综述、国内外研究现状、related work、研究背景、引言中的研究脉络时,不得凭模型记忆补文献。中文文献在未显式尝试 browser-task 前,不得先调用 scholar_search、general_search、普通搜索工具、搜索面板或其他后台检索工具建立候选文献池;browser-task 若不可用,应直接转用户手动回填,而不是改走直接搜索兜底。英文文献可先用 scholar_search 建立正式引用池,但若要支持方法细节、实验结果或局限分析等全文级判断,仍需继续补摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料。
- 中文文献:优先按
../literature-search/SKILL.md子流程执行,先触发豆包 browser-task/浏览器任务检索知网/CNKI,拿到真实题名、作者、来源、年份和 GB/T 7714 引用;只有 browser-task 明确不可用、登录/验证码阻塞或用户明确要求手动时,才让用户手动回填。中文文献必须保留页面可见元数据、来源链接/检索词、知网导出引用或用户回填证据;缺少证据时必须说明“中文文献真实性核验未完成”,不得假装打开知网后编写中文引用。 - 英文文献:可优先使用
scholar_search获取真实英文学术文献元数据和引用格式,也可通过 DOI 页面、正式出版页面、出版社页面、arXiv 页面、browser-task 页面可见内容或用户提供摘录补充更强证据。scholar_search返回的题名、作者、年份、来源和引用格式可用于建立正式英文参考文献、生成文内引用标识和完成元数据层判断;但若正文要写方法细节、实验结果、适用场景、局限边界等全文级判断,仍需结合摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料。不要凭模型记忆补英文参考文献;不要把general_search、普通搜索工具、OpenAlex/Semantic Scholar API 或搜索结果摘要直接转成正式参考文献。 - 只有题名或元数据:只能写元数据层面的事实,不写全文级结论。
- 没有真实来源:只能输出检索策略、综述结构或“待补引用版”段落,不得声称综述已完成;完整初稿任务在未尝试 browser-task 前,不得把文献获取放到“后续补充”后直接进入写作。
Draft Mode 可以生成“待扩充引用初稿”,但不能降低文献真实性要求。若英文或中文文献未达数量阈值,必须在综述开头或状态块中列出缺口,不能用模型记忆补齐参考文献。英文文献缺口可先用 scholar_search 补足正式参考文献、文内引用和元数据层判断;若正文需要写方法细节、实验结果或局限边界,再继续补摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料。只有中文文献缺口仍必须先尝试 browser-task;browser-task 明确不可用、登录/验证码/机构认证阻塞或用户选择手动时,才要求用户手动回填中文来源信息。
找文献时,默认优先选择近几年内与主题高度相关、具有代表性且可核验的来源;在时间范围相近时,可以适度优先高引用文献,但不强求“最新一年”或“最新版本”文献。若某一方向存在基础方法原始论文、经典综述、标准指南或领域公认代表作,即使年份较早,也应保留为基础支撑来源。英文文献至少要区分“可用于正式引用的元数据来源”和“可用于正文全文级判断的强证据来源”两种层级,不得混写。
英文检索完成后,不得直接结束 S1。凡论文类型要求中英文文献池,Google Scholar/DOI/出版社页面检索完成后,必须继续触发 ../literature-search/SKILL.md 或中文来源检索,补足 CNKI/中文来源引用池。中文文献数量不足、未核验,或发现疑似编造/来源不明中文条目时,阶段保持 S1;本轮无法继续时,在交付状态和风险说明中明确写:请使用 /browser-task 继续搜索中文文献,并补足 CNKI/中文来源引用池。
1.1 Draft Mode 文献数量目标
| 论文类型 | 总文献目标 | 英文文献目标 | 中文文献目标 | 说明 |
|---|---|---|---|---|
| 技术类期刊论文 | 至少 30 篇 | 英文至少 20 篇 | 中文至少 10 篇 | 英文文献支撑基础方法、模型和国际相关工作;中文文献支撑国内应用和研究现状。 |
| 技术类毕业/学位论文 | 至少 30 篇 | 英文至少 20 篇 | 中文至少 10 篇 | 不得只用中文文献写“国内外研究现状”。 |
| 课程论文/开题报告 | 10-15 篇 | 视学科至少 5 篇 | 视题目补充 | 可先生成检索清单和待扩充引用初稿。 |
技术类论文英文基础文献池通常应覆盖:基础检测器或核心算法、特征融合、注意力机制、损失函数、数据集/领域任务和近年改进方法。以 YOLO/CV/缺陷检测为例,应优先检索 YOLO 系列、Faster R-CNN、SSD、RetinaNet、FPN/PANet/BiFPN、SE/CBAM/Coordinate Attention、Focal Loss/IoU loss variants,以及 NEU-DET、GC10-DET 或对应领域缺陷检测论文。近年改进方法优先覆盖近几年的代表性工作,可适度优先高引用论文,但不要求一律追到最新一年。
二、文献到正文的证据映射
文献检索不是交付终点。写正文前,先在对话中建立 evidence-claim map:
| Source ID | Citation | Source type | 可直接使用的信息 | 可支持的正文判断 | 使用位置 | Risk |
|---|---|---|---|---|---|---|
填写规则:
可支持的正文判断必须是一句可以进入正文的有限判断,不写“这篇文献很相关”。使用位置具体到段落角色,如“研究背景-P1 问题压力”“相关工作-P3 方法局限”。- 关键研究缺口应尽量由 2 条以上来源共同支撑;材料不足时标为
needs-verification。 - GitHub、博客、模型说明和工具文档只能作为软件资源或方法背景,不能替代正式论文支撑学术主张。
- 进入正文时,每个文献性判断或综合段都必须显式挂文内引用标识;不能只在文末集中列参考文献而正文没有引用。未指定体例时,中文默认使用 GB/T 7714 顺序编码制
[1]、[2];模板要求著者-出版年制、脚注或其他体例时,按模板输出正文标注。 - 若英文来源仅来自
scholar_search元数据或其他 citation-level 来源,可支持的正文判断只能写到题名、作者、年份、来源、方法方向、任务对象等元数据层事实;不得直接扩写为方法细节、实验效果或局限边界。
三、综述组织原则
综述不是逐篇摘要,而是围绕问题、方法和边界组织材料。
3.1 主题组织
一个主题段通常包含:
- 主题或方法家族:这组研究共同处理什么问题。
- 证据综合:比较 2-4 条来源在对象、方法、数据或结论边界上的差异。
- 局限或分歧:说明尚未解决什么,或哪些结论只在特定条件下成立。
- 本文衔接:解释为什么需要当前论文的研究问题、方法或实验设计。
失败写法:
张三研究了 A。李四研究了 B。王五研究了 C。因此该领域发展很快。
较好写法:
围绕 X 问题,已有研究主要从 A 和 B 两类路径展开。A 类方法更关注……,在……条件下能够提供……证据;B 类方法则把重点放在……,但其结论通常依赖……。这些研究说明……已经得到一定讨论,但对于……条件下的……问题,现有证据仍然不足。
示例只能作为结构参考,不能把示例内容迁移到无关论文中。
中文或英文研究现状不得按作者逐篇平铺为“A 等人提出……B 等人提出……C 等人提出……”。若连续两句都以作者名开头,先改成方法家族、问题条件或证据差异的综合段。但即使采用综合段写法,也必须在句内或句末保留明确的文内引用标识,如 [3-5]、(Mousavi et al., 2020) 或模板要求的脚注;不能因为做综合归纳就省略引用。
正文不得使用具体引用次数作为影响力论据,例如“获得 94 次引用”“近 4 万次引用”“高被引论文”。被引次数只能在用户明确要求文献计量分析时出现,且必须来自可核验计量来源;普通综述应说明方法被哪些任务采用、解决了什么问题和留下什么边界。
3.2 中文研究现状
中文研究现状必须优先使用 CNKI/知网或用户提供的可核验中文来源。
- 若用户尚未提供真实中文文献,先输出检索词、筛选条件和回填表格。
- 若 browser-task/浏览器任务不可用,给用户手动检索步骤,而不是改用模型记忆补写。
- 若只能拿到候选文献列表,先请用户确认引用范围,再整理综述。
候选文献回填表:
| # | 题名 | 作者 | 来源 | 年份 | 类型 | 链接/数据库 | 可支持的判断 | 风险 |
|---|---|---|---|---|---|---|---|---|
3.3 英文相关工作
英文文献可优先通过 scholar_search 获取正式元数据和引用格式,也可通过 DOI、出版社页面、arXiv 页面、browser-task 页面可见内容或用户提供 DOI、PDF、出版页面结果整理。Semantic Scholar、OpenAlex 等学术元数据平台只用于发现候选线索,不进入已核验来源优先级。scholar_search 的返回结果可直接进入正式英文参考文献和文内引用;若只有 citation-level 元数据,正文只能写元数据层判断;若要写方法细节、实验效果或局限边界,仍需补摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料。
英文来源优先级:
scholar_search返回的真实英文文献元数据与引用格式,用于建立正式英文参考文献、文内引用和元数据层判断。- DOI 页面、出版社正式页面、会议/期刊官网、arXiv 页面、browser-task 页面可见内容,用于补充摘要、方法细节、结果和局限边界等更强证据。
- 用户上传的 PDF、截图、摘录或 DOI/出版页面信息。
Semantic Scholar、OpenAlex 等只能作为候选发现工具,不能作为英文来源优先级中的正式引用来源;若从这些平台发现候选文献,必须继续追溯到 scholar_search、DOI 页面、出版社页面、arXiv 页面、browser-task 页面可见内容或用户提供的可核验材料。general_search、普通搜索工具和搜索面板不能替代英文正式引用来源;scholar_search 可以作为英文正式引用来源,但若要支持全文级判断,仍需继续补更强证据。
browser-task 目标模板:
使用 `scholar_search` 或 browser-task/浏览器任务获取英文文献时,优先选择基础方法原始论文、近年高相关论文和正式出版版本。若用 `scholar_search`,应记录题名、作者、年份、来源和引用格式;若正文需要写方法细节、结果或局限,再继续补 DOI 页面、出版社页面、arXiv 页面或 browser-task 页面可见摘要与正文线索。Semantic Scholar、OpenAlex 只能用于发现候选题名,不能替代正式引用来源。
如果英文来源只有 scholar_search 元数据或其他 citation-level 信息,可写正式参考文献、文内引用和元数据层面的综述判断,但不能直接写方法细节、实验效果或局限边界。只有补到摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户提供 PDF/摘录后,才可写更强的正文判断;Final Mode 需要补足与结论强度匹配的可核验证据。
四、写作边界
- 不使用“近年来……快速发展”“取得显著进展”“具有重要意义”等空泛模板,除非有明确来源或数据支撑。
- 不把“实验结果表明”套进文献综述,除非原文确实报告了相应实验且当前证据可追溯。
- 不写“获得 X 次引用”“高影响力论文”等引用计数句;除非任务是文献计量分析且来源已核验。
- 不用“近年来……取得显著进展—早期方法主要……—随着深度学习兴起……”的时间线模板代替主题综合。
- 不为凑引用数量把弱相关文献塞进正文。
- 不用 Markdown 加粗或斜体标记文献主题;论文正文用普通标题或自然段主题句,不输出
**...**、__...__、_..._。 - 不运行
python scripts/scholar_search.py、pdf_parser.py、wc或其他本地命令。若用户明确要求本地自动化,说明这属于归档的本地工具链,不是豆包默认流程。 - 不使用
general_search或普通搜索工具结果替代正式英文引用来源或强证据来源;scholar_search可用于正式英文参考文献、文内引用和元数据层判断,但不能单独替代摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料去支撑全文级结论。
五、交付模板
5.1 材料不足时
目前还不能直接写正式文献综述,因为缺少可核验来源。
建议先检索:
- 中文关键词:...
- 英文关键词:...
- 数据库/来源:CNKI/知网、`scholar_search`、学校数据库、期刊官网、DOI 页面、出版社页面、arXiv 页面
- 辅助发现工具(非正式引用来源):Semantic Scholar、OpenAlex、普通搜索工具
请完成 CNKI browser-task 或手动回填中文候选文献表;英文文献可先用 `scholar_search` 获取正式引用,再按需要补 DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料。我再整理 evidence-claim map 并写综述正文。
5.2 材料充分时
### 文献证据映射
[evidence-claim map]
### 综述结构
- 主题一:...
- 主题二:...
- 研究缺口:...
### 综述正文
[连续中文论文段落,不使用项目符号或 Markdown 加粗]
### 风险说明
- 待核验来源:...
- 仅摘要层级证据:...
- 不应写入的强结论:...
综述正文中的文献句必须显式挂文内引用标识。默认中文体例使用 GB/T 7714 顺序编码制,例如 ……已有研究主要从波形建模与到时拾取两条路径展开[1-3]。;若目标模板要求著者-出版年制,也可以写成 Earthquake Transformer(EqT)利用注意力机制实现连续波形中的事件检测与 P/S 相拾取(Mousavi et al., 2020);Siamese Earthquake Transformer 等方法进一步扩展到低信噪比和阵列场景(Xiao et al., 2021)。
六、交付前自检
- 每个文献性判断都能回到 Source ID。
- 中文研究现状没有跳过 CNKI/知网或用户提供来源。
- 英文文献已按证据层级处理:
scholar_search可用于正式参考文献、文内引用和元数据层判断;若正文写入方法细节、实验结果或局限边界,已补摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料。 - 英文文献检索完成后,没有跳过中文文献检索;中文阈值不足时已继续
../literature-search/SKILL.md,或在状态块中要求下一轮使用/browser-task继续搜索中文文献。 - 没有将
general_search、CrossRef、Semantic Scholar、OpenAlex 或普通搜索工具返回的元数据冒充为已核验来源;scholar_search仅在允许的 citation-level / metadata-level 范围内使用。 - 中文文献没有在未尝试 browser-task 前先用 direct search、
scholar_search、general_search、普通搜索工具或搜索面板建立候选文献池;英文文献若先用scholar_search,仅用于正式引用和元数据层判断,没有越界支撑全文级结论。 - 技术类论文没有只用中文文献支撑国内外研究现状;英文文献数量和类别缺口已列出。
- 没有候选文献冒充已核验文献。
- 没有逐篇罗列、无来源综合或空泛模板句。
- 没有按作者逐句平铺研究现状;每个综述段都围绕方法家族、问题条件、证据差异或局限边界组织。
- 文献综述、研究现状和 related work 正文中的文献性判断都已显式挂上文内引用标识;没有出现“正文无引用、只在文末列参考文献”的情况。
- 正文没有未经文献计量任务支持的具体引用次数或“高影响力”空泛标签。
- 参考文献格式与用户要求一致;未指定时中文默认 GB/T 7714。
- 正文没有
**...**、__...__、_..._、提示词、AI 来源说明或待替换说明。