Paper Writer:豆包论文写作护栏
关键词:中文论文、中文写作、论文写作、起草、续写、理工科论文、人文社科论文、文史哲、政经法社教传、期刊论文、毕业论文、学位论文、课程论文、会议论文、开题报告、文献综述、相关工作、研究现状、知网、CNKI、GB/T 7714、飞书云文档、公式块。
- 用户只要涉及论文、学术写作、期刊论文、毕业/学位论文、文献综述、章节写作、论文润色或格式检查,就先按本文件判断任务类型,不直接开始写正文。
- 用户要求“直接生成论文 / 写一篇论文 / 先出完整稿 / 一个文件”时,默认进入 Draft Mode(完整初稿模式),不是 Final Mode(可提交终稿模式)。Draft Mode 要生成结构完整、文献真实、图表充分、表格可用、可继续加工的初稿。
- 涉及中文文献、英文文献、国内外研究现状、文献综述、引言、相关工作或带引用正文时,必须先完成 S1 文献核验。Draft Mode 也必须使用真实中英文文献池;技术类、医学/生物、法学和人文社科论文只完成英文文献检索不算完成 S1,达到英文目标后必须继续检索中文文献,直到达到对应中文阈值或被明确阻塞。文献数量不足时,只有在中文链路已显式尝试 browser-task,且英文链路已通过
scholar_search或更强证据来源完成当前层级核验之后,才可以输出“待扩充引用初稿”,并必须显式标注文献缺口。 - 中文真实参考文献、GB/T 7714、CNKI/知网来源必须显式调用 Doubao browser-task(浏览器任务)。英文参考文献与引用格式可使用
scholar_search获取真实元数据,也可通过 DOI、出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料补充更强证据。不要只给检索词后直接写正文;不要把“文献后续补充”作为跳过 S1 的理由;没有与结论强度匹配的证据时,不能生成带正式引用结论的正文。 - 对未指定输出介质的论文任务,默认先生成单文件 Markdown 源稿,再继续转为飞书云文档;Markdown 是默认源稿格式,不是默认最终交付形态。只有用户明确要求仅输出对话文本、仅保留 Markdown、仅交付 docx 或明确不需要飞书云文档时,才不执行飞书云文档转换。
- 不得放宽中文文献的 browser-task 首步要求:对中文真实文献获取、正式中文引用、国内研究现状、中文文献综述和任何带中文引用正文任务,browser-task 是默认且首要的检索入口。在未显式尝试 browser-task 前,不得先调用
scholar_search、general_search、普通搜索工具、搜索面板或其他后台检索/API 工具建立中文候选文献池;“站点不在白名单”“需走通用 GUI 流程”“先找线索再验证更稳妥”都不是跳过中文 browser-task 的理由。英文文献允许使用scholar_search建立正式引用池,但general_search、普通搜索工具、搜索面板和其他后台检索/API 工具仍不能替代正式英文引用来源。 - Draft Mode 允许规划数据、模拟数值、mock 表格和图占位,但必须统一标注为
PLANNING DATA - replace before submission或“待绘制/待替换”;Final Mode 不允许保留 mock、待补图表或待核验引用。 - 不默认运行 Bash、PowerShell、
wc、Python 或本地脚本。无法读取用户本地文件时,请用户粘贴或上传内容。 - 论文正文不得使用 Markdown 加粗/斜体/emoji/项目符号制造重点,尤其不得出现
**...**、__...__、_..._。 - 从开始生成正文起,摘要、引言、贡献段、实验结论和结论中默认不得使用“首先、其次、最后、第一、第二、第三、此外、总之、值得注意的是、需要指出的是、具有重要意义”等高 AI 味连接词或空壳判断;正文默认写连续段落,不用序号或三项以上无差异顿号串拆分并列点;相邻段落/小节不得复用同一论证骨架(段首切入、句式、举例摆放、结句)。目标模板明确要求分点时,必须改成带对象、证据和边界的短编号,不得机械排比。
- 涉及文献综述、研究现状、related work、引言中的文献性判断或任何带引用正文时,正文必须显式出现文内引用标识;不能只有文末参考文献列表而正文没有挂引用。默认按目标体例输出:未指定时中文默认使用 GB/T 7714 顺序编码制的
[1]、[2]等标注;若学校/期刊模板要求著者-出版年制、脚注或其他体例,则正文必须改用对应的文内标注形式,如“作者(年份)”或脚注序号。 - 公式必须使用可渲染数学格式:Markdown/纯文本交付中,行间公式统一用
$$...$$包裹,行内变量用$...$;飞书云文档交付中优先使用云文档公式块/公式语法,不能输出纯文本下标、HTML 标签或截图式公式。 - S4 审查必须证据化,不得只下结论。交付飞书前,AI 痕迹与格式审查必须贴出正文原文证据:Markdown 装饰和模板连接词的逐字符扫描计数、相邻小节骨架对照表、强判断与顿号排比原句清单。只回答“通过/没问题”而不出示证据的,一律视为未执行审查,不得据此声称初稿完成或转飞书。
运行时以本文件为准。这个技能不是替豆包“重写写作能力”,而是在豆包已有较强中文表达能力外加少量高杠杆护栏:证据要真、事实要稳、实验要有链条、图表要完整、终稿不能混入草稿痕迹。
0. 运行原则
- 少约束句式,多约束风险:不要用大量机械禁令压制自然表达;只对文献、事实、实验、图表、终稿状态和高频 AI 痕迹设门控。
- 先判模式:默认区分 Draft Mode 与 Final Mode。Draft Mode 追求完整、像论文、可加工;Final Mode 才追求可提交和零待补。
- 引用真实,数据可规划:文献引用必须来自真实来源;实验数据、图表和结果可在 Draft Mode 中用 mock/PLANNING DATA 先搭完整初稿,但必须显式标注并可替换。
- 对话产物替代持久文件:豆包沙箱可能回收。关键状态必须在每轮末尾输出为可复制的
paper-writer-state,不能默认依赖长期存在的plan/、chapters/或本地环境。 - 中文文献必须经 browser-task,英文引用可分层取证:中文知网/CNKI、GB/T 7714 引用和中文研究现状仍必须显式触发 Doubao browser-task(浏览器任务)打开页面、检索、提取页面可见元数据和引用文本;登录、验证码、机构认证由用户手动处理。英文文献可使用
scholar_search获取真实元数据和引用格式,用于建立正式参考文献、文内引用和元数据层判断;若正文要写方法细节、实验效果、适用场景或局限边界,仍需继续补摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户材料。未形成与结论强度匹配的引用池和 evidence map 前,不进入引言、综述、相关工作或带引用正文写作。 - 不得混用英文 citation-level 与全文级证据:
scholar_search可作为英文正式引用来源,但不能单独支撑方法细节、实验结果、局限边界等全文级判断。general_search、普通搜索工具、搜索面板和其他后台检索工具不能替代正式英文引用来源;中文链路更不得先用这些工具建立候选池再补 browser-task。 - 不默认使用 Bash/PowerShell/wc/本地脚本:豆包不是稳定 CLI 环境。用户给出本地路径时,先使用平台可用的文件读取能力;若当前环境读不到文件,请用户粘贴正文或上传内容,不要用
bash、wc -l、wc -c、Python 脚本或 PowerShell 命令硬跑。不要探测任何本地隐藏技能目录、IDE 规则目录或运行目录发现命令;本技能内的references/...是打包参考标识,不是本地文件系统路径,不需要通过 shell 查找。 - 正文按论文格式输出,不按 Markdown 演示文档输出:正式论文正文默认纯文本,不使用
**加粗**、__加粗__、_斜体_、emoji 或列表制造重点;标题可以独立成行,但正文内部不得出现 Markdown 加粗或斜体标记。
1. 先判断任务大小
| 用户任务 | 处理方式 |
|---|---|
| 改一句话、改标题、润色已有段落 | 可直接处理,但若涉及事实/引用/实验结论,仍做最小核查;不得用 Markdown 加粗改写正文 |
| 单独写一节/一段,如摘要、引言、综述、讨论、结论 | 进入 S0-S5 简化流程:先判论文类型和学科分支,再按对应章节规则处理;若需要引用,先完成来源核验或明确“无引用待补版” |
| 整篇论文、毕业论文、期刊论文、学位论文、重大返工 | 默认 Draft Mode:先定类型、学科分支和结构,再建立真实文献池与图表/材料计划,然后可生成单文件完整初稿;不要默认拆成多个持久章节文件 |
| 用户要求“直接写快点” | 可压缩提问,但不跳过文献真实性、事实、实验和终稿状态门控 |
| 用户要求编造文献 | 拒绝;文献必须真实 |
| 用户要求先出实验数据、表格或图片占位 | Draft Mode 可生成 mock 表格、规划数据和图占位,但必须标注为初稿模拟/待替换 |
1.1 模式开关
| 模式 | 触发 | 目标 | 允许 | 禁止 |
|---|---|---|---|---|
| Draft Mode(完整初稿) | 用户要“写一篇论文”“直接生成”“先出完整稿”“一个文件” | 结构完整、文献真实、图表充分、可继续加工 | mock 数据、规划表格、图占位、待扩充引用清单 | 伪造文献、把占位当真实终稿、输出无图表计划的空心正文 |
| Final Mode(可提交终稿) | 用户明确说“投稿前/提交前/终稿/可提交性检查” | 零待补、证据闭环、格式可提交 | 只使用真实文献、真实数据、真实图表 | mock 数据、待补图表、待核验引用、草稿提示 |
没有明确说“终稿/投稿前/可提交”时,一律按 Draft Mode 处理。Draft Mode 不是放松文献真实性,而是允许数据和图表先以可替换的初稿形态占位。
2. 六阶段流程
S0 定位
确认任务大小、论文类型、学科分支、目标输出、已有材料、当前阶段。只问必要问题;用户已提供的信息不要重复追问。先按“整篇 / 局部章节 / 段落修改 / 格式或文献检查”判断执行粒度,再判断论文类型和学科分支。论文类型优先归入两大类:期刊论文 与 毕业/学位论文;课程论文、会议论文、开题报告可作为这两类的轻量变体处理。
最小定位字段:
- 任务粒度:整篇论文 / 局部章节 / 段落修改润色 / 文献核验 / 格式检查 / 投稿前自查
- 论文类型:课程论文 / 毕业论文 / 学位论文 / 期刊论文 / 会议论文 / 综述 / 开题 / 研究计划
- 学科分支:技术理工 / 医学与生物 / 法学 / 人文社科 / 其他
- 研究范式:实验/工程实现 / 临床或生物研究 / 规范分析 / 文本史料思辨 / 质性研究 / 量化实证 / 混合方法
- 当前模式:Draft Mode / Final Mode
- 当前任务:新写 / 改写 / 去 AI 味 / 文献核查 / 实验结果 / 终稿检查
- 输出形态:单文件完整初稿 / 分章对话产物 / 局部段落 / 飞书云文档或 docx 交付
- 已有材料:题目、摘要、文献、数据、图表、实验日志、文本/史料/案例/访谈材料、学校/期刊模板
学科分流规则:
论文学科先分文理两大目录:理工与医学走 references/stem/SKILL.md,法学与人文社科走 references/hss/SKILL.md。检测粒度保持四类,但只落到这两个学科规范目录:
| 命中条件 | 分支 | 后续路由 |
|---|---|---|
| 工程、计算机、控制、材料、机械、电子、农工、自然科学实验或算法模型 | 技术理工 | 读 references/stem/SKILL.md 第二节:技术类结构、方法可复现、实验证据链和图表要求 |
| 医学、生物、临床、护理、公共卫生、药学 | 医学与生物 | 读 references/stem/SKILL.md 第三节:IMRaD、伦理/注册/样本/统计和报告规范 |
| 法律、法条、司法解释、裁判文书、比较法、制度建议 | 法学 | 读 references/hss/SKILL.md 第二节;法条、案号和判例必须可核验 |
| 文学、历史、哲学、政治、经济、管理、社会、教育、传播、艺术、马克思主义理论等 | 人文社科 | 读 references/hss/SKILL.md 第三节;需要结构、引用体例、期刊格式或投稿清单时再读 references/hss/ 下细分参考文件 |
| 学科交叉或用户只说“文科/社科” | 先按研究方法判定 | 实证/计量/问卷走社会科学实证写法;文本、史料、概念辨析走人文学科思辨写法;法律规范问题优先走法学 |
| 无法判断 | 暂按用户材料最强线索处理 | 只问一个最关键问题,例如“这是理工实验论文还是人文社科论文?” |
默认语言:中文毕业论文、课程论文、开题报告和国内期刊论文默认用中文;SCI/英文会议/用户明确要求英文时用英文;用户提供学校或期刊模板时,以模板语言为准。信息不足时只问一个最关键问题,不连续抛出长问卷。
S1 文献与来源核验
中文文献优先按 references/literature-search/SKILL.md 子流程执行,必须先通过 Doubao browser-task 打开知网/CNKI 获取真实引用;只有 browser-task 明确不可用、登录/验证码阻塞、用户已提供可核验来源或用户明确要求手动时,才接受用户手动回填。中文引用不能只凭“我已打开知网/已检索”的口头状态生成,必须有页面可见题名、作者、来源、年份、来源链接/检索词、知网导出的 GB/T 7714 原文或用户回填的可核验元数据;缺少这些证据时必须说明“中文文献真实性核验未完成”,不得填充疑似真实的中文参考文献。英文文献允许使用 scholar_search 获取真实英文学术文献元数据和引用格式,也可通过 Doubao browser-task 打开 Google Scholar/谷歌学术引用入口、DOI 页面、出版社页面或 arXiv 页面获取更强证据。scholar_search 获取的题名、作者、年份、来源和引用格式可用于建立英文引用池、生成正式参考文献和正文文内引用标识;但若正文需要写方法细节、实验结果、适用场景、局限边界等全文级判断,仍应优先使用摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户提供的可核验材料。技术类论文(工程、计算机、医学、生物等)默认必须建立英文文献池,不能只用中文文献支撑方法与相关工作。
找文献时,默认优先选择近几年内与主题高度相关、具有代表性且可核验的来源;在时间范围相近时,可以适度优先高引用文献,但不强求“最新一年”或“最新版本”文献。若某一方向存在基础方法原始论文、经典综述、标准指南、关键政策文本或领域公认代表作,即使年份较早,也应保留为基础支撑来源。
涉及文献综述、研究现状、related work、引言中的文献性判断或任何带引用正文时,正文中的文献句必须显式挂文内引用标识,而不是只在文末给一组参考文献。未指定体例时,中文默认使用 GB/T 7714 顺序编码制 [1]、[2];学校、期刊或学科模板明确要求著者-出版年制、脚注注释或其他体例时,正文必须改用对应的作者-年份、脚注序号或模板规定形式。没有文内引用标识的文献综述、相关工作或研究现状,不视为完成。
若任务是中文论文、毕业论文、国内研究现状、中文文献综述,或用户要求“真实参考文献/知网/CNKI/GB/T 7714”,必须先触发 browser-task 走 CNKI;只有 browser-task 明确不可用、登录/验证码阻塞或用户已提供来源时,才进入手动回填。若任务涉及英文 related work、国外研究现状、技术基础文献或英文参考文献,可优先使用 scholar_search 建立英文引用池,也可触发 browser-task 走 Google Scholar/谷歌学术、DOI/出版社页面或 arXiv 页面补充更强证据。只有 scholar_search 元数据时,可生成正式英文参考文献和元数据层判断,但不能直接把方法细节、实验效果或局限分析写成正文结论;这类全文级判断仍需摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户回填的可核验材料。完整初稿任务若尚未完成 S1,下一步必须是继续补足中文引用池,或补齐英文正文判断所需的更强证据,不能直接跳入无依据的 S2/S3 写作。
英文文献池和中文文献池是两个独立门槛。技术类、医学/生物、法学和人文社科论文如果已完成英文文献检索,但中文文献未达到阈值或尚未触发 CNKI/中文来源检索,必须继续执行 references/literature-search/SKILL.md;不得以“英文文献已经够了”“先写后补中文”结束 S1。若本轮时间、浏览器、登录或验证码导致中文检索未完成,状态块 下一步 必须明确写:请使用 /browser-task 继续搜索中文文献,并补足 CNKI/中文来源引用池。
Draft Mode 文献阈值:
| 类型 | 总文献目标 | 英文文献目标 | 中文文献目标 | 不足时处理 |
|---|---|---|---|---|
| 技术类期刊论文 | 至少 30 篇 | 英文至少 20 篇,且包含基础方法原始文献 | 中文至少 10 篇,用于国内应用和中文研究现状 | 可生成待扩充引用初稿,但必须列出缺口 |
| 技术类毕业/学位论文 | 至少 30 篇 | 英文至少 20 篇 | 中文至少 10 篇 | 可生成完整初稿,但参考文献清单标注“待扩充” |
| 医学/生物/临床论文 | 按研究类型通常至少 20-40 篇 | 英文指南、原始研究、系统综述或临床研究来源为主 | 中文指南、共识和本土研究按需要补充 | 可生成待扩充引用初稿,但伦理、样本、注册、统计和报告规范缺口必须列出 |
| 法学论文 | 通常 20-40 篇/项,含学术文献、法律文件、案例或域外法材料 | 比较法或域外制度研究时补充外文来源 | 中文法学核心文献、法律文件、司法解释、裁判文书为主 | 可生成待扩充引用初稿,但法条、案号、判例和制度来源缺口必须列出 |
| 人文社科期刊论文 | 通常 15-25 篇,目标期刊另有要求时从其规定 | 视选题需要补充,涉及国外理论/比较研究时至少 5 篇 | 中文 CSSCI/核心/权威来源为主 | 可生成待扩充引用初稿,但必须列出中文核心文献、经典文献或外文理论缺口 |
| 人文社科学位论文 | 通常 30-60 篇,学校要求优先 | 视选题需要补充,涉及国外研究综述时应有外文来源 | 中文期刊、学位论文、专著、政策/史料来源按范式配置 | 可生成完整初稿,但文献综述、理论框架和材料来源必须标注待扩充项 |
| 课程论文/开题报告 | 10-15 篇 | 视学科至少 5 篇 | 视题目补充 | 可先输出初稿和检索清单 |
技术类论文的英文基础文献至少覆盖:基础检测器、特征融合、注意力机制、损失函数、数据集/领域方法。没有真实英文来源时,不生成“完整相关工作终稿”;Draft Mode 可生成相关工作初稿,但必须列出 [待补英文文献:类别]。
高风险规则:
- 不凭模型记忆生成参考文献。
- 不把普通搜索工具、OpenAlex/Semantic Scholar 元数据或搜索结果摘要当作已核验参考文献。英文文献的
scholar_search元数据可用于正式参考文献、文内引用和元数据层判断,但不能单独支撑方法细节、实验效果、局限边界等全文级结论;这类结论必须再结合摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户提供的可核验材料。 - 不假装已经打开知网/CNKI 后填充中文引用;没有 browser-task 页面可见证据、知网导出文本或用户可核验回填时,必须停止并提示无法完成中文文献真实性核验。
- 不把 GitHub 仓库自然替代为正式论文;仓库只能作为软件/代码资源引用。
- 重复文献必须去重。
- 参考文献格式必须统一到用户指定标准;未指定时中文默认 GB/T 7714。
- 只找到英文文献不算完成文献核验;中文文献数量不足或未核验时,阶段保持 S1,不进入 S2/S3。
- 发现疑似编造、模型记忆生成、来源不明或数量不足的参考文献时,必须删除或标为待核验,并继续检索补足;不能为了凑数保留。
S2 证据图与段落蓝图
写引言、文献综述、相关工作、讨论、结论或任何引用驱动段落前,先建立简化证据图。
| ID | 来源/材料 | 类型 | 可直接支持的事实 | 可写入正文的判断 | 使用位置 | 风险 |
|---|---|---|---|---|---|---|
然后为正文段落建立轻量蓝图,只约束论证角色,不限制具体句式:
### 段落 N
- 角色:背景 / 方法脉络 / 局限 / 缺口 / 本文处理 / 结果解释 / 收束
- 主判断:
- 作者处理意图:这些材料为什么放在本段,作者要把读者引向哪个有限判断
- 证据 ID:
- 边界或限定:
- 段首切入方式:本段第一句用什么角度进入(与相邻段不同)
- 禁止写入:草稿说明、提示词、AI 来源说明、无依据强结论
蓝图可见性规则(这是防拼凑的核心工序,不是可选装饰):
- 整篇论文或整节(如整章文献综述、整节实证分析、多个并列小节)写作前,段落蓝图必须显式打印出来,不得内化跳过。只有单段落任务才允许把蓝图放在脑子里。
- 相邻段落、相邻小节禁止复用同一论证骨架。骨架指四件事:段首切入方式、句式结构、举例/引用的摆放模式、结句方式。若相邻两三段的"角色—段首切入—句式—结句"高度相似,说明是生成骨架在复制,必须先改蓝图再写正文。
- 反面样例(真实失败案例,写作时必须避免):
- 每个小节都写成"访谈发现 X 对 Y 有影响。如果……反之如果…… 一位家长说'……' 另一位家长则表示'……'"——同一骨架套满 4.5.1 到 4.5.5。
- 连续小节全部以"第一,……。第二,……。第三,……"顺序排列,每点只有一句空泛判断。
- 一整段每句都是"以……全面融入……""正在重塑……、拓展……、提升……"的连续动宾排比。
- 出现以上任一模式时,蓝图阶段就要为每段重新分配不同的切入角度、证据组织方式和结句功能,而不是等写完再补救。
Draft Mode 中 evidence map 可在证据充分时压缩展示,但段落蓝图在整篇/整节任务中必须可见;文末 paper-writer-state 汇总文献池、图表计划、mock 数据和待替换项。
S2.5 论文类型结构与图表计划
Draft Mode 生成整篇论文前,先按论文类型套结构:
| 类型 | 默认结构 |
|---|---|
| 技术类期刊论文 | 题目;摘要;关键词;1 Introduction(通常连续段落,不拆过多小节);2 Related Work;3 Proposed Method;4 Experiments and Results;5 Discussion;6 Conclusion;References |
| 技术类毕业/学位论文 | 摘要;Abstract;第1章 绪论;第2章 相关理论与研究现状;第3章 方法设计;第4章 实验与结果分析;第5章 讨论;第6章 结论与展望;参考文献;致谢(如需要) |
| 人文社科期刊论文 | 题目;作者信息(如需要);摘要;关键词;引言/问题提出;文献综述或研究述评;理论框架/概念界定/研究设计;正文论证或实证分析;结论与讨论/政策建议;参考文献/注释 |
| 人文社科学位论文 | 摘要;Abstract;绪论;文献综述;理论基础/概念界定/研究设计;主体章节(按问题、材料、案例或实证结果展开);结论与展望;参考文献;附录/致谢 |
| 综述论文 | 摘要;引言;检索策略;主题综述;比较分析;研究不足;结论;参考文献 |
人文社科结构选择规则:
- 文史哲、艺术、马克思主义理论等偏文本、史料或概念辨析的论文,默认使用“问题提出—文献述评—理论/概念—分论点论证—结论”的递进结构。
- 政经管社教传等若采用问卷、访谈、统计或案例材料,默认使用“问题提出—文献综述—理论框架/研究假设—研究设计—结果分析—讨论结论”的社会科学结构。
- 法学论文不直接套普通人文社科结构,优先使用法学的“问题提出—现行规范及不足—解释/案例/比较分析—完善建议—结语”结构。
- 用户提供学校、期刊或导师模板时,模板优先;本表只用于缺省结构判断。
技术类 Draft Mode 图表最低目标:
- 期刊论文:至少 3-5 个图占位、2-4 个表格。
- 毕业/学位论文:至少 6-8 个图占位、5-7 个表格。
- YOLO/CV/缺陷检测常用图:技术路线图、整体网络结构图、注意力模块图、特征融合结构图、数据集样例图、训练曲线/PR 曲线、检测结果对比图、复杂场景示例图。
- 常用表:数据集划分表、实验环境表、消融实验表、SOTA 对比表、各类别 AP 表、模型复杂度/FPS 表、复杂环境测试表。
S3 正文写作
正文应是连续、自然、学术化的中文段落。避免列表堆砌,但不要把去 AI 化误解为极端压缩。
正文分点默认关闭(这是高频 AI 痕迹来源,必须按门控处理):
- 正文默认写成连续段落,不用"第一/第二/第三""首先/其次/最后"或数字编号把一段拆成并列点。只有目标期刊/学校模板明确要求列表(如贡献列表),且每一点都带具体对象+证据+边界时,才允许短列表,且列表后要接连续解释段。
- 顿号并列(A、B、C)必须承载真实差异或真实层级,不做无意义排比。反面样例:"以新理念、新业态、新模式全面融入经济、政治、文化、社会、生态文明各领域"——这类三项以上、无差异、纯为凑气势的顿号串必须改写为有对象、有条件的具体陈述。
- 同一段内、相邻段之间禁止连续复用同一句式骨架。反面样例:连续小节全是"第一……第二……第三……"、每句都是同一动宾结构排比、每个小节都是"发现X影响Y。如果…反之…一位说'…'另一位说'…'"。出现即按 S2 蓝图重排切入角度和句式,不是换几个同义词。
写作时保留豆包的自然表达能力,只执行这些护栏:
- 强判断必须有证据或边界,例如“显著”“主流”“最具代表性”“全面验证”“满足工业实时检测需求”。
- 凡是转述他人观点、方法、数据或结论,或写文献综述、研究现状、related work、引言中的文献判断的句子,落笔时就在句内或句末挂上文内引用标识:GB/T 7714 顺序编码制的
[2]、[3],或著者-出版年/人名形式(如“李四(2021)”“Smith et al. (2020)”)皆可,全篇统一一种。不要等全文写完再统一补,也不要只在文末列参考文献而正文不挂——正文漏挂引用是本链路最常见的缺陷,写的时候就要挂住。 - 同一结论不要在摘要、引言、方法小结、讨论、结论中反复换词复述。
- 去 AI 味不是降重式同义词替换。优先检查段落功能、作者判断链和重复骨架:这一段为什么存在、依据什么材料、作者怎样处理这些材料、结论边界在哪里。
- Draft Mode 交付前也要做一次语言闸门:摘要、引言和贡献段不得成组堆叠“首先/其次/最后”“实验结果表明”“有效性/鲁棒性/显著提升/重要意义”等模板表达;若这些词没有绑定具体对象、指标、实验条件或文献边界,先改写为有限判断或删除。
- 语言闸门不只在交付前执行,也在开始生成正文时执行:摘要、引言、贡献段、实验结论和结论默认不写“首先、其次、最后、此外、总之、值得注意的是、需要指出的是、具有重要意义”。若确需排序,用研究对象或证据关系承接,不用空泛连接词堆流程。
- 摘要默认用“研究问题—方法处理—主要结果—边界”的连续叙述,不把三个模块机械写成“首先、其次、最后”。引言贡献段默认说明本文相对现有工作的具体处理,不用“第一、第二、第三、第四”长串口号式列举,除非目标模板明确要求贡献列表。
- “以……作为”“用于……”“通过……实现”等学术表达本身不禁用;只在同一段或相邻段机械重复、且缺少对象、证据或边界时调整。不得为了降低 AI 痕迹牺牲术语准确、语法正确或论文正式度。
- 术语解释围绕本文方法和实验条件,不写百科词条式通用介绍。
- Draft Mode 缺真实实验数据时,直接生成带
PLANNING DATA - replace before submission标注的 mock 表格和结果分析初稿;Final Mode 缺数据时才降级为待补说明。 - 缺图时使用统一图占位,不写“注:实际论文中需插入”。格式:
图 X-X 待绘制:图题。内容要求:...。 - 任何“部分内容由豆包生成”、计算纠错、提示词、过程说明都不得进入论文正文。
- 正文不得出现
**预训练与迁移学习**、__预训练与迁移学习__、_预训练与迁移学习_这类 Markdown 装饰;若需要强调,改为普通小标题或自然段主题句。
S4 六项审查(证据化,不得只下结论)
同上下文自检的固有局限:S4 是同一个模型在同一段上下文里检查自己刚写的正文。如果只让它回答"有没有 AI 痕迹/格式对不对",它会顺着"我应该避免了"直接勾"通过",而不真去读正文——这正是"明明满页第一第二、Markdown 加粗,却审查通过"的根源。因此本节的硬要求是:每一项审查都必须贴出正文原文证据,只有结论、没有引文,视为未执行审查,不得交付。
Final Mode 交付前逐项做完并附证据。Draft Mode 不以全部通过为交付前提,但同样要附证据、把未满足项如实列入初稿说明和状态块,不得写"语言已处理完成"。
- 文献:真实、去重、格式统一、引用对象合理。证据:列出参考文献条数、随机抽 2-3 条给出其来源核验方式(browser-task 页面/scholar_search/用户回填)。
- 文内引用覆盖(逐段扫描,给计数):逐段扫描正文中转述他人观点、方法、数据、结论的句子和文献综述/研究现状/related work/引言文献判断段落,报告"应挂引用的句子数 / 实际挂了引用的句子数",并逐条摘出漏挂引用的原句。文内引用形式(
[2]、著者-出版年、人名年份)须全篇统一。发现漏挂立即补挂或删句,不得只在文末列参考文献。缺口未补前不得声称初稿完成或转飞书。 - 事实:版本、术语、方法全称、数据集、领域地位可核实。证据:摘出正文中每一处"最新/主流/最具代表性"等强判断原句,逐句标注其依据或已降级。
- 实验:指标、表格、数据划分、日志、图等证据链足够支撑结论。证据:摘出每条"显著优于/全面验证"类结论原句,对应到具体表格或标注为 PLANNING DATA。
- 格式完整性(逐字符扫描,给计数):
- Markdown 装饰:逐字符扫描全文,报告
**、__、_..._、emoji 的出现次数;必须为 0,否则贴出每一处命中原文并修复。 - 公式:摘出公式样例,确认行间用
$$...$$、行内用$...$,无裸下标/HTML 标签。 - 图表编号:列出正文出现的每个图/表编号,逐一标注"有内容/有占位说明"。
- 参考文献:确认逐条分段、无
[1][2][3]粘连。
- Markdown 装饰:逐字符扫描全文,报告
- AI 痕迹(逐段出对照表,不是打勾):
- 模板连接词:逐字符扫描"首先/其次/最后/第一/第二/第三/此外/综上所述/值得注意的是",报告出现次数与所在段;正文中出现即贴原句并说明是模板堆叠还是真实层级。
- 骨架复用:为相邻小节做一张对照表,列出各段的"段首切入方式 + 主句式 + 结句方式";若相邻段三项高度雷同(如都是"发现X影响Y。如果…反之…一位说'…'另一位说'…'"),判定为拼凑,必须重写。
- 顿号排比:摘出三项以上的顿号并列句,逐句判断是否承载真实差异,无差异的凑气势排比必须改写。
- 价值宣传:摘出"重塑/拓展/提升……"这类连续动宾排比句,改为有对象、有条件的具体陈述。
审查输出模板(每项都要有"证据"行,不能只写"通过"):
### S4 审查(附证据)
1 文献:结论 + 抽查条目及其来源
2 文内引用覆盖:应挂引用句数 / 实际挂引用句数 + 漏挂原句清单 + 引用形式是否统一
3 事实:结论 + 强判断原句清单及依据
4 实验:结论 + 强结论原句清单及对应证据
5 格式:`**`×N / emoji×N / 公式样例 / 图表编号逐项 / 参考文献分段
6 AI 痕迹:模板词扫描计数 + 相邻小节骨架对照表 + 顿号排比清单
未修复风险:
S5 状态交付
每轮结束输出可复制状态块。若本轮只完成一个小修改,也至少说明当前风险。
<!-- paper-writer-state v1 -->
阶段:S0/S1/S2/S3/S4/S5
模式:Draft Mode / Final Mode
论文类型:
学科:
目标输出:
已确认材料:
文献阈值:目标总数 / 目标英文 / 目标中文 / 当前完成
应使用参考:
实际使用参考:
未使用资料及原因:
已核验文献:
待核验文献:
证据图摘要:
图表计划:目标图数 / 目标表数 / 已生成占位 / 已生成表格
Mock/PLANNING DATA:表格编号、用途、待替换项
当前章节/段落:
缺失材料:
高风险问题:
正文格式检查:是否残留 `**...**`、`__...__`、`_..._`、emoji 或列表化正文
下一步:
<!-- /paper-writer-state -->
3. 典型问题对应护栏
| 典型问题 | 护栏 |
|---|---|
| 中文文献伪造或高度可疑 | 先走 CNKI/真实来源核验;无法核验则标为待核验,不进入正式参考文献 |
| 英文文献重复、仓库替代论文 | 去重;区分论文引用和软件资源引用 |
| 实验结论过满 | 强结论必须绑定指标、数据划分、日志或图表;否则改为限定表达 |
| 术语/版本事实错误 | 对“最新”“主流”“全称”“代表性”等词做事实核查 |
| 图号存在但无图 | 交付前检查所有图表编号;缺失则补占位说明或列为待补 |
| Draft Mode 表格只写“待补” | 直接生成带表题、列头、单位和 mock/TBD 行的表格,并标注 PLANNING DATA |
| 期刊论文写成毕业论文结构 | 重新按期刊结构输出,不默认拆成六章;引言通常连续段落,不分过多小节 |
| 公式、表格、标题或参考文献格式粘连 | 公式用可渲染格式;Markdown/纯文本交付中行间公式用 $$...$$,飞书云文档交付中用公式块/公式语法;结构化内容用表格;标题独立成行;参考文献逐条分段 |
| AI 来源说明和思维残留混入正文 | 终稿状态检查中删除过程性文字 |
| 摘要/讨论/结论反复复述 | 给每个区域分配不同功能:摘要报结果,引言立问题,讨论解释边界,结论收束贡献 |
| 模板句和翻译腔 | 优先补足对象、条件、证据和边界,再调整中文语序;不要只做同义词替换 |
3.1 Red Flags:停止并检查
| AI 的想法 | 正确做法 |
|---|---|
| “用户只是说写论文,我先写一版。” | 先 S0 定位论文类型、学科、材料和任务范围。 |
| “中文参考文献我可以凭常识补几条。” | 停止。先走 CNKI/知网或用户提供来源;无法核验则标待补。 |
| “英文参考文献我可以凭模型记忆补几条。” | 停止。先用 scholar_search 获取真实英文文献元数据与引用格式,或用 browser-task/DOI/出版社页面/用户材料补充更强证据;没有可核验来源就标待补。 |
| “英文文献已经找了几篇,我可以先不找中文。” | 停止。技术类、医学/生物、法学和人文社科论文必须继续执行 references/literature-search/SKILL.md 或中文来源检索;中文阈值未达标时,阶段保持 S1。 |
“browser-task 可能不好用,我先用 direct search、general_search 或普通搜索找候选,再去验证。” |
停止。中文链路必须先显式尝试 browser-task;若被登录、验证码、机构认证或环境能力阻塞,直接转用户手动回填,不得先用直接搜索建立候选池。英文链路可用 scholar_search 建立正式引用池,但不能把普通搜索当作正式来源。 |
“scholar_search 或搜索工具已经返回题名、作者和年份,我可以直接整理参考文献。” |
分情况处理。若是英文文献且 scholar_search 返回的元数据和引用格式完整,可整理正式英文参考文献并挂正文引用;若要写方法细节、实验结果或局限边界,仍需继续补摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户回填材料。中文文献仍不得这样处理。 |
| “正文里先不挂引用,最后统一列个参考文献列表就行。” | 停止。文献综述、相关工作、研究现状、引言中的文献判断和其他带引用正文,必须在正文显式挂文内引用标识;文末参考文献列表不能替代正文引用。 |
| “没触发 browser-task,我先把参考文献格式补上。” | 分情况处理。中文引用格式必须先触发 browser-task 或要求用户回填;英文引用格式可来自 scholar_search、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户回填的可核验元数据。 |
| “文献后续再补,我先规划结构或写初稿。” | 停止。涉及引用、研究现状、引言、综述或 related work 时,S1 是前置门控;先启动 browser-task,或在明确阻塞后输出检索策略/回填表,不进入 S2/S3。 |
| “浏览器任务或知网不可用,那我先把正文写完。” | 只有在已经显式尝试 browser-task 且明确不可用、登录/验证码/机构认证阻塞,或用户选择手动回填时,Draft Mode 才可生成无正式引用结论的待补引用版;Final Mode 必须停止。 |
| “数量不够或有几条像编的,但先继续写。” | 停止。删除或标记疑似编造条目,继续 S1 检索;本轮无法继续时,在 paper-writer-state 的下一步写明“请使用 /browser-task 继续搜索文献”。 |
| “用户给了本地路径,我用 Bash/wc 看一下。” | 不默认使用 shell;改用平台读取能力,读不到就请用户粘贴或上传。 |
| “我先在本地文件系统搜索可用技能目录。” | 停止。不要探测任何本地隐藏技能目录、IDE 规则目录或运行目录;直接按当前已加载的技能说明和本文件的打包参考路由执行。 |
| “加粗小标题更清楚。” | 论文正文不用 **...**;改用普通小标题或自然段主题句。 |
| “公式我先用 NQP_{i,t} 或 写,后面再改。” | 停止。Markdown/纯文本行间公式必须用 $$...$$,行内变量用 $...$;飞书云文档用公式块/公式语法,不输出未渲染下标或 HTML 标签。 |
| “规划数据也可以写成实验结果。” | Draft Mode 可写“基于规划数据的初稿分析”,并在表题/状态块标注 PLANNING DATA;Final Mode 不允许。 |
| “写完后简单说通过。” | 执行 S4 六项审查并附原文证据;有未修复风险时不得说可提交。 |
| “S4 我心里过了一遍,没 AI 痕迹、格式没问题,直接转飞书。” | 停止,这是自欺。没有逐字符扫描计数、没有相邻小节骨架对照表、没有强判断原句清单,就是没审查。先按 S4 证据化模板贴出证据,再谈交付。 |
| “正文分点/顿号排比更清楚,先这么写。” | 停止。正文默认连续段落;第一二三、数字编号、三项以上无差异顿号串默认关闭,仅模板要求且每点带对象+证据+边界才允许。 |
| “几个小节都用同一套‘发现X影响Y,如果…反之…一位说…另一位说…’也挺整齐。” | 停止,这是拼凑。相邻小节禁止复用同一骨架;回到 S2 蓝图为每段重排切入角度、句式和结句。 |
4. 总参考索引
本文件不在这里平铺列出所有子参考。统一先读取 references/README.md,再按其中的总表进入对应模块。参考目录分两层:
- 通用能力层(跨学科共用,在
references/顶层):literature-search(中文检索门控+英文文献池)、literature-review(综述组织)、evidence-driven-writing(证据图/实验协议/图表协议)、writing-chapters(章节方法)、writing-core(中文语言与去 AI 味)。 - 学科规范层(个性下沉):
references/stem/SKILL.md(理工+医学)、references/hss/SKILL.md(法学+人文社科,下含六份细分参考文件)。
执行顺序:
- 仍然先以本文件的 S0-S5、Draft/Final Mode 和红线规则为最高优先级。
- 需要细化路由时,读取
references/README.md。 - 在
references/README.md中选择对应的通用能力模块或学科规范目录。 - 执行子参考后,回到本文件当前阶段与
paper-writer-state,不另建持久流程。
references/README.md 只回答“这次该读哪个参考”,不替代本文件的阶段门控,也不放宽 S1 文献真实性、S4 审查和 S5 状态交付要求。
本地工具链(Python 画图、LaTeX、统计脚本、conda 环境)属于用户本地环境的历史参考,不作为豆包沙箱默认承诺;不要在豆包流程中主动读取或调用这些本地工具链。
5. 输出风格
- 中文论文正文优先连续段落,少用列表。
- 段落可以有必要承接和限定,不追求每句都短。
- 正文生成阶段默认不用“首先、其次、最后、此外、总之、值得注意的是、需要指出的是、具有重要意义”等高 AI 味模板词;摘要、引言和结论若需要承接,改为对象、条件、数据和边界驱动的自然承接。
- 不用正文加粗、斜体、emoji 或 Markdown 装饰来制造重点;论文正文中不得输出
**...**、__...__、_..._。 - 涉及文献性判断的正文必须显式挂文内引用标识;未指定体例时中文默认使用 GB/T 7714 顺序编码制
[1]、[2],学校/期刊模板要求著者-出版年制、脚注或其他体例时,按模板在正文中输出对应标注。 - 用户未指定输出介质时,默认先生成单文件 Markdown 源稿,再继续转为飞书云文档;Markdown 是默认源稿格式,不是默认最终交付形态。
- 若用户明确要求仅输出对话文本、仅保留 Markdown、仅交付 docx,或明确不需要飞书云文档时,才不执行飞书云文档转换。
- 创建或更新飞书云文档时,必须先按本技能完成论文内容、引用、图表和公式规范;公式必须落为公式块/公式语法或保留可转换 LaTeX 源。
- 若当前会话缺少飞书登录、权限或云文档能力,必须明确说明“已完成 Markdown 源稿,待转飞书云文档”,不得把对话中的纯文本正文视为最终交付完成。
- 用户提供学校/期刊模板时,以模板为准。
6. 完成标准
Draft Mode 只有同时满足以下条件,才能说“初稿完成”:
- 已按论文类型使用正确结构;期刊论文不默认写成毕业论文六章结构。
- 整篇/整节写作已显式打印段落蓝图,相邻段/相邻小节没有复用同一论证骨架。
- 已按 S4 证据化模板执行审查并贴出原文证据:Markdown 装饰与模板连接词的逐字符扫描计数、相邻小节骨架对照表、强判断与顿号排比原句清单。只勾"通过"而无证据的,视为未审查,不得声称初稿完成,也不得转飞书。
- 单文件初稿包含标题、摘要、关键词、正文、图表占位/表格、参考文献、初稿说明和
paper-writer-state。 - 用户未指定输出介质时,已生成单文件 Markdown 源稿,并已完成飞书云文档转换;若因登录、权限或环境能力阻塞未完成转换,已在初稿说明和状态块中明确记录。
- 文献综述、相关工作、研究现状、引言中的文献判断和其他带引用正文,已显式挂上文内引用标识;没有出现“文末有参考文献但正文未引用”的情况。
- 技术类论文已建立真实中英文文献池;未达阈值时明确列出待扩充英文/中文文献类别。
- 医学/生物/临床论文已标注研究类型、伦理/注册/样本/统计/报告规范状态;未具备真实来源时不得编造伦理号、注册号、样本量或统计结果。
- 法学论文已列明学术文献、法律文件、司法解释、裁判文书或域外法材料来源;未核验的法条、案号、判决结果和制度事实不得写成终稿事实。
- 人文社科论文已建立真实中文核心文献、经典文献、史料/政策/案例/访谈等材料来源清单;涉及国外理论、比较研究或国外研究现状时,已建立真实外文来源池;未达阈值时明确列出待扩充类别。
- 图表数量达到 Draft Mode 目标,或在状态块说明缺口。
- mock 表格和规划数据已标注
PLANNING DATA - replace before submission。 - 公式使用可复制的 LaTeX 数学格式。
- Markdown/纯文本交付中的行间公式已用
$$...$$包裹;飞书云文档交付中的公式已按云文档公式块/公式语法处理或明确保留可转换 LaTeX 源。 - 摘要、引言、贡献段、实验结论已完成 AI 痕迹自查:没有成组模板连接词、无支撑强判断、宣传式价值判断或跨章节同义复述;无法消除时在初稿说明中列为待改风险。
Final Mode 只有同时满足以下条件,才能说“可提交”或“终稿完成”:
- 已说明使用了哪些材料和哪些材料仍待核验。
- 已说明应使用和实际使用了哪些参考;未使用的材料有原因。
- 用户未指定输出介质时,最终交付默认已落在飞书云文档;若未完成云文档转换,已明确说明登录、权限或环境能力阻塞,且不能宣称“终稿完成”。
- 文献综述、相关工作、研究现状、引言中的文献性判断和其他带引用正文,已按目标体例显式挂上文内引用标识;文末参考文献与正文引用一一对应。
- 引用、文内引用覆盖、事实、实验、图表、AI 痕迹六项没有未说明的高风险问题。
- 中文文献或研究现状任务没有跳过 CNKI/用户来源门控。
- 英文文献或国外研究现状任务已按证据层级处理:
scholar_search元数据可用于正式引用和元数据层判断;方法细节、实验结果和局限边界等全文级判断已补摘要、DOI/出版社页面、arXiv 页面、browser-task 页面可见内容或用户来源。 - 没有把
scholar_search、普通搜索工具、OpenAlex/Semantic Scholar 元数据或搜索摘要当作已核验参考文献。 - 正文没有
**...**、__...__、_..._、emoji 或列表化正文残留。 - 输出了本轮结果和
paper-writer-state。 - 若存在缺图、缺日志、缺来源或待核验文献,已明确标注,未伪装成终稿事实。