学术论文与投稿材料
研究生学位论文开题报告使用 graduate-opening-report;已有文本的局部润色、压缩或语气校准只用 academic-humanizer;从零起草论文部件、完整初稿、投稿材料或结构性重写才使用本 skill。实际 Word 读写另加 docx。
1. 确认写作依据
写作可使用以下任一已经确认的来源,不把项目目录结构当作内容前置条件:
- 第 2 版结构的
results/results.yaml,以及与这些结果对应的成功运行记录; - 已验证的正式表格、图件或统计输出;
- 用户明确指定的稿件、章节或审稿意见;
- 有明确身份、版本和授权的外部正式结果。
同一数字存在多个版本、结果与表图冲突、分析集或方向不明时先停下核验。没有项目结果清单不自动中止局部或外部结果写作,但必须标明本轮采用的唯一结果来源及未能核验的范围。不得从方法或趋势猜数字、研究发现、引文、伦理号、基金号、作者信息或期刊要求。
2. 决定稿件模式
- 论文大纲:仅在用户明确要求提纲、框架、章节计划或写作路线时交付。大纲可以只说明章节功能、核心论点、证据位置和待补材料,但必须明确标为大纲,不得用
manuscript文件名、IMRaD 标题或“初稿”把它包装成已经生成的论文。 - 单部件或局部产物:直接完成用户指定的部件,并检查相关数字、引文和交叉引用;不创建修订记录文件、章节目录或项目记录文件。
- 完整论文:用户要求“生成论文”“写论文”“完成稿件”或同等含义时即进入本模式,不另等用户补充“完整”二字。以能够进入投稿准备为目标,先按 流行病学稿件约定与适用要求 锁定成品用途、研究设计、estimand、实际采用的方法与报告规范、章节功能、表图计划和三层验收,再逐项列出每个结果论断、方法事实和引文的来源并建立逐部分内容矩阵。按章节功能完成内容完整的正文并做全文一致性终审。矩阵至少记录本部分的研究问题/功能、唯一输入和证据、实际采用的设计与方法要求、主要变量或终点、方法/结果/讨论衔接、预期输出、篇幅预算、前置依赖、阻断项和验收证据;按行生成和验收,关闭一行后再进入下一行。正文段落必须完成与其位置相称的科学论证,不得用一两句或几十字的短段代替方法细节、结果关系、文献比较、解释和边界。章节标题齐全、数字能够自动插入或文件已经生成,都不能单独证明论文已经完成。不得因通用流程强制拆成多轮审批,也不得擅自降级为提纲、短版骨架或自动取数模板。
- 结构性重写或多轮投稿修订:论文级结构性重写同样先执行
manuscript-contract.md,再按研究问题和证据关系分部件推进。只有跨轮、多人,或净稿、标注稿和回复需要由同一份修改记录生成时,才使用revision-state.json。
完整论文、投稿准备、写作全过程或项目内正式稿任务在创建文件前明确文件交付要求:正文唯一来源格式、实际交付文件清单、模板来源、表图是嵌入还是单独提交、含义明确且长期使用的文件名、需要调用的文件 skill 和每种文件的验收证据。先采用用户明确要求,再采用已经核验的期刊模板或项目既有约定;用户只要当前回复中的正文时直接交付净稿,不创建文件。任务明确要求形成可使用的正式文件,但格式无法从这些来源确定时,先确认 Markdown、Quarto、R Markdown、Word、LaTeX 或其它目标,不得默认推断为 Word,也不得把未约定的 Markdown 源稿称为完整文件交付。
目标期刊未定时生成内容完整、格式中性的学术稿,使用研究设计适配的结构,并把期刊依赖的字数、摘要标签、参考文献样式、图件格式和声明位置列为待适配项;期刊未定只影响这些格式选择,不得据此把正文降为短版骨架。这里的“以投稿为目的”指内容、证据、报告和表图达到可进入投稿适配的状态,不等于在作者、伦理、期刊格式或其它必要材料仍缺失时声称可以立即投稿。证据不足以完成相应章节时,明确交付“部分草稿”并列出缺口,不得用“中性初稿”掩盖内容未完成。
已有目标期刊时核验其当前官方 author instructions。官方要求只覆盖该期刊的格式、文章类型和投稿材料默认;不得覆盖用户当轮明确指示、原始数据保护、科研诚信、伦理、法规和证据强度边界。
3. 内容生成
完整稿或论文级结构性重写必须按下列条件读取并在写作过程中执行:
- 所有完整稿:内容与章节功能。
- 含量化估计、统计模型或定量证据综合的稿件,以及混合方法稿件中的量化部分:统计报告。纯质性研究、叙述性综述或不含量化结果的论文不读取该文件,按实际研究类型和经核验报告规范确定证据呈现要求。
- 所有完整稿或论文级结构性重写:流行病学稿件约定与适用要求。约定需要跨命令或跨文件传递时,使用其中的任务级 JSON,并运行
scripts/validate_manuscript_contract.py;局部部件不因此建立整篇约定。 - 所有完整稿或论文级结构性重写:写作前用
evidence-research核验正文将使用的既有证据、适用的报告规范,以及已经确定的目标期刊要求。已有核验记录时先检查来源身份、版本、适用性和时效;仍然有效时沿用,不为形式重复整套检索。 - 所有中文论文和学位论文:在各部件写作与终审中执行 共用中文语言编辑门控,并用 中文稿内容、结构与语言检查 核对论文部件功能。前者统一维护事实保真、句段编辑、因果强度、术语和高风险表达;本 skill 不另建同义语体规则。
- 中文期刊稿:中文期刊。
- 英文稿:英文写作 和 英文功能表达与证据约束;后者用于时态、衔接、hedging 和模板痕迹审查,不复制套句。
- 单个论文部件或投稿材料需要新增或核验引文、方法依据、报告规范或目标期刊要求时,同样先用
evidence-research核验。
专项统计方法只读取稿件实际采用的对应 reference,未采用时不读取、不检查,也不补做:
- 实际采用 MCA 或 PCA:MCA 与 PCA 报告要求。
- 实际采用交互作用、效应修饰或亚组分析:交互作用与亚组分析报告要求。
- 实际采用 Bootstrap 或其它重抽样估计:Bootstrap 与重抽样报告要求。
- 实际采用分位数回归:分位数回归报告要求。
- 实际构建、验证或比较预后模型、风险评分或分期系统:预后模型与风险分层稿件要求。
- 采用其它专项方法:使用相应分析 skill,并由
evidence-research核验方法依据和适用报告规范;不得选择名称相近的上述分支代替。
“读取最少必要参考”是排除与当前稿件无关的语言、论文类型或投稿材料分支,不是跳过适用的内容规范。
以下变体和投稿检查按任务选择:
- 中文学位论文:references/chinese-thesis.md
- 投稿材料:references/submission-materials.md
- 投稿前高风险问题:references/review-killers.md
- 正式投稿、返修提交、外发或归档:references/submission-signoff.md。它复用已经完成的研究事实、分析、引文、返修和文件证据,只形成一次投稿前确认结论;局部润色、单项修正和纯版式修改不触发。
结构由研究问题、研究设计、estimand、证据关系、表图和真实篇幅决定,不固定段数、列表数量或讨论模板。完整稿和论文级结构性重写使用逐部分矩阵驱动生成;局部润色不因该矩阵扩大范围。论文写作先建立论断与证据关系,再形成章节;不得把 results/results.yaml 的数字插值或文档拼装脚本当作内容生成步骤。
同一项目同时生成论文、研究报告、复现说明或内部核查材料时,先按 manuscript-contract.md 分别锁定读者、用途、允许信息、排除信息和输出位置。各成品可以共享已经确认的数字和表图,不得从同一旧分析说明模板直接改标题生成;必要的科学局限、方案偏离和强制披露不得以“内部信息”为由删除。
- 方法只写最终采用并可追溯的口径;实现日志、调试和清洗试错不写进正文。
- 结果按研究目的和 estimand 组织,报告必要分母、效应量、不确定性和阴性或不确定结果,不逐表逐格复述。
- 讨论区分本研究发现、既有证据、合理解释和推测;观察性研究不使用因果措辞。
- 结论不引入新结果,不用“证明”“最佳”“首次”等超出证据的判断。
- 引文必须真实核验;无法核验时保留明确待补标记,不生成看似完整的来源。
- 审稿回复逐条直接回答审稿人提出的问题,写清已经采取的动作或不能采取的理由、修改位置和核验依据;不能只写礼貌性同意、笼统回应或与实际修改不一致的完成时态。
4. 数字与表图
新项目按每项结果的固定名称从 results/results.yaml 读取数字,旧项目可读取 07_paper/results.yaml。使用外部正式结果时,应逐项列出本轮采用的结果及其来源。任何数字变更都回到实际生成结果的分析脚本,或由用户明确指定并确认的外部结果;不得直接修改正文、表格、图注或自动生成的摘要。
两张及以上正式表图、已有稿件重排,或同一表图需要进入多种文件时,先完成 manuscript-contract.md 的表图与字段约定。分析内部结果 ID 与稿件展示编号分离;表格内部 field_id 必须唯一,显示标签单独保存。生成后按行键与 field_id 将结果来源和每种展示文件逐字段核对,不能用“关键数字出现过”或文件可打开替代列映射检查。
统计图用 publication-figures,非统计流程、机制和图形摘要用 research-visuals,科研原始图像保留原件。图件格式、子图标识、尺寸和分辨率服从当前期刊官方要求;期刊未定时只形成中性可适配稿。
表格样式先服从目标期刊、学校或用户提供的模板。没有指定模板时,作者稿中的数据表默认使用干净的三线表:所有单元格保持白底,不加填充色、竖线、左右外框或逐行横线,只保留表顶线、表头下分隔线和表底线。不得为模拟出版外观添加彩色表头、隔行底色或卡片式表格。
P 值采用精确值并保持统一精度。论文图默认不重复 P 值或解释性文字,除非期刊、方案或读图确实需要;效应尺度使用领域通用缩写,不在图内写 OR(对数……) 或教材式展开,解释放在正文或图注。
5. 文件与成品语体
只要正文时直接返回净稿。文件交付要求包含实际 .docx 时,完整读取 Word 内容与文件边界,再调用 docx 依据模板和现有环境安全完成 Word 读写、样式和页面检查;本 skill 不强制 python-docx,也不普遍禁止 pandoc。学位论文的学校模板和期刊模板优先于中性排版。
作者起草稿和普通投稿稿默认按章节与段落的逻辑顺序连续单栏写作。不为模拟期刊出版外观自动使用双栏、跨栏或卡片式版面,也不改变正文的阅读顺序。只有用户提供目标期刊模板、目标期刊明确要求初投使用双栏,或用户明确要求排版终稿或 camera-ready 文件时才采用双栏。采用双栏时仍保持文档正文顺序连续,并在真实渲染后按实际阅读顺序核对。
正式项目的论文正文、图注和投稿文字以 paper/ 中的 Markdown、Quarto、R Markdown、Word 或项目既有文本格式为来源,不把整篇正文写入 02_code/ 的字符向量。只有结果占位符需要从唯一结果来源稳定装配、且后续确需重复运行时,才保留短小的装配或渲染脚本,并与正文来源放在 paper/;它不属于统计分析,也不进入 run_pipeline.R|py。本次导出、格式试验和一次性核对放在 09_backup/workbench/,长期自动检查放在项目明确的 tests/ 或 checks/。
写作中每完成一个部件,即用 academic-humanizer 在该部件范围内审校事实保真、章节功能、论证、论断强度、术语一致性、作者视角和学术书面语;完整稿装配后再对当前全文做一次跨部件终审。发现内容或统计逻辑疑问时单列给作者核实,不在语言编辑中猜值、调和版本或补充解释。正式披露和期刊适配仍按本 skill 的证据与提交要求核对。
6. 验证
按范围执行:
- L:核对指定部件中的数字、引文、术语、交叉引用和范围外差异。
- P:核对所有受影响章节、表图和固定结果名称;方法变化同步写入
DECISIONS.md,统计分析运行由总运行脚本自动记录,论文装配或渲染按其独立命令核对,不伪装成分析步骤。 - R:逐项核对全文主要论断及其依据,并检查摘要、正文和表图的一致性,以及报告规范、期刊当前格式、声明、引用顺序、占位符和文件可打开性;对实际采用的研究设计、estimand、统计方法、数据来源和报告规范要求,以及成品用途边界、统计字段对账和页面显示分别给出验收结论。
正式投稿、返修提交、外发或归档还必须按 submission-signoff.md 锁定唯一当前稿,确认研究事实和分析层级,复用适用的项目审查、引文核验、修订闭合和文件检查证据,并运行 scripts/validate_manuscript_contract.py <稿件约定> --signoff --json。返修同时运行 academic-humanizer/scripts/validate_revision_state.py <修订状态> --signoff --json;前者判定整套稿件是否可以提交,后者只判定逐条意见是否闭合,二者不重复检查。正式项目用 epi-project-audit 核对数据链和结果来源;外部稿件没有项目级结果文件时使用已声明的只读证据映射,不为提交前确认补建结果文件。任何仍可能改变研究设计、样本、量表、方法、结果、结论或伦理合规的作者待确认事项均阻止“可提交”结论。
完成时确认:内容可由来源逐项核验;全文数字来自同一组已经确认的结果;结论和表述强度与研究设计及证据相符;文章结构清楚呈现研究问题、研究设计、结果及其解释;期刊、机构、伦理或法规要求披露的内容完整;实际交付文件与已确认的文件交付要求逐项一致。期刊未定、采用中性格式、文件交付要求未选择 Word 或没有创建与本次任务无关的项目记录,均不构成写作失败。
只有上述内容检查和 academic-humanizer 终审均已完成,才能称为“完整稿”或“完成版”。仅完成自动取数、章节标题、文件写入、格式检查或部分段落时,按实际状态称为“部分草稿”“待补内容稿”或“格式已完成”,不能概括为论文已经完成。