thesis-style · MEM范文语体
真人论文的"人味"不在精致,在平实:因果链推进、数字带毛边、敢写副作用、允许克制的不完美。AI稿暴露的恰恰是过于顺滑工整。
硬约束(先读这个)
- 结构不动:目录、章节、小节安排按本论文现状(CLAUDE.md 各结构规范优先于范文——例如本论文 Ch2-6 每章保留承上启下引言段,尽管部分参考论文开门见山,范文H公司是有引言段的,跟范文)。
- 数据不动:任何数字、统计量、引用不因改写而变;严禁编造。
- 禁止整段LLM重写:只做定点替换与句式微调(AIGC检测铁律:全量重写会叠加AI指纹)。
- 范文本身有笔误和语病("股那里计划""做为")——取其平实,不模仿其错误。
核心认知(排他性洞察,三组语料交叉验证)
因果顺承链驱动,不靠转折。真人论文用"为了→通过→从而/所以/由此可见"推进,"然而/不过"在6篇中为0或近0,"但"≤1/千字。发现文字靠"然而""但是"频繁转弯,就是改写信号。
真人比AI"糙"。长短句悬殊(同段20字句与120字句混排)、段落长短不齐(80字与400字相邻)、数字带毛边(约/左右/将近/大概)。改稿时不要把这些"修整齐"。
效果数字三件套:改进前值 + 手段归因 + 改进后值,再加克制限定。范文句型:"实施前平均定位时间为48小时,优化后通过与JIRA集成……定位时间缩短至4小时内""得到了一定的改善"。效果从不满打满算。
引号纪律:中文引号只给五类——①术语/问题首次定名(定名后全文一字不改地复用,这是范文的全文锚点技巧)②流程链/口号("发现—记录—分配—解决—验证")③访谈原话④系统界面字面量("待整改")⑤偶发借喻("多米诺骨牌效应")。绝不给普通短语加引号强调(10篇全零)。
理论=判据,不=知识。理论出场即干活:"这与CMMI的'项目监控与控制(PMC)'过程域要求严重不符";引文献立即消化转用当论证台阶,不做"某某认为…某某指出…"流水账(流水账只允许出现在§1.2综述小节内,且末尾必有述评)。
禁止"评审补丁式改稿"(用户铁律)。处理评审意见不得用括注免责补丁去堵。范文实测括注≈2.4/千字且内容全为技术记号(缩写展开/工具示例/数据来源/编号/统计量),限定、免责、口径声明塞进句中括号的写法范文为0处;逐条评审意见各打一个括号补丁,堆起来就是最重的AI味之一。正确做法按优先级:①改正文本身使其不再需要免责 ②写成独立正句("该结果来自小样本回访,尚需更大样本复测")③移入表注/脚注 ④别处已交代过的直接删。
减法有尽头,人味最终靠加法。标点/句式/括注/对冲的清理都是减法,减到一定程度进入负收益区:一篇零AI痕迹但也零作者嗓音的稿子,比留几处人类毛边的稿子更可疑——过度打磨本身是新tell("太顺滑、太匀、太干净")。其中最隐蔽的是信息密度均匀,这是grep抓不到的结构层tell:真人写熟悉的段落详细、不熟悉的概括,若每个方法论(KJ/鱼骨/回归/RACI/灰度)都恰好"定义→本文用法→结果"等长三段式,就是代产信号。破法不是再减(会伤内容、且撞"过度重写→AIGC反弹"铁律),而是加法——让人味从实施故事(具名波折、组织人头数、"至少30%"式口语估计、失败复盘、揭短)往分析段渗、故意让段落密度不均匀、敢写一句带主观判断的话。加法只有作者能做(撞"禁止LLM全量重写"铁律),所以skill/agent把减法做到头后,正确交接是定位"最匀速、最像代产"的几个段落,交还作者亲手写"毛",而不是继续抠字降版本。附推论:去对冲不是越少越好——单案例前后对比该软(提示/有关/相符),机制清楚处可硬(主要归因于);真靶是"较可能主要"式双重对冲堆叠,不是对冲词本身(本论文全书对冲词个位数,≠泛滥,别为清零而清零)。
表达DNA校准表
| 维度 | 目标 |
|---|---|
| 句长 | 中位50–70字/句,一句3–5个逗号分句;>100字长句不回避,<20字短句少用 |
| 转折密度 | 但+然而 ≤1/千字;"然而/不过"基本不用 |
| 推进词 | 通过(第一高频,1.5–3/千字)、为了、从而、所以、由此可见、确保 |
| 段落 | 150–350字、3–6句、一段只讲一件事;相邻段长短不齐是正常态 |
| 段首 | 对象/目的状语先行:为了…/针对…/通过…/在X阶段…;直接名词主语起头也可;不用悬置式开头 |
| 段尾 | 效果/目的收口:"从而提升了X""为Y提供了Z""避免…""即可" |
| 枚举 | (1)(2)(3)或1)2)3)编号+条目名+冒号+完整句;"一是/二是/三是"用于真实的原因归纳(范文H用14次);"其一…其二…"10篇全零,禁 |
| 图表引出 | 句尾"……如表X.X所示",引出前先一句交代表里装的是什么 |
| 图表回收 | 表后必跟解读段:"从表中可以看出/由表可知/结合上表数据可知"+挑2–3个最突出的数+一句管理判断;不逐行复述;禁"如上表所示"式回指 |
| 数据句 | "由X降低到Y/从X提升至Z"+手段归因;先绝对数后比率;数据后接一句定性判断("说明整个过程质量更加稳定") |
| 倾向标记 | 仅有/高达/不足/超过 做倾向词;约/左右/将近 做毛边;不用"惊人的"式渲染 |
| 标点指纹 | 每轮改完复测全表(基准见evidence二·补3):引号≤1.2、注释性括号≤2.0、分号≤1.9、顿号≤8.5、冒号≤2.5;织入括号时用句号拆短句而非堆分号顿号 |
| 括注 | 密度对标范文≤2.0/千字;内容仅限技术记号(英文缩写展开、工具示例"(如禅道、JIRA)"、数据来源、编号、统计量)与简短示例枚举;限定/免责/口径声明型中文夹注为零 |
| 身份 | "本文/本研究"做研究主语+"公司/项目团队"做动作主语;零"笔者";个人在场靠数据动作证明:"本研究从X平台中查询了2020年全年的项目管理数据" |
| 章首 | 承上启下段:上一章发现了什么→因此本章将做什么(范文三篇100%复现;与本论文规范一致) |
| 小结 | 单段80–250字,"本章首先…其次…最后…"过程复述链+落点"为下一章…提供基础";不出新数据;范文特色:末句可带下章钩子 |
| 局限 | 总括让步("受限于时间和条件")+编号2–4条+每条=具体缺口+不否定成果+"有待进一步研究"出路;敢写措施的副作用与成本("严格按规范执行可以减少质量问题,但可能增加操作成本")——这是范文区别于AI稿最深的人味 |
反模式红线(10篇正文全零或近零,出现即改)
其一…其二…排比 / “X,而非Y”对比句式(10篇参考论文整本仅0–2处、H范文为0;本论文曾24处——仅核心结论定名锚点与文献转述可留,其余改“不是/不宜/退居其次”或删后半句) / 给自造管理口号加引号(“做完即止”“上线后被动救火”“大节点”式自造词一律去引号改白话直述;引号仍只留五类) / 具体技术产品名(Prometheus/Grafana等监控与中间件产品名→泛称“链路监控平台/监控看板”;英文gloss如(Dedicated Node Pool)删;通用技术WebP/CDN/JVM承载管理叙事者保留) / 正文破折号插入语(——) / 需要指出的是 / 不难发现 / 显而易见 / 总体而言、总体来看 / 众所周知 / 毋庸置疑 / 换句话说、也就是说 / 给普通短语加引号强调 / 限定/免责/口径声明塞进句中括注(如"(此处X指…而非…)(尚需更大样本复测)"——独立成句、进表注或删) / "如上表所示"式回指 / 每段同构开头(都以"本节/本部分"起) / 间隔号·当分隔符(仅限外国人名) / 助力、赋能(正文) / markdown式列表痕迹 / 空泛"构建了X体系"而无数字(范文凡"建立了机制"后文必接量化效果)
软信号限量(真人低频使用,有实义才用,别一刀切)
| 短语 | 限量规则 |
|---|---|
| 综上所述 | 全篇≤2–3次,仅在收拢刚列完的数据证据或结论章;H范文正文为0 |
| 旨在 | 转述标准/机构的既定目的可用("CMMI旨在引导…");"本研究旨在"≤1次 |
| 值得注意的是 | ≤1次或不用 |
| 一定程度上 | 局限/自谦处可用;效果数据处禁 |
| 首先…其次…最后 | 仅两种场景:本章小结过程复述、方法步骤列举;不做议论段排比装饰;可以不成套(有首无次) |
| 一方面/另一方面 | 真实双侧展开,两翼内容不等长 |
| 聚焦 | ≤1–2次实义使用("本节聚焦于风险评估这一过程") |
改稿操作流程
- 红线grep清零:先按上面红线清单grep目标文件,逐个消灭。
全文或交付前审计时,调用
thesis-deai-review,用其自带扫描器生成带行号的 JSON/Markdown 报告,并按该 Skill 的隔离并行流程启动独立 AI 判断;不得把 脚本命中直接等同于 AI 作者身份。 - 逐段核DNA:段首起法、段尾收口、转折密度、一段一事。转折词句改因果链("然而X"→"由此可见/所以"或删)。
- 效果句改三件套:凡只有改进后值的句子,补前值与手段归因;凡满打满算的断言("完全消除""均达标"),加克制限定。
- 引号审计:非五类用途的引号全部去掉改直述。
- 括注审计:提取全部(…)分类——技术记号与简短示例保留;纯中文限定/免责/口径型逐个处理(独立成句/移表注/删);整体密度压到≤2.5/千字。
- 图表段检查:引出句式、表后是否有"挑数+判断"两步解读。
- 交付泄漏审计:正式交付前读取
references/delivery-leakage-audit.md,清除本机路径、内部阶段名、prompt、 agent、调试日志、评审过程措辞和未授权标识;保留研究复现和AI伦理所需的正式 方法披露。 - 改完自检:通读一遍问自己"是否过于顺滑"——如果每句等长、每段对称、处处流畅,说明改过头了,把原有的克制不完美还回去。
每轮收尾七检(改稿收尾的固定动作,缺一不可)
- 红线grep:反模式清单逐项grep目标文件清零。
- corpus_diff反向差分:
python3 scripts/corpus_diff.py --ours <章节> --refs <参考语料>,风格词嫌疑逐个判留/杀——尤其盯补丁词汇(口径/核验/见第/印证类,见thesis-review-response判例库第五节)。 - 标点指纹表复测(基准见evidence二·补3):引号≤1.2、注释括号≤2.0、分号≤1.9、顿号≤8.5、冒号≤2.5——修一种痕迹必须复测全表(打地鼠效应)。
- 括号引号分类审计:残余引号须全落五类;括号须全为技术记号+示例类,防御/免责/定义型为零。
- 编译验证:完整链xelatex+biber+xelatex×2,
grep -cE 'Reference.*undefined|Citation.*undefined'为0、无fatal。 - 数字改动连带:改任何数先查figures/FIGURES.md重渲受影响图、跑stats/复算脚本、grep旧值清零。
- 范文对照盲读(大改后):派agent"列出本文有而范文没有的一切写法",抓脚本抓不到的结构类痕迹。
- 交付泄漏复扫(交付前):分别扫描源码、PDF、DOCX解包文本和元数据;研究 方法披露可保留,内部生产过程与本机信息必须清除。
诚实边界
- 本 skill 只覆盖语体(以多篇浙大 MEM 范文为基准);结构、方法、数据规范以本论文 CLAUDE.md 为准,两者冲突时后者优先。
- 参考论文作者间存在个体差异(2篇用"笔者"、4篇分号习惯迥异、"值得注意的是"有1人用6次)——本skill取跨组稳定模式,个体癖好不采。
- 遵循本skill不承诺任何AIGC检测平台结果,只能对齐真人写作基准;检测报告复核另见 aigc-reduce-playbook。
- 完整证据(12维度分析、原文例句、逐篇grep计数、句式指纹统计)见
references/style-evidence.md。 - 交付泄漏的分类与保留边界见
references/delivery-leakage-audit.md。
语体基准
本 skill 的语体规则以多篇通过答辩的浙大 MEM 学位论文(含 1 篇导师推荐范文与 9 篇同类论文)为基准提炼;分组标签 R1–R9 与复现验证的证据明细见 references/style-evidence.md。