去 AI 味(de-ai-smell)
本 skill 是全站「去 AI 味」的唯一权威:词表、行为规范、扫描脚本、检查清单都在这里。blog-writing / video-generation 只做引用,不再各自维护词表。
用法:写新文章 / 改稿 / 写口播前,先读本 skill + 词表;写完跑 make check-ai-smell 扫一遍,命中点人工判断后手动改。
一句话心法
把「工作汇报体」改成「真人分享体」——改完读出来,要像一个真人在工位上跟你聊,而不是一份周报在念稿。
保真优先(去味第一原则)
去 AI 味的失败模式是改坏事实,不是没删干净。任何改写都不能新增事实、删核心事实或改变责任主体。为「更口语」改坏原意 = 失败。
- 保护片段清单 + 防幻觉一致性检查见
references/protected-spans.md(代码 / 版本 / 命令 / 报错 / 引用 / 责任 / 数字-对象配对 / 实体关系,一律不动字面量)。 - 口诀:删套话可以,造事实不行。原文没说的,输出不许说。
禁词表(权威,分两级)
完整分类词表见 references/ai-smell-word-list.md。词不是一刀切,分两级:
L1 绝对禁词(出现即改,无例外)——技术语境也不留:
| 词 | 替代 |
|---|---|
| 兜底 | 回退 / 降级 / 防线 / 把关 / 拦下来;「兜底页」→「降级页」 |
| 铁证 | 实测 / 日志为证 / 数据摆在面前 |
| 说白了 | 删掉,直接说结论 |
| 先说 | 「先说结论」→ 直接甩结论 |
| 根子 | 原因 / 根本 / 源头 |
| 扎眼 | 显眼 / 突兀 / 一眼看出 |
| PPT 名词(赋能/闭环/抓手/打通/对齐/拉通/洞察/沉淀/底层逻辑/全生命周期/降本增效/技术底座) | 换具体动作或说法:「赋能业务」→「帮业务做成 X」;「沉淀」→「积累/攒下」;「打通」→「连上/对接」;「闭环」→「完整回路」;「对齐」→「统一/说清楚」 |
| 口头禅(一句话/一件事/踩一遍) | 「一句话说清」→ 直接说;「一件事」→ 换具体所指(一次变更/一个目标);「踩一遍」→「重新走一遍」 |
| 值得注意(的是)/ 值得一提 | 删掉,后面的内容直接接上 |
| 我的判断是 | 删前缀(「我的判断很直接」「先说我的判断」同删) |
| 恰恰 | 删(「恰恰相反」「恰恰是」都算) |
| 记账类比(X 的账 / 这笔账 / 算账 / 算总账 / 翻旧账) | 删比喻直说:「时间的账要拆开」→「时间分两块看」;「这笔账划得来」→「值得」;「算总账」→「加起来看」;「翻旧账」→「查早前的记录/翻早前的日志」。字面义(账单/账号/账户/分账/对账/结算账期)不在禁列 |
⚠️ 2026-08-03 用户定规:兜底、铁证 技术语境也无例外,一律不出现,不靠人工在反讽 / 术语之间来回纠结。 ⚠️ 2026-08-26 用户定规:PPT 名词(含业务术语语境)、口头禅(一句话/一件事/踩一遍)、值得注意/我的判断是/恰恰,同样无例外——「SaaS 商业闭环」这类业务术语、引用 skill 描述里的「一句话」也不再豁免,写新稿一律换写法。 ⚠️ 2026-08-27 用户定规:记账类比(X 的账 / 这笔账 / 算账 / 算总账)无例外——不把成本/时间/取舍写成记账;字面义(账单/账号/账户/分账/对账/结算账期)是实事,不受限。 ⚠️ 2026-08-28 用户定规:「翻旧账」并入记账类比 L1——评论区回复稿用「翻旧账 + 像账本旧页折起来」被打回(提及账务即算),成语化账务比喻一律改直述;扫描脚本已同步收录。
L2 高危慎用词(命中即提示,人工判,确有实质才留)——本身有意义,AI 味在「铺垫升华 / 戏剧化」:
| 词 | 可留 vs 要改 |
|---|---|
| 本质 | 名词「问题的本质」留;副词「本质上…」改「原理」 |
| 澄清 | 动词「澄清事实」留;铺垫「需要澄清的是」删 |
| 真相 | 名词「事件真相」留;戏剧化「真相是…」删 |
| 撕开 | 戏剧化煽情(撕开真相 / 面具),换具体动作 |
| 底层逻辑 | |
| 至关重要 / 不可或缺 / 意义深远 / 护城河 / 分水岭 / 定时炸弹 | 删或换具体影响 |
💡 L2 不是「绝对不能用」,是「用之前先问一句:这里在说人话,还是在装腔?」删了更干净就改,真表实质就留。扫描脚本对 L2 只提示、不阻断门禁。 🚫 已升 L1 无例外(2026-08-26 定规):赋能/闭环/抓手/打通/对齐/拉通/洞察/沉淀(PPT 名词)、一句话/一件事/踩一遍(口头禅)——从本表移出,见上方 L1 表。
行为规范(比词表更要命)
- 少用冒号
:——连续多处「X:Y」是 AI 味。标题式冒号、列举式冒号克制用,优先用自然句子把前后连起来。自检:一眼扫过去连续 3+ 处冒号 = 重写。- 豁免:定义列表的「label:描述」(如
Skills:把常用工作流封装成可复用的技能)是合理格式,不算 AI 味。AI 味指叙述句里「做什么:」「为什么:」这类加粗冒号堆叠。
- 豁免:定义列表的「label:描述」(如
- 别随便加粗——加粗每节 ≤2 处,只加真正要强调的词 / 结论;每个要点都加粗 = 没重点 = AI 味。
- 破折号每篇 ≤2 处(理想 0)——破折号是公认的 AI 签名(web 调研结论)。教程 / 步骤类文章最容易爆量(实测一稿 20+ 处),逐处换成逗号 / 句号 / 冒号或直接拆句,不靠「留着几处显节奏」——理想就是 0。
- 禁「不是 A,而是 B」及其变体排比——AI 句型第一名,改成直陈。变体同样算:「X 不是 A,是 B」「这不是 A,是 B」「没有 A,而是 B」「不靠 A,靠 B」「A,而不是 B」都算;否定句首(「不是…」「没有…」「并非…」起句制造顿悟铺垫)是同族变体,一并改。2026-08-26 用户定规:一律改直陈,「对比有实质语义」不再是豁免理由——真实对比也要换写法(正面陈述 / 先后动作 / 因果句),例如「校验通过后不是直接应用,而是进入 hitl 节点等人确认」→「校验通过后先进 hitl 节点等人确认,通过才应用」。唯一不算的是纯否定 + 让步(「它不是最快的,但最稳」——没有对比转折结构)。
- 禁为排比而排比——三连排比(凑三个显「完整」)、任意凑对仗、凑排比都是 AI 癖好,砍到只剩最有力的一个。真人说话不会句句对仗工整。
- 列表克制——满屏小黑点不像人话,能用段落说清就用段落。
- 收尾不升华——「以上就是」「希望对你有帮助」「你学会了吗」「随着 X 不断进化」全部禁。
- 步骤四件套别三连加粗冒号——教程类常用的「做什么:… / 为什么:… / 预期输出:…」是加粗 + 冒号双倍 AI 味。把「做什么 + 为什么」合并进自然叙述句(例:
到 Releases 下载安装。它是所有切换操作的总入口。),每个步骤只留一个「预期输出」标签。 - 禁「先X」口语开场——「先泼盆冷水」「先给大家」「先聊聊」「先问一句」这类「先+动作」的套话开场,直接删掉进正题。步骤叙述里的「先装 / 先看」是自然动作,不算。
- 禁自问自答设问句——「key 哪来?」「怎么用?」「它是什么?」这种先抛问题再自己答的设问是自媒体 / AI 套路,改成直接陈述(「去开放平台申请一个 key」「直接提需求」)。真人说话不自己问自己。合法衔接 = 内容指向型过桥句(2026-08-26,配合 blog-writing「扫读层」留人技巧):「先看数据」「更麻烦的在后面」「下一行才是关键」——句子指向下一段的具体内容,既不是设问也不是空过渡垫词,去味时保留不删。
- 禁无意义类比 / 比喻——喻体和本体没有实质关联、只为显得「有深度」的比喻(「这就像区块链的信任机器」「宛如一条数字河流」)。技术文章要用比喻,得让它真帮人理解,不是装腔。判断口诀:删掉比喻,读者会不会反而更清楚?会,就删。记账类比(X 的账 / 这笔账 / 算账)已升 L1(2026-08-27 定规,见禁词表)。
- 禁无源权威铺垫——「研究表明」「数据显示」「业内人士指出」「有评论认为」是无源权威,AI 味重且违反「不编造」口径。默认 audit-only:标「缺来源」或删整条,不补虚构来源(不补假机构 / 假数据 / 假年份)。
- 整句重写,不局部换词(2026-08-26 定规)——命中句式 / 句法 / 词表问题,不许只换词、删词、调语序地局部修补,整句重写;同篇同类问题换不同改法(一处拆短句、一处换主语重组、一处删冗余),一种改法全篇重复 = 制造新的机械感。
- 类比密度上限(2026-08-26 定规)——一段 ≤1 个、一篇 ≤3 个。认知功能类比(真帮理解,如「门卫查工牌」讲鉴权)密度内不删;超了留认知价值最高的,其余改直陈。判定口诀仍是「删了读者更清楚就删」。
- 清翻译腔(2026-08-26 定规)——的链 ≥3 拆句、虚动词(进行/作出/加以 + 动词)、滥用「之一」、「是……的」结构、介词堆砌、代词复指、形容词 + 冒号预判(「结论很明确:」)、物理动词抽象用(「论证被击穿」)——例句与改法见
references/de-ai-patterns.md「中文句法层」。 - 禁「先接住再纠偏」缓冲句(2026-08-28 定规,对话回复场景:评论 / 私信 / 对话体口播)——回复前先把对方的话复述 / 归类 / 认领一遍再进正题:「你记的是 X」「你说的是那个 X 吧」「你提到的 X 来自 Y」。这类句子的信息对方自己就有,零信息纯客套,助手腔最重;纠偏和答案从第一句直接开始,要点名所指就并进答案里。例:❌「时空」你记的是 Cordis,来自那篇论文。✅「内核」正好说反了,Cordis 的卖点是没有特权内核。
扫描脚本
- 脚本:
scripts/check_ai_smell.py(词表同references/ai-smell-word-list.md) - 门禁:
make check-ai-smell(全站) /make check-ai-smell path=content/posts/xxx.md(单篇) - 只定位不自动改:扫描有误报(front matter tags / 反讽 / 业务术语),命中必须人工判断,不为去味破坏内容。
发布前检查清单(分四层,按优先级过)
L1 机械扫描(跑脚本 + 标点计数)
- 跑
make check-ai-smell,L1 禁词无命中(L2 / 风格 / 量化提示人工确认) - 破折号 ≤2 处(理想 0)
- 冒号密度:无连续 3+ 处
- 加粗密度:每节 ≤2 处
L2 风格(句式结构)
- 无「不是 A 而是 B」、无为排比而排比(三连 / 凑对仗)、无否定句首顿悟铺垫
- 无翻译腔残留:的链 ≥3 / 虚动词 / 之一 / 是…的 / 预判冒号 / 物理动词抽象用(见 patterns「中文句法层」)
- 类比密度:一段 ≤1、一篇 ≤3
- 改法检查:同类问题未用同一种改法全篇重复(整句重写原则)
- 无无意义类比 / 比喻(删了读者更清楚就删)
- 无「先X」口语开场、无自问自答设问句
- 教程步骤:无「做什么 / 为什么」三连加粗冒号,四件套已合并进叙述
- L2 慎用词(本质 / 澄清 / 真相 / 撕开 / 底层逻辑)人工判过,确认在说人话
- 收尾无「以上就是 / 希望对你有帮助 / 你学会了吗」
L3 内容支撑(去味不丢信息)
- 保真:代码 / 版本 / 命令 / 报错 / 引用 / 责任 / 数字-对象配对未改动(见
references/protected-spans.md) - 每个核心观点有 data / case / 来源支撑,不靠空洞总括
- 无源引用(研究表明 / 数据显示)已 audit-only 处理,无虚构来源
- 无幻觉:输出没有原文没有的能力 / 关系 / 对象
L4 活人感终审(残味复审 + 通读)
- 残味复审 5 项:无开场 / 总结 / narrator / 空泛判断 / 句长过匀残留(见
references/positive-style.md) - 正向目标:有具体信息 / 有主语动作 / 统一语域 / 有节奏 / 有立场 / 有边界
- 通读一遍,像真人在说话而不是周报念稿
分层是检查项的优先级分组,不是必须跑的脚本流程。按 L1→L4 顺序过即可。
去 AI 味方法论(web 调研 + 全站实战沉淀)
- 三遍法:Pass1 去泛化(删抽象升华句)→ Pass2 去书面化(换日常表达)→ Pass3 回自然感(加具体细节、短句、第一人称)。
- Show don't tell:用具体行为 / 数据代替形容词。情绪不写「他很紧张」,写「手心全是汗」。
- 敢下判断:AI 什么都留余地,真人敢下判断(呼应 style-guide 的「权威自信」)。
- 模式大于词表:AI 味核心在句式结构(对称、列表、总结句、破折号),词表是抓手不是全部。
- 详细句式套路见
references/de-ai-patterns.md。