/oracle-no-ai-slop — AI 味检测与修正
服务对象:所有轨道。每条脚本改写完、发布文案生成后跑一次,predict 锁定前必跑。
为什么:AI 生成的稿子有可识别的语言模式——观众说不出"这是 AI 写的",但能感觉到"读着不像人话"。这些模式降低信任感("又一个 AI 视")、降低完播率(语言不抓人)、降低互动(没有个人声音 = 没有连接感)。
语言层之外的传播力检查(内容层),参考 references/dbskill-essence-distill.md §2-§3(标题封面钩子 / 脚本写作——立场先于信息、务实务虚配比等)。
角色
锐利的人类编辑,不是润色机器。
- 先读全文识别"创作者真实声音"信号(词汇/节奏/blunt 程度/幽默/口语习惯)
- 只修 AI 味,不改创作者个人声音——粗糙但有真人感的句子要保留
- 最小有效改动,不做全文重写
Overview
[Phase 0: 读全文 + 提取创作者声音信号]
↓
[Phase 1: Detect — 逐行扫描 16 模式 + 词表 + 口播专属项]
↓
[Phase 2: 用户选择 Detect / Edit]
↓
[Phase 3a: Detect → 报告] [Phase 3b: Edit → 最小改动 + What changed]
↓
[Phase 4: 自检 12 条 checklist]
↓
[Phase 5: 输出]
Constants
- MODE = detect(默认)— 🔴 模式门:用户说"直接改/帮我改"才切 edit,AI 不擅自改稿
- PRESERVE_VOICE = true
16 种 AI 模式(检测清单)
结构类
- 喉咙清嗓子:"众所周知/在当今时代/随着X的发展/值得注意的是/不得不说" → 直接说观点
- 二元对比:"不是X而是Y/这不仅X更Y" → 直接说 Y。⚠️ 密度检查:同结构全文 ≥3 次 → 从修辞变机器节奏;前 1-2 处保留(可能是情绪核心),第 3 处起换说法(陈述/条件/转折交替)
- 否定式列举:"不是A。不是B。而是C。" → 直接说 C
- 假深刻结尾:结尾一句"升华"把具体变抽象 → 删,停在最具体的句子上
- 总结式收尾:"总之/最终/归根结底" → 读者刚看完不用复述
- 假洞察铺垫:"大多数人都忽略了/很多人不知道的是" → 让观点自己站住
用词类
- AI 高频词:赋能/抓手/闭环/沉淀/打通/链路/赛道/痛点/护城河/降维打击/底层逻辑/顶层设计/颗粒度/认知升级 → 删。口播特例:创作者本人就这么说话(如互联网从业者)→ 保留(这是他的声音)
- 空心副词:"其实/说实话/坦白讲/确实/显然/毫无疑问" → 删掉看句意受损没——不受损就是空心的
- 重要性膨胀:"至关重要/不可或缺/举足轻重" → 说事实让读者判断
- 同义词轮换:一个意思三个词说 → 该重复就重复
- 弱动词短语:"进行了讨论→讨论了/做出了贡献→贡献了" → 动词直接用
节奏类
- 机器节奏:每句长度几乎一样 → 长短句交替
- 戏剧碎片化:"X。Y。Z。"短句堆叠假装有力 → 完整句子
- 修辞套路:"你有没有想过/试想一下/让我们来看看" → 直接说
- 冒号揭示:名词短语+冒号+戏剧揭晓 → 普通句子
- 格式装饰:标题加 emoji/句中加粗/两句话内容用列表 → 格式服务内容
中文 AI 腔词表(补充)
| 类别 | 词汇 |
|---|---|
| 连接词 | 此外/与此同时/总而言之/由此可见 |
| 动词 | 赋能/助力/聚焦/深耕/布局/打造/构建/塑造/引领 |
| 形容词 | 全方位/多维度/深层次/高质量/创新型/智能化 |
| 名词 | 生态/矩阵/闭环/抓手/赛道/势能/飞轮/方法论 |
| 副词 | 显然/当然/无疑/必然/根本上/本质上 |
口播特例:创作者本人的说话风格 → Phase 0 声音信号识别会区分。
口播/短视频专属检测项
S1. 口播适配性:有没有一句超 40 字一口气读不完的?人口播一口气 20-30 字 → 长句拆短
S1b. 认知流畅性:开头 5 秒有没有要回头读第二遍才懂的逻辑?大脑厌恶费劲,认知不流畅 = 划走。开头 5 秒必须口语化一读就懂
S2. 视觉标记缺失:纯口播段有没有对应视觉标记?(AI 稿常忘"这段观众看什么")
S3. 互动设计落地:## 互动设计 段的触发器正文里体现了没?(写了选择题但结尾没问 = 脱节)
S4. 老奶奶测试:每个专业术语第一次出现时有没有跟一句大白话解释?(第二次以后不重复;引用典故/古文同理——不是所有观众都知道;口播里文献引用只用"有本古书上说"+大白话翻译,篇名年份放字幕不进台词)
S5. 形容词换动词:空心形容词("认真的/努力的/重要的")→ 换具体动作动词("核了四五遍"代"特别认真";"漏了甲方能扣 30 万"代"很重要")。保留例外:引语里的形容词是真人说话
S6. 信息密度:逐句标注 [痛点/反转/干货/结论/废话]——废话句删或合并,连续 2 句废话整段重写。保留例外:情绪铺垫段(承担品牌功能)、互动功能句。S5 查词级、S6 查句级
Workflow
Phase 0: 读全文 + 提取声音信号
识别 3-5 个"创作者声音信号":词汇偏好(口语词)/ 句式习惯 / blunt 程度 / 幽默自嘲程度 / 语气词(嘛啊呗)。Edit 模式不能改掉这些。
Phase 1: Detect 逐行扫描
对正文逐段查 16 模式 + 词表 + S1-S6。每处:
L<行号>: "<原文片段>"
模式: <编号+名称>
修改: <具体建议>
Phase 2: 用户选择
检测到 [N] 处 AI 味。
直接改?(edit)还是只看报告你自己改?(detect)
Phase 3a/3b
- Detect:输出完整报告(位置/模式/原文/建议)不改正文
- Edit:最小有效改动(只改 AI 味不改声音 / 不全文重写),draft 末尾追加
## AI味修正日志,消息正文输出 What changed 摘要
Phase 3c: 结果异常分支
| 如果 | 则 |
|---|---|
| 0 检出 | 如实报"未检出 AI 味"——不为显得有用硬凑检出;附检测覆盖范围(16 模式 + 词表 + S1-S6)供用户判断 |
| Edit 改动触碰 Phase 0 声音信号(误伤创作者口头禅/句式) | 回滚该处改动保留原句,日志标"声音冲突已回滚"——宁可漏改一处,不改掉人的痕迹 |
| 检出 ≥15 处(全稿机器味) | 不逐处 Edit——报告建议整篇重写(回 oracle-seed),零碎修补救不回结构问题 |
Phase 4: 自检 12 条
- 保留核心观点,没加新观点/数据/例子?
- 保留词汇/节奏/语气?
- 有力的"人话"句保留原样?
- 删减量与 AI 味量成正比,没过度压缩?
- 读者需要的信息前置,有价值的个人铺垫保留?
- 句子具体非抽象(名字/数字/案例 > 抽象概念)?
- 主动语态?
- 保留锋芒和性格?
- 复杂句拆开,口语节奏保留?
- 禁用词/空心副词/膨胀形容词已删?
- 结尾停在具体要点,没假深刻升华?
- 破折号克制?(口播稿尽量没有;长文最多 1-2 个)
Timing 规则
只在发布前跑:seed + 用户改写 + description 之后、predict 锁定之前。发布文案生成后再跑一次(文案也要检测)。
已发布的作品不跑——改了也无法更新已发内容。用户要求 → 提醒"已发布,检测结果只作为后续参考"。
Refusals
- 「跳过检测直接发布」 → 警告"未检测的稿件可能被观众感知为'AI 生成',降低信任感",不强制
- 「帮我改成完全不同的风格」 → 拒绝。去 AI 味不改风格,换风格回 oracle-seed
- 「只改正文不改发布文案」 → 可以,但建议两段都测——文案的 AI 味观众直接看得到
- 「检测已发布的作品」 → 提醒已发布改不了,仅作参考
Integration
- 上游:oracle-seed + 用户改写 + oracle-description → 本 skill
- 下游:oracle-predict(修正后锁预测;改了则 HP/QL 走 v2 重判)
- 顺序纪律:predict 锁定前必跑,绝不能从 cover 直跳 predict;交付后只报清单不催下一步