Platform Compliance — 多平台违禁词检查
把要发布的内容(视频口播、标题、封面文字、简介、图文文案)过一遍目标平台的违禁词与敏感词检查,输出命中报告,全部处理完才允许发布。
何时用
- 视频发布前(和 video-generation skill 的发布管线配合:渲染前检查口播与 metadata,发布前再复扫一遍)
- 写口播文案 / 标题 / 封面关键词 / 简介之后,发布之前
- 用户说「检查一下违禁词 / 敏感词 / 违规词 / 会不会限流 / 平台合规」时
与 de-ai-smell 的分工:de-ai-smell 管「文案像不像 AI 写的」,本 skill 管「平台会不会限流」。两个都要跑,互相不替代。
支持的平台
--platform 可选:douyin(抖音)/ kuaishou(快手)/ xiaohongshu(小红书)/ wechat(视频号)/ all(默认,全部)。
词库分两层:通用层(广告法红线,四平台都查)+ 平台层(各平台特有的严格项)。报告会标注每个命中属于哪个平台,--platform 只查指定平台时,其他平台的命中不阻断门禁。
检查维度
| 维度 | 覆盖 | 级别 |
|---|---|---|
| ① 绝对化/极限词 | 最/第一/唯一/顶级/极致/天花板/封神/yyds 等(《广告法》第九条) | HIGH(通用) |
| ② 夸大宣传/虚假承诺 | 100%有效/零风险/特效/彻底解决/根治 等 | HIGH(通用) |
| ③ 诱导引流/诱导消费 | 微信/QQ/手机号/二维码/私信/加V 等(通用);评论区扣XX/关注我(抖音/快手);VX/扣扣/平台名跳转(小红书);脱离视频号场景(视频号) | HIGH(分平台) |
| ④ 权威冒用 | 央视推荐/官方指定/专家认证/国家级/特供 等 | HIGH(通用) |
| ⑤ 金融收益承诺 | 躺赚/稳赚/保本/月入过万 等;视频号另加荐股/承诺收益 | HIGH(通用+视频号严) |
| ⑥ 迷信/敏感 | 招财/辟邪/转运/消灾/镇宅 等 | HIGH(通用) |
| ⑦ 医疗功效词 | 治疗/治愈/根治/消炎/杀菌 等(通用);小红书扩到 诊断/处方/降血糖/溶脂/祛疤/美白针 等(小红书严) | HIGH |
| ⑧ 平台行为红线 | AI 生成声明、主题黑名单、三品一械、摆拍标注、带货标广告 | INFO(规则提醒) |
| ⑨ 语境敏感词 | 「教父/大师/天花板/最+形容词」等技术语境比喻 | MEDIUM(人工判断) |
级别定义:
- HIGH:命中必须改。平台审核命中即限流/下架;广告法极限词是违规的最大来源。
- MEDIUM:命中提示人工判断。技术科普语境里「天花板/最值得/教父」通常是比喻,但平台 AI 审核不认语境,保险起见能换就换。
- INFO:平台规则提醒,不是词。发布前逐条确认。
词库
references/word-list.md:通用词库(广告法)与合规替换建议references/platform-rules.md:四平台差异规则(处罚梯度、AI 声明、资质红线、导流边界)
词库要点(2026 状态):
- 各平台审核已升级为「AI 实时语义识别 + 人工抽检 + 用户举报」三重机制,谐音、拼音、符号拆分变体也会被识别("z最"、"VX"、"医*用"),不要用错别字规避——故意规避处罚更重。
- 2026 新增封控词:yyds、绝绝子、绝版、封神(营销语境使用均触发);隐性极限词:天花板、标杆、断层领先、遥遥领先。
- 引流硬词(微信/QQ/手机号/二维码/私信)四平台全查;小红书对平台名(淘宝/抖音/B站)+ 跳转/扫码同样严查;视频号禁止「诱导用户脱离视频号场景」。
- 处罚梯度参考:抖音主题黑名单(同主体 3 次中度违规全账号限流);小红书私信发微信直接封禁;快手分级(警告→功能限制→短期封禁→永久封禁);视频号阶梯式(限流→删视频→取消认证→封号)。
工作流
# 1. 扫描(口播脚本、metadata.txt、封面文案、文章),默认全平台
make check-compliance path=.video-generation/narrations/xxx.json
make check-compliance path=xxx.md platform=douyin # 只查指定平台
# 或直接跑脚本
python scripts/check_compliance.py --path <file...> --dir <dir> --platform all
- 扫:对每个目标文件输出命中报告(词 | 类别 | 平台 | 级别 | 位置 | 建议替换)。
- 改 HIGH:指定平台的 HIGH 全部替换,不留。
- 过 MEDIUM:逐条人工判断——技术比喻语境但审核不认的,能换就换;替换建议见 word-list.md。
- 复扫:目标平台的 HIGH 归零才算过。
- 发布 checklist(INFO,按目标平台确认):
- AI 生成内容声明:抖音/快手/小红书/视频号发布时都要标注 AI 生成
- 封面文字会被 OCR:封面标题同样过一遍本检查
- 结尾 CTA 中性化:不用「关注我/评论区扣XX/加V」,用中性价值钩子
- 口播与画面不出现联系方式(QQ/微信/手机号/二维码/平台名跳转)
- 标题 ≤ 平台字数限制且无极限词堆砌
- 医疗/金融资质类内容超出本 skill 范围,需单独资质审查
- 平台规则持续更新,以各平台官方规则中心为准
脚本
scripts/check_compliance.py(Python 3 stdlib,零依赖):
python scripts/check_compliance.py --path content/posts/xxx.md --platform all # 单文件全平台
python scripts/check_compliance.py --path a.json --path b.txt --platform douyin
python scripts/check_compliance.py --dir .video-generation/narrations # 目录
- 输出 markdown 报告,按平台+级别分组;
--json可输出机读结果。 - 返回码:目标平台 HIGH 命中 1,否则 0(配合 Makefile 门禁)。
- 只定位不自动改——词在不在语境里要人判断,自动替换会改坏内容。
边界(必须知道)
- 词库来自广告法公开条款 + 第三方运营整理(2026 年时效),平台规则持续更新,最终以各平台官方规则中心为准。
- 本 skill 面向技术科普/知识类内容。医疗、金融、带货、教育资质类内容有额外监管(小红书三品一械、视频号金融公约、直播电商监督管理办法),超出本 skill 范围,需单独资质审查。
- 误报处理:专有名词(「天花板」「第一」「教父」作为书名/人名/社区昵称)属 MEDIUM,人工判断保留;判断口诀:这个词去掉,内容受影响吗? 影响就留,不影响就换。
事故案例库(词库扫不出但审核判违规的语义类)
2026-08-20:ccswitch 视频抖音审核「不符合相关法规」
- 症状:词库扫描 HIGH=0(标题/简介/话题都干净),但抖音人工+语义审核判违规。
- 根因(语义类,词库盲区):标题「省掉订阅费的Codex,DeepSeek按量付费直接用」+ 简介里「跳过官方登录」「登录环节整个跳过」「个人月账单几块钱」「你切国产模型后月账单多少」——组合起来是教人绕过官方付费/登录体系 + 金钱话题引导。抖音对此类语义(规避监管、绕过付费墙)审核极严,即使没有一个违禁词。
- 修复:① 标题改「Codex 免费版藏得够深,90% 的人没找到」(免费额度是客观事实,非绕过);② 简介删掉「跳过登录/订阅费/月账单」,重写为中性教程口径(「接上国产模型,配置一次就能用…两个坑提前避」);③ 收尾软话题从「聊聊你的月账单」改「你用的哪个模型,大家聊聊」(避开金钱话题)。
- 教训:
- 词库扫描通过 ≠ 审核通过。涉及「绕过官方登录/付费墙/破解/白嫖」语义的内容,即使词库 0 命中也可能被语义审核拦下——这类主题写标题/简介时就要弱化绕过语义,强调「开源集成/配置流程」。
- 金钱话题(订阅费/月账单/省钱金额)是引导性话题,简介结尾的软话题别往钱上引。
- 发布前自查清单加一条:全文搜「跳过/绕过/免登录/白嫖/省钱」语义,出现即改口径。
- 记录位置:
video-generation/build/codex-ccswitch-deepseek/metadata.txt(修订版)+ 本案例库。
2026-08-20(第二次):ccswitch 合规改写后仍「不适宜公开」→ 主题级违规判定
- 过程:第一次失败后做了全面合规改写(口播 4 卡 + 画面 11 处 + 标题/简介),词库 HIGH=0,口播含「官方本来就支持自定义模型服务商」的合规口径——仍判「不适宜公开」。
- 结论:主题级违规,表述无法拯救。「不挂 ChatGPT 账号也能跑 Codex」「接第三方模型绕过官方账号」这个主题本身在抖音就过不了审——审核按「提供规避商业产品认证的手段」处理,不管你措辞多委婉。判定标准升级:口播核心卖点涉及「绕过官方认证/付费体系」= 主题违规,直接放弃抖音,不要试图改写文案。
- 行动:删除已发布作品(douyin_delete_verified.py),抖音平台放弃该主题;如需保留价值,改为纯「官方支持的自定义模型服务商配置教程」角度重做视频(不出现 ChatGPT 账号/免费/绕过语义,核心卖点改为「官方能力配置」),或转投其他平台(需实测各平台审核)。
2026-08-26:DSH 源码拆解视频抖音判「引导至风险不可控渠道」→ 减少作品推荐
- 症状:视频正常过审发布 16 分钟后收到「减少作品推荐」处罚,违规原因「引导至风险不可控渠道:引导用户脱离平台至其他渠道交易,或引导下载/使用第三方软件」。
- 根因(外链直接违规,词库盲区):metadata.txt 通用简介末行「博客逐章长文:https://xiaoshuai1024.github.io/...」——发布时无
简介_抖音变体,回退继承通用简介,博客外链直达抖音简介。技术博客链接在人看是干货,在审核口径是「引导前往其他网站」。口播里「源码在 GitHub 全开源,建议 clone 下来跟着翻」属同语义灰色地带(叠加放大风险)。 - 修复:① 删抖音作品(通知弹窗会挡 manage 页操作,删除脚本需先关 modal;当时的一次性脚本
scripts/pub/_delete_dsh_now.py已删,modal 处理经验保留在本案例);② 简介删外链行;③ 口播末句改「源码全开源,今天讲的每一处都有据可查」(去动作引导,保留信任状);④ 重合成口播改动句 + 重渲 + 重发。 - 教训:
- 抖音简介禁一切外链——博客/文档/GitHub 链接都不行,「无害技术链接」是人视角,审核按「脱离平台渠道」机器判定。链接只放 B站简介(宽松)。
- 通用简介必须按最严平台(抖音)写——
简介_平台变体缺省时回退通用简介,链接会跟着漏过去。要分平台差异化时通用简介也先去链接。 - 口播「去 GitHub clone」「搜我博客」「网上搜 XX」这类指路句都是同语义风险,软化为「全开源」「有据可查」等状态表述,不给具体出口。
- 发布前自查清单加一条:简介(通用+全变体)与口播全文搜 http/链接/clone/下载/搜我,出现即改。
- 记录位置:
video-generation/build/dsh-source-deep-dive-ep1/metadata.txt(修订版)+ video-generation skill 合规矩阵(简介行已同步改禁外链)。
2026-08-27:codex 教程合规元信息版仍 7 分钟被拒 → 主题级判定三度实锤,元信息合规无效
- 症状:codex-desktop-tutorial(零基础教程,结尾含 CcSwitch+DeepSeek 配置段)在抖音连续两晚三次被拒:①旧口径(标题「登录两条路」+简介「不用订阅不用注册」)→「不适宜公开」;②连夜把口播 8 卡重写为「官方支持的自定义模型服务商配置」口径(订阅/免费/省钱/月费/美元/跳过/绕开/换芯语义簇全片清零,词库 HIGH 归零,AI 声明已选,无外链),标题/简介/话题全新合规版重新上传 → 7 分钟内仍「不适宜公开」(自动审核,无人工介入窗口)。
- 根因(内容级,元信息盲区):抖音审核含 ASR 音频转写 + 画面识别——口播在教「往 Codex 里配第三方模型(CcSwitch 写 config/auth + DeepSeek API key)」,这个动作本身就是判定对象,与标题简介怎么写无关。2026-08-20 的「主题级违规」定级至此完成三度实证且边界收紧:不只是「绕过付费」表述,连中性的「官方支持的配置教程」表述也拒。
- 行动定规(升级,替代 8-20 的判定标准):
- 选题/写稿阶段就筛:口播出现「第三方模型接入官方客户端」教学动作(CcSwitch/config.toml/auth.json/API key 配置演示)的视频,直接不排抖音,不进「改口径重投」循环——每次驳回都消耗同主体累计违规计数(3 次中度全账号限流),改写纯属浪费合成渲染工时。
- 同主题视频照发快手/B站/视频号(三平台均过审,2026-08-26 实证);抖音若非要上,唯一可行路径是剪掉第三方接入段的特供版(核心卖点会变,需用户拍板),或走申诉(成功率未知)。
- 合规改写只对元信息层有效(标题/简介/话题/外链/动作词),对内容级判定无效——先判断违规层级再决定改不改:元信息层违禁词→改了有用;内容层主题→改了没用,直接换平台。
- 伴随发现:抖音 metadata 平台变体管线(标题_抖音/简介_抖音)本身正确(本次复核正确落地);8-26 晚一次未落地是上传器 desc 粘贴偶发失败——发布后必须 check_status 三查(标题/简介/状态),见 video-generation skill「挂定时后必须复核实际状态」。
- 记录位置:
video-generation/narrations/codex-desktop-tutorial.json(合规修订版口播)+scripts/video/codex-101-tutorial-plan.md(合规修订记录)。
2026-08-27:抖音后台互动建议「评论区发命令发你脚本」与审核红线冲突(预拦入库)
- 来源:抖音创作者后台作品优化建议(运营侧官方输出):「结尾增加明确实操步骤引导,如:评论区发命令,我把完整挂载脚本发你」。
- 判定:照抄 = 双高危:①「评论区」三字是 2026-08-17 实锤硬红线(top10 视频判「不适宜公开」);②「发X我回Y」结构 = 利益交换类诱导(互动四禁之首)。
- 定规:平台运营建议 ≠ 审核安全——后台建议系统(拉互动指标)与审核系统(判诱导违规)互不知情,官方建议照抄后被官方审核拒绝不是悖论而是常态。任何来源的建议(含平台官方)入稿前一律过本 skill 词库 + 语义自查。
- 合规等价写法(详见 video-generation skill「实操资料型互动」):可执行具体提问 + 置顶评论主动贴资料 + 简介原文链接,不设交换门槛。
- 记录位置:本条目 + video-generation/SKILL.md「互动与转化引导」节。
2026-08-30:batch15 一夜 15 支批量排期 → B站 21566 投稿频控 + 抖音定时卡重复 ×3(频控类首例)
- 症状:一夜全平台批量排期 15 支(支间隔仅 240s):B站第 9 支起(03:02 起第 8 次投稿后)
code 21566「投稿过于频繁」全阻,04:38→07:00 补发→11:53 重试连续被拒(≥7h);同批抖音 8 支 desc 回读校验三连败(自动化输入缺陷,同 8 支跨 3 会话稳定复现、人工发布正常——非账号风控,勿误诊);快手全程「成功」无拦截;多轮补跑在抖音叠出同档重复定时卡 ×3(重复发布是抖音限流真触发,当日已人工清零并复查每档 1 张)。 - 根因:①B站对第三方上传器(biliup 系)有投稿频控,社区实证约 1h 起冷却、深风控 18h+ 重新登录无效,解锁=官方 App/网页手动投稿一次并过验证码(HUMAN);②固定短间隔无平台差异是设计缺陷;③失败补跑无去重前置检查。
- 行动定规:发布路径接入指数退避
scripts/pub/backoff.py(命中风控特征按 base×2^level 冷却、guard fail-fast、成功归零);单会话单平台 ≤5 支、支间隔 ≥600s;同平台连续 2 次风控特征错误即熔断该平台队列;批量排期前 dup 扫描、批后 dup 复核。细则见 video-generationreferences/publishing.md「平台风控与批量排期守则」。 - 记录位置:
D:/tmp/batch15_schedule.log(04:38 起全败实录)+ video-generation skill publishing.md 守则节。