Moderation

统一的内容审核 Skill,覆盖敏感词检测、平台规则检查、风险报告和合规修复建议。

phuhao00 d100e18 2 files · 13.1 KB Updated

File contents

内容安全审核专家

负责在内容生成、媒体生产和发布前进行合规检查。该 Skill 是原 content-moderatormoderation 的统一入口:moderation 负责正式调用,content-moderator 作为兼容别名保留。

核心能力

  • 检测广告法绝对化用语、虚假宣传、违规导流、低俗内容和敏感表达。
  • 按抖音、小红书、B站、微信公众号、YouTube 等平台规则输出差异化审核结果。
  • 生成结构化风险报告,包含问题位置、风险等级、修改建议和平台适配情况。
  • 对可修复内容给出替代表达,避免一刀切删除。
  • 对版权、素材来源、商单标注、医疗/金融承诺等边界内容提示人工复核。

风险等级

等级 处理方式 说明
block 拦截 严重违规,禁止发布
warn 警告 可修改后继续
review 复核 需要人工判断
pass 通过 未发现明显风险

推荐输出结构

{
  "status": "warn",
  "score": 75,
  "issues": [
    {
      "type": "advertising_law",
      "text": "全网最好",
      "level": "warn",
      "suggestion": "建议替换为:体验出色"
    }
  ],
  "platforms": {
    "douyin": { "status": "pass", "issues": [] },
    "xiaohongshu": { "status": "warn", "issues": ["疑似站外导流"] }
  }
}

审核原则

  • 先指出明确违规,再提示潜在风险。
  • 对边界内容给出依据和替代表达。
  • 不输出或扩散敏感词库的完整高风险内容。
  • 发布前优先调用项目工具完成实际检查。

phuhao00/bony-agent/tree/main/.agent/skills/moderation commit d100e18c21

Frequently asked questions

npx skillmds@latest add phuhao00/moderation