自来水内容洞察挖掘(UGC Insight Mining)
从一批用户自发产出的优质内容里做跨样本归纳,输出团队可规模化复用的方法论 —— 并诚实评估这套方法论用在商业投放上会损失什么。
与
content-methodology-analysis的分工:那个技能是单篇深挖(1 篇 → 个人照着写一篇);本技能是跨样本归纳(N 篇 → 团队规模化生产)。输入、方法、使用者都不同,不要混用。
核心立场(贯穿全文)
- ⚠️ 本技能的概念名都是内部用语,禁止原样出现在交付给用户的产物里 —— 本文档用"跨池衰减""双引擎""北极星指标""可迁移度"这类词,是为了让执行者理解方法。但用户不需要学这套框架,他要的是方案。 交付前必须按
output-readability技能翻译一遍,见文末「交付时的说法对照」 - 不把归纳当规律 —— N 条样本得出的共性,只是"这批样本的共同特征"。要变成规律必须再验证。任何声称"破解了算法"的说法都标 [推测]
- 自然流样本 ≠ 商业投放依据 —— 样本长在社区自然流量池,方法论要用在报备商业流量池,中间有结构性落差。必须显式计算这个跳跃(第 7 章,强制章节)
- 行业中立 —— 主干方法与行业无关;行业规则通过
platform-playbook/references/industries/动态加载,无对应行业包时如实说明,绝不套用相近行业规则 - 业务目标决定指标价值 —— 同一个"收藏率高",在不同转化路径下含义相反。映射必须现场推导,禁止套用其他项目的结论
- 学规律不搬原文 —— 延续团队红线:只提炼可迁移的方法,不搬运原文文案、不复制原画面。使用他人 UGC 做二次传播须取得授权
第 0 步:业务澄清(硬门槛,不清不做)
本技能的一切结论都依赖业务目标。业务目标不清就不出方法论——否则会给出"数据好但对生意没用"的结论。
必须问清(一次最多问 2 个,给选项不要开放式提问):
| 项 | 为什么必须 | 选项示例 |
|---|---|---|
| 身份 | 决定视角与产出形态 | 品牌方 / 代运营 / MCN / 小团队自运营 |
| 行业与品类 | 决定加载哪个行业包 | 并追问是否属强监管(金融、医疗、医美、保健食品、教育、宠物食品等) |
| 北极星指标 | 决定指标优先级 | 开户注册 / 首购 / 复购 / 留资 / 下载激活 / GMV / 品牌认知 |
| 转化路径形态 | 决定火法映射(关键) | 见下方四型判别 |
| 主战场平台 | 决定形态改造方向 | 可多选,但要指出主次 |
| 后续动作 | 决定产出侧重 | 投达人 / 自运营矩阵 / 只做认知参考 |
用户说不清北极星时,帮他澄清而不是追问:
你说想带来新用户 —— 具体是想让人完成注册/开户这类要跟着操作的动作,还是直接下单购买,还是先留个线索后面跟进?这三种的内容打法完全不一样,选错了数据再好也没用。
用户不愿细说时:按最合理假设推进,但明确写出假设,并说明假设错了哪些结论会变。
第 1 步:样本质量体检(先说够不够,不够不硬凑)
1.1 输入要求
必需(每条):
- 内容本体:视频给口播逐字稿或字幕截图;图文给正文 + 封面截图
- 表现数据:赞 / 评 / 藏 / 转(有播放量、点击率更好)
- 发布时间
强烈建议:
- 评论区截图(尤其高赞评论) —— 自来水分析最被低估的富矿。用户在评论里说的才是真实痛点与真实用词,往往比正文更值钱;也能发现被竞品或其他渠道截流的迹象
- 账号量级与该账号的常态数据(用于判断极端值)
- 对照组样本:同题材但没火的 5-8 条
不能只给链接 —— 主流内容平台有反爬与登录墙,无法可靠抓取正文与数据。须用户提供内容与数据本体(文档、表格、截图均可)。
1.2 体检判定
| 检查项 | 门槛 | 不达标怎么办 |
|---|---|---|
| 样本量 | ≥ 10 条可做归纳,建议 15-20 | < 10 条:只做单篇拆解,明确告知无法做跨样本归纳 |
| 数据完整度 | 每条至少有核心互动数据 | 缺数据的样本单独标出,其洞察置信度降级 |
| 极端值识别 | 单条数据 > 该账号均值 10 倍 | 标为孤例,不纳入方法论提炼,只作参考(见 1.3) |
| 对照组 | 建议有 | 无对照组:降级为纯共性归纳,明确告知"无法回答为什么这条火那条没火",结论可信度打折 |
| 评论区 | 建议有 | 缺失时明确说明"用户原话层洞察不足" |
1.3 极端值与均值回归(必须处理)
单条孤例爆款拒绝出方法论。 理由:
一条数据是账号均值 10 倍以上的内容,是该账号内容分布的右尾极端值。它的高数据里有多大比例来自运气(推荐赛马的随机性、恰好撞上流量高峰、被某个大号转发),无法从数据中拆开。
据此提炼方法论会系统性高估内容本身的贡献 —— 照着做的期望值 ≠ 这条样本的实际值。
处理方式:
- 明确标出哪些是极端值,从归纳池中剔除
- 在结论中写明:不要按样本的数据量级设定 KPI 预期
- 优先信任"该账号多次复现"的模式,而非一次性爆发
1.4 优先寻找同博主同题材成对样本(最强证据)
如果样本中存在同一账号、同一题材、只有某一处做法不同的成对内容,这是控制变量最干净的自然实验,证据强度远超泛泛的"爆款 vs 平款"对照。
发现这类样本时:
- 单独成节展示,作为方法论的地基
- 明确指出唯一变量是什么、数据差异有多大
- 这类证据可标 [样本归纳·强],其他共性归纳标 [样本归纳]
主动向用户索取:
你的样本里有没有同一个博主、讲同一件事、但做法有一点不同的两条内容?如果有,那是最有价值的证据 —— 人一样、题材一样,差异就能归到那一处做法上。
第 2 步:业务目标推导 × 火法映射(现场推导,禁止套模板)
2.1 为什么不能套用现成映射
"收藏型离转化最近"这类结论绑定特定转化路径。举例:
| 产品类型 | 收藏意味着 | 哪种火法离转化最近 |
|---|---|---|
| 需要跟着步骤操作(开户、注册、设置) | "我要照着做" | 收藏型(离转化最近) |
| 看完就能买、决策轻(食品、日用、低价) | "再想想"(= 延迟 = 流失) | 分享型 + 完播 |
| 周期长需比较(保险、教育、大额、B端) | "以后用得上" | 评论型(具体提问 = 高意向线索) |
| 不追求即时转化,要心智占位 | 价值有限 | 分享型(转发即心智扩散) |
同一个分析框架,不同项目可以得出相反结论。 这是正常的,也是必须的。
2.2 四种转化路径形态判别
用形态而非行业分类 —— 卖 SaaS 和卖保险都可能是决策型,卖零食和卖美妆都可能是冲动型。
| 形态 | 判别特征 | 主指标 | 次指标 | 该砍什么 |
|---|---|---|---|---|
| 操作型 | 用户须跟着步骤完成动作 | 收藏 | 评论(问操作细节) | 纯理念内容(无可照做动作) |
| 冲动型 | 看完即可决策,客单价低 | 转发、完播 | 点赞 | 长教程(拉长决策=流失) |
| 决策型 | 周期长、需比较、金额大 | 评论中的具体提问 | 收藏 | 纯情绪煽动(不解决决策疑虑) |
| 认知型 | 不追即时转化 | 转发 | 完播 | 硬转化引导(伤及扩散) |
2.3 指标翻译(看用户心里那句话,不看指标名)
| 指标 | 用户在想什么 | 注意 |
|---|---|---|
| 收藏 | "我要照着做" 或 "以后可能用得上" | 两者价值差一个量级,必须结合内容形态区分 |
| 转发 | "我要给某个具体的人看" | 追问:转给谁?那个人是你的目标用户吗? |
| 评论 | "我要表态" 或 "我有具体问题" | 后者才是线索,前者只是流量 |
| 完播 | "我看完了" | 冲动型中最重要,操作型中次要 |
| 点赞 | "还不错" | 最弱信号,不作主指标 |
2.4 反向校验(每条映射都要过)
这个指标涨了,我的北极星会不会跟着涨?
答不上来的映射是伪映射,删掉。
2.5 输出
- 本项目专属映射表(基于北极星 + 路径形态推导得出,注明推导依据)
- 指标优先级排序 + 每个指标的"用户心里那句话"
- 该砍什么 —— 哪类内容数据好但离北极星远,给不给配额、给多少
第 3 步:双引擎判定
跨样本归纳的第一层结论:能火的内容通常只做对了两件事之一——
| 引擎 | 用户的反应 | 表现特征 |
|---|---|---|
| 可照做引擎 | "先存下来,回头照着弄" | 收藏显著高于点赞 |
| 可转述引擎 | "太戳了,转给某个人看" | 转发显著高于点赞 |
只讲道理、不给这两个抓手的内容,通常起不来。
补充的第三种(视内容形态决定是否适用): | 即时冲动引擎 | "看完就想试" | 完播高 + 点赞高,收藏反而低(冲动型场景常见) |
逐条判定每个样本属于哪个引擎,并统计分布。分布本身就是洞察 —— 如果 15 条里 12 条是可转述型,说明这个品类的自来水天然靠情绪扩散,规模化时要保住这一点。
第 4 步:逐条复制卡
对最有代表性的 5-6 条(不是全部)做卡片化拆解。每张卡固定五栏:
| 栏位 | 内容 |
|---|---|
| 讲了啥 | 一句话概括内容(不复制原文) |
| 为什么火 | 落到手法层,不落到内容结论层 |
| 骨架(照着填) | 3-5 步可执行结构,每步一行 |
| 换成你的怎么填 | 明确哪些是可替换变量(人物/场景/数据/落点) |
| 主冲什么目标 | 对应第 2 步推导出的映射(拉新 / 转化 / 曝光 / 复购) |
卡片顶部标注目标标签,让运营按当期 KPI 挑卡复制。
第 5 步:深层真相三层挖掘 + 入口矩阵
5.1 痛点三层
同一个产品,痛点有三层,只有第一层是必然雷同的:
| 层 | 内容 | 差异化空间 |
|---|---|---|
| 表层·功能对应 | 产品功能的镜像(怕不安全、不会用、买不到) | 必然雷同,无差异化空间 |
| 中层·生活场景 | 什么事件触发了这个需求 | 开始分化 |
| 深层·真相 | 用户不好意思明说、但真正驱动决策的那件事 | 高度个人化,自来水打动人的一定在这层 |
⚠️ 第三层不限于"情感" —— B 端与专业品类的第三层是职业处境:怕背责任、怕被上级问倒、怕选错被追责、想证明自己的判断正确。消费品的第三层可能是自我怀疑、隐性羞耻、时间焦虑、身份认同。挖的是"难以明说的真实驱动力",不是"情绪"。
5.2 同质化的真正原因
不是产品雷同,是 Brief 只写到第一层:
- Brief 写"突出安全、便捷、省心三大卖点" → 交回来 20 个模子
- Brief 写"你和这件事之间,哪个瞬间最难开口" → 交回来 20 个故事
5.3 情感/真相入口矩阵
从样本中聚类出该产品有几个可用入口,输出:
| 入口 | 适配什么样的达人 | 用户原话怎么说 | 会与哪个入口撞车 |
|---|
分配纪律:
- 每个入口只给 2-3 个达人,避免入口内部撞车
- 不同入口不互相消耗题材新鲜度(20 条同入口内容会互耗,20 个不同入口不会)
- 找出空白入口 —— 全样本没人做过的视角,稀缺即机会
5.4 用户原生话术库
从正文与评论区提取用户自己的说法,分类整理:
| 类别 | 内容 |
|---|---|
| 痛点原话 | 用户怎么描述自己的问题 |
| 惊喜点原话 | 用户觉得好在哪、怎么夸的 |
| 对比原话 | 用户拿它跟什么比、怎么比的 |
| 疑虑原话 | 用户犹豫什么、担心什么 |
这是自来水最大的金矿 —— 品牌方永远写不出用户的话。引用时只截短语(≤15 字),不搬整句。
5.5 不可替代产品动作识别
从样本中找出用户自发反复提及、但品牌从未放大的产品动作或使用方式。
判断准则:用户已经在替你传的东西,就是你该放大的东西。
这类动作通常具备三个特征:竞品学不走、天然带情绪、同时完成"产品演示"与"自我表达"。
第 6 步:广告感自查清单
核心认知:报备类商单在多数平台并不带广告标识(只有在广告素材投放流程中才有)。所以广告感不是平台打的标,而是内容自己泄漏的。
这意味着 —— 真实感不会被平台强制剥夺,只会被自己写坏。 而这是投放中唯一完全可控的一层,所以值得单独立清单。
| 检查项 | 会露馅的做法 | 不露馅的做法 |
|---|---|---|
| 产品出现时机 | 开头就报产品名 / slogan | 情感或价值立住之后,在"具体怎么做"处自然带出 |
| 产品信息量 | 讲全卖点、讲参数条款 | 只讲最必要的 2-3 件事,其余放评论区回 |
| 表达动机 | 从"我想说这件事"变成"我要把产品讲进去" | 保留真实的表达冲动,产品是工具不是主角 |
| 细节真实度 | 摆拍、道具化、完美无瑕 | 保留真实环境、真实瑕疵、真实卡顿 |
| 评价方式 | 全是好评、无缺点 | 有真实取舍与适用边界 |
| 结论强度 | 承诺效果、给普适结论 | 限定在自己的使用范围内 |
| 关键位置占用 | 卖点占掉了最锋利的那几秒 | 最锋利的位置留给最动人的部分 |
最容易翻车的三处(按样本反推,非通用结论时须标注):开头报产品名、把独特动作讲成功能列表、承诺效果。
第 7 步:跨池衰减评估(⚠️ 强制章节,不可省略)
任何从自然流样本产出的方法论,输出时必须包含本章节。 缺了这一章,读者会直接照着投商单,然后归因错误。
7.1 平台流量的三层结构(先讲清概念)
三层正交,不是递进:
| 层 | 内容 | 谁能感知 |
|---|---|---|
| 社区自然流量 | 未报备内容,走推荐赛马 | —— |
| 报备商业流量 | 经官方接单平台(如星图 / 腾讯互选 / 蒲公英)报备后进入,自然推荐降权 | 只有平台,观众无感 |
| 付费加热工具 | DOU+ / 微信豆 / 薯条 / 二次推广 / 聚光 / 千川等 | 买曝光,不改变内容属于哪个池子 |
| (另一维)广告素材投放 | 二次推广中选择将达人内容作为广告素材 | 观众可见标识 |
可信度:报备后自然流落差为 [行业共识](大量创作者反馈趋同,无官方口径)。严禁给具体衰减系数或折扣比例 —— 没有任何平台公开过,给数字就是编造。
7.2 六因子连乘拆解
内容效果不是一个数,是多个因子连乘(不是相加)。这就是为什么几个"看起来只差一点"的折扣,会造成量级落差:
| 因子 | 迁移到商业投放时的变化 | 能否补救 |
|---|---|---|
| 内容范式(结构/钩子/话术) | 基本不变 —— 这是唯一被"借鉴"过来的 | ✅ 可迁移 |
| 题材新鲜度 | 下降 —— 算法与观众都见过了;第一个说的人吃流量 | ⚠️ 换角度可部分恢复 |
| 表达动机 | 下降 —— 从"想说"变成"交活" | ✅ 可改善(见第 6 步) |
| 产品诉求挤压 | 下降 —— 卖点占掉了原本用来打动人的位置 | ⚠️ 可优化编排 |
| 分发池身份 | 下降 —— 报备后自然推荐降权 | ❌ 不可补救 |
| 运气 / 极端值 | 回归常态 —— 通常是最大的一刀 | ❌ 不可补救(统计规律) |
7.3 三层损失与可补救性
| 层 | 迁移损失 | 可控性 |
|---|---|---|
| 内容层 | 基本无损 | ✅ 方法论的主体 |
| 观众心态层(广告感) | 取决于内容做得好不好 | ✅ 唯一完全可控的杠杆 |
| 分发身份层 | 结构性损失 | ❌ 报备了就是报备了;加热工具只能补曝光,补不回身份 |
7.4 必须写给用户的三句话
- 不要按样本的数据量级设定 KPI —— 样本是筛出来的右尾,照着做的期望值低于样本实际值
- 分发层的落差是平台机制,不是你的内容能力问题 —— 不说清这点,团队会误判为执行不到位
- 复制范式不等于复制效果 —— 范式是外壳,动机与首发权是内核,内核不可迁移
7.5 报备与否的权衡(摊开代价,不替用户决定)
| 路径 | 得到 | 代价 |
|---|---|---|
| 报备接单 | 可控、可排期、合规 | 分发身份降权 |
| 不报备、只做产品配合(给产品/权益/素材支持,让创作者继续在自然流表达) | 保住动机与分发身份 | 不可控、不能要求排期、未报备的商业合作存在平台违规风险 |
这不是"哪个更好",是两种权衡。 把代价讲清,由用户决定。
7.6 正确路径:重新创造,而非复制
内核不可迁移,所以正确做法不是让达人重演那条内容,而是:
- 从自来水中提炼为什么这件事值得说(动机源)
- 让达人找到他自己真实的同类经历(换内核,保外壳逻辑)
- 或者反过来 —— 设计一个能让人真的想说的场景
⚠️ 底线:入口用来筛选达人,不是分配剧本。先问达人真实有哪段经历,按真实经历分配入口;匹配不上就换人,不要让他演。反向操作(先定入口再让达人填故事)会得到假故事 —— 观众看不到广告标识,但看得出假。
第 8 步:可信度标注
针对"平台算法是黑盒、网上的运营方法论多为经验总结"这一现实,每条结论必须标注来源层级:
| 标注 | 含义 | 例 |
|---|---|---|
| [官方] | 平台官方文档或法规明确写过 | 平台创作者文档中的规则说明 |
| [样本归纳·强] | 有同博主同题材对照的自然实验支撑 | 控制变量后的差异 |
| [样本归纳] | 从本批样本统计得出,样本内成立,不保证普适 | "15 条里 12 条在开头出现了 XX" |
| [行业共识] | 大量从业者实践趋同,无官方背书 | 报备后自然流落差 |
| [推测] | 逻辑推演,未验证 | 算法可能在识别什么信号 |
纪律:
- 不把归纳当规律
- 不输出伪精确数字(衰减系数、通过率、权重占比)
- 少于 3 条样本支撑的"共性"不写成结论,写成"待观察"
第 9 步:跨平台改造 + 达人 Brief 骨架 + 适用边界
9.1 三层可迁移度(跨平台)
| 层 | 内容 | 跨平台可迁移度 |
|---|---|---|
| L1 人性层 | 什么打动人、真实痛点、用户用什么词 | 高 —— 人性不分平台 |
| L2 形态层 | 结构、钩子位置、信息密度、节奏 | 中 —— 洞察可迁移,形态必须重做 |
| L3 分发层 | 算法偏好、流量池、红线、加热工具 | 极低 —— 必须按平台重来 |
形态改造示例(须按实际平台机制填写,不套用):短视频的"前几秒钩子"→ 图文平台的等价物是"封面 + 标题";完播率驱动 → 点击与收藏驱动。
9.2 达人分发 Brief 骨架
把方法论转成可直接下发的简报。锁死与放开分清:
| 维度 | 处理 | 原因 |
|---|---|---|
| 产品事实与功能口径 | 锁死,统一表述 | 避免各自解释出错、有合规风险 |
| 合规红线 | 锁死 | 不可协商 |
| 转化动作与承接路径 | 锁死 | 保证转化一致 |
| 切入的真相入口 | 彻底放开 | 唯一的差异化来源 |
| 触发场景 | 彻底放开 | 场景不同故事就不同 |
| 表达形式与结构 | 放开,只给参考 | 各达人风格资产不同 |
卖点雷同不是问题,入口雷同才是问题。
Brief 骨架含:达人匹配问卷(问真实经历)→ 分配的入口 → 锁死项清单 → 参考骨架 → 合规红线 → 承接动作 → 交付与审核节奏。
与
brand-deal-brief技能互为镜像:那个是创作者收到 Brief 怎么拆,本节是甲方发 Brief 怎么写。
9.3 适用边界声明(必须输出)
方法论会被跨场景误用,所以必须写清失效条件:
| 换了什么 | 哪些结论会失效 |
|---|---|
| 换赛道/品类 | 深层真相层需重挖;情感入口不可移植 |
| 换平台 | L2 形态层全部需重做;L3 分发层完全重来 |
| 换转化动作 | 第 2 步的火法映射需重新推导(可能得出相反结论) |
| 换样本类型(自然流 → 商单) | 第 7 章的衰减评估前提改变,需重新评估 |
| 时间推移 | 平台机制与法规会变;标注认知截止日期 |
输出结构(标准交付物)
⚠️ 分析顺序 ≠ 交付顺序。 上面九步是你的执行顺序;下面才是给用户看的排列顺序。 用户要先拿到能用的东西,不该被迫先看你怎么验样本、怎么做推导。
交付排列(按 output-readability 的分层交付要求):
第一屏 可以直接开工的结论 3-5 条,每条都能执行。用户只看这段也能动手
├─ 该往哪几个方向做内容
├─ 该重点看哪个数据、别看哪个
├─ 达人怎么分工
└─ 照着做之前必须知道的落差(来自第 7 步,用大白话讲)
第二屏 具体怎么做 能直接抄的部分
├─ 逐条复制卡(5-6 张)
├─ 可以切进去的几个角度 + 达人怎么配(来自第 5 步)
├─ 用户自己的说法(原话库)
├─ 别把内容做得像广告的自查清单(第 6 步)
└─ 达人 Brief 骨架(第 9 步)
第三屏 为什么这么建议 愿意深究的人再看
├─ 这批样本里我们看到了什么(第 3、4 步的判断依据)
├─ 为什么这个数据重要而那个不重要(第 2 步的推导)
└─ 样本情况说明:哪些没算进去、为什么(第 1 步)
第四屏 什么情况下这套不成立 风险与边界
├─ 每条结论有多靠得住、依据是什么(第 8 步,不用 L0/L1 这类标签)
├─ 行业合规约束(第 9 步,保留严谨度)
└─ 换品类、换平台、换目标时哪些会失效
为什么这样排:小团队拿到报告最想知道的是"我明天该干什么"。样本体检和推导过程是我们该做的功课,但不是用户该先读的内容。
交付时的说法对照(强制执行)
本技能的概念名一律不出现在产物里:
| 内部用语 | 产物里怎么说 |
|---|---|
| 跨池衰减 / 分发身份层 | 换个场子打,成绩会不一样 / 平台怎么派流量变了 |
| 双引擎判定 | 火的内容分两种:让人想转发的、让人想收藏的 |
| 可转述引擎 / 可照做引擎 / 即时冲动引擎 | 让人想转给朋友的 / 让人想存下来照做的 / 让人看完就想试的 |
| 北极星指标 | 你最想要的那个结果 |
| 转化路径形态 / 操作型·冲动型·决策型·认知型 | 用户从看到内容到下单要走几步 / 要跟着操作的·看完就能买的·要比较很久的·只求让人记住的 |
| 深层真相三层 | 痛点有三层,越往下越是真心话 |
| 入口矩阵 | 可以从哪几个角度切进去 |
| 均值回归 / 右尾极端值 / 孤例 | 那条爆款是偶然,不是常态 |
| 六因子连乘 | 五六个地方各差一点,乘起来就差一大截 |
| 可迁移度 L1/L2/L3 | 哪些能直接搬、哪些得改、哪些必须重来 |
| 可信度 L0/L1/L2 / [样本归纳] / [行业共识] | 这条有官方文件依据 / 这条是从你这批内容里看出来的,换个品类不一定成立 / 这条是行业里的普遍经验,平台没公开说过 |
| 归因 / 反向校验 / 正交 / 置信度 | 到底是什么造成的 / 反过来验证一下 / 是两件事 / 有多靠得住 |
同时禁止出现"人话版""翻译成人话""用大白话讲""结论先行"这类说法——直接那么写,不要宣告。
篇幅:核心内容(第一至三屏)控制在约 6000 字内。用户读不完的部分等于没写。
合规与红线
- 版权 —— 规模化复制他人 UGC 涉及版权。只提炼方法,不搬运原文与原画面;引用作证据时截短语(≤15 字)并标注为原文片段。将用户自发内容用于二次传播或广告素材,须取得授权
- 虚假种草与铺量 —— 部分平台对素人矩阵铺量、虚假种草有明确治理。规模化时须提示这一风险,不提供规避检测的手段
- 测评类形态 —— 部分行业的测评内容受专门规范约束(如宠物食品用品)。自发测评与收费测评在规范上是两种性质,不能简单照搬形态,须按行业包核对
- 不编造 —— 样本数据、用户原话、评论内容一律不得虚构;缺失就说缺失
- 拒绝洗稿式请求 —— 用户要求"照这条改一改就发"时拒绝,说明平台风险与无长期价值,改为提供结构与手法
常见情况处理
| 情况 | 处理 |
|---|---|
| 只给了链接 | 说明无法可靠抓取,请用户提供内容与数据本体 |
| 样本 < 10 条 | 降级为单篇拆解,明确告知无法做跨样本归纳 |
| 只有 1 条爆款 | 拒绝出方法论,说明极端值与均值回归 |
| 无对照组 | 降级为纯共性归纳,告知无法回答"为什么这条火那条没火" |
| 无评论区截图 | 原生话术库部分标注"数据不足",不编造用户原话 |
| 缺表现数据 | 无法区分"内容好"与"恰好被推荐",明确降级该样本置信度 |
| 用户所在行业无行业包 | 如实说明,只给通用框架建议,不套用相近行业规则 |
| 样本全是商单内容 | 指出样本性质与自来水不同,结论方向会变,需重新界定分析目标 |
| 用户要求给衰减系数 | 拒绝,说明无官方数据、给数字即编造;改为定性描述方向 |
| 用户不愿说北极星 | 按最合理假设推进,写明假设及"假设错了哪些结论会变" |