# Topic Discovery Toolkit

> 话题发现方法库。基于用户洞察与人群扩展，发现目标人群正在关注、搜索、讨论、抱怨的八类话题，区分语料来源与推测，不编造平台数据。

- Skill: `ahang1598/topic-discovery-toolkit` (Agent Skill)
- Install (CLI): `npx skillmds@latest add ahang1598/topic-discovery-toolkit`
- Raw SKILL.md: https://api.skillmd.com/api/skills/ahang1598/topic-discovery-toolkit/raw
- Safety review: pending (external: skill-scanner PASS, skillspector PASS)
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Product & Planning
- Author: ahang1598 (https://skillmd.com/u/ahang1598)
- Updated: 2026-09-09
- Page: https://skillmd.com/skills/ahang1598/topic-discovery-toolkit

---


# 话题发现方法

**核心问题：这些人正在关心什么？**

⚠️ **不是做热点。** 热点是「现在大家都在聊什么」，我们要的是「这群人长期在为什么问题发愁」。热点归郝选题管，我们管人群的问题空间。

## 一、话题从哪来

必须基于两个上游输入，**不能凭空想**：

```
用户洞察（真实痛点 + 用户原话）
        +                      → 话题池
人群扩展（待验证人群的可能问题）
```

两个来源的话题**可信度不同，必须分开标**：

| 来源 | 标注 | 可信度 |
|---|---|---|
| 语料里用户真的问过/抱怨过 | 「语料里出现过」+ 原话 | 高，可优先做 |
| 从人群扩展推出来的 | 「推测」 | 待验证，做的时候当测试 |

## 二、八类话题

每类至少给 2-3 个，用**用户会说的话**来写，不要用行业术语：

| 类型 | 用户处于什么状态 | 例子 |
|---|---|---|
| **痛点话题** | 正在难受，还没找解法 | 产品做好了没人用怎么办 |
| **求解话题** | 在主动找方法 | 独立开发者怎么找到第一批用户 |
| **决策话题** | 在两个选项之间纠结 | 新产品应该先做内容还是投广告 |
| **工具话题** | 在找具体工具/方法 | AI 编程做出来的产品怎么推广 |
| **结果话题** | 想看别人做到了什么 | 怎么找到第一批付费用户 |
| **经验话题** | 想学别人怎么做的 | 一个人做产品是怎么做到月入过万的 |
| **案例话题** | 想看完整过程 | 从 0 到 100 个用户我做了什么 |
| **避坑话题** | 怕犯错 | 独立开发最容易踩的几个推广坑 |

**哪类优先？** 痛点话题和求解话题转化最直接（用户正在难受、正在找解法），案例和经验话题传播最好。**一般先做求解，因为搜索意图最明确。**

## 三、每个话题的必填字段

| 字段 | 说明 |
|---|---|
| 话题名称 | 用用户的说法，不用行业术语 |
| 对应人群 | 哪一类人关心这个（对应人群扩展的分档） |
| 用户为什么关心 | 背后的真实动机 |
| 用户处于什么场景 | 什么时候会想到这个问题 |
| 用户可能的搜索词/表达 | **多给几种说法**，用户不会用书面语搜 |
| 用户可能提出的问题 | 具体的问法 |
| 适合什么内容形式 | 短图文 / 长文 / 清单 / 案例复盘 / 对比 |
| 与产品的关联方式 | 产品怎么自然出现，不硬塞 |
| 内容转化目标 | 看完希望用户做什么 |
| 推荐优先级 | 高 / 中 / 低 + 理由 |
| 来源 | 语料 / 推测 |

## 四、搜索词怎么给

这是话题发现最实用的产出。**用户不会用书面语搜索**，要给他们真实会打出来的字：

❌ 书面表述：「独立开发者用户增长策略」
✅ 真实搜索：
- 独立开发 怎么推广
- 做完的软件没人用
- 一个人做产品怎么找用户
- 小程序上线了没流量
- 独立开发者 第一批用户

**给 4-6 个不同说法**，覆盖不同表达习惯（有人搜长句、有人搜关键词）。

## 五、不编造数据（硬规则）

**没有真实数据来源就不写数字。**

❌ 禁止：
- 「这个话题月搜索量 8000」
- 「热度指数 85」
- 「该人群规模约 50 万」
- 「小红书相关笔记 1.2 万篇」

✅ 可以写（能数清的）：
- 「这个问题在你的语料里出现过 3 次」
- 「有 2 位用户用了几乎一样的说法」
- 「这是推测，还没有数据支撑」

需要真实平台数据时，交给**爆款解析技能**（能按品类实时检索小红书真实高互动笔记），不要自己编。

## 六、话题优先级怎么排

| 判断因素 | 怎么看 |
|---|---|
| 是否来自真实语料 | 语料话题 > 推测话题 |
| 搜索意图强度 | 「怎么办」「怎么做」类 > 泛泛了解类 |
| 与产品的关联紧密度 | 能自然带出产品 > 硬拗 |
| 竞争密度 | 已经很多人写了的，要有新角度才做 |
| 验证价值 | 做了能验证一个人群假设 > 只能涨阅读 |

**优先做：语料来源 + 搜索意图明确 + 能验证人群假设的话题。**

## 七、话题要服务于陌生用户触达

每个话题都要能回答：**「陌生人为什么会看到这条内容？」**

- 靠搜索进来 → 搜索词要准
- 靠推荐进来 → 标题要有共鸣感
- 靠转发进来 → 要有「这说的就是我」的感觉

❌ 只有已有用户才看得懂的话题，不适合做陌生人触达。
✅ 陌生人一眼就知道「这是在说我」的话题才有价值。

## 八、输出前自检

- [ ] 每个话题标了来源（语料 / 推测）
- [ ] 语料来源的话题附了用户原话
- [ ] 没有编造搜索量、热度、人群规模
- [ ] 搜索词给了多种真实说法，不是书面语
- [ ] 每个话题都对应到具体人群
- [ ] 每个话题都能回答「陌生人为什么会看到」
- [ ] 最后有「下一步」：先做哪 2-3 个话题、怎么看有没有效

