# Style Modeler

> 当用户需要学习某种风格、提取写作配方、建立风格库或模仿特定作者时调用。通过证据账本、风格内核、15维度分析和仿写验证，提取作者的判断方式、素材选择、论证推进和语言指纹，避免只做表层模仿。触发词：风格建模、提取风格、学习风格、模仿写作、解构文章、写作配方、风格库。

- Skill: `wangjiawei508/style-modeler` (Agent Skill, multi-file: 4 files)
- Install (CLI): `npx skillmds@latest add wangjiawei508/style-modeler`
- Raw SKILL.md: https://api.skillmd.com/api/skills/wangjiawei508/style-modeler/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- Author: wangjiawei508 (https://skillmd.com/u/wangjiawei508)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/wangjiawei508/style-modeler

---


# 风格建模专家 (Style Modeler)

## 指令 (Instructions)

当用户希望"学习某种风格"、"提取文档风格"或"建立风格库"时，请执行以下深度解构流程。

### 1. 获取样本、预处理与策略路由

#### A. 输入处理

**单篇文章或多篇文章**：
- 如果用户提供 URL，先调用 `web-article-extractor` 提取正文
- 微信公众号需使用绕过安全限制的模式
- 提取成功后保存到 `docs/` 文件夹（格式：`YYYY-MM-DD-文章标题.md`）

**多篇文章批量建模**：
- **串行提取**：依次调用提取工具，避免并发触发风控
- **超级样本构建**：拼接所有文本为单一长上下文（格式：`=== 样本1：标题 ===\n内容...`）
- **整体分析**：对超级样本进行统一建模，不要单独建模每篇

#### B. 身份核验与增量迭代

提取完内容后，立即执行作者身份检查：

1. **提取锚点**：从元数据获取作者或公众号名称
2. **库检索**：检索 `.claude/styles/` 目录
3. **路由决策**：
   - **新作者**：执行标准建模流程，新建风格文件
   - **已存在**：执行融合迭代（读取旧档案 → 验证旧特征 → 补充新特征 → 修正冲突 → 更新文件）

### 2. 先建证据账本，禁止无证据总结

在任何风格归纳前，先建立一份**证据账本**。不要直接写“作者现实主义”“语言犀利”“善用类比”这种空结论。

证据账本必须包含：

| 字段 | 要求 |
|------|------|
| **观察现象** | 样本里具体出现了什么写法 |
| **原文证据** | 摘录原文，不少于一句 |
| **出现位置** | 样本标题或编号 |
| **功能判断** | 这句话在文章里起什么作用 |
| **可复用规则** | 下次写作时如何复现 |
| **适用边界** | 什么主题适用，什么主题不适用 |

硬规则：
- 每个核心结论至少要有 2 条原文证据支撑。
- 只出现 1 次的特征只能写成“可能特征”，不能写成稳定风格。
- 不允许把样本主题当成作者风格。例如作者写过互联网，不等于所有仿写都要举互联网例子。

更完整的方法见：[references/style-core-and-validation.md](references/style-core-and-validation.md)

### 3. 十五维度深度解构 (15-Dimension Deep Analysis)

对样本文本进行 15 个维度的深度分析。详细说明请参考：[references/15-dimensions.md](references/15-dimensions.md)

**15 个维度概览**：

01. **作者画像与核心人格** - 理解作者是谁
02. **思维内核与论证逻辑** - 提取底层思维模式
03. **创作路径还原** - 从选题到成文的过程
04. **互动设计** - 与读者的互动模式
05. **开头模式** - 文章开头的固定模式
06. **段落过渡模式** - 段落之间的连接方式
07. **句式与节奏** - 句子结构和节奏特征
08. **词汇指纹** - 最具辨识度的词汇
09. **修辞手法** - 常用的修辞技巧
10. **结尾模式** - 文章结尾的固定模式
11. **格式与排版** - 视觉呈现特征
12. **独特习惯与招牌动作** - 最具辨识度的 5-10 个特征（核心）
13. **反AI特征** - 让读者感觉"这不是AI写的"
14. **典型段落模板** - 3-5 个代表性段落
15. **禁忌清单** - 绝对不能使用的元素

**重要提示**：15 维度只是中间层，不是最终目标。维度12（招牌动作）很重要，但必须说明触发条件、使用边界和反例，不能只列口头禅。

### 4. 提炼风格内核

在 15 维度之后，必须额外提炼**风格内核**。这是用来解决“形似神不似”的核心步骤。

必须回答：

1. **这个作者首先看见什么**：面对一个题目时，他第一反应看利益、人性、结构、荒诞、代价，还是情绪？
2. **这个作者会自动排除什么**：他不会从什么角度写，不会用什么案例，不会给什么建议？
3. **论证发动机是什么**：他如何从现象推到判断，中间靠什么转折？
4. **素材选择偏好是什么**：他选择什么人、什么场景、什么代价、什么细节？
5. **情绪曲线是什么**：开头、中段、结尾分别是什么温度？
6. **读者关系是什么**：他是在骂读者、拉读者、教育读者，还是陪读者想明白？
7. **最小可复现配方是什么**：换一个新主题时，用 5-7 条硬规则说明怎么写才像。

### 5. 仿写验证与反向修正

生成风格文件前，必须做一次**陌生主题仿写验证**：

1. 选择一个样本文本中没有出现过的新主题，写 300-500 字短段。
2. 按 5 个维度自评，每项 0-2 分：
   - 切入角度是否像
   - 素材选择是否像
   - 论证推进是否像
   - 句式节奏是否像
   - 情绪和读者关系是否像
3. 总分低于 8 分，必须回到风格内核做**反向修正**，不能直接输出最终风格文件。
4. 如果只是在堆口头禅、套句式、复刻原样本主题，要明确标为**形似陷阱**并修正。

### 6. 生成或更新风格文件

在 `.claude/styles/` 目录下创建或**覆盖更新**风格文件。如果是增量更新，请保留原文件主体结构，但根据新样本调整内容，并在 Front Matter 中更新 `last_updated`。

**硬规则：**
- 所有风格文件都必须带 YAML Front Matter。
- 最低必填字段只有 3 个：`author`、`source_count`、`last_updated`。
- 如果是历史遗留文件，且样本数已经无法可靠追溯，允许写 `source_count: null`，不要编造数字。
- 更新旧文件前，若发现没有 Front Matter，必须先运行：
  - `.claude/skills/风格建模/scripts/normalize_style_frontmatter.py .claude/styles --refresh-existing`

基本格式如下：

```markdown
---
author: [作者或公众号名]
source_count: [样本数；历史未知时填 null]
last_updated: [YYYY-MM-DD]
---

# 风格名称：[用户起名]

## 00. 风格内核：不可替代的判断方式

### 这个作者首先看见什么
[面对一个新题目时，作者优先观察的层面：利益/结构/人性/代价/荒诞/情绪]

### 这个作者会自动排除什么
[不会怎么写、不会用什么角度、不会用什么案例]

### 论证发动机
[从现象到判断的推进方式，必须能迁移到新主题]

### 素材选择偏好
[偏爱什么人、场景、细节、代价；拒绝什么素材]

### 情绪曲线
[开头、中段、结尾的温度变化]

### 读者关系
[作者和读者的关系：平视/训诫/陪伴/拆穿/挑衅]

### 最小可复现配方
1. [硬规则1]
2. [硬规则2]
3. [硬规则3]

## 01. 作者画像与核心人格
- **基础特征**：[年龄/职业/背景]
- **性格特质**：[现实主义/犬儒/温和...]
- **社会角色**：[具体描述]
- **核心人格**：[具体描述]

## 02. 思维内核与论证逻辑
- **核心世界观**：[具体描述]
- **价值判断**：[真实vs体面/...]
- **分析模式**：[现象→机制→人性→出路]
- **问题意识**：[关注什么核心问题]

## 03. 创作路径还原
- **痛点捕捉**：[如何发现选题]
- **经验调取**：[亲身经历/身边案例]
- **逻辑搭建**：[递进结构/...]
- **现实化翻译**：[如何具象化]

## 04. 互动设计
- **读者预设**：[画像]
- **互动技巧**：[预判质疑/共情引导/...]
- **引导策略**：[提供框架/...]

## 05. 词汇指纹
- **口语连接词**：[那问题来了/...]
- **高频动词**：[搞/弄/整/...]
- **程度副词**：[超级/巨/...]
- **禁用词**：[赋能/抓手/...]

## 06. 句式与标点
- **典型句式**：[设问-回答/对比/...]
- **标点习惯**：[大量逗号/...]

## 07. 开头与结尾配方
- **开头模式**：[背景交代/问题引入]
- **结尾模式**：[开放式/建议式]
- **示范**："[摘录开头]"; "[摘录结尾]"

## 08. 过渡与连接
- **典型过渡词**：[说到这里/当然了]
- **连接逻辑**：[设问引导/...]

## 09. 修辞手法
- **核心修辞**：[生活化类比/...]
- **反问频率**：[高/中/低]

## 10. 格式与排版
- **小标题**：[不用/...]
- **强调方式**：[加粗/...]

## 11. 招牌动作（最具辨识度！）
1. [动作名称] - [描述]
   > 示范："[原文]"
2. [动作名称] - [描述]
   > 示范："[原文]"
...

## 12. 反AI特征
- [具体特征]
- [具体特征]

## 13. 段落模板库
### 观点段模板
"[原文摘录]"

### 举例段模板
"[原文摘录]"

### 转折段模板
"[原文摘录]"

### 收尾段模板
"[原文摘录]"

## 14. 禁忌清单
- ❌ 禁用词：[...]
- ❌ 禁用句式：[...]
- ❌ 禁用态度：[...]

## 15. 使用说明
写作时，请严格遵守以上配方。每写完一段，对照本文件检查是否符合风格要求。

## 16. 仿写验证与失败修正

### 陌生主题测试
- **测试主题**：[样本中未出现过的新主题]
- **仿写片段**：[300-500字]

### 自评分
| 维度 | 分数 | 依据 |
|------|------|------|
| 切入角度 | 0-2 | [说明] |
| 素材选择 | 0-2 | [说明] |
| 论证推进 | 0-2 | [说明] |
| 句式节奏 | 0-2 | [说明] |
| 情绪和读者关系 | 0-2 | [说明] |

### 形似陷阱
- [哪些地方只是套了口头禅或句式]

### 反向修正
- [根据仿写失败暴露的问题，修正风格内核或使用说明]
```

## 最佳实践

- **风格内核优先**：先抓作者的判断方式，再抓句式和口头禅
- **招牌动作要写触发条件**：必须说明什么时候用、为什么用、什么时候不用
- **多摘录原文**：风格文件中至少要有 10 处原文摘录作为模板
- **画像要有证据**：只有被原文反复证明的画像，才能写进稳定规则
- **必须做仿写验证**：不通过验证的风格文件不能算完成

