# Transcript Organizer

> 语音转文字整理优化工具。当用户说"整理语音稿"、"转写整理"、"帮我改改这段语音转的文字"、"这个会议记录太口语化了"、"把语音转的文字弄通顺"、"提取要点"、"精简内容"时必须使用此技能。支持三种模式：保留（默认）- 保留原文只修正口语和错误；优化 - 优化表达删除冗余；提炼 - 大幅精简只保留核心。

- Skill: `xindoo/transcript-organizer` (Agent Skill)
- Install (CLI): `npx skillmds@latest add xindoo/transcript-organizer`
- Raw SKILL.md: https://api.skillmd.com/api/skills/xindoo/transcript-organizer/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: xindoo (https://skillmd.com/u/xindoo)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/xindoo/transcript-organizer

---


# Transcript Organizer

整理语音转文字后的内容，去除口语化表达并优化为更书面化的文本。

## 触发场景

当用户提到以下内容时，必须使用此 skill：
- "语音转文字"、"语音稿"、"转写"
- "会议记录"、"访谈整理"、"播客整理"
- "口语化"、"太乱了"、"帮我改改"
- "精简"、"提炼"、"取核心"
- 任何看起来像语音识别结果的原始文字

## 使用方式

### 方式一：直接输入（最常用）
```
帮我整理一下这段语音转的文字：
[粘贴原始内容]
```

### 方式二：指定模式
```
/语音稿整理 精炼
[内容]

/语音稿整理 平衡
[内容]
```

### 方式三：从文件读取
```
/语音稿整理
请整理这个文件：/path/to/transcript.txt
```

### 方式四：保存到指定位置
```
整理后保存到 ~/Desktop/meeting-notes.md
```

## 整理模式

| 模式 | 说明 | 适用场景 |
|------|------|----------|
| **保留** | 保留原文，只修正口语填充词、重复、明显错误，篇幅基本不变 | 需要保留原汁原味，只做必要修正 |
| **优化** | 在保留原意的基础上优化表达，删除少量冗余，调整句子更通顺 | 日常整理，兼顾准确与可读性 |
| **提炼** | 大幅精简，只保留核心内容、关键观点和重要信息 | 需要快速获取要点，内容较长时 |

### 交互流程

**Step 1：检查是否指定模式**
- 如果用户已经明确指定模式（如"用提炼"、"选择平衡模式"）→ 直接使用该模式
- 如果用户没有指定 → 进入 Step 2

**Step 2：让用户选择模式**
如果用户没有指定整理模式，必须询问用户选择：

> "请选择整理模式：
> 1. **保留** - 保留原文，只修正口语错误
> 2. **优化** - 适度优化，删除冗余
> 3. **提炼** - 只保留核心要点
>
> 或者直接告诉我要用哪个模式"

等待用户回复后再继续处理。**不要默认选择任何模式，必须让用户明确选择**。

## 处理流程

### Step 1: 理解输入

1. 识别内容来源（会议/访谈/日常语音）
2. 提取或推断主题作为标题
3. 确认用户指定的模式
4. 确认输出路径（用户指定或默认）

### Step 2: 口语化处理（所有模式必做）

对原文进行以下修正：

1. **删除填充词**：
   - 单字：嗯、啊、哦、呃、呀
   - 词组：这个、那个、然后、就是、其实、怎么说呢、怎么说、对吧
   - 重复：嗯嗯嗯、啊是啊

2. **去除重复**：
   - 连续重复的词：知道了知道了 → 知道了
   - 重复表达：我觉得这个 thing 很好，我觉得这个 thing 确实很好 → 合并

3. **补充缺失**：
   - 口语省略的主语："先去A再去B" → "我们先去A再去B"
   - 口语省略的连接词

4. **修正错误**：
   - 明显的错别字
   - 标点符号缺失或滥用
   - 句子明显不完整

### Step 3: 模式特定处理

**保留（默认）**：
- 只做 Step 2 的处理
- 不改变原文结构
- 不删除任何实质性内容
- 尽量保留原文的语气风格

**优化**：
- 在 Step 2 基础上：
  - 删除冗余的过渡词
  - 合并重复的观点（保留一个）
  - 调整过长或不通顺的句子
  - 使用更书面化的表达替换口语

**提炼**：
- 在 Step 2 基础上：
  - 删除所有非核心内容（闲聊、题外话）
  - 提取并保留：核心观点、关键数据、重要结论、行动项
  - 用简洁的语言重述
  - 按逻辑重新组织（时间线/主题/优先级）

### Step 4: 输出

1. 保存到文件（Markdown 格式）
2. 显示统计摘要：
   - 原文字数
   - 整理后字数
   - 精简比例（提炼时）
3. 询问用户是否需要调整

## 输出格式

```markdown
# [推断或用户提供的标题]

> 模式：保留/优化/提炼
> 原文字数：XXX
> 整理后字数：XXX
> 精简比例：XX%

---

[整理后的内容]
```

## 文件处理

### 输入文件支持
- `.txt` - 纯文本
- `.md` - Markdown
- `.vtt` / `.srt` - 字幕文件（提取文本）
- 从 URL 读取（需用户授权）

### 输出路径
- 用户指定：优先使用用户提供的路径
- 默认路径：`~/Documents/transcripts/` 或当前目录

### 文件名生成
- 用户指定：使用用户提供的名称
- 自动生成：`transcript-YYYY-MM-DD.md` 或基于内容主题

## 示例

### 示例 1：保留处理

**输入**：
```
嗯，今天那个...就是我们要讨论一下这个产品上线的事情。然后我觉得应该先测试一下，对吧？那个张三你说说你的看法。然后那个李四你也说一下。
```

**输出**：
```
今天我们要讨论产品上线的事情。应该先测试一下。张三，你说说你的看法。李四你也说一下。
```

### 示例 2：优化处理

**输入**：
```
就是那个...我们之前不是做了一个功能吗？就是那个用户登录的功能。其实这个功能已经做完了，然后呢，现在需要测试。然后测试完了之后呢，还要更新文档。还有就是市场部那边说想要一个推广的页面，这个是我们下一步要做的。
```

**输出**：
```
我们之前完成了用户登录功能，目前需要：
1. 测试
2. 更新文档

下一步：市场部需要推广页面（待处理）
```

### 示例 3：提炼处理

**输入**（会议记录摘要）：
```
[会议讨论了各种细节，包括技术选型、UI 设计、时间安排...]
中间有人问了两个技术问题，王工回答了
中间还闲聊了几句关于周末天气的话题
中间张总接了个电话出去了几分钟
总结：上线时间定在下周一，需要增加测试人员，市场部准备好推广素材
```

**输出**：
```
# 会议要点

## 结论
- 上线时间：下周一

## 待办
- 增加测试人员
- 市场部准备推广素材
```

## 注意事项

1. **不要猜测**：不清楚的地方标注"[存疑]"而非擅自修改
2. **保留专业术语**：技术名词、品牌名、英文保持不变
3. **保护隐私**：敏感信息用 "[敏感内容]" 标注
4. **尊重原意**：不添加原文没有的意思
5. **处理数字**：关键数字、数据、日期要保留

## 错误处理

| 情况 | 处理 |
|------|------|
| 输入为空 | "请提供要整理的内容" |
| 文件不存在 | "无法读取文件，请检查路径" |
| 内容太短（<30字） | "内容太少，建议输入更多内容后再整理" |
| 无读取权限 | "无法访问该文件，请检查权限" |
| 文件太大（>100KB） | "内容较多，处理需要一些时间..." |

## 成功的标志

整理后的文本应该：
- 去掉所有明显的口语填充词
- 句子通顺，易于阅读
- 保留原文的核心信息和意图
- 格式规范，标点正确
- （提炼）只包含关键信息
