# Good Txt To Hwreader

> 清理和修复盗版 txt 电子书中的乱码、广告和排版问题。当用户需要处理 txt 格式电子书、修复乱码、去除广告水印、规范化章节排版时使用此 skill。触发词：txt清理、电子书修复、去广告、修乱码、排版修复、清理txt、修复电子书、txt乱码、txt广告。

- Skill: `18816132863/good-txt-to-hwreader` (Agent Skill, multi-file: 6 files)
- Install (CLI): `npx skillmds@latest add 18816132863/good-txt-to-hwreader`
- Raw SKILL.md: https://api.skillmd.com/api/skills/18816132863/good-txt-to-hwreader/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: 18816132863 (https://skillmd.com/u/18816132863)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/18816132863/good-txt-to-hwreader

---


# Good Txt To Hwreader

将盗版 txt 电子书转换为干净、规范的阅读格式。

## 触发关键词

用户可以通过以下方式触发此技能：

| 关键词 | 示例 |
|--------|------|
| txt清理 | `帮我清理这个txt文件` |
| 电子书修复 | `修复这本电子书` |
| 去广告 | `去掉txt里的广告` |
| 修乱码 | `修复txt乱码` |
| 排版修复 | `修复txt排版` |
| txt乱码 | `这个txt有乱码` |
| txt广告 | `txt里好多广告` |

## 用户输入方式

### 方式一：直接指定文件路径

```
清理 /path/to/book.txt
修复电子书 ~/Downloads/novel.txt
```

### 方式二：模糊搜索手机 txt 文件

当用户说：
- `清理一本txt`（未指定具体文件）
- `帮我找个txt文件清理一下`
- `修复某个电子书`

**执行步骤**：
1. 使用 `search_file` 工具搜索用户设备上的 txt 文件
2. 列出匹配的文件供用户选择
3. 用户确认后执行清理

### 方式三：搜索关键词

```
清理包含"斗破"的txt
修复文件名有"修仙"的电子书
```

**执行步骤**：
1. 使用 `search_file` 工具按关键词搜索
2. 列出匹配结果
3. 用户选择后执行清理

## 依赖

- Python 3.6+
- chardet 库：`pip install chardet`

## 处理流程

### 阶段一：文件获取

1. 使用 `search_file` 搜索用户手机上的 txt 文件
2. 使用 `upload_file` 上传到云端获取 URL
3. 使用 `curl` 下载到工作目录

### 阶段二：清理修复

1. **编码检测** — 自动识别 GBK/UTF-8/GB2312 等编码
2. **广告清理** — 匹配常见广告模式
3. **乱码修复** — 替换常见乱码字符
4. **排版规范化** — 统一章节标题、段落格式

### 阶段三：输出结果

1. **发送文件给用户** — 使用 `send_file_to_user` 发送清理后的文件
2. **输出修复报告** — 以简洁的 md 表格展示修复结果

## 输出报告

清理完成后，助手会解析脚本输出，生成简洁表格：

```markdown
| 项目 | 结果 |
|------|------|
| 原文长度 | 199,044 字符 |
| 清理后长度 | 198,702 字符 |
| 移除内容 | 342 字符 (0.17%) |
| 广告清理 | 0 字符 |
| 乱码修复 | 0 字符 |
| 多余空行 | 342 字符 |
```

## Resources

### scripts/
- `clean_txt.py` — 主清理脚本

### references/
- `ads_patterns.md` — 常见广告模式列表
- `mojibake_patterns.md` — 常见乱码映射表

### assets/
- `chapter_template.txt` — 标准章节格式模板

## 完整示例

**用户**: 帮我修复下载的三体txt文件

**执行流程**:

```
1. search_file(query="三体 txt")
   → 找到: /storage/.../三体.txt

2. upload_file(fileInfos=[{"mediaUri": "file://docs/..."}])
   → 获取公网URL（原始文件）

3. curl -o "三体.txt" "URL"
   → 下载到工作目录

4. python3 ~/.openclaw/workspace/skills/good-txt-to-hwreader/scripts/clean_txt.py "三体.txt"
   → 生成: 三体_清理版.txt

5. send_file_to_user(fileLocalUrls=["三体_清理版.txt"])
   → 发送清理后的文件给用户

6. 解析脚本输出，生成简洁表格报告
```

## 常见问题

| 问题 | 原因 | 解决方案 |
|------|------|----------|
| 文件过大 | 超过 10MB | 分卷处理或提示用户 |
| 编码无法识别 | 特殊编码 | 尝试多种编码，使用 errors='replace' |
| 乱码过多 | 编码错误 | 自动修复常见乱码，无法修复的移除 |
| 章节识别不准 | 格式不规范 | 使用正则匹配多种章节格式 |

## 重要说明

### 📖 一键导入书架

收到清理后的文件后，您可以：
1. **在聊天中长按文件**
2. **选择"分享"**
3. **选择"华为阅读"**

即可一键导入书架，享受修复完美的阅读体验！

---

*技能版本: 3.6.0 (完善文档与脚本一致性)*

