# South Asia Translator

> 南亚研究翻译助手。支持两种模式：(1)短文翻译（Claude直译，适合文章/报告，零依赖）；(2)大文件翻译（LinguaGacha流水线，适合书籍/长篇，需API）。功能包括：分段对照翻译、专有名词规范化、术语表管理、编者按撰写、Word格式输出。当用户需要翻译南亚相关英文内容时使用此技能。

- Skill: `147228/south-asia-translator` (Agent Skill, multi-file: 14 files)
- Install (CLI): `npx skillmds@latest add 147228/south-asia-translator`
- Raw SKILL.md: https://api.skillmd.com/api/skills/147228/south-asia-translator/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Docs & Writing
- Author: 147228 (https://skillmd.com/u/147228)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/147228/south-asia-translator

---


# 南亚研究翻译助手

## 核心定位

**学术翻译工作流助手** —— 从原文到成稿的全流程辅助，确保信达雅+政治合规+格式规范。

**✨ 零依赖，开箱即用**：无需Python环境，无需安装任何软件，只需Claude Code即可完成从原文到Word文档的全流程。

---

## 🚀 快速上手（3秒开始翻译）

### 方式一：提供文件路径（推荐）
```
"C:\路径\original.txt" 翻译这个，按照南亚研究通讯的标准
```

### 方式二：直接粘贴原文
```
翻译这篇文章，按照南亚研究通讯的标准：

[粘贴英文原文]
```

### 就这么简单！

Claude会自动完成：
1. ✅ 翻译初稿（英中对照，32个段落约3分钟）
2. ✅ 撰写编者按（500字，符合南亚研究通讯规范）
3. ✅ 术语规范化（人名、机构名首次标注英文）
4. ✅ 迭代评分优化（六维度评分，目标9.5/10分）
5. ✅ 生成Word文档（宋体/Times New Roman，1.5倍行距）

**无需Python环境，无需安装任何依赖，完全开箱即用！**

---

## 翻译原则

### 总体要求
- **信**：准确传达原意，不增不减
- **达**：符合中文表达习惯，可调整句法结构
- **雅**：语言简练书面，避免翻译腔

### 政治合规底线
- 涉及中国主权、领土完整的表述必须符合我国立场
- 涉台、涉藏、涉疆表述需特别审慎
- 如原文有反华立场，在编者按中提示读者

## 输出格式

### 文件命名
`【0】译者名字-提交日期-文章中文题目.docx`

### 文件管理结构
```
translations/
├── YYYYMMDD_文章标题/
│   ├── source/
│   │   └── original.txt          # 英文原文
│   ├── drafts/
│   │   ├── draft1.docx           # 初译稿
│   │   ├── draft2.docx           # 二稿
│   │   └── draft3.docx           # 三稿
│   └── final/
│       └── 【0】译者-日期-标题.docx  # 终稿
```

### 文章结构（按顺序）
1. **英语标题**
2. **来源说明**：本文编译自《xxx》xxxx年xx月xx日文章
3. **原标题**：原标题为xxx
4. **作者**：作者为xxx
5. **编译/审核**：编译：xxx / 审核：xxx
6. **编者按**：【编者按】开头，500字以内，末尾固定语
7. **正文**：一段英文 + 一段译文，交替排列（**必须完整，不得遗漏**）
8. **作者介绍**：作者曾任/现任职务

### 排版规范
| 项目 | 要求 |
|------|------|
| 字号 | 小四/12号 |
| 中文字体 | 宋体 |
| 英文字体 | Times New Roman |
| 行间距 | 1.5倍 |
| 缩进 | 无首字符缩进 |
| 一级标题 | 加粗，居中 |
| 二级标题 | 加粗，前空一行 |

## 专有名词处理

### 人名规则
- 格式：中文译名（英文原文）
- 示例：苏杰生（Jaishankar）、多瓦尔（Ajit Doval）
- 同一人名全文保持一致

### 机构名规则
- 首次出现：全称（以下简称xxx）
- 后续出现：使用简称
- 示例：印度人民党（印人党）、国民志愿服务团（RSS）

### 货币换算
- 格式：X美元（约合人民币X元）
- 汇率按当前市场汇率估算

### 印度数字单位
| 英文 | 数值 | 换算 |
|------|------|------|
| Lakh | 十万 | 1 Lakh = 100,000 |
| Crore | 千万 | 1 Crore = 10,000,000 |
| Lakh Crore | 万亿 | 1 Lakh Crore = 1,000,000,000,000 |

## 翻译禁忌

### 禁止保留
- ❌ "今年""本周""上个月"等模糊时间 → 查明具体日期
- ❌ 无注释的外文词（GDP等高知晓度词除外）
- ❌ 未经核实的数据、史实

### 禁止使用
- ❌ 无必要的"的""了""其""一个"
- ❌ 动名词做主语（如"提高产品附加值"优于"使产品附加值得到提升"）
- ❌ 缺少主语的句子（使用"通过""由于""经过""为了"时注意）

### 禁止风格
- ❌ 翻译腔/硬译
- ❌ 过长的定语从句直译
- ❌ 被动语态滥用

## 简化表达对照

| 口语化/冗长 | 书面化/简练 |
|-------------|-------------|
| 从中国进口 | 自华进口 |
| 从美国进口 | 自美进口 |
| 相比 | 较 |
| 可能会 | 或/恐 |
| 就……来看 | 以……为例 |
| 对……来说 | 就……而言 |
| 怪罪 | 归咎于 |
| 头几个月 | 初 |
| 这一 | 此 |
| 有望在/将在 | 拟/拟于 |
| 对……持谨慎态度 | 顾虑为 |
| 公司 | 企业 |
| 老板 | 实际控制人 |
| 中央政府 | 联邦政府（或直接写"莫迪政府"） |

## 编者按撰写

### 五要素
1. **核心内容**：精准提炼文章要点
2. **重要性**：为什么值得翻译
3. **推荐理由**：对读者的意义和启发
4. **注意提示**：如作者反华立场、数据存疑等
5. **借鉴意义**：对我方研究/政策的参考价值

### 格式要求
- 字数：500字以内
- 开头：【编者按】
- 结尾固定语：**南亚研究通讯特编译此文，供各位读者批判参考**

### 示例
```
【编者按】莫迪政府2014年上台以来，其让人眼花缭乱的外交政策充满临时变卦和前后矛盾，但却极少有人从其决策层内部斗争的角度进行分析。本文从"内部人"的视角出发，重点研究了多瓦尔和苏杰生两位在印度周边外交问题上的异同，部分回答了为什么印度对周边政策缺乏一致性，为什么对华政策具有两面性。尤其值得注意的是，本文提供的"高分辨率"和"细颗粒度"的分析方法对我们改进、提高政策研究工作具有较大借鉴价值。南亚研究通讯特编译此文，供各位读者批判参考。
```

## 质量检查清单

参考ISO 17100标准和行业最佳实践，建立多维度质量检查体系。

### 翻译前准备（Pre-Translation）
- [ ] 通读原文，理解整体结构、论点和作者立场
- [ ] 标记不确定的术语和表述
- [ ] 查找专有名词固定译法（参考[terminology.md](references/terminology.md)）
- [ ] 确认文章发布日期，计算时间表述
- [ ] 识别文章类型（新闻报道/学术论文/智库报告/评论文章）
- [ ] 确认目标读者群体和翻译风格要求

### 翻译中控制（In-Translation QA）
- [ ] **结构对照**：一段英文对应一段译文
- [ ] **术语标注**：人名机构名首次出现标注英文
- [ ] **疑问标记**：不确定处用红色或【？】标出
- [ ] **语言风格**：前提动词，避免翻译腔
- [ ] **数字核对**：数字、百分比、日期逐一核对
- [ ] **引文检查**：引用内容与原文完全一致

### 翻译后审校（Post-Translation Review）

#### 1. 内容准确性（Accuracy）
- [ ] **完整性检查**：逐段核对，确保无遗漏、无多译
  - 统计原文段落数与译文段落数是否一致
  - 逐段对照，确认每段英文都有对应译文
  - 检查是否有跳段、重复翻译的情况
- [ ] 译文忠实原文，无增删改
- [ ] 数字、日期、人名、地名准确无误
- [ ] 引文、数据来源准确标注
- [ ] 专业术语翻译准确
- [ ] 图表说明、图注已翻译（如有）

#### 2. 术语一致性（Terminology Consistency）
- [ ] 同一人名全文统一（如"苏杰生"不能出现"贾伊尚卡尔"）
- [ ] 同一机构名全文统一（如"印人党"不能出现"BJP"）
- [ ] 专业术语前后一致（如"GDP"不能混用"国内生产总值"）
- [ ] 简称使用规范（首次全称+简称，后续统一用简称）
- [ ] 数字单位统一（Lakh统一译为"十万"，不混用"拉克"）

#### 3. 语言流畅度（Fluency）
- [ ] 以读者视角通读全文，语句通顺
- [ ] 无翻译腔、硬译
- [ ] 句子结构符合中文表达习惯
- [ ] 段落之间过渡自然
- [ ] 无冗余表达（参考common-expressions.md）

#### 4. 语法正确性（Grammar）
- [ ] 无错别字、typo
- [ ] 标点符号正确（区分分号、逗号、句号）
- [ ] 主语完整（使用"通过""由于""经过""为了"时注意）
- [ ] 无语病（如"使……得到提升"改为"提升……"）
- [ ] 时态一致

#### 5. 格式规范性（Formatting）
- [ ] 字体：中文宋体、英文Times New Roman
- [ ] 字号：小四/12号
- [ ] 行间距：1.5倍
- [ ] 一级标题：加粗、居中
- [ ] 二级标题：加粗、前空一行
- [ ] 无首字符缩进
- [ ] 英文原文与中文译文交替排列

#### 6. 政治合规性（Political Compliance）
- [ ] 涉华表述符合我国立场
- [ ] 涉台、涉藏、涉疆表述审慎
- [ ] 边境争议地区表述准确（如"阿鲁纳恰尔邦"需注明"我方称藏南"）
- [ ] 如原文有反华立场，在编者按中提示

#### 7. 完整性（Completeness）
- [ ] 编者按已撰写（500字内，末尾固定语）
- [ ] 作者介绍已添加
- [ ] 文件命名规范：【0】译者名字-日期-中文标题.docx
- [ ] 来源信息完整（出处、日期、原标题、作者）

### 终审清单（Final Check）
在提交前，逐项核对以下内容：

- [ ] 全文通读无障碍，语句流畅
- [ ] 术语一致性100%
- [ ] 数字、日期、人名、地名准确率100%
- [ ] 格式符合规范
- [ ] 编者按质量合格
- [ ] 文件命名正确

## 工作流程

### TEP标准流程（Translation-Editing-Proofreading）

参考ISO 17100国际翻译标准和行业最佳实践，采用三步质量保障流程：

#### T - Translation（翻译）
**目标**：准确传达原文意思，保持一段英一段中的对照格式

- 通读全文，理解文章结构和论点
- 查找专有名词固定译法（参考terminology.md）
- 分段翻译，保持原文段落结构
- 人名机构名首次出现标注英文原文
- 标记不确定处（用红色或【？】标注）
- 初步检查数字、日期、引文准确性

**输出**：初译稿（Draft 1）

#### E - Editing（编辑审校）
**目标**：优化表达，去翻译腔，确保术语一致性

- **术语一致性检查**：
  - 同一人名/机构名全文统一
  - 专业术语前后一致
  - 简称使用规范（首次全称+简称，后续用简称）

- **语言优化**：
  - 调整句法结构，符合中文表达习惯
  - 简化冗长表达（参考common-expressions.md）
  - 前提动词，避免被动语态滥用
  - 删除无必要的"的""了""其""一个"

- **内容核查**：
  - 核对数据、史实、引文
  - 确认时间表述具体化（不保留"今年""本周"）
  - 检查政治敏感表述是否合规

**输出**：二稿（Draft 2）

#### P - Proofreading（校对）
**目标**：消除错误，确保格式规范

- **语言校对**：
  - 通读全文检查连贯性和流畅度
  - 检查typo、错别字、语病
  - 检查标点符号（区分分号、逗号、句号）
  - 确认主语完整性（使用"通过""由于"等介词时）

- **格式校对**：
  - 字体：中文宋体、英文Times New Roman
  - 字号：小四/12号
  - 行间距：1.5倍
  - 标题格式：一级标题加粗居中，二级标题加粗前空一行
  - 无首字符缩进

- **完整性校对**：
  - 撰写编者按（500字内，末尾固定语）
  - 添加作者介绍
  - 确认文件命名规范

**输出**：终稿（Final）

### 自动化质量控制模式（推荐）

**核心理念**：使用Claude子agent进行六维度质量评估，迭代优化直到达到9.5分发布标准。

**重要说明**：本skill使用Claude自己的子agent进行评分和优化，**无需设置任何API密钥**。只需在对话中提出优化请求，Claude会自动创建评分agent和优化agent完成迭代。

#### 评分维度（总分10分）

1. **中文表达自然度** (1.5分) - 避免英文句式，符合中文表达习惯
2. **语言客观流畅度** (2.0分) - 精准客观，无冗余，节奏流畅
3. **动词位置优化度** (1.5分) - 动词紧随主语，避免头重脚轻
4. **句式简化度** (1.5分) - 拆分复杂长句，避免从句嵌套
5. **认知负荷控制** (2.0分) - 信息层次分明，降低理解难度
6. **意思准确度** (2.5分) - 完整传达原意，无遗漏曲解

详细评分标准见：[scoring-standards.md](references/scoring-standards.md)

#### 使用方式（推荐）

**方式一：对话式迭代优化**（最简单，推荐）
```
继续优化：使用评分系统进行迭代优化，目标达到9.5/10分时自动生成Word文档
```

Claude会自动：
1. 创建评分子agent对译文进行六维度评分
2. 如果得分 < 9.5，创建优化子agent根据反馈改进译文
3. 重新评分，直到达到9.5分或达到最大迭代次数
4. 达标后自动生成最终Word文档

#### 迭代优化示例

**第1轮**：初译得分 7.2/10
- 问题：英文句式严重，"的"字连用，动词距离主语过远
- 优化：调整句式结构，简化定语从句

**第2轮**：优化后得分 8.5/10
- 问题：仍有部分翻译腔，认知负荷较高
- 优化：进一步简化表达，增加专有名词注释

**第3轮**：再次优化得分 9.6/10
- 结果：✅ 达到发布标准，生成最终Word文档

#### 质量保证

- **客观评分**：基于明确标准，避免主观判断
- **可追溯性**：每轮迭代保存评分报告和改进记录
- **一致性**：确保所有译文达到统一质量标准
- **效率提升**：自动化流程减少人工审校时间
- **无需配置**：使用Claude自己的子agent，无需额外API密钥

### 快速迭代模式（单人翻译）

如果是单人完成翻译，可以采用四轮快速迭代：

**第一轮：粗译**
- 快速翻译全文，保持一段英一段中
- 标记不确定处

**第二轮：精修**
- 核查术语一致性
- 去翻译腔，简化表达

**第三轮：润色**
- 通读检查连贯性
- 检查标点、typo、语病

**第四轮：收尾**
- 撰写编者按
- 添加作者介绍
- 最终格式检查

## 参考文档

- **专有名词库**：[terminology.md](references/terminology.md) - 人名、机构、地名固定译法
- **惯用表达**：[common-expressions.md](references/common-expressions.md) - 简化表达对照表
- **评分标准**：[scoring-standards.md](references/scoring-standards.md) - 六维度翻译质量评分体系

## 使用示例

### 快速翻译（推荐）
```
"文件路径" 翻译这个，按照南亚研究通讯的标准skills
```
**说明**：提供原文文件路径，系统会自动完成翻译、编者按撰写、格式化，并生成Word文档。

**示例**：
```
"C:\Users\bisu5\Desktop\南亚研究skills\translations\20260111_莫迪经济改革\source\original.txt" 翻译这个，按照南亚研究通讯的标准skills
```

**工作流程**：
1. 读取原文文件
2. 按照南亚研究通讯标准进行翻译
3. 撰写编者按（500字以内）
4. 生成英中对照格式
5. 自动生成Word文档（.doc格式，Word可直接打开）

### 启动翻译（传统方式）
```
请帮我翻译这篇文章，译者姓名：张三
[粘贴英文原文]
```

### 生成编者按
```
请为以下译文撰写编者按：
[粘贴译文]
```

### 术语检查
```
请检查以下译文的术语一致性：
[粘贴译文]
```

### 格式检查
```
请按照南亚研究翻译规范检查以下译文：
[粘贴译文]
```

### 迭代优化（推荐）
```
继续优化：使用评分系统进行迭代优化，目标达到9.5/10分时自动生成Word文档
```

**说明**：使用Claude子agent进行六维度评分（中文表达自然度、语言客观流畅度、动词位置优化度、句式简化度、认知负荷控制、意思准确度），根据反馈迭代优化，直到达到9.5/10分标准后自动生成Word文档。

**优势**：
- ✅ 无需设置API密钥
- ✅ 自动评分和优化
- ✅ 客观量化质量标准
- ✅ 可追溯每轮改进

---

## 大文件翻译流水线（书籍/长篇文档）

### 适用场景
- 书籍翻译（10万字以上）
- 长篇报告/论文集
- 需要术语表统一管理的批量翻译

### 工具链
```
LinguaGacha (翻译引擎) + 第三方LLM API (OpenAI兼容) + Claude Code (审校)
```

### 前置要求
- LinguaGacha v0.55.0+（下载: https://github.com/neavo/LinguaGacha/releases）
- OpenAI兼容API（如 OpenRouter、本地部署等）
- Python 3.9+，python-docx 库

### 六步工作流

#### 第1步：提取文本
```bash
cd ".claude\skills\south-asia-translator\scripts"
python extract_text.py "C:\path\to\book.docx"
# 输出: book.clean.txt
```
支持 .docx / .pdf / .txt，自动清理InDesign标记、页码等。

#### 第2步：构建术语表
使用Claude子agent进行网络搜索，收集权威译法：
```
帮我为这本关于[主题]的书构建术语表，搜索新华社、军科院等权威来源的标准译法
```
术语表格式（LinguaGacha兼容JSON）：
```json
[
  {"src": "Line of Actual Control", "dst": "实际控制线", "info": "中印边境"},
  {"src": "COAS", "dst": "陆军参谋长", "info": "缩写"}
]
```
预置术语表: `glossaries/south_asia_military.json`（185条南亚军事术语）

#### 第3步：配置LinguaGacha
```bash
python run_linguagacha.py setup
# 交互式输入: API URL, API Key, 模型ID, 并发数
```
或手动编辑 `templates/linguagacha_config.json`。

**关键参数**：
| 参数 | 推荐值 | 说明 |
|------|--------|------|
| concurrency_limit | 20 | 并发数，太高会触发API限流 |
| output_token_limit | 16384 | 输出token上限，思考模型需调高 |
| temperature | 0.3 | 低温度保证翻译一致性 |

**经验法则**：
- API代理服务：并发 ≤ 20，否则429限流
- 官方API：并发可到 50+
- 思考模型（如Gemini Flash）：output_token_limit 必须 ≥ 16384

#### 第4步：运行翻译
```bash
# 创建项目并开始翻译
python run_linguagacha.py create "C:\path\to\book.clean.txt"

# 查看进度
python run_linguagacha.py status

# 断点续翻（中断后继续）
python run_linguagacha.py start

# 重试失败项
python run_linguagacha.py retry
```

**翻译风格**由 `templates/academic_prompt.txt` 控制：
- 默认：学术书面语，军事术语规范
- 可替换为其他风格（如新闻报道、文学翻译等）

#### 第5步：导出与审校
```bash
# 从LG数据库导出翻译文本
python run_linguagacha.py export

# Claude Code审校（在对话中）
```
审校要点：
- 术语一致性检查（用Grep批量搜索关键术语）
- 多余空格清理（OCR残留双空格）
- 章节结构重建（识别标题层级）

#### 第6步：格式化输出Word
```bash
python format_book.py  # Markdown格式化
python md_to_docx.py   # 转Word文档
```
Word排版规格：
- A4纸张，页边距2.54cm
- 正文：宋体12pt，1.5倍行距，首行缩进
- 章节标题：黑体，16pt(部)/14pt(章)加粗
- 译者说明：楷体10.5pt，灰色

### 速度参考（Gemini Flash + 20并发）

| 文档规模 | 预计耗时 | 备注 |
|----------|----------|------|
| 1万词 | 5-10分钟 | 短篇报告 |
| 5万词 | 30-40分钟 | 长篇论文 |
| 13万词 | 60-90分钟 | 书籍（如本项目） |
| 30万词 | 3-4小时 | 大部头著作 |

### 已验证的项目

| 项目 | 规模 | 术语条数 | 输出 |
|------|------|----------|------|
| 纳拉瓦内《命运的四颗星》 | 13.3万词/542页 | 185条 | 24万字中文译本 |

---

## 目录结构

```
south-asia-translator/
├── skill.md                     # 本文件（技能定义）
├── scripts/                     # 自动化脚本
│   ├── extract_text.py          # 文本提取（docx/pdf/txt）
│   ├── run_linguagacha.py       # LinguaGacha控制脚本
│   ├── format_book.py           # 书籍Markdown格式化
│   ├── md_to_docx.py            # Markdown转Word
│   └── save_glossary.py         # 术语表生成
├── templates/                   # 模板文件
│   ├── academic_prompt.txt      # 学术翻译提示词
│   └── linguagacha_config.json  # LinguaGacha配置模板
├── glossaries/                  # 术语表
│   └── south_asia_military.json # 南亚军事术语（185条）
└── references/                  # 参考文档
    ├── terminology.md           # 人名/机构译法
    ├── common-expressions.md    # 简化表达对照
    └── scoring-standards.md     # 六维度评分标准
```

项目文件存放在独立目录：
```
translation_projects/
└── 项目名称/
    ├── source/                  # 原文
    ├── drafts/                  # 翻译草稿
    ├── final/                   # 最终稿（.md + .docx）
    └── linguagacha/             # LG项目数据库
```

---
