南亚研究翻译助手
核心定位
学术翻译工作流助手 —— 从原文到成稿的全流程辅助,确保信达雅+政治合规+格式规范。
✨ 零依赖,开箱即用:无需Python环境,无需安装任何软件,只需Claude Code即可完成从原文到Word文档的全流程。
🚀 快速上手(3秒开始翻译)
方式一:提供文件路径(推荐)
"C:\路径\original.txt" 翻译这个,按照南亚研究通讯的标准
方式二:直接粘贴原文
翻译这篇文章,按照南亚研究通讯的标准:
[粘贴英文原文]
就这么简单!
Claude会自动完成:
- ✅ 翻译初稿(英中对照,32个段落约3分钟)
- ✅ 撰写编者按(500字,符合南亚研究通讯规范)
- ✅ 术语规范化(人名、机构名首次标注英文)
- ✅ 迭代评分优化(六维度评分,目标9.5/10分)
- ✅ 生成Word文档(宋体/Times New Roman,1.5倍行距)
无需Python环境,无需安装任何依赖,完全开箱即用!
翻译原则
总体要求
- 信:准确传达原意,不增不减
- 达:符合中文表达习惯,可调整句法结构
- 雅:语言简练书面,避免翻译腔
政治合规底线
- 涉及中国主权、领土完整的表述必须符合我国立场
- 涉台、涉藏、涉疆表述需特别审慎
- 如原文有反华立场,在编者按中提示读者
输出格式
文件命名
【0】译者名字-提交日期-文章中文题目.docx
文件管理结构
translations/
├── YYYYMMDD_文章标题/
│ ├── source/
│ │ └── original.txt # 英文原文
│ ├── drafts/
│ │ ├── draft1.docx # 初译稿
│ │ ├── draft2.docx # 二稿
│ │ └── draft3.docx # 三稿
│ └── final/
│ └── 【0】译者-日期-标题.docx # 终稿
文章结构(按顺序)
- 英语标题
- 来源说明:本文编译自《xxx》xxxx年xx月xx日文章
- 原标题:原标题为xxx
- 作者:作者为xxx
- 编译/审核:编译:xxx / 审核:xxx
- 编者按:【编者按】开头,500字以内,末尾固定语
- 正文:一段英文 + 一段译文,交替排列(必须完整,不得遗漏)
- 作者介绍:作者曾任/现任职务
排版规范
| 项目 | 要求 |
|---|---|
| 字号 | 小四/12号 |
| 中文字体 | 宋体 |
| 英文字体 | Times New Roman |
| 行间距 | 1.5倍 |
| 缩进 | 无首字符缩进 |
| 一级标题 | 加粗,居中 |
| 二级标题 | 加粗,前空一行 |
专有名词处理
人名规则
- 格式:中文译名(英文原文)
- 示例:苏杰生(Jaishankar)、多瓦尔(Ajit Doval)
- 同一人名全文保持一致
机构名规则
- 首次出现:全称(以下简称xxx)
- 后续出现:使用简称
- 示例:印度人民党(印人党)、国民志愿服务团(RSS)
货币换算
- 格式:X美元(约合人民币X元)
- 汇率按当前市场汇率估算
印度数字单位
| 英文 | 数值 | 换算 |
|---|---|---|
| Lakh | 十万 | 1 Lakh = 100,000 |
| Crore | 千万 | 1 Crore = 10,000,000 |
| Lakh Crore | 万亿 | 1 Lakh Crore = 1,000,000,000,000 |
翻译禁忌
禁止保留
- ❌ "今年""本周""上个月"等模糊时间 → 查明具体日期
- ❌ 无注释的外文词(GDP等高知晓度词除外)
- ❌ 未经核实的数据、史实
禁止使用
- ❌ 无必要的"的""了""其""一个"
- ❌ 动名词做主语(如"提高产品附加值"优于"使产品附加值得到提升")
- ❌ 缺少主语的句子(使用"通过""由于""经过""为了"时注意)
禁止风格
- ❌ 翻译腔/硬译
- ❌ 过长的定语从句直译
- ❌ 被动语态滥用
简化表达对照
| 口语化/冗长 | 书面化/简练 |
|---|---|
| 从中国进口 | 自华进口 |
| 从美国进口 | 自美进口 |
| 相比 | 较 |
| 可能会 | 或/恐 |
| 就……来看 | 以……为例 |
| 对……来说 | 就……而言 |
| 怪罪 | 归咎于 |
| 头几个月 | 初 |
| 这一 | 此 |
| 有望在/将在 | 拟/拟于 |
| 对……持谨慎态度 | 顾虑为 |
| 公司 | 企业 |
| 老板 | 实际控制人 |
| 中央政府 | 联邦政府(或直接写"莫迪政府") |
编者按撰写
五要素
- 核心内容:精准提炼文章要点
- 重要性:为什么值得翻译
- 推荐理由:对读者的意义和启发
- 注意提示:如作者反华立场、数据存疑等
- 借鉴意义:对我方研究/政策的参考价值
格式要求
- 字数:500字以内
- 开头:【编者按】
- 结尾固定语:南亚研究通讯特编译此文,供各位读者批判参考
示例
【编者按】莫迪政府2014年上台以来,其让人眼花缭乱的外交政策充满临时变卦和前后矛盾,但却极少有人从其决策层内部斗争的角度进行分析。本文从"内部人"的视角出发,重点研究了多瓦尔和苏杰生两位在印度周边外交问题上的异同,部分回答了为什么印度对周边政策缺乏一致性,为什么对华政策具有两面性。尤其值得注意的是,本文提供的"高分辨率"和"细颗粒度"的分析方法对我们改进、提高政策研究工作具有较大借鉴价值。南亚研究通讯特编译此文,供各位读者批判参考。
质量检查清单
参考ISO 17100标准和行业最佳实践,建立多维度质量检查体系。
翻译前准备(Pre-Translation)
- 通读原文,理解整体结构、论点和作者立场
- 标记不确定的术语和表述
- 查找专有名词固定译法(参考terminology.md)
- 确认文章发布日期,计算时间表述
- 识别文章类型(新闻报道/学术论文/智库报告/评论文章)
- 确认目标读者群体和翻译风格要求
翻译中控制(In-Translation QA)
- 结构对照:一段英文对应一段译文
- 术语标注:人名机构名首次出现标注英文
- 疑问标记:不确定处用红色或【?】标出
- 语言风格:前提动词,避免翻译腔
- 数字核对:数字、百分比、日期逐一核对
- 引文检查:引用内容与原文完全一致
翻译后审校(Post-Translation Review)
1. 内容准确性(Accuracy)
- 完整性检查:逐段核对,确保无遗漏、无多译
- 统计原文段落数与译文段落数是否一致
- 逐段对照,确认每段英文都有对应译文
- 检查是否有跳段、重复翻译的情况
- 译文忠实原文,无增删改
- 数字、日期、人名、地名准确无误
- 引文、数据来源准确标注
- 专业术语翻译准确
- 图表说明、图注已翻译(如有)
2. 术语一致性(Terminology Consistency)
- 同一人名全文统一(如"苏杰生"不能出现"贾伊尚卡尔")
- 同一机构名全文统一(如"印人党"不能出现"BJP")
- 专业术语前后一致(如"GDP"不能混用"国内生产总值")
- 简称使用规范(首次全称+简称,后续统一用简称)
- 数字单位统一(Lakh统一译为"十万",不混用"拉克")
3. 语言流畅度(Fluency)
- 以读者视角通读全文,语句通顺
- 无翻译腔、硬译
- 句子结构符合中文表达习惯
- 段落之间过渡自然
- 无冗余表达(参考common-expressions.md)
4. 语法正确性(Grammar)
- 无错别字、typo
- 标点符号正确(区分分号、逗号、句号)
- 主语完整(使用"通过""由于""经过""为了"时注意)
- 无语病(如"使……得到提升"改为"提升……")
- 时态一致
5. 格式规范性(Formatting)
- 字体:中文宋体、英文Times New Roman
- 字号:小四/12号
- 行间距:1.5倍
- 一级标题:加粗、居中
- 二级标题:加粗、前空一行
- 无首字符缩进
- 英文原文与中文译文交替排列
6. 政治合规性(Political Compliance)
- 涉华表述符合我国立场
- 涉台、涉藏、涉疆表述审慎
- 边境争议地区表述准确(如"阿鲁纳恰尔邦"需注明"我方称藏南")
- 如原文有反华立场,在编者按中提示
7. 完整性(Completeness)
- 编者按已撰写(500字内,末尾固定语)
- 作者介绍已添加
- 文件命名规范:【0】译者名字-日期-中文标题.docx
- 来源信息完整(出处、日期、原标题、作者)
终审清单(Final Check)
在提交前,逐项核对以下内容:
- 全文通读无障碍,语句流畅
- 术语一致性100%
- 数字、日期、人名、地名准确率100%
- 格式符合规范
- 编者按质量合格
- 文件命名正确
工作流程
TEP标准流程(Translation-Editing-Proofreading)
参考ISO 17100国际翻译标准和行业最佳实践,采用三步质量保障流程:
T - Translation(翻译)
目标:准确传达原文意思,保持一段英一段中的对照格式
- 通读全文,理解文章结构和论点
- 查找专有名词固定译法(参考terminology.md)
- 分段翻译,保持原文段落结构
- 人名机构名首次出现标注英文原文
- 标记不确定处(用红色或【?】标注)
- 初步检查数字、日期、引文准确性
输出:初译稿(Draft 1)
E - Editing(编辑审校)
目标:优化表达,去翻译腔,确保术语一致性
术语一致性检查:
- 同一人名/机构名全文统一
- 专业术语前后一致
- 简称使用规范(首次全称+简称,后续用简称)
语言优化:
- 调整句法结构,符合中文表达习惯
- 简化冗长表达(参考common-expressions.md)
- 前提动词,避免被动语态滥用
- 删除无必要的"的""了""其""一个"
内容核查:
- 核对数据、史实、引文
- 确认时间表述具体化(不保留"今年""本周")
- 检查政治敏感表述是否合规
输出:二稿(Draft 2)
P - Proofreading(校对)
目标:消除错误,确保格式规范
语言校对:
- 通读全文检查连贯性和流畅度
- 检查typo、错别字、语病
- 检查标点符号(区分分号、逗号、句号)
- 确认主语完整性(使用"通过""由于"等介词时)
格式校对:
- 字体:中文宋体、英文Times New Roman
- 字号:小四/12号
- 行间距:1.5倍
- 标题格式:一级标题加粗居中,二级标题加粗前空一行
- 无首字符缩进
完整性校对:
- 撰写编者按(500字内,末尾固定语)
- 添加作者介绍
- 确认文件命名规范
输出:终稿(Final)
自动化质量控制模式(推荐)
核心理念:使用Claude子agent进行六维度质量评估,迭代优化直到达到9.5分发布标准。
重要说明:本skill使用Claude自己的子agent进行评分和优化,无需设置任何API密钥。只需在对话中提出优化请求,Claude会自动创建评分agent和优化agent完成迭代。
评分维度(总分10分)
- 中文表达自然度 (1.5分) - 避免英文句式,符合中文表达习惯
- 语言客观流畅度 (2.0分) - 精准客观,无冗余,节奏流畅
- 动词位置优化度 (1.5分) - 动词紧随主语,避免头重脚轻
- 句式简化度 (1.5分) - 拆分复杂长句,避免从句嵌套
- 认知负荷控制 (2.0分) - 信息层次分明,降低理解难度
- 意思准确度 (2.5分) - 完整传达原意,无遗漏曲解
详细评分标准见:scoring-standards.md
使用方式(推荐)
方式一:对话式迭代优化(最简单,推荐)
继续优化:使用评分系统进行迭代优化,目标达到9.5/10分时自动生成Word文档
Claude会自动:
- 创建评分子agent对译文进行六维度评分
- 如果得分 < 9.5,创建优化子agent根据反馈改进译文
- 重新评分,直到达到9.5分或达到最大迭代次数
- 达标后自动生成最终Word文档
迭代优化示例
第1轮:初译得分 7.2/10
- 问题:英文句式严重,"的"字连用,动词距离主语过远
- 优化:调整句式结构,简化定语从句
第2轮:优化后得分 8.5/10
- 问题:仍有部分翻译腔,认知负荷较高
- 优化:进一步简化表达,增加专有名词注释
第3轮:再次优化得分 9.6/10
- 结果:✅ 达到发布标准,生成最终Word文档
质量保证
- 客观评分:基于明确标准,避免主观判断
- 可追溯性:每轮迭代保存评分报告和改进记录
- 一致性:确保所有译文达到统一质量标准
- 效率提升:自动化流程减少人工审校时间
- 无需配置:使用Claude自己的子agent,无需额外API密钥
快速迭代模式(单人翻译)
如果是单人完成翻译,可以采用四轮快速迭代:
第一轮:粗译
- 快速翻译全文,保持一段英一段中
- 标记不确定处
第二轮:精修
- 核查术语一致性
- 去翻译腔,简化表达
第三轮:润色
- 通读检查连贯性
- 检查标点、typo、语病
第四轮:收尾
- 撰写编者按
- 添加作者介绍
- 最终格式检查
参考文档
- 专有名词库:terminology.md - 人名、机构、地名固定译法
- 惯用表达:common-expressions.md - 简化表达对照表
- 评分标准:scoring-standards.md - 六维度翻译质量评分体系
使用示例
快速翻译(推荐)
"文件路径" 翻译这个,按照南亚研究通讯的标准skills
说明:提供原文文件路径,系统会自动完成翻译、编者按撰写、格式化,并生成Word文档。
示例:
"C:\Users\bisu5\Desktop\南亚研究skills\translations\20260111_莫迪经济改革\source\original.txt" 翻译这个,按照南亚研究通讯的标准skills
工作流程:
- 读取原文文件
- 按照南亚研究通讯标准进行翻译
- 撰写编者按(500字以内)
- 生成英中对照格式
- 自动生成Word文档(.doc格式,Word可直接打开)
启动翻译(传统方式)
请帮我翻译这篇文章,译者姓名:张三
[粘贴英文原文]
生成编者按
请为以下译文撰写编者按:
[粘贴译文]
术语检查
请检查以下译文的术语一致性:
[粘贴译文]
格式检查
请按照南亚研究翻译规范检查以下译文:
[粘贴译文]
迭代优化(推荐)
继续优化:使用评分系统进行迭代优化,目标达到9.5/10分时自动生成Word文档
说明:使用Claude子agent进行六维度评分(中文表达自然度、语言客观流畅度、动词位置优化度、句式简化度、认知负荷控制、意思准确度),根据反馈迭代优化,直到达到9.5/10分标准后自动生成Word文档。
优势:
- ✅ 无需设置API密钥
- ✅ 自动评分和优化
- ✅ 客观量化质量标准
- ✅ 可追溯每轮改进
大文件翻译流水线(书籍/长篇文档)
适用场景
- 书籍翻译(10万字以上)
- 长篇报告/论文集
- 需要术语表统一管理的批量翻译
工具链
LinguaGacha (翻译引擎) + 第三方LLM API (OpenAI兼容) + Claude Code (审校)
前置要求
- LinguaGacha v0.55.0+(下载: https://github.com/neavo/LinguaGacha/releases)
- OpenAI兼容API(如 OpenRouter、本地部署等)
- Python 3.9+,python-docx 库
六步工作流
第1步:提取文本
cd ".claude\skills\south-asia-translator\scripts"
python extract_text.py "C:\path\to\book.docx"
# 输出: book.clean.txt
支持 .docx / .pdf / .txt,自动清理InDesign标记、页码等。
第2步:构建术语表
使用Claude子agent进行网络搜索,收集权威译法:
帮我为这本关于[主题]的书构建术语表,搜索新华社、军科院等权威来源的标准译法
术语表格式(LinguaGacha兼容JSON):
[
{"src": "Line of Actual Control", "dst": "实际控制线", "info": "中印边境"},
{"src": "COAS", "dst": "陆军参谋长", "info": "缩写"}
]
预置术语表: glossaries/south_asia_military.json(185条南亚军事术语)
第3步:配置LinguaGacha
python run_linguagacha.py setup
# 交互式输入: API URL, API Key, 模型ID, 并发数
或手动编辑 templates/linguagacha_config.json。
关键参数:
| 参数 | 推荐值 | 说明 |
|---|---|---|
| concurrency_limit | 20 | 并发数,太高会触发API限流 |
| output_token_limit | 16384 | 输出token上限,思考模型需调高 |
| temperature | 0.3 | 低温度保证翻译一致性 |
经验法则:
- API代理服务:并发 ≤ 20,否则429限流
- 官方API:并发可到 50+
- 思考模型(如Gemini Flash):output_token_limit 必须 ≥ 16384
第4步:运行翻译
# 创建项目并开始翻译
python run_linguagacha.py create "C:\path\to\book.clean.txt"
# 查看进度
python run_linguagacha.py status
# 断点续翻(中断后继续)
python run_linguagacha.py start
# 重试失败项
python run_linguagacha.py retry
翻译风格由 templates/academic_prompt.txt 控制:
- 默认:学术书面语,军事术语规范
- 可替换为其他风格(如新闻报道、文学翻译等)
第5步:导出与审校
# 从LG数据库导出翻译文本
python run_linguagacha.py export
# Claude Code审校(在对话中)
审校要点:
- 术语一致性检查(用Grep批量搜索关键术语)
- 多余空格清理(OCR残留双空格)
- 章节结构重建(识别标题层级)
第6步:格式化输出Word
python format_book.py # Markdown格式化
python md_to_docx.py # 转Word文档
Word排版规格:
- A4纸张,页边距2.54cm
- 正文:宋体12pt,1.5倍行距,首行缩进
- 章节标题:黑体,16pt(部)/14pt(章)加粗
- 译者说明:楷体10.5pt,灰色
速度参考(Gemini Flash + 20并发)
| 文档规模 | 预计耗时 | 备注 |
|---|---|---|
| 1万词 | 5-10分钟 | 短篇报告 |
| 5万词 | 30-40分钟 | 长篇论文 |
| 13万词 | 60-90分钟 | 书籍(如本项目) |
| 30万词 | 3-4小时 | 大部头著作 |
已验证的项目
| 项目 | 规模 | 术语条数 | 输出 |
|---|---|---|---|
| 纳拉瓦内《命运的四颗星》 | 13.3万词/542页 | 185条 | 24万字中文译本 |
目录结构
south-asia-translator/
├── skill.md # 本文件(技能定义)
├── scripts/ # 自动化脚本
│ ├── extract_text.py # 文本提取(docx/pdf/txt)
│ ├── run_linguagacha.py # LinguaGacha控制脚本
│ ├── format_book.py # 书籍Markdown格式化
│ ├── md_to_docx.py # Markdown转Word
│ └── save_glossary.py # 术语表生成
├── templates/ # 模板文件
│ ├── academic_prompt.txt # 学术翻译提示词
│ └── linguagacha_config.json # LinguaGacha配置模板
├── glossaries/ # 术语表
│ └── south_asia_military.json # 南亚军事术语(185条)
└── references/ # 参考文档
├── terminology.md # 人名/机构译法
├── common-expressions.md # 简化表达对照
└── scoring-standards.md # 六维度评分标准
项目文件存放在独立目录:
translation_projects/
└── 项目名称/
├── source/ # 原文
├── drafts/ # 翻译草稿
├── final/ # 最终稿(.md + .docx)
└── linguagacha/ # LG项目数据库