# Glossary Rules

> 解释或判断术语的收录资格、实体身份、译名与字面覆盖。

- Skill: `neavo/glossary-rules` (Agent Skill, multi-file: 2 files)
- Install (CLI): `npx skillmds@latest add neavo/glossary-rules`
- Raw SKILL.md: https://api.skillmd.com/api/skills/neavo/glossary-rules/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- Author: neavo (https://skillmd.com/u/neavo)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/neavo/glossary-rules

---


# 术语领域判据

## 技能加载

需要形成或判断译名时，加载并遵循 `writing-guide` 技能。

本技能负责 glossary 对象的收录资格、身份、边界、字段和安全覆盖。术语概念解释可直接使用本技能。

glossary 承载普通翻译无法稳定推出的专有译法、身份、指代、消歧和作品特有事实；维护资格由对象身份与翻译需求决定。运行时按 `src` 连续字面命中激活条目，把 `src -> dst #info` 交给翻译模型；`info` 向模型提供语义或条件指令，程序侧按固定 `dst` 是否出现检查应用。

字面命中用于激活术语提示，每处命中是否采用固定译文由对象身份与 `info` 中的适用条件共同决定。局部翻译输入能够区分的其它义项或普通词内部片段，可以通过条件说明处理并保留术语；程序侧缺失警告作为复核线索。

## 1. 收录资格

先确定对象是否需要 glossary，再收束字段表达。

- **应收录**：对象是专有实体、作品特有概念，或需要固定译法、身份、指代或消歧；普通翻译可能产生足以破坏一致性的分歧，且没有其它最终规则安全覆盖。
- **不应收录**：普通称谓、职业、描述性或泛用内容，普通翻译能够稳定处理，且不承载必要身份或消歧，或已经由其它最终规则安全覆盖。
- **尚不能判断**：补充调查后仍无法判断资格。继续按语境、边界或分支缩小问题；只有字段无法表达任何安全策略时，才列为需要补充信息。

人名、别名、姓氏、地名、家族、组织，以及作品特有的物品、技能、生物或概念，在身份可以合理建立时默认应收录。专有身份、译法稳定性和消歧需求共同决定资格。

固定译文、命中频率、共享词根和相似性只能作为辅助证据；术语资格仍由专有身份、作品特有性、身份、指代、消歧需求及翻译稳定性决定。

## 2. 领域发现方向

独立漏项检查使用三类证据基础：

- **名称与结构**：完整非空 `name_src`、名称边界、特殊书写、并列、枚举、等级、对立体系和其它同构结构；
- **语境与关系**：命名、定义、首次登场、别名、规则、获得、装备、发动、所属和身份变化等槽位；
- **译文与长尾**：`dst` / `name_dst` 的译法分歧、外文残留、身份线索、现有规则未覆盖的文件长尾与单次概念。

已确认对象在有限语境中的位置可抽象成槽位，再扫描同槽位的其它连续原文字面量；别名、同位说明、同系列形式、公共片段、相邻实体和文件结构生成候选，工程语境证据确定术语资格与语义身份。

包含术语发现目标时，三类证据基础各自形成至少一个独立方向。

候选按批次合并使用 `ws.tool.matchLiterals` 在 `src` / `name_src` 上执行正式连续字面匹配。同一有效事实范围、模式与匹配策略的已有结果直接复用。摘要包含原文字面量、发现来源、完整计数、既有覆盖线索和判断所需语境；低频、单次出现及尚未返回的候选仍保留处置去向。频率、重复次数和已有错误用于排序与证据预算，资格由身份和翻译需求确定。

### 匹配证据与补证

|当前需要|证据用法|
|---|---|
|数量、零命中和分布|复用完整计数，或以 `max_matches_per_pattern: 0` 取得计数|
|候选资格、身份或译名事实|取得与具体问题相关的必要语境，保存实际判断范围及结论|
|覆盖差异、词根新增命中及边界分析|复用完整位置，或省略 `max_matches_per_pattern` 一次取得所需模式的完整证据，再完成语义判断|

`matchLiterals` 始终返回完整计数，`matches_complete` 只表示字段命中位置是否收齐。完整位置支持覆盖计算，实际用法仍需语义分类；限量取证为 `false` 时，按当前检查是否需要完整位置决定补取。

正整数 `max_matches_per_pattern` 收集最先出现的至多 N 条字段证据。需要其它用法时，从已有证据或定点读取结果选择相关语境。多个对象的上下文问题，将对应 item ID 合批传给 `ws.tool.queryItemContexts`，按返回关系关联共享条目，只返回各问题所需字段。

### 发现种子与后继启发

`seed` 表示既有 glossary 条目在当前任务中的发现资格。`seed: true` 条目的身份、命名槽位或所属体系已经由工程证据支持，可以启发别名、派生形式、同体系对象和边界反例调查；`seed: false` 条目作为参考，参与译名、覆盖、冲突和边界核验。种子资格与最终保留、调整或删除结论分别判断。

新证据改变身份、体系或适用边界时，重新判断种子资格及受影响的关联结论。

正确术语的命名位置、别名关系和体系也可以启发新方向；被排除的普通词可以提供边界反例。每个受启发候选都取得自己的工程资格证据。全部既有条目暴露的冲突、覆盖缺口和过宽边界都需要核验，关联发现范围遵循种子资格与用户目标。

## 3. 表达路径与字段

对应收录或可能应收录的对象按以下顺序收束：

1. 取得身份、指代、译法分布和边界所需的有限语境，确认收录资格与固定译名；将实际命中分类为目标用法、其它义项或普通词内部片段；
2. 已核验命中均适用同一固定译法时，直接形成规则；不影响翻译行为的未知信息不妨碍收束；
3. 存在不适用命中时，先核验局部翻译输入能否可靠区分；能够区分时，用 `info` 说明何时采用本条，以及其它义项或普通词内部片段按什么原则翻译；
4. 条件说明无法覆盖全部行为时，调整连续字面边界，或拆分不同实体、别名和固定分支；
5. 直接、条件、调整边界和拆分方案均无法安全表达时，才列为需要补充信息并记录 `blocked`；说明已尝试的方案、具体失败证据、缺失事实与解除条件。仅记录存在误命中不足以支持该结论。

字段约束：

- `src` 是 `item.src` 或 `item.name_src` 中的精确连续字面量，不使用正则；优先最短自然稳定边界；
- `dst` 必须是非空固定译文；译名选择遵循 `writing-guide`；
- `info` 只写影响译法、指代或消歧的最少语义；条件条目说明何时采用本条及不适用时的翻译原则，条件必须可由局部翻译输入判断；
- 角色条目，应在 `info` 中填写性别信息：“男性角色”或“女性角色”，无法确定时填写“未知性别角色”，确有需要时可简洁追加年龄、职业、阵营、特殊身份等补充信息；
- 大小写策略依据敏感与不敏感完整匹配集合决定，真实大小写碰撞才使用 `case_sensitive: true`。

对象身份、适用边界和字段事实的证据优先级为：用户明确指定、工程内语境、已核验同类规则、目标语言一般表达；工程反例优先。性别、身份、所属和别名等影响字段的判断关联到具体事实依据，有决定性线索时围绕缺口补证；性别仍不确定时使用上述未知表达。同一事实供规则字段与实体关系共同使用，发现冲突时更新事实及受影响方案。

字段判例：

|工程证据|正确处置|
|---|---|
|`ミナ → 米娜`，明确为女性角色|使用 `info: "女性角色"`|
|`ノヴァ → 诺瓦`，明确是一座城市|使用 `info: "地名"` 进行消歧|
|`アストラ → 阿斯特拉`，明确是一把剑|使用 `info: "物品，剑"`|
|`エーテル → 以太`，只需固定译名|使用 `info: ""`|
|`ルナ` 同时是角色名和普通“月亮”，句内可以辨认|条件 `info` 说明角色时采用本条，其他义项按上下文翻译|
|`May` 是角色名而 `may` 是普通词|通过完整匹配使用 `case_sensitive: true`|
|`ALICE`、`Alice`、`alice` 都指同一角色且无普通词误匹配|使用 `case_sensitive: false` 扩大覆盖|
|已确认应收录的术语也命中普通词内部片段，局部输入足以区分|保留术语，用 `info` 写明目标用法及普通词内部片段的处理条件，再核验全部相关命中|
|条件术语在普通义项下未采用固定译名，产生术语缺失警告|核验该命中属于其它义项，确认条件说明是否准确；警告本身不构成改变固定译名的依据|

## 4. 词根候选与边界

词根用于浓缩同一对象或规则体系的稳定表达。先完成成员资格、身份与译名判断，再对其中多个不同词形使用 `ws.tool.deriveCommonLiteralRoots` 枚举公共连续字面候选。异义或尚待确认的成员分别保留；字符重合只能产生候选。

候选必须稳定表达共同身份或概念，固定译文能用于各分支，剩余文本可按语境正常组合翻译。在这些条件成立的候选中选择最短自然稳定边界；必要的身份区别、固定译法与消歧信息决定边界下限。

采用候选前，复用同一有效事实范围、模式与匹配策略的完整匹配，将缺少完整位置的比较模式合批传给 `ws.tool.matchLiterals` 一次取得证据。确认各模式 `matches_complete`，完整字段命中记录保存在工作文件中；事实范围或模式变化后重新取得受影响证据。由完整记录计算精确分支 item 并集 `B`、词根与分支 item 并集 `R`，逐项分类新增命中 `R - B`：

- 同一对象、别名或派生形式：取得共同身份及译法可组合的证据。
- 其它义项或普通词内部片段：先确认局部翻译输入能否可靠区分，并按“表达路径与字段”形成条件说明；条件不足时继续调整边界或拆分。
- 新对象或边界反例：补证、收窄或拆分，直到安全表达成立；仍缺决定性事实时保持独立未决。

item 并集用于定位覆盖差异，同一 item 内原有命中旁新增的片段仍须核验。完整命中与必要语境共同证明边界安全，计数相同不能单独证明身份或译法相同。候选边界、大小写策略或条件变化后，重新核验受影响的匹配与语义证据。

## 5. 安全覆盖闭合

最终规则集合必须保留完整待判断对象、全部已确认覆盖与显式未决：

- 每个应收录对象由安全的直接、条件或精确分支规则覆盖；暂时无法安全表达的对象保留独立 `blocked` 结论、已完成调查、缺失事实与解除条件。
- 每条选定规则的全部命中均已分类：适用命中采用固定译文；不适用命中可依据局部输入和明确的条件说明正常翻译；无法可靠区分的命中已经调整边界或拆分排除。
- 合并前后每个已确认对象的覆盖可追溯；词根与必要精确分支可以共同覆盖对象。合并失败时保留安全的精确规则。

从完整对象记录核对处置与覆盖，按规则核对命中。复用能关联到实际用法的有效分类，未分类命中继续处理。未决对象作为尚未完成的覆盖目标明确报告。

## 6. 最小充分集合

按收录资格、译名正确性、覆盖充分性、边界安全、作品风格、一致性、集合最小性的顺序取舍。

对象覆盖闭合且规则命中完成核对后，检查每条拟删除规则的对象覆盖、固定译法和条件是否由保留规则充分承担，再删除调整范围内的冗余规则。删除后重新计算对象到最终规则的覆盖；出现缺口时恢复安全分支或调整方案并重新验收。范围外规则保持原值，参与最终工程集合的覆盖核对。

最小化结果保留采用的词根、必要精确分支及其理由；没有安全合并机会时，记录对应身份或边界依据。

## 7. 判例

判例根据对应工程证据解释领域判据：

|工程证据|结论|理由|
|---|---|---|
|`ミナ` 位于姓名栏，多处明确为女性角色，译名可确定为 `米娜`|应收录并直接形成规则|固定译名和性别提示不能由普通翻译稳定推出|
|`knight` 始终表示普通职业，没有作品专有译法或消歧信息|不应收录|普通翻译足以稳定处理|
|`レイ` 的可能身份要求互不兼容译名，局部输入无法区分，调整边界与拆分均不可行|保留独立 `blocked`，记录失败证据与解除条件|直接、条件和精确分支均无法安全表达|
|`セラ`、`セラ王女`、`セラ殿` 都指同一角色，剩余称谓可正常翻译|可采用 `セラ` 词根|共同身份、译名和覆盖均已闭合|
|`ドトール家`、`ドトール領`、`ドトール伯爵` 都由同一家名派生，剩余文本可组合|可采用 `ドトール` 词根|词根稳定表达家名，分支身份由剩余文本表达|
|`セラ` 是角色，`セラ教団` 是与她无关的组织|不合并|字面重合不代表共同语义身份|
|`黒騎士` 与 `白騎士` 只共享普通词 `騎士`|不合并为 `騎士`|前缀承担必要区别|
|`Alice` 与 `Alicia` 只偶然共享 `Ali`|不合并|公共字符不表达稳定共同概念|
|公共词根新增普通词命中，局部输入与清楚条件足以可靠区分|可采用带条件 `info` 的词根|新增命中已安全分类，全部应收录对象的覆盖仍成立|
|公共词根新增大量高频普通词，局部输入与条件说明无法可靠区分|拒绝词根并保留安全精确规则|新增命中无法安全处理，词根合并失败不改变对象收录资格|

