术语领域判据
技能加载
需要形成或判断译名时,加载并遵循 writing-guide 技能。
本技能负责 glossary 对象的收录资格、身份、边界、字段和安全覆盖。术语概念解释可直接使用本技能。
glossary 承载普通翻译无法稳定推出的专有译法、身份、指代、消歧和作品特有事实;维护资格由对象身份与翻译需求决定。运行时按 src 连续字面命中激活条目,把 src -> dst #info 交给翻译模型;info 向模型提供语义或条件指令,程序侧按固定 dst 是否出现检查应用。
字面命中用于激活术语提示,每处命中是否采用固定译文由对象身份与 info 中的适用条件共同决定。局部翻译输入能够区分的其它义项或普通词内部片段,可以通过条件说明处理并保留术语;程序侧缺失警告作为复核线索。
1. 收录资格
先确定对象是否需要 glossary,再收束字段表达。
- 应收录:对象是专有实体、作品特有概念,或需要固定译法、身份、指代或消歧;普通翻译可能产生足以破坏一致性的分歧,且没有其它最终规则安全覆盖。
- 不应收录:普通称谓、职业、描述性或泛用内容,普通翻译能够稳定处理,且不承载必要身份或消歧,或已经由其它最终规则安全覆盖。
- 尚不能判断:补充调查后仍无法判断资格。继续按语境、边界或分支缩小问题;只有字段无法表达任何安全策略时,才列为需要补充信息。
人名、别名、姓氏、地名、家族、组织,以及作品特有的物品、技能、生物或概念,在身份可以合理建立时默认应收录。专有身份、译法稳定性和消歧需求共同决定资格。
固定译文、命中频率、共享词根和相似性只能作为辅助证据;术语资格仍由专有身份、作品特有性、身份、指代、消歧需求及翻译稳定性决定。
2. 领域发现方向
独立漏项检查使用三类证据基础:
- 名称与结构:完整非空
name_src、名称边界、特殊书写、并列、枚举、等级、对立体系和其它同构结构; - 语境与关系:命名、定义、首次登场、别名、规则、获得、装备、发动、所属和身份变化等槽位;
- 译文与长尾:
dst/name_dst的译法分歧、外文残留、身份线索、现有规则未覆盖的文件长尾与单次概念。
已确认对象在有限语境中的位置可抽象成槽位,再扫描同槽位的其它连续原文字面量;别名、同位说明、同系列形式、公共片段、相邻实体和文件结构生成候选,工程语境证据确定术语资格与语义身份。
包含术语发现目标时,三类证据基础各自形成至少一个独立方向。
候选按批次合并使用 ws.tool.matchLiterals 在 src / name_src 上执行正式连续字面匹配。同一有效事实范围、模式与匹配策略的已有结果直接复用。摘要包含原文字面量、发现来源、完整计数、既有覆盖线索和判断所需语境;低频、单次出现及尚未返回的候选仍保留处置去向。频率、重复次数和已有错误用于排序与证据预算,资格由身份和翻译需求确定。
匹配证据与补证
| 当前需要 | 证据用法 |
|---|---|
| 数量、零命中和分布 | 复用完整计数,或以 max_matches_per_pattern: 0 取得计数 |
| 候选资格、身份或译名事实 | 取得与具体问题相关的必要语境,保存实际判断范围及结论 |
| 覆盖差异、词根新增命中及边界分析 | 复用完整位置,或省略 max_matches_per_pattern 一次取得所需模式的完整证据,再完成语义判断 |
matchLiterals 始终返回完整计数,matches_complete 只表示字段命中位置是否收齐。完整位置支持覆盖计算,实际用法仍需语义分类;限量取证为 false 时,按当前检查是否需要完整位置决定补取。
正整数 max_matches_per_pattern 收集最先出现的至多 N 条字段证据。需要其它用法时,从已有证据或定点读取结果选择相关语境。多个对象的上下文问题,将对应 item ID 合批传给 ws.tool.queryItemContexts,按返回关系关联共享条目,只返回各问题所需字段。
发现种子与后继启发
seed 表示既有 glossary 条目在当前任务中的发现资格。seed: true 条目的身份、命名槽位或所属体系已经由工程证据支持,可以启发别名、派生形式、同体系对象和边界反例调查;seed: false 条目作为参考,参与译名、覆盖、冲突和边界核验。种子资格与最终保留、调整或删除结论分别判断。
新证据改变身份、体系或适用边界时,重新判断种子资格及受影响的关联结论。
正确术语的命名位置、别名关系和体系也可以启发新方向;被排除的普通词可以提供边界反例。每个受启发候选都取得自己的工程资格证据。全部既有条目暴露的冲突、覆盖缺口和过宽边界都需要核验,关联发现范围遵循种子资格与用户目标。
3. 表达路径与字段
对应收录或可能应收录的对象按以下顺序收束:
- 取得身份、指代、译法分布和边界所需的有限语境,确认收录资格与固定译名;将实际命中分类为目标用法、其它义项或普通词内部片段;
- 已核验命中均适用同一固定译法时,直接形成规则;不影响翻译行为的未知信息不妨碍收束;
- 存在不适用命中时,先核验局部翻译输入能否可靠区分;能够区分时,用
info说明何时采用本条,以及其它义项或普通词内部片段按什么原则翻译; - 条件说明无法覆盖全部行为时,调整连续字面边界,或拆分不同实体、别名和固定分支;
- 直接、条件、调整边界和拆分方案均无法安全表达时,才列为需要补充信息并记录
blocked;说明已尝试的方案、具体失败证据、缺失事实与解除条件。仅记录存在误命中不足以支持该结论。
字段约束:
src是item.src或item.name_src中的精确连续字面量,不使用正则;优先最短自然稳定边界;dst必须是非空固定译文;译名选择遵循writing-guide;info只写影响译法、指代或消歧的最少语义;条件条目说明何时采用本条及不适用时的翻译原则,条件必须可由局部翻译输入判断;- 角色条目,应在
info中填写性别信息:“男性角色”或“女性角色”,无法确定时填写“未知性别角色”,确有需要时可简洁追加年龄、职业、阵营、特殊身份等补充信息; - 大小写策略依据敏感与不敏感完整匹配集合决定,真实大小写碰撞才使用
case_sensitive: true。
对象身份、适用边界和字段事实的证据优先级为:用户明确指定、工程内语境、已核验同类规则、目标语言一般表达;工程反例优先。性别、身份、所属和别名等影响字段的判断关联到具体事实依据,有决定性线索时围绕缺口补证;性别仍不确定时使用上述未知表达。同一事实供规则字段与实体关系共同使用,发现冲突时更新事实及受影响方案。
字段判例:
| 工程证据 | 正确处置 |
|---|---|
ミナ → 米娜,明确为女性角色 |
使用 info: "女性角色" |
ノヴァ → 诺瓦,明确是一座城市 |
使用 info: "地名" 进行消歧 |
アストラ → 阿斯特拉,明确是一把剑 |
使用 info: "物品,剑" |
エーテル → 以太,只需固定译名 |
使用 info: "" |
ルナ 同时是角色名和普通“月亮”,句内可以辨认 |
条件 info 说明角色时采用本条,其他义项按上下文翻译 |
May 是角色名而 may 是普通词 |
通过完整匹配使用 case_sensitive: true |
ALICE、Alice、alice 都指同一角色且无普通词误匹配 |
使用 case_sensitive: false 扩大覆盖 |
| 已确认应收录的术语也命中普通词内部片段,局部输入足以区分 | 保留术语,用 info 写明目标用法及普通词内部片段的处理条件,再核验全部相关命中 |
| 条件术语在普通义项下未采用固定译名,产生术语缺失警告 | 核验该命中属于其它义项,确认条件说明是否准确;警告本身不构成改变固定译名的依据 |
4. 词根候选与边界
词根用于浓缩同一对象或规则体系的稳定表达。先完成成员资格、身份与译名判断,再对其中多个不同词形使用 ws.tool.deriveCommonLiteralRoots 枚举公共连续字面候选。异义或尚待确认的成员分别保留;字符重合只能产生候选。
候选必须稳定表达共同身份或概念,固定译文能用于各分支,剩余文本可按语境正常组合翻译。在这些条件成立的候选中选择最短自然稳定边界;必要的身份区别、固定译法与消歧信息决定边界下限。
采用候选前,复用同一有效事实范围、模式与匹配策略的完整匹配,将缺少完整位置的比较模式合批传给 ws.tool.matchLiterals 一次取得证据。确认各模式 matches_complete,完整字段命中记录保存在工作文件中;事实范围或模式变化后重新取得受影响证据。由完整记录计算精确分支 item 并集 B、词根与分支 item 并集 R,逐项分类新增命中 R - B:
- 同一对象、别名或派生形式:取得共同身份及译法可组合的证据。
- 其它义项或普通词内部片段:先确认局部翻译输入能否可靠区分,并按“表达路径与字段”形成条件说明;条件不足时继续调整边界或拆分。
- 新对象或边界反例:补证、收窄或拆分,直到安全表达成立;仍缺决定性事实时保持独立未决。
item 并集用于定位覆盖差异,同一 item 内原有命中旁新增的片段仍须核验。完整命中与必要语境共同证明边界安全,计数相同不能单独证明身份或译法相同。候选边界、大小写策略或条件变化后,重新核验受影响的匹配与语义证据。
5. 安全覆盖闭合
最终规则集合必须保留完整待判断对象、全部已确认覆盖与显式未决:
- 每个应收录对象由安全的直接、条件或精确分支规则覆盖;暂时无法安全表达的对象保留独立
blocked结论、已完成调查、缺失事实与解除条件。 - 每条选定规则的全部命中均已分类:适用命中采用固定译文;不适用命中可依据局部输入和明确的条件说明正常翻译;无法可靠区分的命中已经调整边界或拆分排除。
- 合并前后每个已确认对象的覆盖可追溯;词根与必要精确分支可以共同覆盖对象。合并失败时保留安全的精确规则。
从完整对象记录核对处置与覆盖,按规则核对命中。复用能关联到实际用法的有效分类,未分类命中继续处理。未决对象作为尚未完成的覆盖目标明确报告。
6. 最小充分集合
按收录资格、译名正确性、覆盖充分性、边界安全、作品风格、一致性、集合最小性的顺序取舍。
对象覆盖闭合且规则命中完成核对后,检查每条拟删除规则的对象覆盖、固定译法和条件是否由保留规则充分承担,再删除调整范围内的冗余规则。删除后重新计算对象到最终规则的覆盖;出现缺口时恢复安全分支或调整方案并重新验收。范围外规则保持原值,参与最终工程集合的覆盖核对。
最小化结果保留采用的词根、必要精确分支及其理由;没有安全合并机会时,记录对应身份或边界依据。
7. 判例
判例根据对应工程证据解释领域判据:
| 工程证据 | 结论 | 理由 |
|---|---|---|
ミナ 位于姓名栏,多处明确为女性角色,译名可确定为 米娜 |
应收录并直接形成规则 | 固定译名和性别提示不能由普通翻译稳定推出 |
knight 始终表示普通职业,没有作品专有译法或消歧信息 |
不应收录 | 普通翻译足以稳定处理 |
レイ 的可能身份要求互不兼容译名,局部输入无法区分,调整边界与拆分均不可行 |
保留独立 blocked,记录失败证据与解除条件 |
直接、条件和精确分支均无法安全表达 |
セラ、セラ王女、セラ殿 都指同一角色,剩余称谓可正常翻译 |
可采用 セラ 词根 |
共同身份、译名和覆盖均已闭合 |
ドトール家、ドトール領、ドトール伯爵 都由同一家名派生,剩余文本可组合 |
可采用 ドトール 词根 |
词根稳定表达家名,分支身份由剩余文本表达 |
セラ 是角色,セラ教団 是与她无关的组织 |
不合并 | 字面重合不代表共同语义身份 |
黒騎士 与 白騎士 只共享普通词 騎士 |
不合并为 騎士 |
前缀承担必要区别 |
Alice 与 Alicia 只偶然共享 Ali |
不合并 | 公共字符不表达稳定共同概念 |
| 公共词根新增普通词命中,局部输入与清楚条件足以可靠区分 | 可采用带条件 info 的词根 |
新增命中已安全分类,全部应收录对象的覆盖仍成立 |
| 公共词根新增大量高频普通词,局部输入与条件说明无法可靠区分 | 拒绝词根并保留安全精确规则 | 新增命中无法安全处理,词根合并失败不改变对象收录资格 |