/llm-as-a-verifier — 可选排序器 (v9.9.9)
9.9.8 把 LaaV 留作 opt-in 槽(design B、llm-as-a-verifier)。本版提供可调用 skill 与脚本,默认关闭,不进入 PACE 默认链,不新建 stage。
何时用
同时满足:
_index.laav_enabled = true(/athena-preferences写入),或用户本轮显式要求排序- 相关测试已绿
- 面前有 ≥2 个合格候选(独立 worktree / 补丁 / 实现变体)
- 发生在 runtime-verify 之后、一次独立 review 之前
缺任一条件 → skip,写明原因。不要为了用 LaaV 去生成多余候选。
怎么用
python3 ~/.claude/skills/llm-as-a-verifier/scripts/rank.py \
--packet .ai_state/sprints/<slug>/review-packet.md \
--candidate a.diff --candidate b.diff \
--output .ai_state/.runtime/verifier_rank.json
- 后端必须能返回 score token 的 logprobs(OpenAI-compatible / Gemini / DeepSeek)。用
ATHENA_LAAV_BASE_URL+ATHENA_LAAV_API_KEY(或该 URL 对应的官方 key env)。 - Claude / 无 logprobs 的自定义网关 → 脚本 exit 0 且
status: skipped,不得用 1–5 离散分冒充 LaaV。 - 评分标准 = 当前
review-packet.md的 Done checks,禁止另造「感觉更好」。 - 输出只排序。
reviewer可以读verifier_rank,不能把它写成 VERDICT。delivery-gate / 测试 / VM 实跑仍是法律。
硬边界
- 不替换 review、不替换 VM、不为 LaaV 新建 PACE stage。
- 不改全局
ANTHROPIC_BASE_URL;独立端口/独立 base URL,fresh install 默认关。 - 未校准前只记 ignored
.runtimetelemetry,不作为选实现的强制依据。 - 秘密不进 hash 输入、不进对话。
细则与校准记录见 playbook。模板:verifier_rank.json。