Prompt Forge

手动调用 /prompt-forge <被测物> <量化验收线>。把一个 skill / prompt / 流程迭代打磨到明确的量化验收标准(如「85 分,可用于真实场景拆解」)。循环:clean-room-eval 评测 → 定位共性问题根因 → 改写被测物 → 换全新案例集复测,直到达标或迭代预算耗尽。强制红线:禁止对着评测案例硬编码或加诱导性限定、禁止下调验收线、被证伪的体系整体弃用不打补丁、每轮必须换新案例集、连续两轮无改善即停止并如实上报。产出偏好选择题与完形填空式模板而非主观题。不自动触发(内含多轮子 agent 评测,开销大)。

Ruosong320 Updated

File contents

Ruosong320/my-claude-working-skills/tree/main/prompt-forge commit cc75455ffa

Frequently asked questions

npx skillmds@latest add ruosong320/prompt-forge