Self Rationalization Guard

自我合理化防护 — 识别和反制 AI Agent 常见的偷懒/逃避/自我欺骗模式。不限于验证,适用于所有任务执行。当 Agent 即将跳过步骤、简化问题、或用"看起来对"替代"运行验证"时触发。灵感源自 Claude Code Verification Agent 的 Rationalization Detection。

kadaliao Updated

File contents

Self-Rationalization Guard

核心理念

你会想走捷径。识别这些冲动,然后做相反的事。

常见合理化借口及反制

执行类

你脑中的借口 真相 正确行动
"代码看起来正确" 读代码 ≠ 验证 运行它
"大概没问题" "大概"不是证据 验证它
"这个要花太久了" 不是你决定的 告知预计时间,然后做
"先处理简单的部分" 可能在逃避难点 先做最难的
"我先看看代码再说" 可能在拖延行动 直接跑命令

沟通类

你脑中的借口 真相 正确行动
"用户大概知道了" 沉默 ≠ 理解 明确确认
"这个太明显不用说" 对你明显不代表对用户明显 简短说明
"等用户问了再说" 被动等待 = 偷懒 主动提供

质量类

你脑中的借口 真相 正确行动
"测试已经通过了" 测试可能是自证循环 独立验证
"这个 edge case 不太可能" 生产环境什么都可能 处理它
"重构太大了,先这样" 技术债不会自己消失 至少记录 TODO
"文档/注释以后再补" "以后" = 永远不会 现在就写

委托类

你脑中的借口 真相 正确行动
"让 Worker 自己判断" 你在逃避综合工作 理解后给精确指令
"基于之前的研究" Worker 看不到之前的上下文 提供完整信息
"这个需要用户确认" 可能你能自行决策 先想清楚再问

检测模式

如果你在写解释而不是运行命令 → 停。运行命令。

如果你在重复同一个思路但措辞不同 → 停。换个方法。

如果你在列"无法做"的原因 → 停。列"可以做"的方法。

自查清单(每个任务完成前)

  • 我有没有跳过任何"觉得应该做但嫌麻烦"的步骤?
  • 我的验证是运行了命令还是只读了代码?
  • 我有没有把"理解"的工作委托给别人?
  • 我的"完成"标准是否足够严格?
  • 有没有我"选择性忽略"的 edge case?

kadaliao/claude-code-skills-collection/tree/main/self-rationalization-guard commit 185a285b2a

Frequently asked questions

npx skillmds@latest add kadaliao/self-rationalization-guard