完成前验证
概述
在未经验证的情况下声称工作已完成是不诚实,而非高效。
核心原则: 永远先有证据,再下断言。
违反这条规则的字面意思,就是违反这条规则的精神。
铁律
未经全新验证证据,不得声称完成
如果你在本条消息中尚未运行验证命令,就不能声称它通过。
门控函数
在声称任何状态或表达满意之前:
1. 识别:什么命令能证明这一断言?
2. 运行:执行完整命令(全新、完整)
3. 阅读:完整输出,检查退出码,统计失败数
4. 验证:输出是否确认了该断言?
- 如果否:陈述带有证据的实际状态
- 如果是:陈述带有证据的断言
5. 只有在以上之后:做出断言
跳过任何一步 = 撒谎,而非验证
常见失败
| 断言 | 所需证据 | 不足证据 |
|---|---|---|
| 测试通过 | 测试命令输出:0 个失败 | 上次运行、"应该能过" |
| Lint 干净 | Linter 输出:0 个错误 | 部分检查、外推推断 |
| 构建成功 | 构建命令:退出码 0 | Linter 通过、日志看起来正常 |
| Bug 已修复 | 测试原始症状:通过 | 修改了代码、假设已修复 |
| 回归测试有效 | 红绿循环已验证 | 测试一次性通过 |
| 智能体已完成 | VCS diff 显示变更 | 智能体报告"成功" |
| 需求已满足 | 逐项清单核对 | 仅测试通过 |
危险信号 — 立即停止
- 使用"应该"、"可能"、"看起来"
- 在验证前表达满意("太好了!"、"完美!、"搞定!"等)
- 即将在未经验证的情况下提交/推送/发起 PR
- 相信智能体的成功报告
- 依赖部分验证
- 想着"就这一次"
- 累了想赶紧收工
- 任何暗示成功但未运行验证的措辞
防止自我合理化
| 借口 | 现实 |
|---|---|
| "现在应该可以了" | 运行验证 |
| "我有信心" | 信心 ≠ 证据 |
| "就这一次" | 没有例外 |
| "Linter 通过了" | Linter ≠ 编译器 |
| "智能体说成功了" | 独立验证 |
| "我累了" | 疲惫 ≠ 借口 |
| "部分检查就够了" | 部分什么也证明不了 |
| "换种说法规则就不适用" | 精神大于字面 |
关键模式
测试:
✅ [运行测试命令] [看到:34/34 通过] "所有测试通过"
❌ "现在应该能过" / "看起来没问题"
回归测试(TDD 红绿):
✅ 编写 → 运行(通过)→ 撤销修复 → 运行(必须失败)→ 恢复 → 运行(通过)
❌ "我写了一个回归测试"(未做红绿验证)
构建:
✅ [运行构建] [看到:退出码 0] "构建通过"
❌ "Linter 通过了"(Linter 不检查编译)
需求:
✅ 重新阅读计划 → 创建清单 → 逐项验证 → 报告差距或完成情况
❌ "测试通过,阶段完成"
智能体委派:
✅ 智能体报告成功 → 检查 VCS diff → 验证变更 → 报告实际状态
❌ 相信智能体报告
为什么要这样做
来自 24 条失败记忆:
- 你的合作伙伴说"我不相信你" —— 信任破裂
- 未定义的函数被发布 —— 会崩溃
- 缺失的需求被发布 —— 功能不完整
- 在虚假完成上浪费时间 → 重新定向 → 返工
- 违反了:"诚实是核心价值观。如果你撒谎,你会被取代。"
使用时机
始终在以下之前使用:
- 任何形式的成功/完成断言
- 任何满意表达
- 任何关于工作状态的积极陈述
- 提交、创建 PR、任务完成
- 转向下一个任务
- 委派给智能体
规则适用于:
- 完全相同的措辞
- 意译和同义词
- 成功的暗示
- 任何暗示完成/正确的沟通
底线
验证没有捷径。
运行命令。阅读输出。然后再声称结果。
这是不可协商的。
使用时机
本技能适用于执行概述中描述的工作流或操作。
局限性
- 仅当任务明确匹配上述范围时使用本技能。
- 不要将输出视为环境特定验证、测试或专家审查的替代品。
- 如果缺少必需的输入、权限、安全边界或成功标准,请停止并请求澄清。