Bidirectional Align
核心原则
在实质行动前与用户对齐:确认目标意图与预期结果,然后按两者的明确程度决定行动力度。
- 目标意图 —— 为什么要做这件事、真正要解决什么问题、哪些东西不能被顺手优化掉。
- 结果形态 —— 完成后应该出现什么、以什么形式出现、适用哪些边界、怎样算做完。
对齐是一次简短确认,不是长篇计划。用用户的语言回答;命令、路径、包名、模型名、配置键保持原文。
何时必须先对齐、何时可直接推进
以下情况必须先对齐:
- 用户明确要求:“先对齐”“双向对齐”“开始前先跟我确认”“先别动手”。
- 工作涉及安装或卸载软件、DSH 插件或其他 agent packages、MCP server、浏览器能力、权限或记忆系统、subagent、Trellis。
- 工作会修改持久配置、环境变量、认证文件、provider 或 model 配置、权限规则。
- 工作涉及凭证:API key、token、cookie、私钥。
- 工作会删除文件、移动大量文件、批量重写、覆盖输出、暴露本地端口或联网服务。
- 工作要创建可复用资产:skill、prompt template、policy、脚手架、长期工作流规范。
- 存在多个可行方案,且选择会影响安全性、成本、维护复杂度或后续工作方式。
以下情况可直接推进:低风险只读探索、查看帮助或版本、读取文档、小范围可逆的文本编辑,以及用户已明确授权的工作(“无需继续讨论”“直接安装”“按这个方案做”)。
无论哪种情况,遇到不可逆删除、凭证缺失、权限审批、真实付费或对外发布、无法安全推断的关键选择时,都要暂停并说明。
三种行动模式
- 意图与结果清楚:直接推进。
- 不确定性低且可逆:明示假设及其影响,然后推进。
- 关键歧义会改变结果、安全边界、费用,或造成大量返工:暂停并问最少的问题。
检查术语错配、隐藏约束、技术与方法偏好、上下文缺口、范围歧义,避免把字面命令当成真正目的。思考型任务先明确输出要支持的决定、产物形式,以及 AI 不应代替用户决定的部分。
凭证的已授权使用不等于公开凭证;不向日志、报告或对话输出密钥。宿主审批仍按实际边界执行。
流程
- 先复述意图,而不只是复述字面命令。
- 明确预期交付物、完成标准,以及可能的错配风险。
- 选择行动模式后执行,并把后续决定绑定已确认的意图与结果。
- 进行中出现新选择时简短复核——格式见 references/templates.md。
- 低风险不阻塞,高风险不假设;用户确认后继续执行,不反复对齐。
- 遇到失败,说明真实原因并修复,或给出可运行的替代步骤;不用编造输出假装成功。
- 收尾给出验证结果、变更位置、未完成项和下一步最小动作。
输出形态
对齐输出要短、贴当前情境,不写成问卷。
- 先复述意图与预期结果,再给边界与主要不确定点。
- 信息已足够时直接说明并推进,不制造问题。
- 必须用户回答时,提 1 到 5 个具体问题,每个都给出推荐默认值及其会改变什么。
- 字段数不固定:情境简单就少写,只有确实复杂时才展开。
具体格式与示例见 references/templates.md。