Amazon AMC 查询审查
目标
从业务问题反推事件粒度和输出,检查连接放大、重复计数、时间/归因口径和聚合阈值,确保 SQL 结果可解释且隐私安全。
何时使用
- 复制 AMC SQL 后结果异常或无法运行
- 人群、路径、频次或归因分析数字被放大
- 准备根据 AMC 输出创建受众或调整预算
开始前要拿到
- 业务问题、预期决策、站点/广告主、时间和归因窗口
- 当前 AMC schema、字段分类、查询全文与参数
- 每张表的事件粒度、主键/连接键、预计行数和已知总量
- 运行错误、阈值列、对照报表和目标输出字段
缺失项必须标为 UNKNOWN 或 NEEDS_EVIDENCE;不得猜数字、补属性,或混用不同站点、ASIN、币种和时间窗。
不可妥协的边界
- 当前 Amazon 官方规则、目标账户实时状态和一方业务报告优先;公开内容与第三方数据只能作为待验证启发或代理证据。
- 默认提供诊断或草案。写入前展示对象、旧值、新值、影响、停止线与回退,核对用户已有授权是否覆盖对象、动作与预算;范围已明确授权时继续执行并回读核验,只有未覆盖或扩大的范围才请求批准。
- 数值、政策、因果和执行状态分别标为
FACT、ESTIMATE、ASSUMPTION或UNKNOWN。 - 不保存或输出素材来源身份、账号、链接、文章编号、发布日期、阅读量、原始话术或其他可反查线索。
- 个案、论坛回答和示例 SQL 只能形成候选方法,不能证明普遍因果。
- 不得输出或尝试识别单个用户;遵守 AMC 当前聚合、过滤和隐私阈值。
- 示例 SQL 只能作为结构参考,必须按当前 schema、实例和问题重写。
- 查询成功不等于语义正确;连接基数、去重和已知总量必须单独 QA。
工作流
- 把业务问题写成对象、事件、窗口、分组、指标和允许的最终粒度。
- 逐表记录一行代表什么、键是否唯一、时间字段和可能重复事件。
- 在每次 JOIN 前检查一对一/一对多/多对多,并预聚合或去重。
- 统一时区、回溯、归因、曝光/点击/购买定义和过滤顺序。
- 按字段分类检查最终 SELECT、过滤和聚合阈值,解释 NULL 与拒绝原因。
- 用行数、唯一计数、已知广告总量和极小样本做 QA,再限制性解释结果。
判断状态
READY:当前规则、输入、基线和动作边界均已核实。HOLD:方向可能成立,但关键数据、样本、资格或审批仍缺失。STOP:存在违规、隐私越界、经济性不可承受、数据不可解释或无法回退。
必须交付的结果
- 业务问题到字段/粒度映射
- JOIN 与重复风险表
- 隐私阈值和查询 QA
- 解释边界与受众/预算使用门
- 数据范围、采集时间、定义、证据状态、限制和待批准动作
详细台账与质量门见 references/playbook.md。