SRT B-roll 规划
交付 visual-lock.json/md 与 shot-plan.json/md,供用户共同批准。本阶段不生成图片、H3 脚本或视频,不估价、不启动 GPU。
输入与设计
- 用户指定任务时直接读取其
task.json与相关产物;未指定时只在work/tasks/定位同一输入的候选任务。恢复和变更遵循任务与授权契约,继承已冻结标注、输入参考、Design 和禁用项,不从聊天摘要重建。 - 新任务通过
broll-video init非破坏性复制 SRT。首次规划或全篇逻辑改变时完整阅读 SRT;已有完整理解且只改局部时读取受影响段及必要上下文。 - 场景设计前取得两类参考:内容/场景风格,以及口播原片或用户指定的口播衔接画面。已有资产直接登记;缺少时一次索取缺项,不自行补造。冲突时先明确优先级。
- 视觉锁记录来源、SHA-256、适用范围、禁用项、角色比例、摄影语言及衔接的光色、密度、方向与节奏。风格连续不等于重复房间或构图。
- 先判断候选覆盖区间,再完成
scene_design,最后写摄影。每单元说明可见主体、空间、信息推进、风格落实和切入口播的方式;按项目画面标准保证它对应此段含义。
编写计划
新建或改变覆盖逻辑时读语义与计划字段;局部字段修订只查相关章节及 shot plan schema。
- 覆盖目标沿用用户要求;未给出时按解释需要提出实际覆盖率,不固定 60%。用所选绝对时间区间的并集计算覆盖时长,分母为完整节目时长,同时列出重要淘汰区间及原因。
rhetorical_coverage完整映射必需章节、问题、分类和回调成员,不能用覆盖率代替。一个 H3 单元为 4–15 秒;过长按真实语义边界拆,过短合并相邻信息或保留真人。shot-plan.json使用schema_version: 3.0。保留源绝对时间、原话、具体场景与对应理由;beats[]使用数值型相对时间,语义新增驱动节拍,节拍不等于切镜。- 摄影字段与镜头编号遵循参考中的格式;新 Shot 有动机地改变景别、角度或视点并增加信息。
- 每单元声明
text_strategy: none / keyword / concept_ui / exact_ai_text。有文字时压低到单一主体、动作与主文字焦点,文字正面、巨大、高对比并稳定停留;精确内容逐字给出,仍由 AI 生成。 - 人物用明确动画化角色;不生成拟真人演员、操作员或真人口型,不自行创造用户/名人化身。身份素材只能来自用户提供的视觉资产。
交付与批准
shot-plan.md 应让用户看到全部覆盖区间、必需修辞成员、对应口播、具体场景和切点;visual-lock.md 展示两类参考及使用方式。核对机器文件和审阅版一致,修复本阶段缺项后提交这组可审阅产物。
用户明确批准当前视觉锁、镜头计划和继承账本后,由 Agent 执行:
broll-video approve-shot-plan <task-id> --approval-source explicit_user_instruction
命令记录四份文件、审阅包与账本的 SHA-256。缺少参考、计划字段或用户批准时停在阶段一;批准有效后,已授权的后续工作转入 broll-storyboard-producer,无需重复询问。