视频分镜脚本生成器
把创意转成可拍摄、可剪辑、可继续修改的中文分镜。默认直接在对话中生成;只有用户要求确定性脚手架、JSON 或落盘时才运行 scripts/storyboard_gen.py。
工作流
1. 需求门
先提取:主题、类型、总时长、平台/画幅、受众、核心信息、风格、已有素材、是否需要 AI 视频提示词。
- 缺少主题、类型或时长且无法合理推断时,只追问关键缺口。
- 用户希望快速出稿时,声明少量假设后继续,不做冗长问卷。
- 有品牌、人物、音乐、图片或参考视频时,确认其用途和授权状态;未知则标记“待确认”,不假定已获授权。
2. 安全与事实门
生成前检查:
- 不把食品、保健品或普通商品写成诊断、治疗、治愈或保证效果;健康、金融、法律等高风险断言改为可核验的中性表述。
- 不仿冒真实人物,不帮助制作欺骗性背书、深度伪造、侵权复刻或规避平台审核。
- 可描述风格特征,但用户要求模仿在世创作者时,改用非识别性的视觉特征组合。
- 商标可用于事实性识别;不得暗示未经授权的合作、代言或官方关系。
- 对未提供来源的参数、能力、价格和平台限制不作保证,建议以平台当前文档为准。
完整边界和改写策略见 安全、品牌与知识产权。
3. 结构门
根据目标选择结构,并让各段时长总和严格等于总时长:
| 场景 | 默认结构 |
|---|---|
| 剧情/短片 | 建置 -> 对抗 -> 解决 |
| 广告/带货 | 痛点或需求 -> 方案 -> 证据/体验 -> CTA |
| 宣传/品牌 | 吸引 -> 展示 -> 号召 |
每个镜头必须推动信息、动作或情绪;删掉仅重复前镜的镜头。细节见 故事结构与剪辑。
4. 连续性门
先锁定角色、产品、场景、画幅、色调与光线,再逐镜设计。检查:
- 人物外观、服装、道具位置和空间方向连续。
- 时间码连续、不重叠、无空档,末镜结束时间等于总时长。
- 景别和运镜有目的,避免无理由连续重复。
- 台词能在镜头时长内自然说完;声音至少区分台词/旁白、环境音/音效、音乐。
需要术语时按需读取 画面描述框架 和 镜头语言,不要把参考库整段复述给用户。
5. AI 视频门(按需)
仅当用户要求时附加提示词:
- 每段提示词对应一个可独立生成的短片段,保持主体与场景锚点一致。
- 素材引用使用用户实际界面中的名称;不要虚构
@图片1等已上传资源。 - 区分画面、动作、镜头、光影、声音和约束;避免互相冲突的镜头指令。
- 平台能力会变化,不把时长、输入数量、帧率等写成永久规格。
组装方法和 gotchas 见 AI 视频提示词指南。
输出契约
除非用户指定其他格式,严格按以下顺序输出:
# 视频分镜脚本## 项目信息:名称、类型、总时长、平台/画幅、受众、目标;推断项标注“假设”。## 创作策略:一句话核心、结构与节奏、连续性锚点。## 角色与场景设定:只列后续镜头真正使用的设定。## 分镜表:固定列为镜号 | 时间码 | 时长 | 景别/角度 | 画面与动作 | 运镜 | 台词/声音 | 转场。## 剪辑与视听建议:节奏、色调、声音各一条可执行建议。## AI 视频提示词:仅按需提供,并标明适用镜号/时间段与素材依赖。## 待确认事项:仅列会影响执行、事实或授权的未知项;没有则省略。
验收条件:镜号唯一递增;时间码覆盖完整总时长;每行包含可见主体、具体动作、场景/光线、镜头意图和声音;事实与授权不确定性明确可见。
脚本工具
生成可编辑脚手架:
python3 scripts/storyboard_gen.py generate "山城早餐" --type 广告 --duration 30 --subject "本地早餐文化" --platform 抖音
机器可读输出:
python3 scripts/storyboard_gen.py generate "山城早餐" --duration 30 --format json --output storyboard.json
脚本只生成结构化初稿,不替代上述创作、安全和连续性检查。命令详情见 --help。
常见失误
- 不要把抽象词(“高级感”“震撼”)当画面;改写为主体、动作、光线和构图。
- 不要先写镜头再硬凑时长;先分配段落,再分配镜头。
- 不要在一个短镜头塞入多个无法同时执行的动作或矛盾运镜。
- 不要把 AI 生成稳定性当承诺;将约束词视为意图,而非结果保证。
- 不要为了“完整”输出无关模板;按需读取 references,保持交付聚焦。