短视频脚本
原则
- 一条视频只讲一个核心判断。
- 前 3 秒给出冲突、结果、利益或具体场景。
- 口播必须说得出口,不把长文章切成字幕。
- 画面承担证明、演示、对比或情绪任务,不重复字幕。
- 优先使用真实人物声音、产品录屏和真实证据,不默认数字人。
- 数字人是用户主动选择后的制片模式,必须有头像与声音的使用权利;用户本人负责在所选数字人平台中手动上传、创建和选定敏感素材,并保留人工预览和发布确认。
确认输入
检查:目标平台、受众、内容目标、时长、出镜方式、可用素材、核心判断、行动和不能展示的内容。缺少会改变方案的信息时最多问 3 个问题。
视频制作模式
方案模式:没有原片、没有确认数字人平台素材已就绪,或没有明确成片授权时,交付可拍摄方案,不擅自生成成片。真人剪辑模式:用户提供原片并明确要求剪辑时,调用当前环境可用的视频、字幕和音频能力。数字人制片模式:用户明确选择数字人、确认肖像与声音权利,并已在所选平台手动上传、创建和选定数字人及声音后,按 digital-human-production.md 生成数字人讲解片段,再完成画面解析、字幕、人物窗口和竖屏成片。
数字人模式的生成工具由运行时发现。若当前环境提供 Topview MCP,可在用户确认 Topview 中的数字人和声音已就绪后,将其作为数字人片段生成适配器;本 Skill 不调用上传凭证或克隆接口代替用户上传原始头像、录音。核心流程不写死供应商 API。生成能力或合成能力不可用时,降级为数字人分镜、画面映射、字幕稿、素材清单和可手动完成的发布包。
结构
选择一种主体结构:
- 问题 → 方法 → 例证。
- 结果 → 过程 → 教训。
- 冲突 → 选择 → 后果。
- 演示 → 解释 → 适用边界。
结尾给一个记忆点和一个主要行动。
分镜
使用 storyboard-template.md。每个镜头写清:
- 时间和时长。
- 景别、画面、人物动作或录屏操作。
- 口播、字幕和屏幕文字。
- 证据、B-roll、音效、BGM 和转场。
所有镜头时长之和必须等于目标时长。字幕与口播事实必须一致。
输出包
交付:
- 3 个钩子和推荐版本。
- 完整口播稿。
- 分镜表或录屏清单。
- 字幕稿。
- 封面标题和画面说明。
- 发布标题、正文、话题和 BGM 建议。
- 拍摄或素材缺口。
数字人制片模式额外交付:肖像与声音权利确认、平台手动上传和素材就绪状态、数字人生成片段、画面解析与人物窗口规格、字幕文件或字幕文本、发音词表、最终视频技术规格、AI/数字人披露要求和验收结果。交付包不包含原始头像、录音或平台私有标识。
用户没有提供原片时,默认停在可拍摄方案;但用户明确选择数字人制片、完成权利确认,并确认数字人和声音已在所选平台中手动上传和选定时,可以继续发现并调用当前环境的数字人、视频、字幕和音频工具。