短篇短剧视频全流程
定位
本 skill 是短篇短剧 / 剧情短片生成的主规划入口,承接单集 5-10 分钟以内的短篇制作,负责按固定流程路由任务:
planner -> scriptwriter -> storyboard -> assets -> frame -> prompt
planner 就是当前主 SKILL.md。其它阶段按需读取 refs:
| 阶段 | 读取文件 |
|---|---|
| scriptwriter | references/scriptwriter.md |
| storyboard | references/storyboard.md |
| assets | references/assets.md |
| frame | references/frame.md |
| prompt | references/prompt.md |
阶段之间存在依赖,推荐按上述顺序推进;发现上游依赖缺失时,回到最早缺失的阶段补齐再继续,通常比往后硬推更省事。
承接边界
- 主承接:单集 5-10 分钟以内的短篇短剧、微电影、剧情短片、动画短片、宣传片、预告片、广告剧情、单条剧情短视频。
- 可承接(建议同步声明幻觉风险):多集/长篇短剧的完整剧本创作。剧本阶段可以承接生成,但集数超过 10 集时较易出现剧情漂移与人设漂移,生成前建议一次性向用户告知这一风险,并在剧情梗概之外附一份分集大纲以降低漂移概率(详见
references/scriptwriter.md的声明模板与"长篇分集大纲附表"要求)。长篇完整剧本推荐按"首批 3-5 集 → 用户确认 → 下一批"分批输出,不建议一次性输出全部剧集。 - 长篇短剧诉求也可以主动建议用户拆成独立短篇/单集样片下单,或改用专门的长篇短剧生产工具,以更彻底地规避漂移风险。
- 无论短篇还是长篇,剧本创作阶段建议交付**"剧情梗概(约 1500 字)→ 人物小传(主角/配角/反派)→ 主要故事场景(2-4 个短篇 / 4-8 个长篇)→ 完整剧本(分集分场专业格式)"四段产物**,缺任何一段都会影响下游对齐;完整剧本的场景推荐从产物三"主要故事场景"清单中选取,如遇例外应先回填清单再继续。
核心规则
- 当用户要求生成视频时,必须先澄清并确认以下基础参数再动手,不得跳过参数确认直接调用视频生成工具:
- 时长:单段视频长度。当前项目侧全局锁定 15s(下游生视频模型仅支持 15s,无需向用户澄清),30s 作为项目侧预留分支保留在下游 refs 中,未来模型支持 30s 后由项目侧统一切换。
- 当用户调用image_video且task_type=r2v,比例支持:'16:9','4:3','1:1','3:4','9:16','21:9'
- 当用户调用image_video且task_type=f2v,比例仅支持保持原比例,如果用户要求调整,需向用户说明。
- 生成详细内容:画面主体、动作、场景、风格、镜头运动、情绪氛围、文字、声音或其他限制。
- 一次最多生成2个视频,超出必须先与用户澄清"一次仅能生成两个视频"。
- 即时输出原则:在资产设定(如角色设定图、场景图等)和视频生成阶段,每生成完一张图或一个视频,建议立即将其展示并返回给用户,不建议等待所有图片或所有视频全部生成完毕后再统一打包返回。
- 图片质量审查原则:完成任何一个阶段的图片生成后,建议检查图片是否存在问题:
- 人设图审查:重点审查左侧面部特写是否是正脸,三视图是否与左侧面部特征保持一致,三视角是否是同一个人物。
- 关键帧审查:重点审查画面是否和对应剧情对得上,人物、场景、道具是否和资产设定图中的对应特征对得上。
- 角色形象变化资产更新原则(强制):随着剧情进展,如果人物形象发生较大变化(如换装、发型变化、受伤/毁容、年龄阶段变化、身份伪装、盔甲/制服/礼服等关键造型变化),必须先重新生成对应阶段的角色资产设定图并经用户明确确认后,再继续生成后续关键帧或视频;禁止直接沿用旧资产图硬套新造型。
- 【强制】图片输出统一使用 Markdown 图片格式:所有阶段(人设图、场景图、道具图、关键帧图等)生成的图片,必须以 Markdown 图片语法(
)在对话中直接呈现给用户;不得仅返回 URL 文本、附件链接或纯文件路径,也不得用 HTML<img>标签替代。 - 【强制】视频生成结果必须通过
notify_human工具输出:无论text_to_video/image_to_video、UGC / marketing / corporate,任何视频生成结果交付前必须调用notify_human工具上屏视频本体,禁止以纯 Markdown 链接、<video>标签、裸 URL 或总结文案替代;notify_human入参必须包含可渲染的视频资源本体(video_url/output_url/url/result_url或本地视频路径)。 - 【强制】资产设定阶段分批确认顺序:资产设定阶段必须严格按以下顺序分批生成并逐批等待用户明确确认,禁止合并生成或跳批推进:
- 主角设定图:先生成主角人设图(含左侧正脸特写 + 三视图),输出后停下来等用户明确确认。
- 配角/反派设定图:主角确认通过后,再依次生成配角、反派的人设图,每生成一位输出一次并等用户确认;全部角色设定图生成完毕后,必须再向用户做一次总体确认("所有角色资产是否 OK")。
- 场景全景图:角色资产总体确认通过后,进入场景资产阶段;每个场景先生成一张全景图,输出后停下来等用户明确确认。
- 场景其余视角图:全景图确认通过后,再继续生成该场景的其余视角图(近景、特写、俯视/仰视等);同一场景全景未确认前,禁止提前生成其他视角。
- 用户明确确认参数后才可进入生成。无论用户是否已经一次性提供完整参数,都必须先输出一次参数摘要并等待用户确认,即使信息看似完整也不得直接进入生成。明确确认可以是 确认、可以生成、开始生成、没问题、yes、looks good、ok 等表达。
澄清清单
在剧情设计、剧本设定和视频生成开始前,建议主动澄清会显著影响结果的关键参数。每轮只问 1-3 个问题。用户说"你来定""随便""直接做"等表达时,可以内部选择合理默认值并继续推进非生成阶段。
真正生成视频前,必须确认以下基础参数(用户确认门禁,不因规划自由度软化而放松):
- 单集总时长:短篇短剧默认 5-10 分钟。用户未明确时默认 6 分钟,并在澄清中告知用户可选 5-10 分钟区间。
- 单个视频片段时长:当前项目侧全局锁定 15s(下游生视频模型仅支持 15s),30s 作为项目侧预留分支保留在下游 refs 中,无需向用户澄清;仅在用户主动明确要求 30s 或双版本时按其指定生成。
- 比例:例如
16:9、4:3、1:1、3:4、9:16、21:9。 - 生成模式:文生视频、图生视频、参考视频生成、首帧驱动视频,或工具侧的
r2v/f2v等模式。 - 画面详细内容:主体、动作、场景、风格、镜头运动、情绪氛围、可见文字、台词、声音和限制。
- 生成数量:单批最多 2 个视频,超出必须先与用户澄清"一次仅能生成两个视频"。
- 确认表达:必须在用户明确回复"确认""可以生成""开始生成""没问题""yes""looks good"等之后再进入生成。
分阶段澄清
| 阶段 | 需要澄清 |
|---|---|
| planner | 目标、产物形式、受众、单集总时长(5-10 分钟)/长篇总集数、剧作基调(微电影三幕式 / 短视频钩子驱动)、已有素材、希望从哪个阶段开始。如果用户诉求指向 >10 集的长篇短剧完整剧本,建议在此阶段一次性向用户告知"超过 10 集可能出现剧情/人设漂移"的幻觉风险,附主动建议(拆分下单 / 改用长篇工具),并同步告知长篇完整剧本会分批输出(首批 3-5 集,逐批确认);用户明确知晓风险与分批机制后再进入 scriptwriter 阶段。 |
| scriptwriter | 故事主题、题材、单集总时长/长篇总集数、主角/配角/反派人物设定、核心冲突、结局方向、情绪基调、禁用内容、剧作基调偏好。建议交付"剧情梗概(约 1500 字)→ 人物小传(主角/配角/反派)→ 主要故事场景(2-4 / 4-8 个)→ 完整剧本(分集分场专业格式)"四段产物;长篇建议附分集大纲,且完整剧本按"首批 3-5 集 → 用户确认 → 下一批"的模式分批输出,不建议一次性输出全部剧集;完整剧本的场景推荐从产物三清单中选取。剧情设计和剧本设定缺关键参数时先澄清通常更稳。 |
| storyboard | 单集时长、章节切分(3-5 个叙事章节)、每章节 15s 片段数量、镜头密度、台词/字幕/声音要求。 |
| assets | 角色、场景、道具、视觉风格、参考图用途、一致性锚点、音色或台词锚点。生成顺序强制为:主角设定图 → 用户确认 → 配角/反派设定图(逐位输出逐位确认)→ 角色总体确认 → 场景全景图(逐场景输出逐场景确认)→ 场景其余视角图,不得合并或跳批。 |
| frame | 哪一章节/哪些片段、关键帧数量与判定标准(决定性瞬间/情节转折/身份亮相/状态突变/空间锚点等)、场景引用、角色引用、构图、光影、角色物理状态连续性。 |
| prompt | 工具模式、目标片段时长(当前锁定 15s)、比例、参考资产、该片段已锁定的关键帧列表、时间戳动作规划、台词/声音、负向约束、批次数量。 |
如果某个缺失值只影响最终生成、不影响规划,可以继续规划,并把它标为生成前确认点。
阶段判断
按顺序检查,通常停在第一个缺失依赖处补齐:
- 只有 idea、标题、简短梗概、不完整故事或松散角色概念时,进入剧本创作,交付"剧情梗概 + 人物小传 + 主要故事场景 + 完整剧本(分集分场专业格式)"四段产物。
- 有完整剧本但没有按章节/片段/镜头切分时,进入分镜切分。
- 有分镜但没有可用角色、场景、道具资产引用或详细视觉基准时,进入资产设定。
- 有资产和分镜但没有片段关键帧图时,进入关键帧生成。
- 有关键帧但没有最终视频提示词执行包时,进入视频提示词生成并生成对应视频。
规划输出
启动或接续项目时,先输出简短规划报告,再读取下一阶段 ref:
## 短篇短剧生产规划报告
### 项目信息
- 项目名称:
- 类型(短篇短剧 / 微电影 / 剧情短片 / 动画短片 / 广告剧情等):
- 风格:
- 默认比例:
- 单集总时长(5-10 分钟内):
- 剧作基调(微电影三幕式 / 短视频钩子驱动):
- 单段视频时长:当前项目侧全局锁定 15s(30s 为项目侧预留分支)
### 当前完成度检查
| 阶段 | 要求 | 是否完成 | 缺失内容 |
|---|---|---|---|
| 1. 剧本创作 | 剧情梗概(约 1500 字)+ 人物小传(主角/配角/反派)+ 主要故事场景(2-4 / 4-8 个)+ 完整剧本(分集分场专业格式);长篇附分集大纲,且完整剧本按每批 3-5 集分批输出、逐批确认;剧本场景建议来自"主要故事场景"清单 | 是/否 | |
| 2. 分镜切分 | 章节切分 + 15s 片段规划(30s 为预留分支) | 是/否 | |
| 3. 资产设定 | 角色、场景、道具资产与参考图 | 是/否 | |
| 4. 关键帧 | 每个片段依判定标准动态锁定 1-3 张(15s)/ 2-5 张(30s)关键帧图 | 是/否 | |
| 5. 视频提示词 | 可执行视频 prompt 与生成参数 | 是/否 | |
### 承接确认
- 剧本形态:短篇(单集 5-10 分钟)/ 长篇(>1 集,标注总集数)。
- 长篇总集数 >10 集:已一次性向用户输出"剧情/人设漂移"幻觉声明,并附主动建议:是/否/不适用。
- 长篇分批输出:完整剧本首批 3-5 集,每批用户确认后再继续下一批:是/否/不适用。
### 执行规划
当前阶段:
后续流程:
需要确认:
路由
- 当前阶段是剧本创作时,读取
references/scriptwriter.md。 - 当前阶段是分镜切分时,读取
references/storyboard.md。 - 当前阶段是资产设定时,读取
references/assets.md。 - 当前阶段是关键帧生成时,读取
references/frame.md。 - 当前阶段是最终视频生成时,读取
references/prompt.md。
每阶段完成后必须先向用户明确确认再进入下一阶段(用户确认门禁,强制): 在剧本、分镜、资产、关键帧的任何一个阶段完成输出后,必须停下来,主动询问用户是否满意、是否需要修改;必须收到"确认/没问题/继续/yes/ok"等明确许可后,才可以读取下一个 reference 文件推进。禁止在没有获得用户明确许可的情况下,擅自读取下一个 reference 文件并自动推进到下一阶段。
工具门禁
以宿主环境实际可用工具为准。旧版工具名按下表理解:
| 旧工具名 | 当前含义 |
|---|---|
text_to_image |
文生图 |
image_to_image |
基于参考图的图像编辑 / 图像生成 |
image_to_video |
基于图片参考的视频生成 |
工具调用失败处理:
当阶段规则要求使用 image_to_image / I2I 或 image_to_video / I2V 时,如果实际调用失败,建议先重新尝试对应工具,仍失败再停下来向用户说明失败原因与所需补充信息。不建议为了绕过失败而擅自降级改用 text_to_image / T2I 或纯 text_to_video / T2V——这会丢失参考图约束并破坏角色、场景、道具一致性,通常得不偿失。
完成检查
声明完成前建议逐项过一遍;标注为「强制」的项属于用户确认与交付门禁,不可跳过:
- 阶段依赖已按顺序补齐,未跳过上游阶段(如遇例外应先说明再继续)。
- 【强制】视频生成前已完成必要澄清并获得用户明确确认。
- 比例、时长、模式、数量、参考素材和限制已记录。
- 角色、场景、道具和关键帧连续性已保持。
- 【强制】剧情导致人物形象明显变化时,已补充并经用户明确确认新的角色资产设定图,不得直接沿用旧资产图硬套新造型。
- 【强制】所有图片交付统一使用 Markdown 图片语法呈现(
),未使用纯 URL 文本、附件链接或 HTML<img>标签替代。 - 【强制】资产设定阶段严格按"主角 → 配角/反派(逐位确认)→ 角色总体确认 → 场景全景(逐场景确认)→ 场景其余视角"顺序推进,每一批输出后都已停下等用户明确确认,未合并或跳批。
- 应使用 I2I / I2V 的任务未因工具调用失败而擅自降级为 T2I / T2V;如失败,建议已重试对应工具或明确说明失败原因。
- 【强制】单批生成视频数量不超过 2 个。
- 资产和视频的输出遵循"即时输出"原则,生成一个返回一个,不建议囤积。
- 【强制】所有视频生成结果,无论
text_to_video/image_to_video、UGC / marketing / corporate,交付前必须调用notify_human整理输出并展示视频;不得以"非飞书内容""在线 URL 可直接回复""链接可展示""Markdown/HTML video 标签可播放""用户偏好直接交付"等理由跳过。 - 【强制】
notify_human入参必须包含可渲染的视频资源本体:video_url/output_url/url/result_url或本地视频路径;不得只传总结文案、HTML/Markdown<video>片段或裸链接文本。 - 【强制】只有确认
notify_human已正常上屏视频后,才可以输出视频已生成或成功格式;如未正常上屏,必须用同一视频资源重试一次,仍失败再说明展示失败并保留链接/路径排查。 - 若宿主环境的实际工具名是
notify_hunman(历史拼写),按宿主侧实际工具名调用,本文件文档统一采用notify_human作为说明。