Archival Fragments
从零做出一条完整短片。用户可能只给你一个想法,也可能给一份写好的文案——两种都从下面的流程走。
三条硬约束(违反任何一条,成片必废)
1. 每一镜的画面必须不同
N 个镜头需要 N+1 张各不相同的关键帧。
"相邻两镜共用同一张图"的意思是:第 1 镜的尾帧 = 第 2 镜的首帧,这一张图被这两镜共用。 不是整片共用一张图。
绝对禁止:
- 拿同一张图当所有镜头的输入
- 拿一张结构图、示意图、信息图当所有镜头的参考
- 把
assets/style-reference.png当成生成输入——它是给人看的风格参考板,任何一次生成都不要挂它
这样做出来的片子几十个镜头长得一模一样,等于没拆镜,观众三秒划走。
自检(必须做,并把结果报给用户):
关键帧张数 == 镜头数 + 1 ✓/✗
任意两张关键帧的画面描述不重复 ✓/✗
每张关键帧都有自己独立的提示词 ✓/✗
2. 故事、画面、节奏必须由你亲自拆,且拆完要给用户过目
不要拿到文案就直接开生成。必须先产出一张逐镜表,包含:每镜的旁白、画面内容、首尾帧、时长。拆完先给用户看,让他有机会否掉——改一张表 5 分钟,跑完再改是 4 小时。
详见 01-script.md。
3. 具象优先,不要抽象图形
纸和红线是画面的地面,不是主体。每句话找一个观众不用想就懂的通用符号——世界地图+图钉、天平、台阶、一大堆实物。一条片子收敛到 2–3 个符号,各用几次。
用空白纸加一条线表达"这个位置是空的"、用三个方块表达"三家公司"——这类抽象图形观众看不懂,实测失败。
详见 style-guide.md 第零条。
流程
按顺序做,每一阶段有自己的文档:
| 阶段 | 文档 | 产出 |
|---|---|---|
| 0. 环境准备 | 00-setup.md | 依赖装好、凭据可用、检查全绿 |
| 1. 想法 → 文案 → 拆故事/画面/节奏 | 01-script.md | narration.json + 逐镜表 |
| 2. 设计关键帧链 | 02-keyframes.md | keyframes.json |
| 3. 写运动句 | 03-shots.md | shots.json |
| 4. 排节奏 | 04-rhythm.md | 镜长分配表 |
| 5. 生成与合成 | 05-produce.md | 关键帧 → 镜头 → 配音 → 成片 |
视觉基线随时查 style-guide.md。
三个必须停下来问用户的节点:
- 阶段 0 检查完 —— 告诉用户环境就绪,请他给想法或文案
- 阶段 1 拆完 —— 把逐镜表给用户过目
- 阶段 5 跑完 2–4 个样片 —— 确认方向再跑全量
默认参数
4:3 / 2K(1920×1440)/ 视频 Minimax H3 frames2video / 图片 Seedream 5.0 Pro /
count=1 / 每镜生成 5 秒 / 并发上限 1,必须串行。
包里有什么
references/—— 六份规则文档,就是上表那几份examples/—— 一条已完成 67.3 秒成片的完整配置:35 张关键帧提示词原文、34 条运动句、镜长分配表、17 句旁白、文案。照着改结构,不要照抄内容——那些符号是为特定题材设计的assets/style-reference.png—— 风格参考板,只给人看assets/example-01..08-*.jpg—— 八张连续的关键帧,展示同一条片子里画面是怎么一张一张推进的