Seedance 提示词生成器
专业的AI脚本和分镜生成系统,用于在Seedance 2.0平台上创建专业的AI视频系列。
⚡ Seedance 2.0 通用生产铁律(最高优先级·所有 prompt 必须遵守)
以下是经过实测沉淀的通用规范,适用于所有 Seedance 2.0 / GPT-image-2 prompt 的生成。生成任何分镜 prompt 前必须逐条核对。
铁律 -1:防提示词污染,先尊重用户任务
- 不要把所有任务都改写成 AI 短剧工业 SOP。 只有用户明确说「短剧 / 分集 / 连载 / 第 N 集 / 剧本创作」时,才启用短剧剧本创作与分集结构。
- 不要默认拆成 6 个首尾帧、5 集/20 集、每段 15 秒或 90 秒一集。 这些只能作为平台限制下的拆分方案或示例,不是默认产物。
- 先保留用户的原始目标:已有脚本就转提示词,已有时长就按该时长拆段,已有镜头数就保持镜头数;信息不足时先问 1-3 个关键问题。
- 15 秒是 Seedance 单段常见上限,不是叙事单位。 总片长、集数、镜头数、首尾帧数量都由用户目标、素材复杂度、平台参数共同决定。
- 输出前做一次自检:是否擅自添加了短剧付费卡点、爽点矩阵、固定集数、固定时长或无关角色资产库?如果是,删掉或改成可选建议。
铁律 0:平台与模式
- Seedance 2.0 在字节「小云雀」App / 网页版上的入口为:创作 → 模式 → 沉浸式短片(Seedance 2.0)。即梦平台也可用。
- 沉浸式短片模式的核心能力是「视听一体」:生成画面的同时原生生成匹配的音效、环境音、配乐,并支持口型同步与情绪匹配。因此声音设计是 prompt 的一等公民,不是附属(详见沉浸式短片章节)。
- 小云雀官方「沉浸式短片黄金公式」:[主体描述] + [画面运动描述] + [音效互动] + [台词] + [音色描述] + [运镜/环境] + [风格修饰] + [限定信息]。八维逐项填充,缺一不可(详解见 references 模板十七)。
- 官方提示词指南:https://www.volcengine.com/docs/82379/2222480?lang=zh
铁律 1:时长与分段计算
- 单段视频自由时长 4-15s,用
将@视频1延长Ns语法拼接更长片段(如 2×15s = 30s 单集)。 - 时长估算公式:段时长 ≈ 对白句数 × 1.3s + 画面节拍数 × 0.8-1.5s。每段生成前用此公式核对内容是否塞得下,节奏是否过挤。
- 密集场景(9+ 画面节拍 / 6+ 句对白)优先拆成 2 段,拆分点选在 hook 断点(疑惑 / 反转 / 情感峰值),让两段各自完整。
- 15s 视频对白控制在 3-4 句,避免 TTS 来不及念或与画面错位。
- 官方更新(2026.05.15):火山引擎官方指南指出模型对精确秒数(0–3秒)支持不稳定,通用场景建议改用「镜头1/镜头2/镜头3」按事件顺序组织、不强制限时。取舍:沉浸式短片 / 口型同步 / TTS 对齐强需求场景仍保留秒数标注(配合铁律4 对白时间轴对齐);其余场景优先「镜头N」。详见 references/seedance-prompt-guide.md 第 0.4 节。
铁律 2:段 B 续接陷阱(视频延长拼接时)
@视频1 的视觉元素会被当作强锚点继续渲染——即便 prompt 里说"位置空了 / 东西没了",模型也会脑补它继续存在,甚至换个品牌也要保留语义。要让某元素在续接段中真正消失,必须三重加固:
- 顶部加【关键差异指令】,显式禁止:"绝对不出现 XXX"。
- 用时间轴描述替代视觉锚点(例如用"空地砖 + 飘落的樱花瓣"占据原本放道具的位置)。
- 【参考】区注明:"@视频1 仅用于色调 / 服饰 / 光线衔接,视觉元素以本 prompt 为准"。
铁律 3:无字幕规则(废止旧冗长禁令)
- 每个 Seedance prompt 开头第一句只写:"画面无任何字幕。" 即可。Seedance 新版理解力强,简短一句足够。
- ❌ 不要再写"【画面禁令·绝对】画面绝对无任何字幕、UI、水印、文字标签、品牌logo、装饰花纹;所有对白通过TTS配音呈现严禁字幕"这类冗长版本。
- 所有对白默认通过 TTS 角色配音输出,不上画面字幕(除非用户明确要求剪映后期加字幕)。
铁律 4:对白排版(配音对齐关键)
- 对白必须按时间点嵌入到对应的时间轴分镜段落里,掐准每句话出现的秒数。
- 正确示例:
6-9秒:…角色探头,角色A(为难):"怎么分呢?"
- 正确示例:
- 【声音】块只描述声线 / 配乐风格 / 音效,绝对不集中堆放对白文本。
- 教训:把对白抽出来集中放进【声音】块会导致 TTS 配音与画面动作错位(说话时机对不上口型 / 动作)。此规则适用所有 Seedance prompt。
铁律 5:审核规避(正向描述代替负面词)
- 删除所有负面关键词(含"严禁 XXX""禁止 XXX"等前缀 + 负面词组合),一律改用正向描述。
- 例:用"少女俏皮无邪甜美"替代"严禁性感";用"画面中无 XXX"替代"禁止出现 XXX"。
- 2026 年 5 月起审核明显收紧:
- "15-17岁 + 少女"这类年龄 + 性别组合高风险,改为中性的"年轻女孩"。
- "裸妆"改"清新妆";"撒娇 / 嘟嘴"改中性表情描述。
- 合规安全区:自然风光、萌宠、建筑、美食、治愈场景。避免暴露、黑暗、可能引起不适的内容。
铁律 6:TTS 配音陷阱
- 叠字 / 谐音 / 方言尾音口头禅(如 "咕咕嘎嘎""欧润吉""菲比啾比""洛洛")TTS 容易念崩或时序错乱。处理方式:
- 若口头禅可有可无,改用画面表情 / 音效替代,不让 TTS 念。
- 关键对白交给发音稳定的角色承担。
- 特殊读音词在 prompt 中保留原文并紧跟拼音标注,如 "菲比啾比(fēi bī jiū bǐ)"。
- 避免方言尾音"哒 / 诶 / 咩",改用通用语气词"呀 / 啦 / 嘛"。
- 注:Seedance 新版对口头禅渲染能力已增强,固定 IP 的口头禅可保留(除非用户明确说不要),但仍遵循上述读音标注与稳定角色承担原则。
铁律 7:动作 / 物体可分性渲染避坑
- "掰断 / 掰一半"形变动作渲染差(断面易崩);"剥瓣"(如橘子)理解一般。
- 最稳的是单个直白大动作:西瓜往地上一摔啪地裂开、糖葫芦从串上取球、包子一人一个、蛋糕切块。
- 优先选天然可分或一个动作就能分开的物体,用"摔 / 取 / 递"替代"掰断 / 剥瓣"。
案例教训:肉夹馍「水平横切开膜」模型有强先验,难纠正
实测白吉馍 / 肉夹馍「侧面水平插刀、撑开口袋」这类反常规切法,Seedance 2.0 与 GPT-image-2 都存在难以纠正的强先验,几乎总会渲染成「竖刀往下劈 / 切碎」(即参考图里那种常规切法)。多轮验证后的结论:
- 纯文字 prompt 反复强调也无效:哪怕写满"刀水平躺平、刀面与桌面平行、从侧面腰线水平没入、绝不竖刀、绝不刀刃朝下、绝不切碎"等正面 + 限定描述,并附水平剖口参考图,Seedance 实际输出仍会回退到竖切。模型对"刀=往下切"的动作先验压过了 prompt 指令。
- 改走故事版(逐帧关键帧)也会被 Seedance 覆盖:即使先用图像模型逐帧生成了正确的水平横切关键帧,再让 Seedance "按故事版"补全中间动作,成片依然会在运动过程中渲染成竖切——Seedance 的动作先验会盖过输入关键帧的姿态。
- 图像模型的张数阈值:用 GPT-image-2 直接渲染故事版分镜,4 张、6 张时能正确渲染水平横切;但12 张时也会塌回竖着切。张数越多、单格指令密度被稀释,模型越容易回退到常规先验。这是当前大模型的能力局限。
应对策略:
- 能换动作就换——按铁律 7 主旨,优先改成模型擅长的单一大动作(如"馍已切开两半、手往里夹肉"直接给结果态,跳过"横插刀撑开"这个过程镜头)。
- 必须保留横切过程时,故事版分镜张数控制在 6 张以内,单格只承载一个清晰姿态,避免 12 张级别的密集分镜。
- 关键姿态以逐帧静态图交付(图像模型在低张数下可控),动态过程镜头能省则省;不要指望 Seedance 凭关键帧自行补出反先验的中间动作。
- 记录此类「反常规物理动作」清单,遇到同类(反向开合、非常规角度切割、违反重力的形变)先预判模型先验,提前用结果态镜头规避。
铁律 8:双人手部混淆
- 双人递 / 交易场景中,模型容易把双方手部混淆(尤其一方戴珍珠手链等饰品时)。
- 角色锁定块需明确:"POV 手臂无饰品,与 XXX 严格区分",逐项锁定各自手部特征。
铁律 9:Prompt 输出与排版规则(适用所有 Seedance / GPT-image-2 prompt)
- 每次修改 prompt 后都直接输出完整版完整 prompt,不要只给局部修改片段让用户自己拼接——即使只改了一两个 KF / 分镜,也要重出整套完整 prompt。
- 正文中不使用 "———" 长破折号分隔符;需要分隔时改用空行、换行,或【方括号区块标题】(如【角色声线锁定】【声音】【参考】【关键差异指令】)来分段。
铁律 10:多模态声线锁定
- 若有真实参考音频,可用多模态引用
@音频N上传锁定真实音色(配合或替代顶部文字声线描述块)。 - 文字声线档案(音域 / 嗲度 / 年龄感)作为描述性备份保留。
- 注:作为文本模型无法直接听取 / 分析音频声学特征,仅在工作流中引用音频作为权威声线参考。
铁律 11:视听语言优先(电影感的真正杠杆)
- 别人的 AI 视频像电影、你的像"会动的 PPT",差的不是模型 / 画质 / 提示词长度,而是视听语言。生成每个分镜前先问:"这一拍要让观众看哪里、感受到什么?"再选对应的镜头语言,而不是把信息一次性塞进一个镜头。
- 六大杠杆,按需取用(完整映射表见 references/cinematic-techniques.md):
- 景别分层:远景交代环境 → 中景交代动作 → 近景传递情绪 → 特写放大细节,逐步引导。
- 运镜服务情绪:推=放大情绪、拉=孤独感 / 揭示信息、跟=代入、环绕=主角感、上摇=气势、希区柯克变焦=心理冲击;慢推克制、快推爆发。
- 光影塑造故事:逆光英雄 / 浪漫、顶光压迫权力、底光诡异、侧光内心冲突、硬光张力、柔光治愈、丁达尔史诗、蝴蝶光主角感。
- 构图控制情绪:前景空间感、中心主角、三分法呼吸、对角线张力、对称权力、引导线视线、框架旁观感。
- 节奏 = 情绪推进速度:慢铺垫 / 快压迫 / 先压抑再释放;善用镜头前摇、情绪停顿、环境节奏、镜头留白(反差最敏感)。
- 蒙太奇制造意义:同一画面接不同镜头产生不同含义(时间 / 情绪 / 平行 / 联想蒙太奇)。
- 活人感:客观镜头改过肩 POV + 前景虚化;情绪表情拆细节(面部情绪 = 嘴角 + 眼部 + 面部;完整情绪 = 表情 + 手部 + 身姿 + 视线)。
- 配音真实感:用标点控语气、写"发声方式"而非"情绪词"、给场景与动机(场景 + 人物状态 + 发声方式 + 台词)。
- 一致性硬控:角色资产库三视图 + 空场景锚点 + 尾帧续接 + 动作迁移,用于需要跨段连续的项目;普通单段视频不强制套用。
铁律 12:提示词即视觉语言 · 去 AI 感(底层机制控制)
- "一眼假"的根因是在"许愿"而非用视觉语言下指令——把情绪 / 风格标签丢给 AI 让它猜。提示词要保持结构(
情绪 + 主体 + 光线 + 镜头 + 细节),具体 > 简短,用专业词汇。完整方法见 references/prompt-craft-and-realism.md。 - 抽象词必须量化:
梦幻 = 低饱和 + 软光源 + 长焦压缩、高级 = 强光线对比 + 部分留白;要去掉某效果直接写"无 X"(如"无纹理、无锐化",对应模型的"误解机制"),而不是反复堆同义词。 - 词序就是优先级:主体词放最前、光影词放中段、抽象词放末尾。
- 去 AI 感 = 别太干净:加前景遮挡(物理 + 氛围/雾气颗粒,记得写"虚化")、做减法(剪复杂背景 / 多光源 / 杂色)、剪词(剪情绪词 / 重复词 / 人类整句,拆成"谁在动 / 怎么动 / 镜头如何")。
- 电影感 = 摄影约束先于美学:先写镜头类型 / 拍摄距离 / 光线结构,再写风格;把情绪翻译成摄影语言(不写"孤独",写"人物置于边缘 + 大量负空间")。
- 可控与复用:JSON 只负责"可控 / 可复用"不负责审美(结构
subject → environment → style);风格提取看"不可变条件"与多图共性;调色把审美拆成数据(色相 / 明暗 / 色温)再执行。 - 动作 / 一致性:动作减动词增方式词、单一主动作;人物一致性先人景拆分 + 三视图、拆镜头;声音一致性建角色声音参考库 + 情绪库。
Workflow
本 Skill 覆盖「创意 → 完整短剧剧本 → AI 视频提示词 → 成片」全链路。下面 1-5 是核心的视频化流程(剧本 → Seedance 提示词)。如果用户还没有剧本、只有一句创意或一篇小说,想从头写一部短剧(集数可自定义,常见 50-100 集),先走可选的上游 阶段 0,产出剧本后再进入 1-5。
⚠️ 合规风险预警(一次性 · 不限制创作) — 在合适情景下触发:每个会话中,首次进入剧本创作(阶段 0 /
/start)或首次产出可能触及敏感题材(涉政与历史、暴力凶杀、违法犯罪示范、色情低俗、封建迷信灵异、宫斗权谋、未成年人等)的内容时,简短提醒一次:「⚠️ 你创作的是面向公开传播的网络视听内容,需符合《网络短视频内容审核标准细则(2021)》与广电总局微短剧规范(先审后播)。请留意政治导向 / 历史虚无 / 暴力凶杀 / 色情低俗 / 封建迷信 / 违法犯罪示范 / 未成年人保护等红线;可随时运行
/compliance逐条排查。本提醒仅出现一次。」规则:同一会话内不再重复;不因此限制、删改、降级或拒绝用户的正常创作(除非内容本身明显违法);预警是「提个醒」,不是「拦路」。详见 references/short-drama/compliance-checklist.md。
0.(可选·上游)短剧剧本创作
当用户说「写一部短剧 / 帮我做短剧剧本 / 从选题开始 / 我要做 N 集短剧」时,进入短剧剧本创作子模式——完整规范见 references/short-drama-screenwriting.md(改编自 MIT 开源 0xsline/short-drama,方法论文档在 references/short-drama/)。
- 渐进式命令流(每步确认后再下一步):
/start选题(13 题材) →/plan三幕+付费卡点+爽点矩阵 →/characters角色+四层反派 →/outline分集目录(🔥关键集/💰卡点集) →/episode N单集 △ 剧本 →/review五维自检 →/compliance合规 →/export;/overseas任意阶段切出海(好莱坞格式/英文)。 - 产物:
episodes/epNNN.md等文学剧本(与本 Skill 下游同用△ 镜头 + 景别格式,天然衔接)。 - 交接:剧本完成后,把每集 △ 剧本与角色档案接入下面的 1-5——抽资产编号 C/S/P、逐集转 Seedance 2.0 分镜提示词;人物资产套用 portrait-realism-details.md 真实感关键词。详见该参考末尾「→ 视频化交接」。
已有现成剧本/小说/大纲的用户跳过阶段 0,直接从下面的 1. 分析输入开始。
1. 分析输入
确定输入类型:
- 完整文本:需要改编和分集的完整小说/文章
- 大纲:需要完整脚本开发的简短故事概念
提取核心元素:
- 主角和关键角色
- 核心冲突和叙事弧线
- 场景/世界观元素
- 关键情节和情感节拍
- 核心梗/卖点
如果输入模糊或不完整,请提出澄清问题。
2. 确认制作参数
需要询问的基本问题:
- 视觉风格:什么视觉风格?(写实/动画/水墨/科幻/复古/电影感/其他)
- 时长:目标总时长或平台单段时长?(未知时先问;只有做 Seedance 单段时才按 4-15s 约束拆分)
- 目标平台:画幅比例?(16:9横屏 / 9:16竖屏 / 2.35:1电影宽屏)
- 基调:整体情感基调?(史诗/温馨/悬疑/欢快/忧伤等)
- 核心梗:一句话卖点是什么?(绝境反杀/复仇爽剧/治愈温馨/悬疑惊悚等)
记录这些参数,确保在整个过程中一致应用。
3. 生成完整剧本结构
重要:输出必须严格遵循以下格式,符合"好剧本.md"的质量标准。
3.1 Output Format - Part 1: Story Analysis
# [Title] - 剧本
一、核心梗
[Two-word or short phrase core hook, e.g., 绝境反杀、经典武侠、复仇爽剧]
二、故事梗概
故事背景:[Time period, location, initial situation]
开场冲突:[What breaks the status quo, inciting incident]
主角画像:[Who is the protagonist, their core trait, current state]
主线事件:[Key plot progression → climax → resolution]
结局:[Final outcome, character transformation]
三、一句话卖点
[Punchy marketing hook with emotion, e.g., 忍无可忍,无须再忍!风雪夜,豹子头林冲长枪出鞘,血溅山神庙!]
四、人物小传
[For EACH main character include:]
**角色名**
视觉形象:[Age, appearance details, clothing, key visual markers]
身份背景:[Social role, background, relationship to protagonist]
核心标签:[2-4 character traits, e.g., 隐忍不发、悲情英雄、杀神降临]
性格特点:[Detailed personality description, arc transformation]
金句:[Memorable line that captures their essence]
五、剧本大纲
前期(起):[Setup - establish world, protagonist, status quo]
中期(承/转):[Conflict development, complications, turning point]
后期(高潮):[Climax, confrontation, emotional peak]
尾声(收尾):[Resolution, aftermath, thematic closure]
六、剧本正文
3.2 Output Format - Part 2: Script Body (Each Episode)
CRITICAL: Each episode must use the EXACT format below:
第X集
X-X [日/夜] [内/外] [场景名称]
道具:[List key props]
出场人物:[List characters in scene]
△ 【空镜/开场镜头】[Detailed shot description with camera movement, composition, lighting, atmosphere]
△ [Shot 2 description with specific camera movement: 推/拉/摇/移/跟/环绕/升降/特写/远景]
△ [Shot 3 description - continue for each beat]
角色名(os):[Interior monologue/voiceover]
△ [Reaction shot description]
角色名(对白/动作描述):[Spoken dialogue]
△ [Action/sequence description]
【字幕:xxx】[When on-screen text is needed]
△ [Scene continuation]
△ 【闪回】[Flashback scene description]
[Flashback content with △ shots]
【闪回结束】
△ [Return to present, reaction]
角色名(vo):[Voiceover from off-screen character]
△ [Climactic action sequence]
△ 【空镜】[Closing atmospheric shot]
【字幕:xxx】
Script Format Rules:
Every shot starts with
△(triangle + space)Camera language must be specific:
- 景别:远景/全景/中景/近景/特写/大特写
- 运镜:推镜头/拉镜头/摇镜头/移镜头/跟镜头/环绕镜头/升降镜头/希区柯克变焦/一镜到底/手持晃动
- 组合:
中景推近、特写环绕、远景俯拍、快速推近、缓慢拉远
Dialogue notation:
角色名(os)- 画外音/内心独白 (off-screen sound/interior monologue)角色名(vo)- 画外音,人物不在画面中 (voiceover)角色名(惊/怒/喜)- 带情绪的对白角色名- 普通对白
Special elements:
【空镜】- Establishing/atmospheric shot without characters【闪回】/【闪回结束】- Flashback sequence【字幕:xxx】- On-screen text/titles
Action description format:
- Use
→for action sequences:林冲一枪刺穿差拨胸膛 → 鲜血喷溅 → 雪地染红 - Use emotive language:
杀气冲天、眼中怒火燃烧、浑身颤抖
- Use
Sensory details:
- Visual: 颜色、光影、构图、氛围
- Auditory: 声音描述融入镜头中
- Tactile: 寒冷、疼痛、质感
4. 创建资产生成计划
对所有视觉资产进行分类和编号:
| 类别 | 前缀 | 示例 | 描述 |
|---|---|---|---|
| 角色 | C01-C99 | C01 林冲·正面全身 | 每个角色多个角度 |
| 场景 | S01-S99 | S01 沧州草料场·雪景 | 关键位置 |
| 道具 | P01-P99 | P01 长枪 | 重要物品 |
资产生成提示词格式:
### [编号] — [名称]
[风格前缀],[详细视觉描述(中文)],[技术规格]
**风格前缀示例:**
- Chinese ink wash painting style mixed with anime cel-shading
- Cinematic photorealistic style with dramatic lighting
- 3D Pixar-style animation rendering
- Sci-fi cyberpunk aesthetic with neon lighting
**角色区分:** 为每个角色使用不同的配色方案和视觉标记,确保在所选艺术风格中能够识别。
输出格式: 带有唯一ID的组织列表,适合复制粘贴到图像生成器中。
5. 生成 Seedance 2.0 分镜脚本
为每集生成:
a. 素材上传列表
| 上传位置 | 素材ID | 素材描述 |
| 图片1 | C01 | 林冲正面全身(角色一致性参考) |
| 图片2 | S01 | 草料场场景参考 |
b. Seedance Prompt (时间轴或镜头序列格式,使用中文)
遵循通用铁律:开头第一句固定"画面无任何字幕。";对白嵌入对应时间段或镜头段落;【声音】块只放声线/配乐/音效,不堆对白。若用户没有指定精确秒数,优先用「镜头1/镜头2/镜头3」组织,避免模型被不必要的秒数污染。
画面无任何字幕。
[风格描述],[目标时长N秒或镜头序列],[画幅比例],[整体氛围]
镜头1 / 0-N秒:[场景建立] - [镜头运动],[详细画面描述],[环境音效],[氛围营造]
镜头2 / N-N秒:[主体引入/情节发展] - [镜头运动],[具体动作],[动作音效],角色A(情绪):"[此刻的对白]"
镜头3 / N-N秒:[发展/冲突] - [镜头运动],[关键动作],[细节特写],角色B(情绪):"[此刻的对白]"
镜头4 / N-N秒:[高潮/转折] - [镜头运动],[情绪爆发],[视觉冲击 + 同步音效]
镜头5 / N-N秒:[结尾/落版] - [镜头运动],[最终画面],[余韵]
【声音】[配乐风格] + [关键音效清单] + [各角色声线描述,对白已在时间轴内不再重复]
【参考】@图片1 [用途说明],@图片2 [用途说明],@图片3 [用途说明]...
c. Ending Frame Description
- 记录最后一帧内容,确保下一集的连续性
- 包含:主体、背景、光线、构图、氛围
Camera movement keywords: 推镜头/拉镜头/摇镜头/移镜头/跟镜头/环绕镜头/升降镜头/希区柯克变焦/一镜到底/手持晃动
For continuation / chaining: 只有需要把上一段视频继续生成时,才在开始提示词使用 将@视频1延长Ns(N 按平台可选时长填写,通常 4-15s)并上传上一段作为视频参考;如果只是同系列新镜头,优先引用角色/场景资产,不强制视频续接。
Output Files
生成以下交付文件:
[Title]_剧本.md - 完整剧本,包含:
- 核心梗
- 故事梗概(背景/冲突/主角/主线/结局)
- 一句话卖点
- 人物小传(视觉形象/身份/标签/性格/金句)
- 剧本大纲(起承转合)
- 剧本正文(△镜头格式 + 对白 + OS/VO + 闪回 + 字幕)
[Title]_素材清单.md - 所有角色/场景/道具生成提示词
[Title]_E[XX]_分镜.md - 单集分镜脚本,包含时间轴格式
脚本写作指南
单段视频的节奏(4-15s)
| 片段类型 | 建议镜头数量 | 节奏 |
|---|---|---|
| 对话/情感 | 3-4个镜头 | 每个镜头4-5秒 |
| 动作/战斗 | 5-7个镜头 | 每个镜头2-3秒 |
| 蒙太奇/序列 | 6-8个镜头 | 每个镜头2秒 |
上表只适用于 Seedance 单段 4-15s 的生成。完整短片、短剧单集或广告片应先按用户目标总时长拆成若干单段,再分别生成。
情感 progression
每个独立片段应包含:
- 开场 (0-3s):建立情感/氛围
- 发展 (3-9s):紧张感上升或情节发展
- 高潮 (9-12s):情感高峰或关键揭示
- 释放 (12-15s):解决或悬念
视觉一致性
- 在所有资产提示词中保持一致的艺术风格
- 为每个角色使用独特的视觉标记(颜色、轮廓、配件)
- 在场景描述中参考光线和一天中的时间
质量保证
最终确定前:
- ✅ 验证所有资产引用(@图片X)在资产列表中有对应的ID
- ✅ 检查分段/分集间的连续性(需要续接时才使用结尾帧 → 开场帧)
- ✅ 确保时间轴或镜头序列覆盖用户指定的目标时长
- ✅ 验证相机运动是可行且逻辑顺序的
- ✅ 确认脚本使用正确的△格式和具体的相机语言
- ✅ 检查所有对话都正确标记(os/vo/情感)
- ✅ 包含感官细节(视觉、听觉、氛围)
- ✅ 验证每个独立片段都有情感弧线(开场 → 发展 → 高潮 → 释放)
- ✅ 确认没有擅自加入固定短剧模板(固定集数、固定 15 秒、固定首尾帧数量、无关付费卡点)
参考材料
有关详细的Seedance 2.0提示词模式、模板和最佳实践,请参阅 references/seedance-prompt-guide.md。
关键参考部分:
- 不同视频类型的模板1-16(叙事/产品/角色/风景/战争/等)
- 模板十七:沉浸式短片(视听一体)——小云雀 Seedance 2.0 专属模式
- 相机运动快速参考
- 氛围关键词库
- 多模态引用语法(@图片X, @视频X, @音频X)
视听语言实战技巧库见 references/cinematic-techniques.md(由抖音「AI 视频教程」19 集创作者实操经验蒸馏整理):
- 四模态能力地图(P 视频 / TVC 广告 / 电影镜头复刻)
- 景别分层、16 种运镜→情绪、8 种打光→情绪、7 种构图→作用 的可套用映射表
- 节奏(慢铺垫 / 快压迫 / 反差释放)与 5 个节奏技巧、4 类蒙太奇
- 活人感 3 招、情绪表情公式、AI 配音 3 步
- 一致性硬控四步法(角色库 / 场景锚点 / 尾帧续接 / 动作迁移;按项目需要选用)
- 漫剧 / 短剧工业化 SOP、3 人团队分工、一句话出片三种打法
- AI 短剧导演思维:五大注意力钩子(异常事件 / 情绪冲突 / 信息缺口 / 情绪治愈 / 视觉奇观)+ 短剧 Agent 2.0 选题、角色资产库、分镜节点工作流
- 导演台工作流(解决场景一致性):先建空间基准(720° 全景图 / 九宫格 / 导演台摆人物)再生成各镜;景别叙事功能(远=环境 / 全=环境关系 / 中=推进 / 近=情绪 / 特=细节),别一个景别用到底
- 提示词污染(复杂打斗能出、简单画面却崩):AI 把句子拆 token 逐词当独立视觉任务执行→三招规避:少写抽象词(→具象画面)、少写否定词(→肯定结果)、少写自带模板大词(→具体动作/空间/物体)
提示词工程底层机制与去 AI 感技巧库见 references/prompt-craft-and-realism.md(由抖音「刺猬星球superi」37 集创作者实操经验蒸馏,"邪修"篇):
- 提示词即视觉语言(五板块 / 具体 / 专业词)
- AI 底层机制邪修:误解机制、词序等级、扰动词、鲁棒性破坏、伪透视词、时间词、特征塌陷、反着写提示词
- 光线控制(方向 / 光比 / 色温;体积光 / 反光 / 补光层次)
- JSON 结构化生图、反推画面 / 视频提示词、风格提取四板块
- 去 AI 感 / 真实感:去摆拍感、前景遮挡、环境因果、电影感=摄影约束先于美学、减法审美、剪词
- 调色数据化 / Hex 自动调色、动作崩坏与打击感、人物 / 声音一致性、导演思维(调度 / 叙事 / 补拍)
Seedance 2.0 提示词「关键词触发」配方手册见 references/seedance2-prompt-cookbook.md(由抖音「Seedance2 教学计划」张百川AI 18 集实操经验蒸馏,可照抄的触发词 + 防崩配方 + 痛点避坑):
- 运镜配方:缓慢推进 / 拉远 / 仰拍 / 俯拍 / 跟拍 / 低角度跟拍(写机位高度)/ 希区柯克变焦(背景被拉伸挤压)/ 斯皮尔伯格闯入镜头
- 速度感与特殊镜头:延时摄影、高速跟拍 + 动态模糊(1/50s 慢快门)、航拍鸟瞰(FPV + 高度 + 飞行路径)、快速变焦推拉
- 电影级快切 / 动作类型:甩镜转场、碎片化快切(多次生成 + 剪辑)、超高速微观摄影
- 构图视角:荷兰角倾斜、第一人称(必放句首)、一镜到底;光影色彩:黄金时刻逆光、暗调低调、胶片颗粒感
- 万能公式:防崩神词清单 + 人物 / 场景 / 动漫二次元三大固定结构 + 情绪 / 唯美 / 炫酷简短模板;动作宁慢勿快、运镜只写一个、优先 10 秒
- 痛点避坑:先音频定节奏(音画同步)、三层提示词结构(主 + 约束 + 禁指向≤5)、情绪递进拆可见动作、固定空间布局、多人分层级、一素材一职责、爽点三段(压制 / 证据 / 反应)、动作戏省略暴力强化结果
- 竖屏 9:16「权力构图」(脸在上 1/3 + 底部字幕安全区 + 关键信息上移 + 少超远景)、量产可用率(先定合格条件 + 失败标签复盘 + A/B/C 三版交导演定夺)、新手先拆任务(五问,别让模型当编剧)、一条只解决一个戏剧点(三段式,避免剧情塞车)
- 表演 / 镜头细化:情绪写「过程」不写结果(震惊→克制→外露→未失控)、动作链路三步(准备→触发→结果);「电影感」拆成具体镜头语言(低角度 / 前景深 / 逆光 / 慢推 / 冷暖对比 / 长焦压缩);人物别老在画面正中→景别组合叙事 + 前景遮挡(门缝 / 玻璃 / 窗帘 / 雨伞 / 车窗反光)
AI 人物面部真实感关键词库见 references/portrait-realism-details.md(由抖音「AI视觉真实感系列」啊布 5 集 + Jac.key 蒸馏,专攻人物「一眼假→一眼真」):
- 一眼假的根因不在五官、在「太干净太完美」;真实感 = 可控的不完美
- 面部局部特写关键词库(眼睛 / 嘴唇 / 鼻子+脸颊 / 发丝,每条照抄即用)+ 通用增强词(细腻光影 / 高清细节 / 电影质感)
- 皮肤 / 毛孔去「塑料感」关键词清单(可见毛孔 / 细小绒毛 / 自然油光反射 / 肤色不均 / 手机原相机 / 未修图无滤镜 / 8K)
- 发丝真实感(人物 / 商品模特同理,「100 例 · 7 大组别」):额前碎发 / 飞发凌乱 / 发丝遮挡脸部 / 发丝质感分叉 / 近景层次 / 逆光透发光影 / 动态形态 + 头皮发际线,收尾加「自然光 / 抓拍感 / 原相机质感」(脸决定点击率、发丝决定真实感)
- 美妆商品图嘴唇:唇形轻微不对称 + 嘴角阴影 + 下唇轻微高光(非塑料)+ 自然唇纹颜色层次 + 唇皮过渡,让 AI 理解「这是美妆商品图不是网红自拍」
- 微表情 8 步框架:不要写情绪、要写情绪变化过程(锁定人物→锚定初始表情→拆解肌肉变化→设计情绪递进→添加自然动作→控制节奏→强化质感→反向限制 Bug)
- 别只堆词:先搭标准化提示词结构,再用打光(强度 / 颜色 / 方位)+ 多角度把人物「做活」(真实感靠光线+姿态+情绪一起成立,不靠脸多高清)
短剧剧本创作(上游 · 创意→完整剧本)见 references/short-drama-screenwriting.md(改编自 MIT 开源 0xsline/short-drama,方法论文档在 references/short-drama/)——配合 Workflow 阶段 0 使用:
- 渐进式命令流:/start 选题 → /plan 三幕+付费卡点+爽点矩阵 → /characters 角色+四层反派 → /outline 分集目录 → /episode 单集 △ 剧本 → /review 五维自检 → /compliance 合规 → /export;/overseas 出海
- 八大方法论库:13 题材+出海映射、开篇黄金法则、付费卡点 5 套路、节奏四阶段波形、5 大爽点矩阵、四层反派体系、5 种钩子、合规红线/灰区
- 巨量引擎短剧创作者中心官方审核标准(compliance-checklist 第六节):分级备案阈值(特殊题材或≥300万=重点 / 100-300万=普通 / <100万=其他)、内容安全七大红线(真人/漫剧通用)、内容质量/剧壳创作建议、成片发布审核常见问题(版权主体/剧名一致、工程文件、催审、拒审查看)
- 与下游衔接:剧本 episodes/epNNN.md → 抽 C/S/P 资产 + 逐集转 Seedance 2.0 分镜(同用 △ + 景别格式,见该文档「→ 视频化交接」)
常见陷阱避免
(以下为快速清单,完整规范见顶部「Seedance 2.0 通用生产铁律」)
- 敏感词:删除负面关键词改正向描述;2026年5月审核已收紧,年龄+性别组合等高风险表述需中性化(见铁律5)。
- 字幕冗余:开头只写"画面无任何字幕。"一句,勿写旧版长禁令(见铁律3)。
- 对白错位:对白嵌入时间轴对应秒数,【声音】块不堆对白(见铁律4)。
- 续接残影:视频延长时旧视觉元素会被强续渲,要消失需三重加固(见铁律2)。
- 时长溢出:用"对白×1.3s + 画面节拍×0.8-1.5s"核对每段,密集场景拆段(见铁律1)。
- 缺少连续性:跨段/分集项目需记录结尾帧并验证下一段以匹配的场景开始;单段视频不用强制续接。
- 风格不一致:对所有资产生成提示词应用相同的视觉风格前缀。
- 模糊的相机语言:避免"镜头移动"这类通用描述,使用"推镜头""环绕镜头"等具体术语。
- 物体分形崩坏:用"摔/取/递"替代"掰断/剥瓣"(见铁律7)。
- 缺少音效设计:沉浸式短片是视听一体,每个动作节拍都应配同步音效,而非只在结尾堆配乐。
- 平淡的情感弧线:每个独立片段或剧集需要情感进展,而不仅仅是情节点。
- 机械堆提示词(一眼假):把信息一次塞进一个镜头、只描述动作而不用镜头语言讲故事。改用景别分层 + 运镜 / 光影 / 构图 / 节奏服务情绪(见铁律 11 与 cinematic-techniques.md)。
- 节奏平:全程匀速、镜头一直动、情绪是平的 = 流水账。用前摇 / 停顿 / 留白制造张弛反差。
- 跨段后崩坏:换脸 / 飘色 / 乱位。需要跨段连续时,先建角色三视图资产库 + 空场景锚点,再用尾帧续接(见一致性硬控四步法);单段视频不要强制套用。
- 抽象词直接堆:"梦幻 / 高级 / 质感"对 AI 是空词,必须量化成视觉动作;要去掉某效果写"无 X"而非堆同义词(见铁律 12 与 prompt-craft-and-realism.md)。
- 画面太干净=假:缺前景遮挡与空气介质。加物理 + 氛围前景(并写"虚化")、做减法、统一摄影逻辑。
- 动作写成清单:堆动词导致指令冲突 / 崩坏。保留单一主动作 + 方式词,顺序改成状态约束。
- 提示词越长越乱:用三层结构(主提示词 + 约束提示词 + 禁指向,禁指向≤3-5 个),且每条只设一个「第一优先级」,别让算力分散(见 seedance2-prompt-cookbook.md 8.2)。
- 多素材 / 多人串味:一个素材一个职责并明写"不参考什么";多人按主动作 / 反应 / 背景分层级,只细描主角(见 seedance2-prompt-cookbook.md 8.5 / 8.6)。
- 打戏爆破崩坏:别把整套动作塞进一段,用"省略暴力过程、强化结果反馈",危险动作放画外用光 / 声 / 反应表现(见 seedance2-prompt-cookbook.md 8.8,呼应铁律7)。
- 场景一致性差(位置乱跳):人物上一镜在左、下一镜在右,因为没先锚定空间。先建空间基准——720° 全景图 / 场景九宫格 / 导演台摆人物,再从同一空间取景生成各镜(见 cinematic-techniques.md 十五)。
- 一个景别用到底:全程同一景别像监控录像。按叙事功能切换——远=交代环境 / 全=环境关系 / 中=推进 / 近=放大情绪 / 特=突出细节(见 cinematic-techniques.md 十五 / 二)。
- 竖屏主体太小 / 字幕挡脸:用横屏思维写竖屏。改 9:16 竖图构图,脸在上 1/3、底部预留字幕安全区、关键信息上移、少超远景多中近景(见 seedance2-prompt-cookbook.md 8.9)。
- 量产可用率低 / 一条塞太多剧情:没评判标准就盲产,或 10 秒塞五集剧情。先定每镜合格条件 + 失败标签复盘 + A/B/C 三版;新手先拆任务(五问),一条只解决一个戏剧点(三段式)(见 seedance2-prompt-cookbook.md 8.10–8.12)。
- 简单画面老崩 / 否定词不生效 / 大词带跑画面(提示词污染):AI 把句子拆 token、逐词当独立视觉任务执行("医院用 iPad 看剧"→强行把屏幕翻转朝镜头;"不要出现学校"→反而更出现学校)。三招规避:少写抽象词→写具象画面、少写否定词→写肯定结果、少写自带模板大词(创业/约会/直播)→写具体动作+空间+物体(见 cinematic-techniques.md 十六)。
- 情绪 / 动作 / 电影感写"结果词":写
崩溃大哭/电影感/ 人物全正面像证件照→一眼假。情绪写变化过程(震惊→克制→外露→未失控)、动作写链路三步(准备→触发→结果)、"电影感"拆成镜头语言(低角度/前景深/逆光/慢推/冷暖对比/长焦压缩)、人物别老在画面正中→景别组合 + 前景遮挡(见 seedance2-prompt-cookbook.md 8.13–8.16)。
示例对比
❌ 不好(模糊大纲):
关键情节:
- 林冲听到门外有人说话
- 得知高球要烧死自己的阴谋
- 冲出去报仇
✅ 好(标准脚本格式):
△ 林冲屏住呼吸,悄无声息地起身,贴在门缝边偷听。
△ 门外的声音透过风雪传来,清晰可辨。
陆谦(vo):这把火下去,管教他林冲死无葬身之地!
差拨(vo):陆大人放心,就算烧不死他,失了草料场也是死罪!
△ 林冲听到"高太尉"三字,浑身一震,眼中原本的隐忍瞬间化为熊熊怒火。
△ 【闪回】高衙内调戏妻子、自己误入白虎堂、刺配沧州的画面如走马灯般闪过。
【闪回结束】
△ 林冲死死抓着枪杆,指节因用力而泛白,牙齿咬得咯咯作响。
林冲(os):陆谦!我待你不薄,你却要置我于死地!
△ 门外传来泼油的声音,火光瞬间映红了门缝。
△ 林冲猛地抬头,杀气冲天,原本的颓废一扫而空。