# Wan3 Cinematic 30s

> 用“视觉复杂、逻辑简单”的方法生成、改写和诊断可直接粘贴的电影感视频提示词，尤其适用于完整30秒、16:9的文生视频与图生视频、角色参考图改编、高概念成人科幻选集气质、Higgsfield Series式短篇，以及带清晰反转、人物与道具连续性、物理动作、镜头、灯光、同步音效和定制负面约束的提示词。用户提到“30秒提示词”“有反转”“根据这张角色图写视频”“无垫图文生视频”“视觉复杂逻辑简单”“Series感”时使用。

- Skill: `2799662352/wan3-cinematic-30s` (Agent Skill, multi-file: 8 files)
- Install (CLI): `npx skillmds@latest add 2799662352/wan3-cinematic-30s`
- Raw SKILL.md: https://api.skillmd.com/api/skills/2799662352/wan3-cinematic-30s/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- License: MIT
- Author: 2799662352 (https://skillmd.com/u/2799662352)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/2799662352/wan3-cinematic-30s

---


# 30秒电影视频提示词导演

<!-- skill-budget: standard -->

万相 3.0 的提示词底座 —— 与 Seedance 的 sd2-pe / sd25-pe 平级（按 model 三选一），
**同一任务只载一个**。

两个专项叶子按题材加载，不要预载：

- 产品广告 / TVC / 带货片 → `wan3-product-tvc`
- 情绪戏、对白戏、单人或双人 20 镜头级别的表演 → `wan3-emotion-shotlist`

把一个角色或高概念压缩成模型可执行的30秒短片。追求高视觉密度、清楚因果和稳定连续性，不把“电影感”、摄影机品牌或风格标签当作导演工作的替代品。

## 核心原则

始终遵守：

> 视觉可以复杂，逻辑必须简单。

默认采用以下生成安全骨架：

- 一个主要空间，或一组地理连续、无需重置的相邻空间。
- 一个绝对主角；必要时最多增加一个配角。
- 一个核心任务、动作或观察行为。
- 一个承担剧情的关键物件或视觉规律。
- 一个逐步升级的异常。
- 一个在22秒后发生、能重新解释前面信息的清晰反转。
- 一个由画面事件驱动的摄影机行为。

允许一个大型视觉奇观，但它必须来自既有空间和同一个机制，例如雨滴悬停、城市灯光依次熄灭、影子脱离人物、天空被打开。不要同时加入换景、多人群演、复杂变形、追逐、战斗、长对白和多次反转。

## 先判断任务类型

选择一个路径：

1. **参考图改编**：检查图片，只锁定用户需要保留的身份、造型、媒介或物件；重新导演场景、动作、构图和光线。
2. **无垫图文生视频**：自行建立完整角色、单一场景、核心机制和反转；正文不得出现 `@Image`、参考图、角色卡或外部文件。
3. **已有提示词优化**：保留已批准的内容，只修复最主要的失败层，不用新故事覆盖用户的原意。
4. **批量成品**：每条提示词必须标题唯一、彼此独立、可单独粘贴，不能依赖“同上”或前一条的设定。

如果平台、时长或画幅未说明，普通短片默认30秒、16:9、24fps。不要凭空添加4K、特定模型或摄影机品牌，除非它们确实影响交付或用户明确要求。

## 检查并路由参考图

有参考图时必须先实际查看。不要从文件名猜内容。

先判断图像的主要媒介：真人照片、半写实插画、二维动画、水彩绘本、平面编辑插画、风格化3D、拟真3D或游戏过场。默认忠于原媒介；只有用户明确要求真人化、3D化或换媒介时才转换。

为每张参考图写清四件事：

`图片 + 正向职责 + 保真程度 + 不得控制的维度`

常见写法：

```text
参考图只负责锁定主角的面部身份、年龄感、发型、体型和固定服装；保持全片同一张脸、同一发型、同一服装。忽略角色卡文字、箭头、多视图排版、白色展示背景、静态摆拍姿势、原始构图和棚拍光线。
```

如果图片被指定为首帧，则它可以控制开场构图、位置、环境和光线；否则不要让角色卡或证件照姿势冻结整条视频。

多张图时，一张图只承担一个主要职责：身份、服装、产品、环境、构图、光线或连续性。不要让多张图共同“投票”同一个脸、同一个机位或同一个光线方向。

## 先定媒介，再定反转

不要把所有角色都套成同一种“ALEXA真人电影”或“UE5 3A动画”。根据参考图与用户意图选择原生媒介，再用媒介能稳定实现的机制设计反转。

- 真人电影：真实演员、皮肤、服装、实景、实用光源和克制无痕特效；避免游戏CG、塑料皮肤和时尚摆拍。
- 风格化3D：角色轮廓、材质、毛发、布料和表演保持同一套动画逻辑；避免突然真人化或廉价手游CG。
- 二维动画或插画：保持线条、上色、纸张、笔刷和逐帧运动规律；避免不必要的3D建模与写实材质漂移。
- 运动或专业动作：专业技术、惯性、接触、脚步、重心、物体轨迹和空间轴线优先于炫技运镜。

用户说出某部作品、工作室或系列名称时，提取其功能特征，例如“成人科幻选集、高概念异常、克制表演、最后重释”，不要复制已有角色、剧情、镜头或独特美术。

## 建立复杂度预算

先从以下安全配置开始：

`1个场景 + 1个主角 + 1个关键物件 + 1条异常规律 + 1次反转`

以下每项都属于高风险变量：

- 新增主要场景或地理跳跃；
- 第三个以上可辨识人物或群众；
- 角色、动物、车辆或道具发生结构变形；
- 两人以上同步舞蹈、搏斗或复杂身体接触；
- 快速追逐、连续腾跃或多次危险动作；
- 多物体精确碰撞、复制或高速轨迹；
- 长对白、持续口型或唱歌；
- 镜面、多重倒影或画中画需要精确同步；
- 多次时间跳跃、世界重置或两个以上反转；
- 无动机甩镜、绕拍、频繁换焦或连续跳切。

普通30秒成片最多保留两个高风险变量。如果超过两个，优先删除不会改变核心情绪和反转的变量。视觉奇观优先做成环境状态变化，而不是让人物和道具不断变形。

## 设计一行因果链

在写正文前，用一句话完成：

`主角在固定场景执行任务 → 一个异常规律干扰任务 → 主角做出一次可见选择 → 结尾揭示同一物件或空间的真实含义`

如果一句话说不清，剧情仍然过载。不要继续加摄影、材质和负面词；先删减故事变量。

## 使用30秒节拍

默认使用五段式：

- **0—7秒，钩子与状态**：第一秒就让异常物件、动作或视觉规律出现，同时建立主角、空间和任务。
- **7—14秒，验证与升级**：主角做一个简单测试或继续任务，异常以同一规律升级。
- **14—22秒，阈值与选择**：异常逼迫主角作出一个动作；接触、重心、物件位置和因果必须连续。
- **22—27秒，反转与重释**：通过空间揭示、意图反转、物件功能或尺度关系重释前22秒。
- **27—30秒，余韵与落点**：摄影机停稳，给一个呼吸、眼神、动作回声或小笑点，不再开启第二个故事。

运动、广告或需要更清楚动作链的任务可细分为六段，但总因果仍只能有一条。每个时间段必须描述可见动作，不写抽象情绪或纯风格口号。

## 选择低风险反转

优先选择：

- **空间揭示**：拉远、开门、移焦或改变观察角度，揭示观众误解了场所或尺度。
- **意图反转**：看似逃跑、破坏或攻击，实际在保护、归还、释放或修复。
- **物件功能反转**：同一个物件的真实用途在结尾被看见。
- **关系反转**：已在画面内的配角并非威胁，而是帮助者、见证者或被保护者。
- **规律反转**：异常不是故障，而是在执行另一套可验证规则。

反转必须回看可成立：前面至少埋一个可见线索；结尾不得依赖突然出现的新角色、新地点或新设定。避免把“巨大爆炸、变成怪兽、醒来是梦、又一次反转”当作默认惊喜。

## 导演镜头、表演与灯光

摄影机先有物理位置，再有焦段：

`位置 + 高度 + 与人物距离 + 轴线/角度 + 前景关系 + 唯一主要运动`

常用焦段功能：

- 35mm：人物承受环境或运动压力，保留清楚地理关系。
- 40mm：自然观察人物与空间，最适合单场景高概念短片。
- 50mm：克制反应、手部细节和结尾重释，同时保留必要背景原因。
- 微距或长焦：只在物件接触、专业运动或远距离观察确有需要时使用。

全片默认一种主要摄影机行为：观察、跟随、反应、揭示或停稳。镜头只因人物或事件而移动，禁止把推、拉、摇、移、环绕、甩镜同时堆进一段。

给主角明确任务、视线、重心、手部动作和一个微反应。光线必须来自场景内可推断的窗、路灯、顶灯、屏幕、车灯、日出或闪电；写清方向和层次，不靠“电影感”三个字完成照明。

摄影机品牌、镜头型号、引擎和渲染术语只能放在结构之后。它们用于约束响应、材质或镜头行为，不用于掩盖静态剧情。

## 锁定连续性

提示词至少记录：

- 角色：脸、年龄、发型、体型、主次关系、惯用手。
- 服装：颜色、剪裁、鞋、帽、首饰、干湿与损坏状态。
- 物件：数量、形状、材质、朝向、谁持有、是否已经移动或打开。
- 地理：入口、出口、左右位置、远近关系、运动轴线和摄影机不可跨越的方向。
- 光线与天气：主光方向、时间、雨雾、湿润程度和不可逆变化。
- 动作状态：谁碰过什么、物件最终落点、是否已经破裂、熄灭、落地或打开。

专业运动、双人对打、车辆、球体或武器场景必须写出每次来因与去果。不得出现无来源来球、物体瞬移、左右手变化、跨轴、人数增殖或道具复制。

## 写成可直接粘贴的正文

按以下控制优先级组织最终提示词：

1. 完整时长、画幅、帧率、媒介和原创气质；
2. 唯一片名；
3. 参考图职责与不可变锁，或无垫图的完整角色定义；
4. 固定场景、关键物件和空间关系；
5. 摄影机物理位置、焦段功能、主要运动和光源；
6. 带时间段的连续动作与反转；
7. 物理、表演、材质与连续性要求；
8. 同步声音；
9. 针对本条任务的严格禁止项。

用户只要提示词时，交付一条完整正文，不额外输出提纲、分镜表或大量解释。可以在正文前用一句话说明核心反转，但不要让说明代替提示词。

具体模板见 [references/prompt-templates.md](references/prompt-templates.md)。

## 只写有用的负面约束

先针对本条视频最可能失败的维度写禁止项：

- 身份漂移：换脸、年龄变化、发型或服装变化。
- 媒介漂移：真人变CG、二维变三维、写实变卡通。
- 动作物理：滑步、漂浮、错误重心、穿模、断裂接触、橡皮肢体。
- 道具连续性：复制、消失、瞬移、变形、数量变化。
- 空间连续性：跨轴、场地翻转、背景跳变、光向突变。
- 镜头问题：无动机绕拍、快速甩镜、闪烁、过度慢动作和运动模糊。
- 画面质感：塑料皮肤、过度HDR、全局锐化、假景深、手游CG感。
- 文字品牌：未经要求的Logo、字幕、水印、品牌、字母或数字。

不要把几百个通用负面词机械复制到每条提示词。专业动作、球类、机械、产品、Logo或文字有特殊风险时，再增加对应约束。

## 处理声音

除非用户明确要求音乐，默认不添加背景音乐、歌曲、旋律或节拍。只保留与画面事件同步的环境、动作、接触、机械、风、雨、车辆、呼吸、衣料和空间转场声。

即梦视频必须在每条提示词末尾追加下面这段原文：

> 音频要求：不要背景音乐、配乐、歌曲、旋律或节拍，不要任何音乐性铺底；只保留与画面严格同步的环境音、动作音、机械声、风声、掠过声、碰撞声和空间转场音效。音效具有电影级空间层次，但不能形成旋律或音乐节奏。

## 最小化修复

优化已有提示词或生成结果时：

1. 只写一个可见症状。
2. 将症状归到故事复杂度、参考职责、媒介、动作物理、摄影机、灯光、连续性或质感中的一层。
3. 列出必须保留的已批准部分。
4. 只改变一个主要变量。
5. 用同一症状验证新版本。

常见优先顺序：

`故事因果与复杂度 → 身份/物件硬锁 → 动作连续性 → 摄影机/空间 → 灯光/质感 → 风格修饰`

不要在一次修复中同时改故事、角色、焦段、机位、灯光、媒介和反转。完整检查见 [references/qa-checklist.md](references/qa-checklist.md)。

## 交付格式

普通请求交付：

1. 一句视觉或反转意图，可省略；
2. 有参考图时给一句参考职责说明；
3. 一个可直接粘贴的完整提示词代码块；
4. 仅在必要时补充一条平台或连续性提醒。

批量请求中，每条都重复完整规格、角色、场景、声音和禁止项。不得写“沿用上一条”。


