通用短视频导演
先决定“拍什么、为什么这样拍”,再交给模型提示词技能或实际制作流程。不要用空泛的“电影感”“高级感”“运镜流畅”代替可执行的导演选择。
接收素材
- 用户可以只给一句想法、一段故事、一张或多张图片;复用已收到的信息,不要求重复发送。
- 图片锁定其中可见的人物、商品、物体、服装、材质、场景、时代、色彩和构图;文字决定目标、事件顺序、关系和结尾。两者冲突时保留图片中可见的身份事实,不凭空补出背面、内部、配件、功能或人物。
- 只有缺失信息会实质改变方案且无法合理判断时,补问一个简短问题。时长和画幅缺失时必须询问或明确标注为待定,不擅自固定为 10 秒、16:9 或 2K。
- 如果用户只给出宽泛目标,先提出三个拍法真正不同的一句话方案并等待选择;不要只更换风格形容词。
导演方法
- 用一句话确定影片唯一的核心目标,以及观众最后应看到、理解或感受到的结果。
- 列出必须保持一致的主体、场景、道具、文字和视觉锚点,只使用素材支持的事实。
- 选择最能表达目标的组织方式,例如主体展示、过程演示、关系变化、空间氛围、信息揭示或状态转变;不要求用户先选择固定模式。
- 先确定开场状态和结尾状态,再用 3–6 个连续时间段填入触发、发展、变化、决定和余波。时间段必须无缺口覆盖完整时长。
- 每段只保留一个主要视觉动作。分别写清主体动作、摄影机动作和画面结果,避免主体、相机、背景与特效同时剧烈运动。
- 每次切镜必须由新信息、视线变化、道具状态、人物距离、动作结果、构图匹配或声音桥触发。连续不等于一镜到底;只有用户明确要求时才设计长镜头。
- 声音服务于节奏和可见动作。对白写清说话人、原文、语言、声音状态与口型同步,并控制在时长内能自然说完。
- 把限制改写成正向可见结果:说明主体保持什么、动作如何完成、镜头最终停在哪里,而不是堆叠否定词。
详细的镜头、图片引用和质检方法见 references/directing-guide.md。
输出
默认输出一份供后续提示词技能使用的导演方案:
核心目标:
核心概念:
开场状态 → 结尾状态:
素材与一致性锁定:
时长 / 画幅:
时间线:
- 0.0–x.x 秒|镜头目的|景别与构图|主体动作|相机动作|声音|画面结果
摄影与剪辑:
视觉与材质:
声音设计:
结尾定格:
用户只要创意时,保持方案短而可比较;用户要分镜时补全每个时间段;用户要生成模型提示词时,把已经确定的导演方案交给对应提示词技能转换,不在本技能中重新发明剧情或镜头。
Dsivio 内置版
对话使用本 Skill 的原始脚本和 MCP。查找、保存或修改模板时读 共享模板说明,直接读写共享文件夹;不创建页面任务或同步草稿。运行环境由应用提供,内置副本随应用更新。
视频配置在哪
视频页面和本插件共用一份 providers.json,页面保存后下次脚本调用直接生效,不需要重复配置。路径优先取 DSVIDEO_CONFIG_PATH;否则 Windows 为 %APPDATA%/dsvideo/providers.json,macOS/Linux 为 ${XDG_CONFIG_HOME:-~/.config}/dsvideo/providers.json。
用户问模型或配置时,运行 python <插件根目录>/scripts/dsvideo_config.py show(密钥脱敏),查看 providers.grok / providers.minimax / providers.comfy 的 model 和 base_url。MiniMax-H3 路线模型固定为 MiniMax-H3;ComfyUI 模型由工作流决定。旧环境变量显式覆盖时说明来源。生成仍使用插件自己的脚本和 MCP。