# Video Prompt Spec

> 入力（テキストアイデア/音源/動画/YouTube URL）を映像制作用の4構造プロンプト仕様書（①映像タイムライン ②ビジュアル特徴・画風 ③画像生成AI用プロンプト(英+訳) ④動画AI用モーション指示）に変換し、Phase 5 で画像+動画の実際生成ウィザードまで担当する。音源・動画・YouTubeはGemini(gemini-code)に分析委任、テキストアイデアはCC単独で処理。音楽生成プロンプトは出力しない（それは reverse-engineer-song の役割）。ユーザーが「映像プロンプト」「動画プロンプト」「映像仕様書」「ビジュアルプロンプト作って」「このアイデアで映像」「映像構成作って」「武将の動画」「サイバー和の映像」「MV作って」等と言った時、または /video-prompt-spec を呼んだ時にトリガー。楽曲のMV・プロモーション映像・ショート動画の映像プロンプトが欲しい時、画像/動画の実際生成まで走らせたい時は必ず本スキルを使うこと。

- Skill: `fukukei23/video-prompt-spec` (Agent Skill, multi-file: 3 files)
- Install (CLI): `npx skillmds add fukukei23/video-prompt-spec`
- Raw SKILL.md: https://api.skillmd.com/api/skills/fukukei23/video-prompt-spec/raw
- Safety review: pending (external: skill-scanner PASS, skillspector PASS)
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- Author: fukukei23 (https://skillmd.com/u/fukukei23)
- Updated: 2026-08-19
- Page: https://skillmd.com/skills/fukukei23/video-prompt-spec

---


# 映像プロンプト仕様書ジェネレータ

## トリガーワード
「映像プロンプト」「動画プロンプト」「映像仕様書」「ビジュアルプロンプト作って」「このアイデアで映像」「映像構成作って」「MVのプロンプト」「武将の動画」「サイバー和の映像」「MV作って」「/video-prompt-spec」

## 前提知識（進行開始前に必ず読み込む）
- `references/映像プロンプト_マスタープロンプト.md`（**本体**・音源/動画/YouTube入力時にGeminiに投げるマスタープロンプト・映像4構造の分析要件・出力フォーマット）
- `references/映像タイムライン_テーマ別.md`（**Phase 5 参照**・サイバー和モダン3作品＋三国志水墨画のタイムライン・構造化プロンプト・モーション指示）

## 設計の核心（厳守）
- **本スキルは2役**: Phase 0-4 で「映像プロンプト仕様書生成」、Phase 5 で「画像+動画の実際生成ウィザード」。Phase 5 は独立セクション（肥大化対策）。
- **本スキルは「映像」に特化**。音楽生成プロンプト（Suno/Udio用のStyle/Tags/Lyrics制御タグ）は出力しない。それが必要なら `reverse-engineer-song`（YouTube楽曲→音楽3モダリティ）へ。
- **入力タイプで処理が分かれる**:
  - テキストアイデア（世界観・情景の言葉）→ **CC単独**で4構造を直接生成（Gemini不要）
  - 音源/動画ファイル・YouTube URL → **Gemini(gemini-code)に分析委任**（CCは音源/動画を直接扱えないため）
- **連携2系統（R-5）**: ルートA（make-song経由・曲→映像の一気通貫）/ ルートB（本スキル直接起動・映像単体）
- CCの役割は **①入力タイプ判定 ②マスタープロンプト組立（Geminiパス時）or 直接生成（テキストパス時） ③結果の構造検証・Markdown整形 ④保存 ⑤橋渡し（make-song/reverse-engineer-song） ⑥Phase 5 画像+動画の実際生成（MiniMax MCP）** のみ。

## 進行（6フェーズ・ハイブリッド）

**🔴 = 人間判断ポイント。必ず停止してユーザー確認を待つ。**

### Phase 0: 入力確認・タイプ判定（起点）🔴

`AskUserQuestion` で確認:
```
質問:「映像プロンプト仕様書を作ります。入力を教えてください」
選択肢:
  テキストアイデア（世界観・情景の言葉で指定）
  音源ファイル（ローカルmp3等のパス）
  動画ファイル（ローカルmp4等のパス）
  YouTube URL
```
入力内容を収集（テキストなら言葉、ファイルならパス、URLならURL）。
※ 既存楽曲なら実時間軸、アイデアなら仮想楽曲構成（4分曲・Aメロ/Bメロ/サビ）で進めることを案内。

### Phase 1: 分析（入力タイプで分岐）

#### A. テキストアイデアの場合（CC単独・Gemini不要）
1. ユーザーのアイデアから仮想楽曲構成（例：4分曲・Intro/Aメロ/Bメロ/サビ/間奏/大サビ/アウトロ）を想定
2. 各セクションの心理的変化（静寂→爆発 等）と対応する映像シーンを設計
3. CCが直接4構造（タイムライン/ビジュアル/画像プロンプト/動画モーション）を生成
4. Phase 2 へ

#### B. 音源/動画/YouTubeの場合（Gemini委任）🔴
1. `references/映像プロンプト_マスタープロンプト.md` を読み込む
2. マスタープロンプト本文の `[ここに分析対象を記述（YouTube URL または 音源/動画ファイルパス）]` に Phase 0 の入力を埋め込む
3. ユーザーに提示 🔴:
   ```
   以下のマスタープロンプトを Gemini(gemini-code) に投げてください。
   結果が出たら、そのままこのチャットに貼り戻してください。
   
   [埋め込み済みマスタープロンプト全文を表示]
   ```
4. **停止**。ユーザーがGeminiに投げ、結果を貼り戻すまで待つ。

### Phase 2: 4構造生成・構造化 🔴

1. （テキストパス）CC生成物 / （Geminiパス）ユーザーが貼り戻したGemini出力 を読む
2. **構造検証**（以下4点を確認）:
   - [ ] セクション1「映像タイムライン構造」に時間軸×シーン（心理的変化）があるか
   - [ ] セクション2「ビジュアル特徴・画風」にアートスタイル・カメラワークがあるか
   - [ ] セクション3「画像生成AI用プロンプト」に英語プロンプト＋日本語訳＋シチュエーション別（3パターン推奨）があるか
   - [ ] セクション4「動画AI用モーション指示」に静/動シーン別があるか
3. **不備あり** → ユーザーに「Geminiに〇〇を追加で出力させて再投してください」（Geminiパス）、またはCCで補完（テキストパス）して停止
4. **全て揃い** → Markdown整形（見出し階層・コードブロック整理）し、ユーザーに最終確認提示 🔴

### Phase 3: 単独ファイル保存

1. タイトルを確認（不明ならユーザーに確認）
2. `/home/yn4416/projects/obsidian-ssot/01_DECISIONS/ai-music/YYYY-MM-DD_<タイトル>_映像プロンプト仕様書.md` に保存
   - frontmatter: `project: ai-music`, `date: YYYY-MM-DD`, `tags: [ai-music, 生成AI, 映像プロンプト仕様書]`
   - 本文: 4構造（構造化済み）を記載
   - 末尾に「生成元（入力）」「生成日時」「使用マスタープロンプト: video-prompt-spec/references/映像プロンプト_マスタープロンプト.md（Geminiパス時）」を付記
3. commit:
   ```bash
   cd /home/yn4416/projects/obsidian-ssot
   git add 01_DECISIONS/ai-music/YYYY-MM-DD_<タイトル>_映像プロンプト仕様書.md
   git commit -m "feat: <タイトル> 映像プロンプト仕様書（video-prompt-spec生成）"
   ```

### Phase 4: 橋渡しオプション（2系統・R-5）🔴

`AskUserQuestion` で確認:
```
質問:「映像制作の進め方を選んでください（連携ルート）」
選択肢:
  make-song で楽曲を先に作る（ルートA継続時は Phase 5 へ）
  reverse-engineer-song で音楽再現プロンプトも追加
  このまま Phase 5 で画像+動画を実際生成する
  いいえ（仕様書＋生成物保存のみで終了）
```

- **ルートA（曲→映像・一気通貫）**: make-song Phase 6 経由で起動（楽曲ファイル・テーマ・世界観引き継ぎ済）→ そのまま Phase 5 映像生成へ
- **ルートB（映像単体・直接起動）**: 本スキルを直接起動（仕様書のみ・画像のみ・既存曲への映像付け等）

- **make-song 選択** → make-song で楽曲を制作（テーマ: 武将/サイバー和 等）。ルートA継続時は楽曲完成後 Phase 5 へ
- **reverse-engineer-song 選択** → 同じ入力で音楽3モダリティ仕様書を追加生成（本仕様書と統合可）
- **Phase 5 選択** → Phase 5 映像生成ウィザードへ（画像→動画の実際生成）
- **いいえ** → 「仕様書を保存しました: `<パス>`」と表示して終了

### Phase 5: 映像生成ウィザード（sangoku/cyber-wa 統合・画像+動画の実際生成）

**🔴 = 人間判断ポイント。必ず停止してユーザー確認を待つ。**

1. **画像生成**: MiniMax MCP `text_to_image`(image-01)・`references/映像タイムライン_テーマ別.md` の該当シーンプロンプト使用・`--ar 16:9`（動画ソース帧として使用）
2. 🔴 花鈿（眉間の赤点）あれば → `remove-huadian` スキル自動呼出
3. 🔴 **人間判断**: 「構図/花鈿除去はこれでいいですか?」
4. **動画生成**: MiniMax MCP `generate_video`(Hailuo-2.3)・静=ループモーション(Lofi/籠城)/動=パンアップ・フライスルー(ラウド/EDM)を使い分け・最大10秒・15秒は10s+5sを2本→ffmpeg結合
5. 🔴 **人間判断**: 「動画はこれでいいですか?」Token Plan制限時は従量課金($0.19~/本)案内してスキップ可、または `MINIMAX_API_KEY_VIDEO` で直接API

**保存先（実生成物）**:
- テーマが `sangokushi-HIPHOP`（三国志系）→ `/home/yn4416/projects/sangokushi-HIPHOP/songs/<武将>_<エピソード>/` 配下へ画像・動画を保存
- テーマが `cyber-wa-modern`（サイバー和系）→ `/home/yn4416/projects/cyber-wa-modern/<作品名>/` 配下へ画像・動画を保存
- 仕様書（Markdown）は Phase 3 と同じく `01_DECISIONS/ai-music/` へ

## 関連skill（双方向リンク）
- `make-song` — 汎用作曲エンジン（テーマ修飾: 武将/サイバー和 等）。Phase 4 ルートA で楽曲を先に作る際に起動。make-song Phase 6 から本スキルへ橋渡し（ルートA一気通貫）
- `reverse-engineer-song` — 音楽再現（音楽+画像+動画の3モダリティ）。本スキルの映像のみ版。Phase 4で相互呼び出し可能
- `remove-huadian` — 花鈿（眉間の赤点）除去。Phase 5 画像生成後に自動呼出
- `sangoku-song` / `cyber-wa-song` — （旧スキル・参照用）楽曲制作ウィザード。テーマ別タイムライン・画風の知見は `references/映像タイムライン_テーマ別.md` に統合済

