Video Analyzer Skill — 视频截帧分析引擎
功能概述
用 ffmpeg 从视频中按时间间隔截取关键帧图片,返回图片路径列表给 AI,AI 通过查看截图来理解和分析视频内容。
核心场景:拆解短视频的制作手法,分析视频是怎么用 AI 工具做的。
工具清单
| 工具 | 说明 |
|---|---|
analyze_video(video_path, interval, max_frames, output_dir) |
截取视频关键帧,返回截图路径和元数据给 AI 分析 |
save_video_analysis(video_path, analysis, topic) |
保存 AI 生成的视频分析报告 |
设计原则
遵循 Tool → AI → Tool 模式:
analyze_video负责截帧 + 提取元数据(IO)- AI 查看截图,理解视频内容(智能)
save_video_analysis保存分析结果(IO)
截帧策略
针对「制作手法分析」优化 — 短视频画面切换快(1-3秒一个画面),需要更密的截帧间隔。
| 视频时长 | 默认间隔 | 设计理由 |
|---|---|---|
| < 15s | 1s | 超短视频,几乎逐秒截取 |
| 15s ~ 60s | 1.5s | 短视频,保证不漏过任何转场 |
| 1min ~ 3min | 3s | 中等视频 |
| 3min ~ 10min | 8s | 长视频 |
| > 10min | 20s | 超长视频 |
最大帧数默认 30,在保证覆盖率的同时不过载 AI 上下文。 超过 max_frames 时自动调大间隔。
元数据提取
通过 ffprobe 提取:
- 时长、分辨率、帧率
- 编码格式、文件大小
- 是否有音频轨道
AI 分析框架
截帧完成后,AI 会按以下框架进行制作手法分析:
- 画面层 — AI生成/实拍/素材库?风格?运动方式?
- 文字/字幕层 — 标题样式、排版、字幕工具
- 音频层 — 真人/AI配音?背景音乐风格?
- 剪辑/转场层 — 转场方式、节奏、结构设计
- 整体结构 — Hook→展开→收尾 的叙事结构
- 制作流程还原 — 推测使用的工具链和制作步骤
输出位置
截图:{video_dir}/frames_{video_name}/frame_{序号}.jpg
分析报告:通过 ItemManager 保存到知识库