# Cinematic Video Prompts

> 실사 영상 생성 프롬프트를 8개 브리프 질문으로 설계하고 작성하거나 수정한다. 인물 참조, 시간순 숏, 행동, 카메라와 렌즈 질감, 전환, 음향, 연속성을 통합하고 각 프롬프트 작성 전에 한국어로 연출 내용을 설명한다. TVCF, 폰카, 드라마, 패션 영상 등 구체적인 촬영 연출이 필요한 영상 프롬프트에 사용한다. 단순 이미지 생성이나 영상의 내용 요약에는 적용하지 않는다.

- Skill: `9mr-arch/cinematic-video-prompts` (Agent Skill, multi-file: 2 files)
- Install (CLI): `npx skillmds@latest add 9mr-arch/cinematic-video-prompts`
- Raw SKILL.md: https://api.skillmd.com/api/skills/9mr-arch/cinematic-video-prompts/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: Coding & Dev Tools
- Author: 9mr-arch (https://skillmd.com/u/9mr-arch)
- Updated: 2026-09-22
- Page: https://skillmd.com/skills/9mr-arch/cinematic-video-prompts

---


# Cinematic Video Prompts

## 목적과 범위

사용자의 이야기와 특별 요청을 촬영·편집 가능한 영상 프롬프트로 변환한다.
공통 골격은 유지하되 예시의 장면 수, 러닝타임, 의상, 카메라 회전, 대사 유무를 기본 규칙으로 고정하지 않는다.

이 스킬은 연출 구조를 담당한다. 생성 도구가 지정되면 해당 도구의 사용 가능한 전용 스킬과 공식 지침으로 참조 표기와 지원 설정을 확인한다. 확인되지 않은 모델 제한이나 장비 사양을 단정하지 않는다. 프롬프트 작성 요청만으로 실제 영상 생성이나 크레딧 사용을 실행하지 않는다.

## 1. 브리프 수집: 사용자가 정한 8개 질문

기존 대화와 첨부 자료에서 답한 내용은 재사용하고, 빠진 항목만 묻는다. 아래 순서와 취지를 유지하되 불필요한 설문 반복을 피한다. 미정인 항목에는 내용에 맞는 안을 제안한다. 이미지·영상 업로드 요청은 일반 대화로 전달한다.

1. **몇 초짜리, 몇 컷짜리 영상을 만들어야 하나요?** 미정이면 내용에 맞춰 제안한다. 여기서 컷 수는 편집점 수가 아니라 최종 숏 수인지 확인해 해석한다.
2. **어떤 컨셉의 영상인가요?** 전달할 이야기와 감정, 분위기, 원하는 마지막 장면을 파악한다.
3. **등장인물은 누구이고 어떤 행동을 하나요?** 인물의 관계, 행동 순서, 감정 변화도 필요한 만큼 파악한다.
4. **참고 이미지나 영상을 모두 올려주세요. 여기서 가져오면 안 되는 데이터도 알려주세요.** 자료별로 가져올 얼굴·체형·의상·배경·구도·움직임과 제외할 요소를 구분한다. 실제 첨부를 확인하지 못했으면 확인했다고 말하지 않는다.
5. **장소와 시간은 어떻나요?** 시간대, 계절, 날씨와 장면별 공간·시간 변화가 필요한지 파악한다.
6. **사운드(대사, BGM, 효과음)는 어떻게 할까요?** 화자, 정확한 대사, 언어, 환경음, 동작과 소리의 동기화, 자막 여부를 필요한 만큼 확인한다.
7. **꼭 지키거나 피해야 할 조건에 대해 알려주세요.** 필수 조건, 금지 조건, 지정 연출을 구분한다. 충돌할 때에만 우선순위를 확인한다.
8. **TVCF용 카메라로 촬영한 느낌인가요? 폰카로 촬영한 느낌인가요?** 원하는 장비나 렌즈, 참고 촬영 질감이 있으면 함께 받는다. 다른 스타일이나 숏별 혼합도 허용하며 둘 중 하나를 강요하지 않는다.

화면 비율과 생성 도구는 대화에서 확인되지 않았고 결과에 영향을 줄 때 추가로 확인하거나 제안한다. 사용자가 렌즈나 편집 용어를 알아야 답할 수 있는 방식으로 질문하지 않는다.

## 1-A. 스타일프레임이 있으면 구도 분석부터 진행

이 절은 사용자가 스타일프레임·룩보드·스토리보드 또는 시각적 연출 기준으로 제시한 이미지에 적용한다. 스타일프레임은 단일 이미지, 여러 개의 개별 이미지, 임의 개수의 패널로 된 합성 이미지일 수 있다. 6패널이나 특정 배열을 기본값으로 두지 않는다. 이하 “프레임”은 개별 참조 화면을 뜻하며, “패널”은 합성 이미지에 실제로 구획이 있을 때만 적용한다. 인물 시트나 제품 도면의 다중 뷰를 자동으로 영상의 컷 구성으로 해석하지 않는다. 사용자의 명시적 요청을 우선하며, 참조가 보여주는 촬영 문법을 관습적인 광고 구성보다 우선한다.

### 참조의 역할과 권한

- 각 자료를 인물 정체성, 제품 형상, 화면 구성, 빛·색·질감, 동작·편집 중 어떤 요소의 기준으로 사용할지 정한다. 하나의 자료가 여러 역할을 가질 수 있다.
- 사용자가 “이런 톤”이라고 말해도 색감만 추출하지 않는다. 이미지에 반복되는 구도, 피사체 크기, 촬영 높이, 크롭, 전경 처리와 포즈까지 확인하고, 이번 작업에 적용할 범위를 짧게 설명한다.
- 실제 첨부에서 이미지 수와 각 이미지의 구획 유무를 먼저 확인한다. 참조 프레임 수와 요청 숏 수는 별개의 값이다. 단일 프레임의 시각 문법을 여러 숏에 적용할 수도 있고, 여러 프레임에서 한 숏의 기준을 종합할 수도 있다. 시퀀스 참조는 확인된 순서에 따라 프레임과 숏을 대응시킨다. 무드보드는 공통 시각 문법을 추출하되 패널 순서를 편집 순서로 단정하지 않는다. 패널 수와 요청 컷 수의 일치는 판단 근거 중 하나이며 단독 확정 근거가 아니다.
- 순서 표기, 사용자의 설명과 패널 간 관계로 의도가 충분하면 진행한다. 읽기 순서만으로 순서를 정했다면 가정임을 밝힌다. 재현과 자유 재구성 중 선택이 결과를 크게 바꾸는데 근거가 없을 때만 한 번 질문한다.
- 충돌은 속성별로 해결한다. 예를 들어 제품 사진은 제품 형상, 인물 시트는 정체성, 스타일프레임은 구도의 기준이 될 수 있다. 이 역할은 실제 사용자 지정에 따라 바뀐다. “제품 사진 우선”을 이유로 스타일프레임의 제품 배치까지 바꾸지 않는다.

### 각 프레임에서 반드시 읽을 것

프롬프트를 쓰기 전에 관련 프레임별로 다음을 짧게 기록한다. 관찰 사실과 새로 제안하는 연출을 구분하고, 보이지 않는 부분을 사실처럼 채우지 않는다.

- 대응 참조: 이미지 번호와, 합성 이미지인 경우에만 패널 위치를 기록한다. 원본에 컷 번호가 있으면 함께 사용한다. 단일 이미지에 없는 패널 번호를 만들지 않는다.
- 화면 구조: 숏 크기, 얼굴·몸·제품의 화면 점유, 좌우 위치, 여백, 프레임 밖으로 잘린 부위.
- 시점과 자세: 카메라 높이, 정면·사선·측면, 얼굴과 몸의 방향, 시선, 손의 진입 방향, 제품 각도와 접촉 상태.
- 깊이와 재질: 전경 흐림, 배경 분리, 초점 대상, 피부·금속·천의 표면 표현.
- 빛과 색: 광원 방향과 부드러움, 하이라이트, 그림자, 배경색과 피부색의 관계.
- 화면을 성립시키는 소품과 자세: 체어, 몸의 기대기, 제품의 기울기, 접지점과 그림자 등.

렌즈 수치나 조명 장비명은 이미지에서 확인된 사실로 단정하지 않는다. 구현을 위한 선택이라면 그렇게 표시한다. 좌우가 불확실하면 인물의 해부학적 좌우보다 화면 기준 좌우와 보이는 귀·코·손 위치로 기술한다.

### 정지 구도를 영상으로 옮기는 규칙

- 먼저 참조 구도를 문장으로 확정하고, 그 구도 안에서 가능한 행동과 카메라 움직임을 추가한다. 참조가 제공한 시작 상태를 존중한다. 이미 볼에 닿은 기기를 다시 들어 올려 접촉시키는 준비 동작을 임의로 만들지 않는다.
- 구도 재현이 중요한 경우에는 작은 움직임을 기본으로 한다. 사용자가 큰 행동을 요청했다면 그 요구를 반영하되 기준 구도가 나타나는 시점을 명시한다. 모든 작업에 미세 움직임을 강제하지 않는다.
- 얼굴을 크게 자른 프레임을 인물 소개용 미디엄으로 바꾸거나, 기대앉은 자세를 똑바로 앉힌 자세로 바꾸거나, 대각선 제품을 눕히는 식의 재해석을 피한다. 새로운 도입 컷·받침대·로고 여백은 필요하거나 요청된 경우에만 추가한다.
- 패널 경계와 라벨은 제외하되, 패널 안의 구도·체어·전경·그림자까지 함께 제거하지 않는다. “스튜디오”는 촬영 환경 조건이지 모든 생활 소품을 지우라는 뜻이 아니다.
- 별도로 연출된 뷰티·제품 컷은 독립적인 포즈로 연결할 수 있다. 얼굴 방향이나 사용하는 볼이 달라졌다고 손과 기기가 얼굴을 가로질러 이동하는 동작을 추가하지 않는다. 사용자가 연속 동작을 요구했을 때는 실제 연속성을 설계한다.
- 비현실적으로 보이는 제품 자세도 시각적 연출일 수 있다. 요청된 실사 톤 안에서 리깅·합성으로 표현할 수 있는지 판단하고, 실루엣을 임의로 바꾸지 않는다. 리깅은 구현 제안이며 원본 촬영 사실로 말하지 않는다.
- 참조 패널과 출력 비율이 다르면 주 피사체의 크기·크롭·상대 위치를 최대한 유지하며 주변 배경을 확장한다. 양립할 수 없는 경우 필요한 구도 변화와 이유를 밝힌다.

### 프롬프트에 대응 관계를 남길 것

각 숏은 “대응 참조 프레임 → 보존할 구도와 시작 상태 → 허용 움직임 → 끝 상태와 컷” 순서로 작성한다. 하나의 참조를 여러 숏에 적용한다면 공통으로 유지할 문법과 숏별로 새로 설계한 부분을 구분한다. “참고 이미지처럼”, “고급스럽게”라는 표현만으로 대체하지 않는다. 다중 패널 이미지를 시퀀스로 사용하기로 정한 경우에만 해당 패널을 전체 화면 숏으로 대응시킨다. 무드보드에는 이 규칙을 강제하지 않는다. 사용자에게 화면 분할 요청이 없으면 참조의 분할 레이아웃 자체가 영상에 전이되지 않도록 적는다.

참조 이미지 지정과 정확한 첫 프레임 지정은 다르다. 프롬프트만으로 구도 고정을 보장하지 않는다. 정확한 재현이 핵심인데 결과가 반복해서 어긋나면 패널을 개별 이미지로 준비하여 숏별로 생성하고 편집하는 방식 등 실제 사용 도구에서 가능한 제어 방법을 제안한다.

## 2. 공통 골격으로 설계

### 제작 목표와 참조 역할

- 러닝타임, 비율, 숏 수, 컨셉과 종료 상태를 정리한다. 시간 구간을 쓰면 합계가 전체 길이와 맞도록 하며 생성 결과의 프레임 단위 정확도를 보장하지 않는다.
- 각 참조에 인물 별칭과 역할을 부여한다. 얼굴 전용 참조와 의상까지 포함하는 참조를 구분한다. 스타일프레임은 1-A절에 따라 분석한다. 제외할 시트 경계·라벨과 보존할 패널 내부 배경·구도를 구별한다.
- 인물·의상·소품·공간·빛·시점별로 계속 유지할 요소와 허용된 변경을 구분한다. 의상 고정과 장면별 교체를 동시에 요구하지 않는다.

### 시간순 숏 설계

각 숏에 필요한 항목을 포함한다: 목표 시간, 서사적 역할, 시작 상태, 공간과 의상, 인물 행동과 감정, 구도와 주요 카메라 이동, 대사·소리, 종료 상태와 다음 숏 연결.

- 감정을 눈에 보이는 행동과 들리는 전달 방식으로 바꾼다. 예: 상대를 본 뒤 말이 잠깐 멈추고 몸이 고요해진다.
- 소품이나 배경 인물은 이야기, 공간 깊이, 전환 등 필요한 역할을 갖게 한다. 핵심 인물보다 주목받지 않아야 한다면 그 위계를 적는다.
- 구도 기준이 있는 숏은 참조의 숏 크기와 크롭을 우선한다. 구도 기준이 없는 숏의 전신·미디엄·클로즈업은 보여줘야 할 정보에 맞춰 선택한다. 의상 전체 공개와 얼굴 공개가 동시에 가능한 카메라 위치인지 확인한다.
- 한 숏의 주요 이동을 명확히 한다. 복합 이동이 필요하면 순서와 목적을 명시하고 짧은 시간에 과도한 동작을 쌓지 않는다.
- 시선 방향, 이동 방향, 인물 거리, 카메라 높이와 축을 연결한다. 오버숄더에서 상대 얼굴이 실제로 보이는지, 1인칭 손잡기 거리에서 구도가 가능한지 검토한다.

### 경계와 편집

- 공간의 장면 단위와 카메라의 숏 단위를 구분한다. 정확히 N숏을 요구하면 기본 편집점은 N-1개이며 숨겨진 추가 인서트도 숏으로 센다.
- 직접 컷, 가림 속 컷, 그래픽 매치 등 요청에 맞는 연결을 선택한다. 모든 영상에 특수 전환을 추가하지 않는다.
- 연속 촬영인지 별도 컷인지 경계마다 명확히 한다. 별도 숏인데 단순히 'continue'라고 써서 합쳐지게 하지 않는다.
- 정교한 전환은 나가는 프레임 상태 → 편집 순간 → 들어오는 프레임 상태로 적는다. 필요한 위치·크기·움직임·소리만 맞춘다.
- 컷 전후 행동이 중복되지 않게 한다. 접촉을 마친 상태로 시작한다면 다시 다가와 접촉하도록 지시하지 않는다.
- 의상이나 시점 변경을 숨겨야 할 때만 가림 조건을 지정한다. 가림 동작이 타격이나 신체 관통으로 오해될 표현을 피한다.

## 3. 8번 답변을 촬영·렌즈 표현으로 변환

장비 이름의 나열보다 화면에 나타날 효과를 먼저 설계한다. 필요한 경우 카메라 계열 또는 모델, 센서 포맷, 렌즈 계열과 초점거리, 촬영 거리, 심도·보케, 초점 운용, 광학 수차, 질감과 색 처리를 서로 일치시킨다.
장비명은 시각적 목표를 위한 참조이며 실제 촬영 메타데이터나 재현 보장이 아니다.

### TVCF 또는 시네마 카메라 느낌

- 사용자가 원하면 ARRI ALEXA 계열 같은 카메라 참조를 사용하되 특정 모델 없이 센서 크기를 단정하지 않고, 어떤 카메라로 찍은 느낌을 선호하는지 문의한다. 정확하게 존재하지 않는다면 자동으로 설정한다.
- 인물과 배경의 분리 정도, 하이라이트의 완만한 변화, 피부색, 카메라 안정성 등을 컨셉에 맞게 구체화한다. TVCF를 무조건 얕은 심도나 강한 그레인으로 해석하지 않는다.
- 초점거리와 촬영 거리를 구도에 맞춘다. 전신 장면에 망원 렌즈를 선택하면 충분한 작업 거리를 확보하고 공간 설정과 맞는지 확인한다.
- 상세한 렌즈 스펙을 원할 때, 렌즈 품목 특성에 맞춘 광학적 구현을 위해 렌즈값, 렌즈 품목을 프롬프트에 넣는다. '100mm Petzval lens' 같은 사용자 요청은 보존하되 모든 숏의 기본 렌즈로 강제하지 않는다.

### 폰카 느낌

- 기본적으로 선택한 스마트폰 카메라에 맞는 넓은 화각, 비교적 깊은 심도, 자동 노출·초점의 반응, 손에 든 움직임, 필요시 계산 사진 특성을 기술한다.
- 얕은 심도는 가까운 촬영 거리, 망원 모듈, 인물·시네마 모드 등의 의도가 있을 때 구분해 표현한다. 스마트폰에도 렌즈·모드 차이가 있으므로 모든 폰카를 한 가지 특성으로 고정하지 않는다.
- 불필요하게 저화질, 심한 흔들림, 초점 헌팅, 과도한 압축을 넣지 않는다. 일상 기록, 깔끔한 UGC, 광고용 폰 촬영 중 컨셉에 맞는 정도를 선택한다.

### 광학과 질감의 공통 원칙

- '풀프레임/크롭 센서'로 정리한다. 풀바디 구도인 전신 촬영과 혼동하지 않는다.
- 센서 크기만으로 보케를 결정하지 않는다. 같은 구도에서의 초점거리·조리개·피사체 거리·배경 거리와 렌즈 특성을 함께 고려한다. 정확한 수치가 필요하지 않으면 효과 중심으로 적는다.
- 포커스 플레이는 무엇에서 무엇으로, 어떤 계기로, 언제 초점을 옮기는지 지정한다. 예: 인물의 발견 순간 전경 소품에서 상대 얼굴로 한 번의 절제된 랙 포커스. 초점 이동이 필요 없는 숏에는 안정된 초점 추적을 쓴다.
- 색수차, 플레어, 비네팅, 주변부 연화는 원하는 광학적 개성에 맞춰 절제해 선택한다. 얼굴의 식별성과 의상 디테일을 훼손하지 않는다.
- 그레인은 렌즈 수차와 구분해 필름 질감 또는 후반 처리로, 센서 노이즈는 촬영 특성으로 다룬다. 그레인·색수차를 모든 프롬프트에 자동 삽입하지 않는다.
- 프롬프트에는 선택한 효과의 강도와 적용 범위를 적는다. 예: shallow depth of field with natural bokeh, subtle edge chromatic aberration, fine restrained film grain. 서로 모순되는 깊은 심도·강한 배경 흐림을 같은 조건에 나열하지 않는다.

## 4. 프롬프트 작성 전 한국어 설명 — 필수 순서

새 프롬프트, 수정본, 복수 대안을 작성할 때마다 해당 프롬프트보다 먼저 한국어로 내용을 설명한다. 내부 추론이 아니라 사용자가 확인할 수 있는 구체적인 연출 요약을 제공한다.

설명에는 다음 중 해당하는 내용을 간결하게 담는다.

- 무엇을 보여주고 어떤 감정과 마지막 상태로 끝낼지.
- 숏의 흐름, 핵심 행동, 인물과 의상·공간의 유지 또는 변경.
- TVCF·폰카 등 선택한 촬영 느낌과 렌즈·심도·보케·초점·질감이 화면에 주는 효과.
- 전환 및 대사·음향의 핵심 타이밍.
- 사용자의 특별 조건을 어느 숏과 규칙에 반영했는지, 미정 사항에 사용한 가정.
- 스타일프레임이 있으면 어떤 참조 프레임을 어떤 숏에 적용했고, 어떤 구도와 질감을 유지하며 무엇만 움직이는지. 필요한 변경은 이유까지 간결하게 밝힌다.

브리프가 충분하면 한국어 설명 후 같은 답변에서 프롬프트를 제공한다. 설명 절차를 불필요한 승인 대기로 바꾸지 않는다. 사용자가 설명 후 검토를 요청했거나 핵심 정보가 없을 때만 해당 답을 기다린다. 이후 사용자가 명시적으로 출력 형식을 변경하면 최신 요청을 따른다.

## 5. 최종 프롬프트와 검수

기본 구성은 제작 목표 → 참조와 인물 → 공간·빛·촬영 질감 → 시간순 숏과 전환 → 음향 → 연속성·필수 제외 조건이다. 짧은 영상에는 필요한 항목을 합친다. 플랫폼의 실제 설정은 프롬프트와 구분하고, 프롬프트 언어는 사용자 요청을 따른다. 대사는 지정된 언어와 문구를 보존한다.

최종 출력 전에 확인한다.

스타일프레임이 있으면 원본 이미지를 보며 각 숏의 시작 상태와 핵심 프레임을 대조한다. 분석문만 다시 읽고 검수를 끝내지 않는다.

- 참조 프레임 수와 요청 숏 수를 혼동하지 않았는가? 참조 대응과 컷 순서가 선택한 참조 역할 및 사용자 요청에 맞는가?
- 얼굴·제품의 화면 점유, 크롭, 시선, 손의 진입 방향, 제품 각도와 접촉 상태를 보존했는가?
- 전경 흐림, 배경 깊이, 빛 방향, 표면 질감 등 핵심 시각 요소가 실행 가능한 문장으로 들어갔는가?
- 행동이나 카메라 이동이 기준 구도를 불필요하게 깨뜨리지는 않는가?
- 색감만 남기고 익숙한 광고 구성으로 바꾸지 않았는가? 요청하지 않은 도입 컷·받침대·로고 여백·준비 동작이 추가되지 않았는가?
- 변경이 있다면 사용자 요청 또는 비율·시간·도구 제약으로 설명 가능한가? 근거 없는 변경은 출력 전에 고친다.

이 검수는 프롬프트와 참조의 대응 검수다. 실제 영상을 생성하지 않았다면 영상의 구도 재현이나 품질을 검증했다고 말하지 않는다.

- 프롬프트를 영어로 출력하고, 한국어로 설명하는 구조 분리를 진행했는가?
- 요구한 숏 수, 전체 시간, 사건 순서, 종료 상태가 일치하는가?
- 대사를 자연스럽게 말하고 동작·감정 반응을 수행할 시간이 있는가? 부족하면 선택 동작을 줄이거나 조정안을 제시하며 필수 대사를 임의 삭제하지 않는다.
- 참조 역할과 인물별 소품 소유가 명확하고, 장면 경계에서 유지·변경 규칙이 충돌하지 않는가?
- 구도와 렌즈·심도·포커스가 의상, 얼굴, 소품 중 반드시 보여야 할 정보를 실제로 드러내는가?
- 전환 전후 위치와 동작이 연결되고 행동·효과음이 반복되지 않는가?
- 특별 요청이 구체적인 실행 지시로 반영됐는가? 검수용 금지문만 있고 이를 실현하는 긍정 지시가 빠지지 않았는가?
- 불필요한 금지문을 줄였는가? 반복은 중요한 실패 방지 조건에만 사용한다.

설명만 요청받으면 구조와 문제점을 설명한다. 작성·수정 요청이면 한국어 사전 설명과 실제 사용 가능한 프롬프트까지 제공한다.

