# 텍스트 투 비디오 프롬프트 예시: 즉시 사용 가능한 가이드

URL: https://polymorf.me/ko/journal/text-to-video-prompt-examples-ko
Type: blog
Locale: ko
Published: 2026-10-03
Updated: 2026-10-03

---

> 텍스트 투 비디오 프롬프트는 같은 골격을 따릅니다: 카메라 움직임, 장면, 하나의 액션, 세부사항. 이 가이드는 훅, 상품 샷, B-롤, 교육 클립용 복사 가능한 예시를 제공합니다.

텍스트 투 비디오 프롬프트 예시들은 모두 같은 골격을 따릅니다. 카메라 움직임, 장면, 하나의 액션, 세부사항. 이 텍스트 투 비디오 프롬프트 예시 가이드는 5초에서 10초 안에 즉시 복사해서 쓸 수 있는 템플릿을 제공합니다. 훅, 상품 샷, B-롤, 말하는 인트로, 교육 클립용 실제 프롬프트와 스켈레톤을 배우고, 매번 한 가지 요소만 바꿔서 반복하세요.

## 대부분의 텍스트 투 비디오 프롬프트가 흐릿하게 나오는 이유는?

무드보드처럼 읽히기 때문입니다. "에픽한 시네마틱 걸작, 8K, 극도로 상세한"은 모델이 움직일 수 있는 것들에 대해 아무것도 알려주지 않습니다. 비디오 모델에는 물리학이 필요합니다. 누가 무엇을 하고 있는지, 어디서 하고 있는지, 카메라는 어떻게 움직이는지.

Runway의 공식 프롬프팅 가이드에 따르면 이를 네 가지로 정리할 수 있습니다: [카메라 움직임, 장면, 액션, 세부사항](https://runway.com/resources/ai-video-prompting-guide). 클립 하나에 액션은 하나입니다. Kling의 가이드도 비슷한 결론에 도달합니다: [주체, 액션, 배경, 카메라 언어, 조명과 무드](https://kling.ai/blog/kling-ai-prompt-guide).

치명적인 습관은 두 가지입니다. 하나의 프롬프트에 다섯 가지 액션을 집어넣는 것, 그리고 마치 모델이 타임라인을 가지고 있는 것처럼 "그 다음"이라는 말을 쓰는 것. 그렇지 않습니다. 매 생성마다 하나의 비트만 나옵니다.

![Storyboard of four blank frames on a desk with a pencil and a toy camera dolly](https://fdzlnqpwsaniezitwiuw.supabase.co/storage/v1/object/public/cms-media/polymorf/2026-10/7536dc-i1.webp)

## 모든 모델에서 통하는 프롬프트 골격은?

단어를 늘리지 마세요. 샷이 명확해질 때까지만. 이 순서를 지키세요:

> [샷과 카메라 움직임]. [장면과 배경]. [주체가 하나의 액션]. [조명, 렌즈, 무드].

약한 것부터 쓸 만한 것까지, 같은 생각을 세 번 표현하겠습니다.

**약함:** "카페에 있는 아름다운 영상의 젊은 여성."

**나음:** "햇빛이 나는 카페에서 젊은 여성이 라떼를 들어 입술에 가져간다."

**촬영 준비 완료:** "중거리 샷에서 클로즈업으로 천천히 줌인. 햇빛이 들어오는 카페 모서리, 세라믹 컵에서 수증기가 올라온다. 크림색 울 스웨터를 입은 젊은 여성이 컵을 들어 희미한 미소를 짓는다. 얕은 심도, 부드러운 황금색 아침 빛, 차분한 따뜻한 톤."

세 번째 버전이 카메라, 액션, 조명을 지정합니다. 모델이 추측해야 할 느낌은 없습니다. 프로덕션 규모는 여기서 시작합니다. 재사용할 수 있는 프롬프트는 슬롯을 가진 프롬프트입니다.

## 소셜 훅과 광고 스타일 클립에 어떤 예시가 먹히나요?

짧고, 임팩트 있고, 한 가지 아이디어. 세로 프레이밍은 희망에 담아서가 아니라 프롬프트에 담아야 합니다. 이들은 9:16 형식과 5초에서 8초를 염두에 두고 썼습니다.

> 자정의 어수선한 책상으로 빠르게 팬. 노트북 화면이 빛나고, 서류가 흩어져 있고, 식은 커피. 손이 노트북을 내려쳤다가 멈춘다. 핸드헬드, 가혹한 오버헤드 조명, 9:16 세로.

> 고정된 매크로 샷. 잉크 한 방울이 맑은 물로 떨어져 나선으로 핀다. 슬로우 모션, 검은 배경, 스튜디오 조명, 핀 부분에 샤프한 포커스.

> 새벽의 젖은 포장도로를 따라 달리는 선수의 신발을 옆에서 찍는 로우앵글 트래킹 샷. 발목 높이의 안개, 사라지는 가로등. 부드럽고 안정된 움직임, 차가운 파란 빛.

정기적으로 올리는 크리에이터들을 위한 두 가지 더. 둘 다 얼굴 없는 채널용입니다:

> 어두운 도서관 통로를 천천히 앞으로 이동. 높은 창에서 들어오는 빛 한 줄기에 먼지가 떠다닌다. 가죽 책이 선반에서 떨어져 열린 책상 위에 떨어진다. 따뜻한 텅스텐 톤, 16:9.

> 책상 위의 노트북에서 시작해서 창을 통해 파란 시간대의 도시 스카이라인으로 드론처럼 올라간다. 머그잔이 키보드 옆에 있고, 화면이 부드러운 빛을 비친다. 차분하고 안정된, 다큐멘터리 느낌.

패턴: 모델이 그릴 수 있는 동사, 모델이 유지할 수 있는 질감(젖은 포장도로, 잉크, 유리), 주체를 방해하지 않는 카메라 동작. 화면 텍스트는 건너뛰세요. 생성된 비디오 속 텍스트는 대부분 모델에서 여전히 밀리고 깨져서, 편집기에서 자막을 추가하세요.

## 상품 샷과 B-롤은 어떻게 프롬프트하나요?

상품 작업은 절제를 상으로 합니다. 다른 움직임이 적을 때 모델이 형태와 조명을 잘 유지합니다.

> 수증기가 올라오는 세라믹 커피 컵으로 천천히 줌인, 조용한 부엌 아침, 얕은 심도, 왼쪽에서 들어오는 부드러운 창빛.

> 오버헤드 샷. 두 손이 옅은 오크 테이블 위에 무광 검은색 스피커를 언박싱한다. 뚜껑이 떨어지고, 티슈 종이가 내려앉는다. 중립적인 톤, 확산된 조명, 카메라 흔들림 없음.

> 벨벳 받침대 위의 향수병 주위를 도는 샷. 유리 모서리를 따라 빛이 번진다. 천천하고 균일한 회전, 어두운 배경, 표면의 미묘한 반사.

![Miniature camera on a slider rail pushing in toward a steaming latte cup on a model cafe set](https://fdzlnqpwsaniezitwiuw.supabase.co/storage/v1/object/public/cms-media/polymorf/2026-10/675637-i2.webp)

B-롤의 경우, 에스탈리싱, 디테일, 커팅어웨이로 생각하세요. 종류당 하나의 프롬프트:

- 
에스탈리싱: "황금시간에 해안 도시 위로 올라가는 드론 와이드 샷, 항구에 배들이 있다."

- 
디테일: "백라이트 키보드에 타이핑하는 손가락의 극도 클로즈업, 얕은 포커스."

- 
커팅어웨이: "빈 광장을 가로지르는 자전거 타는 사람의 미디엄 샷, 카메라 정적, 긴 그림자."

각각 세 가지씩 생성하면 행운 한 번이 아니라 시퀀스가 됩니다. 그것이 라이브러리를 만드는 방법이기도 합니다. 우승작을 샷 종류로 태그하고 골격을 재사용하세요.

### 교육 및 설명 클립은 어떻게 프롬프트하나요?

L&D와 설명 작업은 대부분 일러스트레이션입니다. 프로세스, 장소, 비포/애프터. 프롬프트의 일은 한 가지 아이디어를 보여주는 것이라서 보이스오버가 나머지를 할 수 있게 하는 것입니다.

> 웨어하우스 워커가 핸드헬드 스캐너로 상자를 스캔하고 선반에 놓는 정적 미디엄 샷. 밝고 균일한 산업 조명, 깨끗한 바닥, 프레임에 다른 움직임 없음.

> 화이트보드 위의 스티키 노트를 세 개 열로 배치하는 손의 톱다운 샷. 노트는 빈 상태, 색깔은 노랑, 파랑, 분홍. 정적 카메라, 부드러운 자연광, 얕은 그림자.

> 오전 9시의 정리된 오픈플랜 사무실의 느린 팬, 책상은 반쯤 찼고, 모니터는 일반 대시보드를 보여준다. 자연광, 중립 팔레트, 차분한 속도.

눈에 띄는 것은 빠진 것입니다: 로고, 읽을 수 있는 화면, 간판, 이름. 보는 사람이 읽어야 할 것은 모두 포스트에 추가되어야 하는데, 거기서 당신이 철자를 제어합니다. 40모듈 시리즈의 경우, 이것이 가장 저렴한 습관입니다. 각 프롬프트를 재사용 가능한 장면 카드로 쓰고, 그것이 섬기는 모듈로 태그하면, 일반 "사무실" 샷을 두 번 생성할 일이 절대 없습니다.

## 말하는 사람이 있을 때 프롬프트는 뭐가 달라지나요?

음성이 있는 텍스트 투 비디오 프롬프트 예시들이 모델에 따라 갈라지는 지점입니다. 일부 최신 모델은 동기화된 오디오와 입술 움직임을 생성합니다. 다른 것들은 무음 클립과 몇 초 후 표류하는 얼굴을 줍니다.

당신의 모델이 음성을 지원한다면, 문자 그대로 짧게:

> 미디엄 클로즈업, 정적 카메라. 부엌 테이블에 앉은 여성이 렌즈로 돌아서서 말한다: "세 개의 프롬프트, 십 분, 완성된 클립 하나." 자연 창빛, 얕은 포커스. 자막 없음.

작동하는 경우: 한 명의 말하는 사람, 한 줄, 한 장소, 10초 미만. 깨지는 경우: 긴 독백, 두 명이 주고받는 대사, 이름과 브랜드 단어, 같은 얼굴이 다섯 번의 분리된 생성을 견뎌내야 하는 뭐든지.

마지막 것이 생각보다 중요합니다. 클립 전체에서 일관성은 텍스트 비디오의 진짜 세금입니다. 당신의 시리즈가 40개 모듈 동안 같은 발표자가 필요하다면, 프롬프트는 얼굴을 위한 잘못된 도구입니다. 텍스트 투 비디오로 장면과 B-롤을 생성하고, 아바타 파이프라인이 음성을 담당하게 하세요. 스크립트 입력, 아바타 출력, 장면은 그 주변에 편집합니다.

## 완전히 피해야 할 프롬프트 실수는?

의견입니다. 오늘 버릴 가치가 있는 습관입니다.

- 
**네거티브 프롬프트.** Runway의 가이드는 긍정 표현을 사용하는 것입니다. "카메라 흔들림 없음"은 프레임에 흔들림을 집어넣는 경향이 있습니다. 대신 "부드럽고 안정적인 카메라 움직임."이라고 쓰세요.

- 
**품질 주문.** "걸작, 8K, 상을 받은"은 토큰을 더하지만, 제어는 더하지 않습니다.

- 
**추상적인 감정.** "고독감"은 모델에 퍼즐을 줍니다. "남자가 벤치에 혼자 앉아 있고, 코트가 빗에 젖어 있고, 카메라가 천천히 물러난다"는 샷을 줍니다.

- 
**동시의 두 개 카메라 움직임.** 하나의 주 움직임을 고르세요. 줌인 또는 팬 왼쪽, 팬, 틸트, 궤도 함께는 아닙니다.

작동하는 곳: 짧은 클립, 단순한 움직임, 구체적인 명사. 꼬이는 곳: 군중, 세심한 작업을 하는 손, 읽을 수 있는 텍스트, 물과 천처럼 물리학이 무거운 프레임.

### 모델 전체에서 하나의 프롬프트를 어떻게 적응시키나요?

골격은 여행합니다. 어휘는 완벽히 여행하지 않습니다. 크레딧을 소모하기 전에 알 가치가 있는 세 가지 조정입니다.

- 
**Kling:** 카메라 언어, 멀티샷 스크립팅, 주체 참조에 몸을 싣습니다. 액션을 묻는 너무 긴 프롬프트를 조심하세요.

- 
**Veo:** 장면 세부사항과 오디오 또는 대사 큐에 몸을 싣습니다. 긴 음성과 브랜드 이름을 조심하세요.

- 
**Runway:** 단순한 움직임 프롬프트와 기본 이미지로부터의 반복에 몸을 싣습니다. 입력 이미지가 이미 보여주는 것을 재설명하는 것을 조심하세요.

Runway의 가이드는 여기서 명시합니다. 이미지에서 시작할 때, 움직임을 설명하세요, 이미지를 설명하지 마세요. 이미지의 내용을 세부 사항으로 반복하는 것은 움직임을 줄일 수 있습니다. Kling의 가이드는 당신을 클립보다 샷으로 생각하도록 밀어붙입니다. 이는 위의 한 액션 규칙과 같은 본능입니다.

## 이 프롬프트들은 어디서 실행하고, 어떻게 반복하나요?

로고가 아니라 일을 위해 모델을 고르세요. Kling과 Veo는 카메라 언어와, 버전에 따라 네이티브 오디오를 처리합니다. Runway는 반복과 편집 도구에 강합니다. Higgsfield는 한 작업공간에서 여러 비디오 모델을 묶어서, 다섯 개 로그인 없이 한 프롬프트를 두 개 이상의 엔진에 대해 테스트하고 싶을 때 도움이 됩니다.

같은 골격 프롬프트를 두 모델에 실행하세요. 하나의 요소만 바꾸세요: 카메라 움직임, 조명, 또는 동사. 각 변화가 뭘 했는지 기록하세요. 열 번 실행 후에 당신이 가진 것은 집 스타일이고, 집 스타일은 목록을 포함해서 어떤 예시보다 가치가 있습니다.

![Laptop with two video timelines beside a studio microphone and ring light on a creator desk](https://fdzlnqpwsaniezitwiuw.supabase.co/storage/v1/object/public/cms-media/polymorf/2026-10/8da013-i3.webp)

## 이번 주에 이 프롬프트들로 실제로 뭘 할까요?

이미 가지고 있는 스크립트 하나를 집으세요. 여섯 개 비트로 쪼개세요. 골격을 사용해서 비트당 하나의 프롬프트를 쓰세요: 카메라, 장면, 하나의 액션, 세부사항. 각각 세 가지를 생성하고, 최고를 유지하고, 보이스오버로 편집하세요. 작품이 말하는 얼굴이 필요하면, 그 비트들을 위해 아바타를 가져오세요. 모델과 일관성을 위해 싸우는 대신.

한 오후 안에 대체 편집본이 생깁니다. 생존한 프롬프트들은 샷 종류와 함께 공유 문서에 들어갑니다. 다음 비디오는 빈 상자가 아닌 그 문서에서 시작합니다.

## FAQ

### 좋은 텍스트 투 비디오 프롬프트란 무엇입니까?

좋은 프롬프트는 카메라 움직임, 장면, 하나의 명확한 액션, 그리고 조명이나 무드를 그 순서로 명시합니다. 모델이 렌더링할 수 있는 물리적 움직임을 설명하고, 추상적인 감정이 아니라, 5~10초의 단일 비트에 맞습니다.

### 텍스트 투 비디오 프롬프트는 얼마나 길어야 합니까?

샷을 명확히 할 정도로 길되, 명확함을 유지할 정도로 짧으세요. 보통 2~4문장이 작동합니다. 간단하게 시작해서 움직임이 작동하는지 확인한 후, 한 번에 세부사항을 하나씩 추가하세요.

### AI 비디오에서 네거티브 프롬프트를 사용해야 합니까?

대부분 아닙니다. Runway의 가이드는 긍정적 표현을 선호합니다. 제거하고 싶은 것을 명시하면 프레임에 들어갈 수 있기 때문입니다. '카메라 흔들림 없음' 대신 '부드럽고 안정적인 카메라 움직임'이라고 쓰세요.

### 텍스트 투 비디오가 음성과 립싱크를 생성할 수 있습니까?

일부 최신 모델은 짧은 대사에 대해 동기화된 오디오와 입술 움직임을 생성합니다. 결과는 한 명의 화자와 한 줄의 짧은 대사에서만 유지됩니다. 긴 스크립트나 반복적인 발표자의 경우, 아바타 파이프라인이 더 일관됩니다.

### 같은 프롬프트를 매번 실행하면 왜 다르게 나옵니까?

생성은 확률적이므로 매번 변합니다. 할 수 있는 것들을 고정하세요: 구체적인 명사 사용, 카메라 움직임 하나, 그리고 모델이 지원하는 경우 참고 이미지. 그 다음 여러 번 생성해서 최고의 것을 유지하세요.

### 프롬프트 테스트에 가장 좋은 AI 비디오 모델은?

단 하나의 우승자는 없습니다. Kling, Veo, Runway는 각각 카메라 언어를 조금씩 다르게 해석합니다. 같은 스켈레톤 프롬프트를 두 모델에서 실행해서 비교하고, 한 번에 하나의 요소만 바꾸세요.