배울 내용
- 항상 재사용 가능한 5단 구성(피사체, 액션, 배경, 스타일, 카메라)
- 모호한 프롬프트를 정밀하게 다시 쓰는 법 — 전/후 비교 예시 포함
- 부정 지시어(“텍스트 없음, 워터마크 없음”)가 결과를 정리하는 이유
- 추측 없이 샷을 개선하는 ‘한 번에 한 가지 변경’ 반복 루프
모델이 프롬프트를 읽는 방식
텍스트-투-비디오 모델은 사람처럼 이야기를 “이해”하지 않고, 학습한 시각과 당신의 단어를 패턴 매칭합니다. 화면에 무엇이 어떻게 보여야 하는지 구체적으로 묘사할수록 모델의 추측이 줄어들어요. 구체적인 명사, 하나의 분명한 동작, 명시된 카메라 무브는 무드 형용사 나열보다 훨씬 낫습니다.
잘 먹히는 프롬프트 구조
감독처럼 샷을 묘사하세요 — 피사체, 액션, 배경, 스타일, 카메라. 한두 문장으로 명확하게 유지합니다.
- 1피사체: 화면에 누가/무엇이 있는가(“바리스타”, “슬림한 폰”).
- 2액션: 무엇이 일어나는가(“라떼 아트 따르기”, “받침대 위에서 천천히 회전”).
- 3배경: 어디인가(“햇살 드는 스페셜티 카페”, “미니멀 스튜디오, 부드러운 그림자”).
- 4스타일: 룩과 톤(“시네마틱, 얕은 심도, 따뜻한 그레이드”).
- 5카메라: 움직임(“천천히 푸시인”, “오빗”, “정적인 와이드”).
전과 후
모호함: “커피 영상”. 더 나음: “흰 컵에 라떼 아트를 붓는 바리스타의 클로즈업, 나무 카운터 위, 햇살 드는 스페셜티 카페, 시네마틱, 얕은 심도, 천천히 푸시인, 텍스트 없음.” 두 번째 프롬프트는 피사체, 배경, 조명, 렌즈, 모션을 통제해 모델이 만들어낼 것이 훨씬 줄고, 활용 가능한 샷을 얻을 확률이 높아집니다.
원하지 않는 것을 명시하세요
부정 지시어는 결과를 정돈합니다. 고전적인 AI 아티팩트를 피하려면 “텍스트 없음, 워터마크 없음, 로고 없음, 손가락 추가 없음”을 넣으세요. 브랜드 세이프 출력을 원한다면 “제너릭 패키징, 브랜드 로고 없음”을 추가하세요. 짧은 제외 목록이 형용사 몇 개보다 품질에 더 도움이 되는 경우가 많습니다.
과도한 지정 대신 반복 개선
핵심에 집중한 프롬프트로 시작해 생성하고, 한 번에 한 가지만 바꾸세요 — 먼저 조명, 그다음 카메라 무브, 그다음 무드. 한꺼번에 형용사를 열 개 쌓으면 무엇이 효과였는지 알 수 없습니다. 각 생성을 단일 변수를 가진 실험으로 다루세요.
재사용 가능한 ‘하우스 스타일’ 만들기
원하는 룩을 찾았다면 프롬프트의 스타일링 절반을 접미사로 저장해 두세요(예: “시네마틱, 4K, 부드러운 자연광, 얕은 심도”) 그리고 클립 전반에 재사용합니다. 샷마다 피사체와 액션은 바꾸되, 하우스 스타일이 시리즈의 시각적 일관성을 유지해 채널을 의도적으로 보이게 합니다.
빠른 팁
- 가장 중요한 비주얼을 앞에 두세요 — 모델은 프롬프트의 초반을 더 크게 가중합니다.
- 에너지와 템포를 제어하려면 카메라 무브를 명시하세요(“슬로우 팬”, “오빗”, “정지”).
- 모든 클립에서 일관된 룩을 위해 ‘하우스 스타일’ 접미사를 재사용하세요.
- 샷당 하나의 액션 — “들어와서 앉고 말한다”는 장면을 나눠 찍으세요.
- 좋은 샷을 뽑아낸 프롬프트를 모아 스와이프 파일로 보관하고, 재사용·리믹스해요.
자주 묻는 질문
프롬프트 길이는 어느 정도가 좋나요?
한두 문장의 명확한 문장이 보통 단락보다 좋아요. 길이보다 구체성이 중요해요.
같은 프롬프트를 여러 모델에 써도 되나요?
네 — Vivideo에서는 하나의 프롬프트를 다른 모델들(Sora, Veo, Kling 등)에 돌려 비교할 수 있어요.
제 영상이 프롬프트의 일부를 무시하는 이유가 뭔가요?
모델은 앞부분을 우선하고 뒤쪽 세부는 떨어뜨릴 수 있어요. 핵심 요소를 앞쪽으로 옮기거나 다른 씬으로 나눠보세요.
이미지-투-비디오에도 프롬프트가 통하나요?
네 — 입력 이미지가 있으면 프롬프트는 주로 움직임과 카메라를 지시하고, 피사체 자체는 덜 바뀌어요.
샷마다 동일한 캐릭터를 유지하려면 어떻게 하나요?
같은 상세한 피사체 설명을 재사용하거나 아바타/레퍼런스 이미지를 사용해 외형을 안정적으로 유지하세요.










