Bạn sẽ học được gì
- Cấu trúc prompt 5 phần (chủ thể, hành động, bối cảnh, phong cách, camera) có thể tái dùng mỗi lần
- Cách viết lại prompt mơ hồ thành prompt chính xác — kèm ví dụ trước/sau
- Vì sao các chỉ dẫn phủ định (“không chữ, không watermark”) làm sạch kết quả
- Vòng lặp lặp thử từng thay đổi một, cải thiện cảnh quay mà không mò mẫm
Mô hình đọc prompt của bạn như thế nào
Một mô hình text-to-video không “hiểu” câu chuyện như con người — nó so khớp mẫu giữa từ ngữ và hình ảnh đã học. Bạn mô tả càng cụ thể những gì xuất hiện trên màn hình và cách camera hoạt động, nó càng ít phải đoán. Danh từ cụ thể, một hành động rõ ràng, và một chuyển động camera được nêu tên sẽ hiệu quả hơn một đống tính từ diễn tả tâm trạng.
Một cấu trúc prompt hiệu quả
Mô tả cảnh quay như một đạo diễn — chủ thể, hành động, bối cảnh, phong cách và camera. Giữ trong một đến hai câu rõ ràng.
- 1Chủ thể: ai hoặc cái gì ở trong khung hình (“a barista”, “a sleek phone”).
- 2Hành động: chuyện gì xảy ra (“pours latte art”, “rotates slowly on a pedestal”).
- 3Bối cảnh: ở đâu (“sunlit specialty café”, “minimal studio, soft shadows”).
- 4Phong cách: diện mạo (“cinematic, shallow depth of field, warm grade”).
- 5Camera: chuyển động (“slow push-in”, “orbit”, “static wide”).
Trước và sau
Mơ hồ: “a coffee video”. Tốt hơn: “Close-up of a barista pouring latte art into a white cup on a wooden counter, sunlit specialty café, cinematic, shallow depth of field, slow push-in, no text.” Prompt thứ hai kiểm soát chủ thể, bối cảnh, ánh sáng, ống kính và chuyển động — nên mô hình ít phải tự bịa hơn, và bạn thường nhận được cảnh quay dùng được.
Hãy nói điều bạn không muốn
Chỉ dẫn phủ định giúp làm sạch kết quả. Thêm “no text, no watermark, no logos, no extra fingers” để tránh các lỗi kinh điển của AI. Để đầu ra an toàn thương hiệu, thêm “generic packaging, no brand logos”. Một danh sách loại trừ ngắn thường cải thiện chất lượng nhiều hơn là thêm một tính từ nữa.
Lặp thử, đừng đặc tả quá mức
Bắt đầu với một prompt tập trung, tạo video, rồi mỗi lần chỉ thay đổi một thứ — ánh sáng, rồi chuyển động camera, rồi tâm trạng. Chồng chất mười tính từ cùng lúc khiến bạn không thể biết điều gì thực sự giúp ích. Xem mỗi lần tạo là một thí nghiệm với một biến duy nhất.
Xây dựng “phong cách nhà” có thể tái dùng
Khi tìm được phong cách ưng ý, hãy lưu nửa “định kiểu” của prompt như một hậu tố (ví dụ: “cinematic, 4K, soft natural light, shallow depth of field”) và tái sử dụng cho nhiều clip. Bạn thay đổi chủ thể và hành động theo từng cảnh, nhưng phong cách nhà giữ cho cả series nhất quán về mặt thị giác — đó là điều khiến một kênh trông có chủ đích.
Mẹo nhanh
- Đưa yếu tố hình ảnh quan trọng nhất lên đầu — mô hình thường ưu tiên phần đầu prompt.
- Nêu tên chuyển động camera (“slow pan”, “orbit”, “static”) để kiểm soát nhịp độ và năng lượng.
- Tái dùng hậu tố “phong cách nhà” để có diện mạo nhất quán trên mọi clip.
- Mỗi cảnh một hành động — tách “đi vào rồi ngồi xuống rồi nói chuyện” thành các phân cảnh riêng.
- Giữ một “swipe file” các prompt đã tạo ra cảnh quay xuất sắc; tái sử dụng và phối lại chúng.
Câu hỏi thường gặp
Một prompt nên dài bao nhiêu?
Một đến hai câu rõ ràng thường hiệu quả hơn cả đoạn văn. Hãy cụ thể, không cần dài.
Tôi có thể dùng cùng một prompt trên nhiều model không?
Có — trên Vivideo bạn có thể chạy một prompt qua nhiều model (Sora, Veo, Kling và hơn thế nữa) để so sánh.
Vì sao video của tôi bỏ qua một phần prompt?
Các model ưu tiên phần đầu và có thể bỏ sót chi tiết phía sau. Hãy đưa yếu tố chính lên sớm hơn, hoặc tách nó thành một cảnh khác.
Prompt có hoạt động cho image-to-video không?
Có — khi có ảnh đầu vào, prompt chủ yếu điều hướng chuyển động và máy quay, không phải chủ thể.
Làm sao giữ nhân vật nhất quán giữa các cảnh quay?
Tái sử dụng cùng mô tả chủ thể chi tiết, hoặc dùng avatar/ảnh tham chiếu để giữ diện mạo ổn định.










