एआई से वीडियो बनाना दो शब्दावलियों का मेल है — पारंपरिक वीडियो (aspect ratio, resolution, codecs) और जनरेटिव कृत्रिम बुद्धिमत्ता (diffusion, prompts, CFG scale, image-to-video). यह एआई वीडियो शब्दकोश हर टर्म को परिभाषित करता है, ताकि जार्गन आपकी रफ्तार न रोके.
बुनियादी बातों से शुरू करें — aspect ratio, resolution, frame rate — फिर उन एआई-विशिष्ट शब्दों पर जाएँ जो आपके आउटपुट को तय करते हैं: text-to-video, image-to-video, diffusion, lip-sync, avatars और अधिक. हर परिभाषा क्रिएटर के लिए लिखी गई है, शोधकर्ता के लिए नहीं.
किसी टर्म को खोजें या श्रेणी के अनुसार ब्राउज़ करें. हर प्रविष्टि सरल अंग्रेज़ी में है, बिना गणित के, और उन जगहों के लिंक के साथ जहाँ यह अवधारणा वीडियो बनाते समय सच में मायने रखती है.

एआई वीडियो दो क्षेत्रों के संगम पर है—हर एक की अपनी पारिभाषिक शब्दावली: पारंपरिक वीडियो प्रोडक्शन (आस्पेक्ट रेशियो, रेज़ोल्यूशन, फ्रेम रेट, कोडेक, बिटरेट) और जनरेटिव कृत्रिम बुद्धिमत्ता (डिफ्यूज़न, प्रॉम्प्ट्स, CFG स्केल, टेक्स्ट-टू-वीडियो, इमेज-टू-वीडियो, लेटेंट स्पेस)। इस शब्दावली में हर टर्म को सीधी-सादी हिंदी में समझाया गया है, ताकि शब्दावली आपके और तैयार वीडियो के बीच रुकावट न बने।
कुछ टर्म सीधे आउटपुट तय करते हैं। टेक्स्ट-टू-वीडियो और इमेज-टू-वीडियो का फर्क जानने से प्रोजेक्ट की शुरुआत बदलती है; आस्पेक्ट रेशियो और रेज़ोल्यूशन समझने से तय होता है कि वीडियो कहाँ पोस्ट होगा; डिफ्यूज़न और डिनॉइज़िंग समझने से मॉडल के व्यवहार के पीछे का कारण साफ होता है। हर परिभाषा एक क्रिएटर के लिए लिखी गई है जो वीडियो बना रहा है—पेपर पढ़ने वाले शोधकर्ता के लिए नहीं।
इसे रेफरेंस डेस्क की तरह इस्तेमाल करें: जैसे ही कोई टर्म मिले, खोजें, या श्रेणी के हिसाब से ब्राउज़ करें—वीडियो बेसिक्स, एआई कॉन्सेप्ट्स, और एआई-वीडियो स्पेसिफिक्स। हर प्रविष्टि बताती है कि यह अवधारणा असल वर्कफ्लो में कहाँ मायने रखती है, और आप सीधे स्टूडियो में जाकर 30+ मॉडलों पर इसे काम में देख सकते हैं।
एआई वीडियो के हर टर्म की सरल हिंदी डिक्शनरी — वीडियो बेसिक्स जैसे आस्पेक्ट रेशियो और कोडेक से लेकर एआई कॉन्सेप्ट्स जैसे डिफ्यूज़न, प्रॉम्प्ट्स और टेक्स्ट-टू-वीडियो तक। जार्गन को आसान करने के लिए सर्च करें या श्रेणीवार ब्राउज़ करें।
टेक्स्ट-टू-वीडियो लिखित प्रॉम्प्ट से क्लिप बनाता है; इमेज-टू-वीडियो स्थिर फोटो को मोशन में एनिमेट करता है। दोनों की परिभाषाएँ यहाँ हैं, और Vivideo 30+ मॉडलों पर दोनों करता है।
डिफ्यूज़न वह प्रक्रिया है जिसे ज़्यादातर वीडियो मॉडल फुटेज जनरेट करने में उपयोग करते हैं—नॉइज़ से शुरू होकर आपके प्रॉम्प्ट द्वारा निर्देशित साफ़ छवि तक क्रमशः परिष्कृत करना। इसकी पूरी परिभाषा, सरल संदर्भ सहित, शब्दावली में है।
नहीं—बिना थ्योरी समझे भी आप बेहतरीन वीडियो बना सकते हैं। लेकिन कुछ अहम टर्म (आस्पेक्ट रेशियो, टेक्स्ट-टू-वीडियो बनाम इमेज-टू-वीडियो, प्रॉम्प्ट) जानने से आप तेज़ी से बेहतर नतीजे पाते हैं—यही इस शब्दावली का उद्देश्य है।
CFG स्केल नियंत्रित करता है कि मॉडल आपका प्रॉम्प्ट कितना सख्ती से माने या कितना इम्प्रोवाइज़ करे। ऊँचा मान शब्दों से क़रीब रहता है; कम मान अधिक रचनात्मक होता है। यह अनेक टर्म्स में से एक है जिन्हें यहाँ क्रिएटर-फ्रेंडली भाषा में समझाया गया है।
हर परिभाषा यह दिखाती है कि वास्तविक वर्कफ़्लो में वह अवधारणा कहाँ मायने रखती है, और आप इसे सीधे Vivideo पर आज़मा सकते हैं—वन स्टूडियो, 30+ मॉडल, शुरुआत मुफ्त।