Att göra video med AI blandar två vokabulärer — traditionell video (bildförhållande, upplösning, codecs) och generativ AI (diffusion, prompts, CFG-skala, image-to-video). Det här AI-videoglossariet definierar varje term du kommer att möta, så att jargongen slutar bromsa dig.
Börja med grunderna — bildförhållande, upplösning, bildfrekvens — och gå sedan vidare till AI-specifika termer som avgör ditt resultat: text-till-video, image-to-video, diffusion, lip-sync, avatarer och mer. Varje definition är skriven för skapare, inte forskare.
Sök efter en term eller bläddra efter kategori. Varje uppslagsord är på enkel engelska utan matte, och länkar till där konceptet faktiskt spelar roll när du gör en video.

AI-video ligger i skärningen mellan två fält, vart och ett med sin egen jargong: traditionell videoproduktion (bildförhållande, upplösning, bildfrekvens, codecs, bitrate) och generativ AI (diffusion, prompts, CFG-skala, text‑till‑video, bild‑till‑video, latent utrymme). Denna ordlista förklarar varje term du möter, på enkel svenska, så att vokabulären slutar vara ett hinder mellan dig och en färdig video.
Vissa termer styr resultatet direkt. Att kunna skillnaden mellan text‑till‑video och bild‑till‑video ändrar hur du startar ett projekt; att förstå bildförhållande och upplösning avgör var videon kan publiceras; att greppa diffusion och avbrusning avmystifierar varför modeller beter sig som de gör. Varje definition här är skriven för en skapare som gör videor, inte en forskare som läser artiklar.
Använd den som en uppslagsbok: sök efter en term i samma stund du stöter på den, eller bläddra per kategori — videogrunder, AI‑koncept och AI‑videospecifikt. Varje uppslag kopplar begreppet till var det spelar roll i praktiken, och du kan hoppa direkt in i studion för att se det i aktion över 30+ modeller.
Ett lättbegripligt lexikon över alla termer inom AI‑video — från videogrunder som bildförhållande och codec till AI‑koncept som diffusion, prompts och text‑till‑video. Sök eller bläddra per kategori för att avmystifiera jargongen.
Text‑till‑video skapar ett klipp från en skriven prompt; bild‑till‑video animerar ett stillfoto till rörelse. Båda definieras här, och Vivideo gör båda över 30+ modeller.
Diffusion är processen de flesta videomodeller använder för att generera material — den startar från brus och förfinar det stegvis till en tydlig bild styrd av din prompt. Den fulla definitionen, med enkel kontext, finns i ordlistan.
Nej — du kan göra fantastiska videor utan teorin. Men att kunna några nyckeltermer (bildförhållande, text‑till‑video vs bild‑till‑video, prompt) hjälper dig få bättre resultat snabbare, vilket är vad den här ordlistan är till för.
CFG‑skala styr hur strikt en modell följer din prompt jämfört med att improvisera. Högre håller sig närmare orden; lägre är mer kreativt. Det är en av många termer som definieras här med skaparfokuserat språk.
Varje definition länkar till var begreppet spelar roll i ett verkligt arbetsflöde, och du kan prova det direkt på Vivideo — en studio, 30+ modeller, gratis att börja.