Det här lär du dig
- En femdelad promptstruktur (motiv, handling, miljö, stil, kamera) du kan återanvända varje gång
- Hur man skriver om en vag prompt till en precis — med före/efter-exempel
- Varför negativa signaler (”ingen text, ingen vattenstämpel”) städar upp dina resultat
- En iterationsloop med en ändring i taget som förbättrar bilder utan gissningar
Hur modeller läser din prompt
En text-till-video-modell ”förstår” inte en berättelse som en människa — den mönstermatchar dina ord mot visuella exempel den lärt sig. Ju mer konkret du beskriver vad som ska synas och hur kameran ska bete sig, desto mindre behöver den gissa. Konkreta substantiv, en tydlig handling och en namngiven kamerarörelse slår en hög med stämningsadjektiv.
En promptstruktur som fungerar
Beskriv tagningen som en regissör — motiv, handling, miljö, stil och kamera. Håll det till en eller två tydliga meningar.
- 1Motiv: vem eller vad syns i bild (”en barista”, ”en slimmad telefon”).
- 2Handling: vad händer (”häller latte art”, ”roterar långsamt på en piedestal”).
- 3Miljö: var (”solbelyst specialkaffebar”, ”minimal studio, mjuka skuggor”).
- 4Stil: utseendet (”cinematisk, kort skärpedjup, varm färgkorrigering”).
- 5Kamera: rörelsen (”långsam inåkning”, ”orbit”, ”statisk vid”).
Före och efter
Vagt: ”en kaffevideo”. Bättre: ”Närbild på en barista som häller latte art i en vit kopp på en disk i trä, solbelyst specialkaffebar, cinematisk, kort skärpedjup, långsam inåkning, ingen text.” Den andra prompten styr motiv, miljö, ljus, objektiv och rörelse — så modellen har mycket mindre att hitta på, och du får oftare en användbar tagning.
Säg vad du inte vill ha
Negativa signaler städar upp resultaten. Lägg till ”ingen text, ingen vattenstämpel, inga logotyper, inga extra fingrar” för att undvika klassiska AI-artefakter. För varumärkessäkert material, lägg till ”generisk förpackning, inga varumärkeslogotyper”. En kort exkluderingslista gör ofta mer för kvaliteten än ytterligare ett adjektiv.
Iterera, överdetaljera inte
Börja med en fokuserad prompt, generera, och ändra sedan en sak i taget — först ljuset, sedan kamerarörelsen, sedan känslan. Att stapla tio adjektiv på en gång gör det omöjligt att veta vad som faktiskt hjälpte. Behandla varje generering som ett experiment med en enda variabel.
Bygg en återanvändbar ”husstil”
När du hittar ett utseende du gillar, spara stilhalvan av prompten som ett suffix (t.ex. ”cinematisk, 4K, mjukt naturligt ljus, kort skärpedjup”) och återanvänd den i flera klipp. Du byter motiv och handling per tagning, men husstilen håller en serie visuellt sammanhängande — vilket får en kanal att se genomtänkt ut.
Snabba tips
- Börja med det viktigaste visuella — modeller viktar början av prompten tyngre.
- Namnge kamerarörelsen (”långsam panorering”, ”orbit”, ”statisk”) för att styra energi och tempo.
- Återanvänd ett ”husstils”-suffix för ett enhetligt utseende i varje klipp.
- En handling per tagning — dela upp ”går in och sätter sig och pratar” i separata scener.
- Spara en samling prompts som gav bra klipp; återanvänd och remix dem.
Vanliga frågor
Hur lång bör en prompt vara?
En eller två tydliga meningar slår oftast ett stycke. Var specifik, inte lång.
Kan jag använda samma prompt i olika modeller?
Ja — på Vivideo kan du köra en prompt genom olika modeller (Sora, Veo, Kling och fler) och jämföra.
Varför ignorerar min video en del av prompten?
Modeller prioriterar början och kan tappa senare detaljer. Flytta nyckelelementet tidigare, eller dela upp det i en annan scen.
Funkar prompts även för image-to-video?
Ja — med en inmatad bild styr prompten främst rörelse och kamera, inte motivet.
Hur behåller jag en konsekvent karaktär mellan klipp?
Återanvänd samma detaljerade motivbeskrivning, eller använd en avatar/referensbild så utseendet förblir stabilt.










