I tre år har hver AI‑videomodel givet dig omtrent det samme: et smukt femsekunders klip, der slutter lige når det bliver interessant. Hele håndværket omkring AI‑video er bygget op omkring den begrænsning — storyboard i beats, generér i fragmenter, sy sammen i klipningen, og kryds fingre for, at karakterens jakke har samme farve i skud fire som i skud et.
Seedance 2.5, ByteDance’s nyeste videomodel, er den første bredt tilgængelige udgivelse, der angriber selve begrænsningen i stedet for pixlerne. Den genererer fulde 30 sekunder i ét enkelt gennemløb — ingen sammensyning, ingen scene-klip-splicing, ingen sømme at skjule. Den ene ændring spreder sig til alt andet: hvordan du prompt’er, hvordan du budgetterer, og hvor meget af din klippetid der overlever.
Dette indlæg handler om, hvad der faktisk er ændret, hvor den er ægte bedre, og — lige så vigtigt — de to steder, hvor den er dårligere end det, du allerede bruger.
Vigtigste pointer
- Seedance 2.5 genererer 30 sammenhængende sekunder i ét gennemløb og holder karakteridentitet, lys og fysik gennem hele klippet.
- Lyd genereres sammen med billedet i stedet for at blive dubbet bagefter, så lip sync og timing af impacts lander på den rigtige frame.
- Reference-til-video accepterer op til 50 multimodale input, hvilket flytter konsistens fra en prompt‑trick til et leveret input.
- Der er reelle trade‑offs: output topper ved 720p, og prisen pr. sekund er premium — brug en 4K‑model til hero‑shots.
Hvad Seedance 2.5 egentlig er
Seedance er ByteDance’s videogenereringsfamilie — samme firma som står bag TikTok og CapCut, hvilket siger noget om tempo- og framing-instinkterne, der er indbygget. Seedance 2.5 blev annonceret i juni 2026 på Volcano Engine FORCE‑konferencen og udgivet i slutningen af juli 2026, først i ByteDance’s Dreamina- og Jimeng‑apps, før den nåede API’et.
Den kører tre tilstande: tekst‑til‑video fra en skreven prompt, billede‑til‑video fra et stillbillede og reference‑til‑video, som er den, der er værd at omlægge din arbejdsgang for. Du kan bruge Seedance 2.5 på Vivideo uden en ByteDance‑konto, side om side med 30+ andre modeller på ét abonnement.
De vigtigste specifikationer, lige ud ad landevejen:
- 30 sekunder, genereret nativt i ét gennemløb (en ultralang tilstand går til 180 sekunder, stadig i beta)
- Native lyd, genereret sammen med videoen
- Op til 50 referenceinput — cirka 30 billeder, 10 videoklip og 10 lydfiler
- 480p og 720p output, på billedformater fra biografisk 21:9 til vertikal 9:16
- Omtrent 20% bedre prompt‑efterlevelse end den forrige generation
30‑sekunders‑tingen er hele historien

Det er fristende at læse “30 sekunder” som en kvantitetsopgradering — seks gange mere video pr. generering. Det undervurderer det. Forskellen er kontinuitet, ikke varighed.
Når du syr seks femsekunders klip sammen, håndterer du drift. Ansigtet skifter en smule. Lys-temperaturen vandrer. En hånd bliver til seks fingre i det tredje skud, og du regenererer, hvilket ændrer indramningen, hvilket betyder, at klippet ikke længere matcher. Enhver, der har samlet en 30‑sekunders AI‑reklame, ved, at den reelle omkostning ikke er genereringstiden — det er forsoningsarbejdet bagefter.
Et enkelt 30‑sekunders gennemløb fjerner forsoningen. Identitet, garderobe, lys og fysik besluttes én gang og holdes. Derfor betyder 30 sekunder specifikt noget: det er længden på en standard reklameslot, et komplet produkt‑forklaringsbeat eller en fuld vertikal video. Det er den første varighed, hvor modeludfaldet er leverancen frem for råmateriale til en redigering.
Hvis din nuværende arbejdsgang er bygget op omkring at kæde korte klip, gælder vores guide til at lave AI‑videoer længere end 60 sekunder stadig — du vil bare kæde langt færre, langt længere stykker.
Lyd genereret med billedet, ikke bagefter

De fleste “AI‑video med lyd” er to systemer i en frakke: generér videoen, generér eller dub lyden, og align den. Det fungerer, indtil noget skal ramme en helt præcis frame — et fodtrin, et smæk med en dør, en stavelse.
Seedance 2.5 genererer lyd og visuel side i fællesskab. Praktisk betyder det, at lip sync, impact‑timing og ambient sammenhæng besluttes i samme gennemløb som den bevægelse, der forårsager dem. Det nyttige trick: læg en replik i dobbelte anførselstegn i din prompt, og karakteren leverer den, lip‑synket.
For dialogdrevne formater — testimonials, sketches, explainer‑scener med en oplægsholder — kollapser dette en flertrins‑pipeline til én generering. Du kan stadig lægge AI‑speak, klonede stemmer eller et musikspor ovenpå bagefter, når det kreative kalder på det.
Regnestykket, ingen nævner
Tag en standard 30‑sekunders produktspot. Under den gamle model genererer du seks klip à fem sekunder. Antag en realistisk hitrate på én brugbar take ud af tre — det er 18 genereringer. Derefter bruger du en time i klipningen på at matche farve, klippe på bevægelse og skjule de to overgange, hvor produktets refleksion ændrer sig.
Under en enkelt‑pass‑model er det samme spot én generering. Hitraten er lavere pr. forsøg, fordi mere kan gå galt over 30 sekunder end over fem — lad os kalde det én ud af fire. Det er fire genereringer og ingen forsonings‑redigering.
Færre forsøg er ikke automatisk pointen; forsvindingen af forsoningstrinnet er. Sy‑sammen‑arbejdet var aldrig fakturerbart, aldrig kreativt, og blev aldrig lettere med øvelse.
Multimotiv-bevægelse er dér, den virkelig skinner
Det andet reelle spring i kapabilitet er interaktion. Seedance 2.5 er bygget til at håndtere flere motiver, der påvirker hinanden — sport, dans, kamp, objekter der kolliderer — i stedet for ét motiv foran en baggrund.
Det er netop den type optagelse, der historisk brød sammen hurtigst. To personer der afleverer en bold, kunne give en bold der skifter størrelse, eller hænder der går gennem hinanden, fordi modellen ikke havde en vedvarende forståelse af nogen af kroppene. Over 30 sekunder forstærkes den fejlopførsel; at Seedance 2.5 sigter præcist mod dette, ved netop denne længde, er ikke en tilfældighed.
Den praktiske læsning: hvis dit storyboard har to eller flere ting, der rører ved hinanden, er dette nu en fornuftig model at starte med, ikke en sidste udvej.
Regionsredigering og 180-sekunders beta
To funktioner fylder mindre i overskrifterne, men ændrer, hvordan du itererer.
Regionsredigering lader dig ændre en del af en frame uden at regenerere hele klippet. I et enkelt take på 30 sekunder betyder det enormt meget — i den gamle arbejdsgang betød ét forkert element at kassere hele genereringen og slå terningerne igen. At kunne rette en region, mens du bevarer alt det, du allerede har godkendt, er det, der gør et langt enkelt-take praktisk at iterere på overhovedet.
Ultra-lang tilstand forlænger en enkelt generering til 180 sekunder. Det er beta og bør behandles som sådan: brug den til at udforske, hvad et tre minutters kontinuerligt take muliggør, ikke til at love en kunde en leverance i næste uge.
Halvtreds referencer: konsistens bliver et input

Den stille overskriftsfunktion er reference-til-video. Seedance 2.5 accepterer op til 50 multimodale referencer — billeder, videoklip og lyd — og fastholder dem gennem genereringen.
Det ændrer karakteren af brandkonsistens. Historisk har du promptet dig hen imod konsistens: beskrevet en karakter i manisk detalje og håbet, at modellen konvergerede. Nu leverer du selve tingene. Et produkt fra tre vinkler. En præsenters ansigt. En location. En stemme. Modellen matcher i stedet for at nærme sig.
Til kampagner er dette forskellen mellem "vores skud ser beslægtede ud" og "vores skud ligner samme optagelse". Hvis du har vedligeholdt et promptdokument for at holde en karakter stabil på tværs af en serie, erstatter referencer det meste af det.
Hvad det koster dig
To ærlige trade-offs, fordi begge betyder noget, når du vælger en model til opgaven.
Opløsningen topper ved 720p. Seedance 2.5 leverer 480p og 720p — ikke 1080p og ikke 4K, trods lanceringsdækning som forvekslede den med 2.0-opdateringen. Til social-first arbejde leveret til telefon er 720p som regel fint. Til et hero-shot på en landing page eller alt, der skal på en stor skærm, generér det skud med en 4K-kapabel model som Veo 3.1 i stedet.
Pris pr. sekund er premium. Nativt afregnes Seedance 2.5 pr. sekund output, og 720p koster omtrent det dobbelte af 480p. Tredive sekunder er mange sekunder. Den praktiske arbejdsgang: lav udkast i 480p, til prompten sidder, og gå så all-in på et 720p final pass. På Vivideo er modellen inkluderet i ét abonnement i stedet for at blive målt pr. klip, hvilket fjerner det meste af udkast-angsten.
Seedance 2.5 vs Seedance 2.0: hvornår bruger du hvad
Seedance 2.0 er ikke forældet, og det rigtige valg sparer penge.
Ræk ud efter 2.5, når klippet er leverancen: en 30-sekunders spot, en dialogscene, alt hvor en karakter eller et produkt skal forblive identisk gennem hele klippet, eller hvor lyd skal ramme specifikke frames.
Ræk ud efter 2.0, når du har brug for et kort, slagkraftigt cut med høj bevægelse — en tre-sekunders hook, en transition, et energisus til en hurtig klipning — eller når du vil have 1080p og ikke har brug for længde. Dens bevægelseskvalitet er stadig fremragende, og korte genereringer er billigere.
Sammenligningen der er værd at indprente: 2.0 optimerer selve skuddet, 2.5 optimerer scenen.
Sådan prompt’er du Seedance 2.5
Tredive sekunders kontinuitet belønner en anden prompt-form end fem sekunders spektakel. Nogle mønstre, der holder:
Skriv et beat sheet, ikke en beskrivelse. Med fem sekunder beskriver du et øjeblik. Med tredive beskriver du en lille bue: hvad sker først, hvad ændrer sig, hvor ender det. Modellen har plads til at udføre en progression — giv den en, ellers finder den selv på fyld.
Nævn kameraadfærden én gang. Ét sammenhængende take antyder ét kamera. Afgør om det er låst af, langsomt skubber ind, eller er håndholdt, og sig det én gang. At skændes med kameraet midt i prompten er den hurtigste vej til at introducere de klip, du forsøgte at undgå.
Sæt dialog i dobbelte anførselstegn. Dette er den dokumenterede trigger for læbesynkroniseret tale. Hold replikker korte nok til at kunne siges komfortabelt i den tilgængelige tid — et 30-sekunders klip rummer langt mindre dialog, end folk tror.
Brug referencer i stedet for adjektiver. Hvis du har ansigtet, produktet eller locationen, så vedhæft det. Hver reference, du tilføjer, svarer til et afsnit beskrivelse, du slipper for at skrive, og den er mere pålidelig.
Vores bredere guide til at skrive AI-videoprompter dækker de grundlæggende principper, der går igen på enhver model.
Et gennemarbejdet eksempel
Her er formen, der typisk virker, for et 30-sekunders produkt-spot:
Et sammenhængende håndholdt skud i et solbeskinnet køkken. En kvinde i trediverne pakker en kaffekværn ud af en æske på køkkenbordet, vender den i hænderne og sætter den ved siden af kedlen. Hun ser op og siger: "Helt ærligt? Den er mere stille end min gamle." Hun smiler og begynder at kværne. Varmt morgenlys, lav dybdeskarphed, blid kameradrift mod højre gennem hele klippet.
Bemærk hvad det gør: én kamerainstruktion sagt én gang, en tre-beats bue (pak ud, placer, brug), én kort citeret linje tilpasset øjeblikket, og lys beskrevet én gang i stedet for pr. beat. Tilføj det faktiske produktfoto som reference, og du har fjernet den eneste del, modellen ellers skulle gætte på.
Sammenlign det med fem-sekunders vanen — "cinematisk skud af en kaffekværn, dramatisk lys, 8k" — som giver en 30-sekunders model intet at lave i 25 af dens sekunder.
Billedformater er et førsteklasses valg
Seedance 2.5 spænder fra 21:9 til 9:16, inklusive 16:9, 4:3, 1:1 og 3:4. Vælg bevidst ved generering i stedet for at beskære senere: et 30-sekunders take komponeret til 9:16 holder sit motiv i ramme hele varigheden, hvorimod beskæring af et 16:9-take til vertikalt vil drive ud af rammen på et tidspunkt i de tredive sekunder, og så er du tilbage ved at klippe.
Hvor det passer ved siden af Veo, Sora og Kling
Ingen enkelt model vinder alt, og at behandle feltet som en værktøjskasse slår loyalitet til ét navn.
Seedance 2.5 ejer kontinuerlig varighed med synkroniseret lyd. Veo 3.1 er stadig valget til 4K-fidelitet. Sora 2 er stærk på fysisk plausibilitet og promptforståelse. Kling håndterer udtryksfuld menneskelig bevægelse og billede-til-video godt.
Den pragmatiske opsætning til et 30-sekunders stykke: generér hovedscenen med Seedance 2.5, erstat eventuelle close-up hero-shots med en 4K-model, og klip dem sammen. Det er præcis det, en multimodelplatform er til — se hvordan feltet aktuelt står i vores oversigt over de bedste AI-videogeneratorer til 2026.
Bør du skifte denne uge?
Ja, hvis du producerer 30-sekunders sociale spots, dialogscener, testimonials eller UGC-lignende annoncer; hvis karakter- eller produktkonsistens på tværs af en kampagne er en tilbagevendende hovedpine; eller hvis en meningsfuld del af din uge forsvinder i at sammenlappe og farvematche klip.
Ikke endnu, hvis dit output primært er storskærm eller 4K; hvis du har brug for klip under ti sekunder, hvor 2.0 og andre modeller er billigere og lige så gode; eller hvis din pipeline allerede er tunet til korte genereringer, og omkostningen ved at skifte opvejer den sparede redigeringstid.
Prøv det under alle omstændigheder, hvis du vælger en stack til næste kvartal. En model, der laver leverancen i ét hug, er en anden slags værktøj end en, der laver råmateriale, og den forskel er lettere at mærke på en eftermiddag i brug end at ræsonnere sig frem til fra et datasheet.
Den korte version
Seedance 2.5 er den første model, hvor outputlængden matcher længden på det, folk faktisk udgiver. Tredive sammenhængende sekunder med sammenhængende lyd og referencelåste karakterer fjerner en hel kategori af efterproduktions-småopgaver, og prisen for det er opløsning og omkostning pr. sekund.
Hvis dit arbejde er kortformat, socialt, dialogdrevet eller kampagne-konsistent, er det årets hidtil mest nyttige release. Hvis du behøver 4K masters, så behold den som ét værktøj blandt flere.
Du kan prøve Seedance 2.5 gratis på Vivideo — ingen ByteDance-konto, vandmærkefri eksport på en betalt plan, og 30+ andre modeller ved siden af, når et skud kræver noget andet.
