Al drie jaar leveren vrijwel alle AI-videomodellen hetzelfde op: een prachtige clip van vijf seconden die stopt precies wanneer het interessant wordt. De hele kunst van AI-video is om die beperking heen gebouwd — storyboard in beats, genereren in fragmenten, in de edit aan elkaar naaien, en hopen dat het jasje van het personage in shot vier dezelfde kleur heeft als in shot één.
Seedance 2.5, ByteDance's nieuwste videomodel, is de eerste mainstream release die de beperking zelf aanpakt in plaats van de pixels. Het genereert een volledige 30 seconden in één enkele pass — geen stitching, geen scène-cuts splicen, geen naden om te verbergen. Die ene wijziging werkt overal door: hoe je prompt, hoe je budgetteert en hoeveel van je montagetijd overblijft.
Dit stuk gaat over wat er daadwerkelijk is veranderd, waar het aantoonbaar beter is en — net zo belangrijk — de twee punten waarop het slechter is dan wat je nu gebruikt.
Belangrijkste punten
- Seedance 2.5 genereert 30 aaneengesloten seconden in één pass, met behoud van karakteridentiteit, belichting en fysica over de hele clip.
- Audio wordt samen mét beeld gegenereerd in plaats van er later onder gezet, waardoor lipsync en timing van impacts precies op het juiste frame landen.
- Reference-to-video accepteert tot 50 multimodale inputs, waardoor consistentie verschuift van een prompt-truc naar een aangeleverde input.
- Er zijn echte trade-offs: output piekt op 720p en de prijs per seconde is premium — gebruik een 4K-model voor hero-shots.
Wat Seedance 2.5 eigenlijk is
Seedance is ByteDance's familie van videogeneratie — hetzelfde bedrijf achter TikTok en CapCut, wat iets zegt over het tempo en de kadreringsinstincten die erin gebakken zijn. Seedance 2.5 werd aangekondigd in juni 2026 op de Volcano Engine FORCE-conferentie en eind juli 2026 gelanceerd, eerst in ByteDance's Dreamina- en Jimeng-apps en daarna via de API.
Er zijn drie modi: text-to-video vanuit een geschreven prompt, image-to-video vanuit een stilstaand beeld, en reference-to-video — de modus waarvoor je je workflow wilt herinrichten. Je kunt Seedance 2.5 gebruiken op Vivideo zonder ByteDance-account, naast 30+ andere modellen in één abonnement.
De belangrijkste specs, helder:
- 30 seconden, native gegenereerd in één enkele pass (een ultralange modus gaat tot 180 seconden, nog in bèta)
- Native audio, gezamenlijk met de video gegenereerd
- Tot 50 referentie-inputs — grofweg 30 afbeeldingen, 10 videoclips en 10 audiobestanden
- 480p en 720p output, in beeldverhoudingen van cinematografisch 21:9 tot verticaal 9:16
- Ongeveer 20% betere prompt-naleving dan de vorige generatie
De 30-secondenfactor is het hele verhaal

Het is verleidelijk om "30 seconden" te lezen als een kwantiteitsupgrade — zes keer zoveel video per generatie. Dat doet het tekort. Het verschil is continuïteit, niet duur.
Wanneer je zes clips van vijf seconden aan elkaar stikt, ben je drift aan het managen. Het gezicht verschuift subtiel. De kleurtemperatuur zwerft. Een hand wordt zes vingers in de derde shot en je regenereert, wat de kadrering verandert, waardoor de cut niet meer matcht. Iedereen die ooit een AI-commercial van 30 seconden in elkaar heeft gezet weet dat de echte kosten niet in de generatietijd zitten — maar in het reconciliatiewerk erna.
Eén enkele pass van 30 seconden haalt die reconciliatie weg. Identiteit, garderobe, belichting en fysica worden één keer besloten en vastgehouden. Daarom is 30 seconden specifiek belangrijk: het is de lengte van een standaard reclameslot, een complete productuitleg-beat of een volledige verticale video. Het is de eerste duur waarbij de modeloutput zelf het deliverable ís in plaats van ruwe montagestof.
Als je huidige workflow is gebouwd rond het aaneenrijgen van korte clips, blijft onze gids voor AI-video's langer dan 60 seconden maken van kracht — je rijgt alleen veel minder, maar veel langere stukken.
Audio gegenereerd met het beeld, niet erna

De meeste "AI-video met geluid" is twee systemen in een trenchcoat: eerst de video genereren, daarna audio genereren of dubben en uitlijnen. Het werkt totdat iets exact op een frame moet landen — een voetstap, een dichtslaande deur, een lettergreep.
Seedance 2.5 genereert geluid en beeld gezamenlijk. Praktisch betekent dit dat lipsync, impact-timing en omgevingscoherentie in dezelfde pass worden beslist als de beweging die ze veroorzaakt. De handige truc: zet een zin dialoog tussen dubbele aanhalingstekens in je prompt, en het personage spreekt hem uit, lipgesynchroniseerd.
Voor dialooggedreven formats — testimonials, sketches, uitlegscènes met een presentator — klapt dit een pijplijn met meerdere stappen terug naar één generatie. Je kunt nog steeds AI-voice-over, gekloonde stemmen of een muziekbed erna lagen als de creatie daarom vraagt.
De rekensom die niemand noemt
Neem een standaard productspot van 30 seconden. In het oude model genereer je zes clips van vijf seconden. Ga uit van een realistische hitrate van één bruikbare take op drie — dat zijn 18 generaties. Vervolgens breng je een uur in de edit door met kleurmatchen, knippen op beweging en het verbergen van de twee overgangen waar de reflectie van het product verandert.
In een single-pass-model is dezelfde spot één generatie. De hitrate per poging is lager, omdat er over 30 seconden meer mis kan gaan dan over vijf — noem het één op vier. Dat zijn vier generaties en geen reconciliatie-edit.
Minder pogingen is niet automatisch het punt; het verdwijnen van de reconciliatiestap is dat wel. Het stitching-werk was nooit factureerbaar, nooit creatief en werd nooit makkelijker met oefening.
Multi-subjectbeweging is waar het schittert
De andere echte sprong in capaciteit is interactie. Seedance 2.5 is gebouwd om meerdere onderwerpen die elkaar beïnvloeden aan te kunnen — sport, dans, vechten, objecten die botsen — in plaats van één onderwerp dat voor een achtergrond beweegt.
Dit is de categorie shot die historisch gezien het snelst uit elkaar viel. Twee mensen die een bal overspelen leverden een bal op die van grootte verandert, of handen die door elkaar heen gaan, omdat het model geen blijvend begrip had van elk lichaam. Over 30 seconden stapelt die faalmodus zich op; het feit dat Seedance 2.5 precies dit doelwit kiest, op precies deze lengte, is geen toeval.
De praktische les: als je storyboard twee of meer dingen bevat die elkaar aanraken, is dit nu een redelijk model om eerst te proberen in plaats van een laatste redmiddel.
Bewerken op regiobasis en de 180-seconden-bèta
Twee functies staan net niet in de kop, maar veranderen hoe je iteraties maakt.
Bewerken op regiobasis laat je een deel van een frame wijzigen zonder de hele clip te regenereren. In een enkele take van 30 seconden is dat enorm belangrijk — in de oude workflow betekende één fout element dat je de hele generatie weggooide en opnieuw gokte. Een regio kunnen repareren terwijl je alles behoudt wat je al had goedgekeurd, is wat een lange single take überhaupt praktisch maakbaar maakt om op te itereren.
De ultralange modus verlengt één generatie tot 180 seconden. Het is bèta, en zo moet je het ook behandelen: gebruik het om te verkennen wat een ononderbroken take van drie minuten mogelijk maakt, niet om een klant volgende week een oplevering te beloven.
Vijftig referenties: consistentie wordt een input

De stille headline-functie is reference-to-video. Seedance 2.5 accepteert tot 50 multimodale referenties — afbeeldingen, videoclips en audio — en houdt die vast tijdens de hele generatie.
Dit verandert de aard van merkkonsistentie. Historisch gezien stuurde je met prompts richting consistentie: je beschreef een personage tot in obsessief detail en hoopte dat het model convergeerde. Nu lever je het ding zelf aan. Een product vanuit drie hoeken. Het gezicht van een presentator. Een locatie. Een stem. Het model matcht in plaats van te benaderen.
Voor campagnewerk is dit het verschil tussen "onze shots lijken verwant" en "onze shots lijken van dezelfde shoot". Als je een promptdocument bijhield om een personage stabiel te houden in een reeks, vervangen referenties het meeste daarvan.
Wat het je kost
Twee eerlijke afruilen, want beide tellen mee wanneer je een model voor een klus kiest.
Resolutie gaat tot maximaal 720p. Seedance 2.5 levert 480p en 720p — geen 1080p, en geen 4K, ondanks sommige coverage bij de lancering die het verwarde met de 2.0-refresh. Voor social-first werk dat op een telefoon wordt afgeleverd is 720p meestal prima. Voor een hero shot op een landingspagina of iets voor een groot scherm, genereer je dat shot beter met een 4K-capabel model zoals Veo 3.1.
Prijs per seconde is premium. Seedance 2.5 wordt native afgerekend per seconde output, en 720p kost ruwweg het dubbele van 480p. Dertig seconden is veel seconden. De pragmatische workflow: schets op 480p tot de prompt goed is, en commit dan aan een 720p eindpass. Op Vivideo is het model inbegrepen in één abonnement in plaats van per clip afgerekend, wat het meeste van de draft-stress wegneemt.
Seedance 2.5 vs Seedance 2.0: wanneer gebruik je welke
Seedance 2.0 is niet verouderd, en juist kiezen bespaart geld.
Grijp naar 2.5 wanneer de clip zelf het deliverable is: een spot van 30 seconden, een dialoogscène, alles waar een personage of product identiek moet blijven gedurende de hele clip, of waar audio precies op specifieke frames moet vallen.
Grijp naar 2.0 wanneer je een korte, krachtige, high-motion cut nodig hebt — een hook van drie seconden, een overgang, een energiestoot voor een snelle edit — of wanneer je 1080p wilt en geen lengte nodig hebt. De bewegingskwaliteit blijft uitstekend, en korte generaties zijn goedkoper.
De vergelijking om te internaliseren: 2.0 optimaliseert de shot, 2.5 optimaliseert de scene.
Zo prompt je Seedance 2.5
Dertig seconden continuïteit vragen om een andere promptvorm dan vijf seconden spektakel. Enkele patronen die standhouden:
Schrijf een beat sheet, geen beschrijving. Met vijf seconden beschrijf je een moment. Met dertig beschrijf je een kleine boog: wat gebeurt er eerst, wat verandert er, waar eindigt het. Het model heeft ruimte voor een opbouw — geef die, anders verzint het opvulling.
Noem het cameragedrag één keer. Eén ononderbroken take impliceert één camera. Bepaal of hij statisch is, langzaam inzoomt, of handheld is, en zeg het één keer. In de prompt met de camera vechten is de snelste manier om de cuts te introduceren die je juist wilde vermijden.
Zet dialoog tussen dubbele aanhalingstekens. Dit is de gedocumenteerde trigger voor lipgesynchroniseerde spraak. Houd zinnen kort genoeg om comfortabel binnen de beschikbare tijd te spreken — een clip van 30 seconden bevat veel minder dialoog dan mensen inschatten.
Lever referenties aan in plaats van bijvoeglijke naamwoorden. Heb je het gezicht, het product of de locatie, voeg die dan toe. Elke referentie die je toevoegt is een alinea beschrijving die je niet hoeft te schrijven, en het is betrouwbaarder.
Onze bredere gids voor het schrijven van AI-videoprompts behandelt de basis die voor elk model geldt.
Een uitgewerkt voorbeeld
Dit is de vorm die meestal werkt voor een 30-seconden productspot:
Een enkele ononderbroken handheld shot in een zonovergoten keuken. Een vrouw van in de dertig pakt een koffiemolen uit een doos op het aanrecht, draait hem in haar handen en zet hem naast de waterkoker. Ze kijkt op en zegt: "Eerlijk? Hij is stiller dan mijn oude." Ze glimlacht en begint te malen. Warm ochtendlicht, geringe scherptediepte, gedurende de hele take een zachte cameradrift naar rechts.
Let op wat het doet: één camera-instructie, één keer genoemd; een boog in drie beats (uitpakken, neerzetten, gebruiken); één korte, geciteerde zin passend bij het moment; en belichting één keer beschreven in plaats van per beat. Voeg de echte productfoto toe als referentie en je haalt het enige weg dat het model anders zou moeten gokken.
Vergelijk dat met de vijf-seconden-reflex — "cinematic shot van een koffiemolen, dramatische belichting, 8k" — die een 30-secondenmodel 25 seconden lang niets te doen geeft.
Beeldverhoudingen zijn een eerste-keuze
Seedance 2.5 beslaat 21:9 tot en met 9:16, inclusief 16:9, 4:3, 1:1 en 3:4. Kies bewust tijdens het genereren in plaats van later te croppen: een take van 30 seconden die voor 9:16 is gecomponeerd, houdt het onderwerp de hele duur in beeld, terwijl het croppen van 16:9 naar verticaal ergens in die dertig seconden uit het kader zal drijven en je weer moet gaan knippen.
Hoe het zich verhoudt tot Veo, Sora en Kling
Geen enkel model wint alles, en de lijst als gereedschapskist behandelen is beter dan trouw zweren aan één naam.
Seedance 2.5 excelleert in continue duur met gesynchroniseerde audio. Veo 3.1 blijft de keuze voor 4K-kwaliteit. Sora 2 is sterk in fysieke plausibiliteit en promptbegrip. Kling gaat goed om met expressieve menselijke beweging en image-to-video.
De pragmatische setup voor een stuk van 30 seconden: genereer de hoofdsfeer met Seedance 2.5, vervang een close-up hero shot door een 4K-model en monteer ze samen. Daar is een multimodelplatform precies voor — zie hoe het huidige veld zich verhoudt in ons overzicht van de beste AI-videogenerators voor 2026.
Moet je deze week overstappen?
Ja, als je 30-seconden social spots, dialoogscènes, testimonials of UGC-achtige ads maakt; als karakter- of productconsistentie over een campagne heen een terugkerende hoofdpijn is; of als een betekenisvol deel van je week opgaat aan het aan elkaar naaien en colormatchen van clips.
Nog niet, als je output primair groot scherm of 4K is; als je clips onder de tien seconden nodig hebt, waar 2.0 en andere modellen goedkoper en net zo goed zijn; of als je pipeline al is afgestemd op korte generaties en de switch-kosten zwaarder wegen dan de gewonnen edittijd.
Probeer het hoe dan ook als je een stack kiest voor volgend kwartaal. Een model dat het eindproduct in één keer oplevert is een ander type gereedschap dan een model dat ruwe materialen maakt, en dat verschil voel je makkelijker in een middag gebruik dan dat je het uit een specificatieblad redeneert.
De korte versie
Seedance 2.5 is het eerste model waarbij de outputlengte overeenkomt met de lengte van wat mensen daadwerkelijk publiceren. Dertig ononderbroken seconden met coherente audio en referentie-vergrendelde personages haalt een hele categorie postproductiewerk weg, en de prijs daarvoor is resolutie en kosten per seconde.
Als je werk shortform, social, dialooggedreven of campagne-consistent is, is dit tot nu toe de nuttigste release van het jaar. Als je 4K-masters nodig hebt, houd het als één tool tussen meerdere.
Je kunt Seedance 2.5 gratis proberen op Vivideo — geen ByteDance-account, watermerkvrije exports met een betaald abonnement, en 30+ andere modellen ernaast wanneer een shot iets anders nodig heeft.
