
Veo 3.1 Fast
Schnell und günstig — ideal für zügige Iterationen.
| Entwickler | Zhipu AI |
| Herkunft | China |
| Veröffentlicht | CogVideoX 1.5 · Nov 2024 |
| Natives Audio | Voiceover hinzufügen |
| Maximale Auflösung | 1360×768 |
| Maximale Cliplänge | 6–10 Sek. |
| Verfügbarkeit | Offene Gewichte · Offene Gewichte (2B: Apache 2.0) |
| Verfügbar über | Open weights · Z.ai API |
| Preis ab | Free (open) · API |
CogVideoX eignet sich am besten für schnelle, flexible Text- und Bild-zu-Video-Generierung, wenn ein zugängliches, offenes Modell gefragt ist.
Hintergrund. Von Zhipu AI und Tsinghuas THUDM: CogVideoX (1.5, November 2024) gehört zu den am häufigsten geforkten frühen offenen Videomodellen, läuft auf Consumer-Hardware und verfügt über ein auf der ICLR akzeptiertes Design.
Öffne Vivideo und starte ein neues Video.
Wähle CogVideoX als Modell — oder lass den Video-Agenten für dich auswählen.
Beschreibe deine Einstellung (oder lade ein Bild hoch) und lege Dauer sowie Seitenverhältnis fest.
Generiere mit CogVideoX, verfeinere anschließend, füge eine Stimme oder einen Avatar hinzu und exportiere für jede Plattform.
Jedes Modell ist eines von 30+ in Vivideo — wechsle pro Shot, um genau den Look zu erhalten, den du willst.

Schnell und günstig — ideal für zügige Iterationen.




State-of-the-Art Bewegung, Realismus und native Audiospur.



CogVideoX von Zhipu AI ist ein weit verbreitetes Open-Source-Videomodell mit Unterstützung für Text- und Bild-zu-Video. Seine Offenheit hat es in der Community zu einem Favoriten für Experimente gemacht.
CogVideoX passt zu Creators, die ein flexibles, zugängliches System für Alltagsclips und schnelle Iterationen mit Text- und Bild-Eingaben suchen.
Auf Vivideo ist CogVideoX eines von 30+ Modellen in einem Abo — nutze es als flexible Alltagsoption und wechsle bei Bedarf innerhalb desselben Projekts zu Veo oder Sora, wenn ein Shot extra Feinschliff braucht.
CogVideoX hat sich als eines der meistgeforkten Open-Video-Modelle etabliert: Die 2B-Variante ist Apache‑2.0-lizenziert und kommerziell frei, sie läuft bereits mit etwa 4–5 GB VRAM, und das Diffusers-, ComfyUI- und LoRA-Ökosystem darum ist umfangreich. CogVideoX Text-zu-Video und Image-zu-Video eignen sich gut für schnelle, alltägliche Clips — deshalb wurde es zur Standardstartbasis für eine Generation von Tüftlern und Forschern.
Sei realistisch hinsichtlich seines Alters: Die offenen Releases stammen aus dem Spätjahr 2024, die Auflösung endet bei 1360×768, Clips dauern 6–10 Sekunden, es gibt kein natives Audio und Prompts sind nur auf Englisch möglich. Gegen neuere Engines hinkt die Bildtreue hinterher — heute sind WAN und Hunyuan die stärkeren Open-Optionen, und Veo 3.1 oder Sora 2 überzeugen in Sachen Finish. Es bleibt jedoch eine solide Wahl für Prototyping, B‑Roll und Forschung.
Auf Vivideo kannst du CogVideoX AI-Videos kostenlos ausprobieren — tägliche Gratis-Generierungen, kein lokales GPU-Setup. Nutze es für schnelle Drafts und Layout-Passes und rendere die Finalshots auf einem stärkeren Modell neu; da der Output stumm ist, füge im selben Projekt eine KI-Synchronstimme und Musik hinzu, bevor du exportierst, oder baue Clips in einen längeren 10‑Minuten-Schnitt ein.
Du kannst CogVideoX auf Vivideo zunächst kostenlos testen — keine Kreditkarte nötig. Umfangreichere Nutzung und Premium-Modelle sind in einem kostenpflichtigen Tarif enthalten.
CogVideoX ist ein zugängliches, offenes Modell, das sowohl Text-zu-Video als auch Bild-zu-Video gut beherrscht — eine flexible Alltagsoption.
Ja — auf Vivideo kannst du CogVideoX für Text-zu-Video und Bild-zu-Video nutzen und pro Shot zu anderen Modellen wechseln.
Ja — Vivideo erlaubt den Modellwechsel pro Shot, sodass du CogVideoX mit anderen Engines in einem Projekt kombinieren kannst.
Die 2B-Open-Gewichte stehen unter Apache 2.0 — kostenlos, inklusive kommerzieller Nutzung, wenn du selbst hostest. Auf Vivideo kannst du es ebenfalls kostenlos testen, mit täglichen Gratis-Generierungen und ohne Setup.
Die offenen Releases enden bei 1360×768. Für 1080p- oder 4K-Auslieferung generiere die Einstellung lieber mit einem neueren Modell wie Veo 3.1 oder LTX-2.