
| المطوّر | Zhipu AI |
| المنشأ | الصين |
| تاريخ الإصدار | CogVideoX 1.5 · Nov 2024 |
| صوت مدمج أصلي | إضافة تعليق صوتي |
| أقصى دقّة | 1360×768 |
| أقصى طول للمقطع | 6–10 ثوانٍ |
| الإتاحة | أوزان مفتوحة · أوزان مفتوحة (2B: Apache 2.0) |
| متاح عبر | Open weights · Z.ai API |
| السعر بدءًا من | Free (open) · API |
CogVideoX مثالي للإنشاء السريع والمرن من نص وصورة إلى فيديو عندما يكون النموذج المفتوح سهل الوصول هو الأنسب.
الخلفية. من Zhipu AI وفريق THUDM في جامعة تسينغهوا، يُعد CogVideoX (الإصدار 1.5، نوفمبر 2024) واحدًا من أكثر نماذج الفيديو المفتوحة تشعبًا مبكرًا، وقابلًا للتشغيل على عتاد استهلاكي مع تصميم مقبول في ICLR.
افتح Vivideo وابدأ فيديو جديدًا.
حدّد CogVideoX كنموذجك — أو دع وكيل الفيديو يختاره لك.
صف اللقطة (أو ارفع صورة) واضبط المدة ونسبة الأبعاد.
ولّد باستخدام CogVideoX، ثم حسّن النتيجة، وأضِف صوتًا أو أفاتارًا، وصدّر لأي منصة.
كل نموذج هو واحد من أكثر من 30 في Vivideo — بدّل بين النماذج لكل لقطة لتحصل على الشكل الدقيق الذي تريده.








CogVideoX من Zhipu AI هو نموذج فيديو مفتوح المصدر واسع الاستخدام يدعم التحويل من نص وصورة إلى فيديو. انفتاحه جعله مفضلًا لدى المجتمع للتجربة والابتكار.
يناسب CogVideoX المبدعين الذين يريدون محرّكًا مرنًا وسهل الوصول للمقاطع اليومية والتكرار السريع عبر إدخالات النص والصورة.
على Vivideo، يُعد CogVideoX واحدًا من أكثر من 30 نموذجًا ضمن اشتراك واحد — استخدمه كخيار يومي مرن، ثم ارتقِ إلى Veo أو Sora عندما تحتاج لقطة إلى صقل إضافي، وكل ذلك داخل مشروع واحد.
حصل CogVideoX على مكانته كأحد نماذج الفيديو المفتوحة الأكثر استنساخًا: نسخة 2B مرخصة Apache 2.0 ومجانية للاستخدام التجاري، ويمكن تشغيلها على ذاكرة فيديو صغيرة تبلغ حوالي 4–5 جيجابايت، ونظام البيئات حولها مثل Diffusers وComfyUI وLoRA واسع الانتشار. يعمل CogVideoX جيدًا في تحويل النص إلى فيديو والصورة إلى فيديو للقطات السريعة واليومية، مما جعله نقطة انطلاق افتراضية لجيل من المطورين والباحثين.
كن واقعياً بشأن عمره: الإصدارات المفتوحة تعود لأواخر 2024، والدقة تصل إلى 1360×768 كحد أقصى، وطول المقاطع عادة 6–10 ثوانٍ، ولا يدعم صوتًا مدمجًا، والتعليمات النصية تعمل بالإنجليزية فقط. مقارنة بالمحركات الأحدث يتراجع في جودة التفاصيل — حاليًا WAN وHunyuan من أفضل الخيارات المفتوحة، وVeo 3.1 أو Sora 2 يتفوقان من حيث الصقل. يظل خيارًا جيدًا للنماذج الأولية، ولقطات B-roll، والبحث.
على Vivideo يمكنك تجربة فيديو CogVideoX مجانًا — توليدات يومية مجانية وبدون حاجة لبطاقة GPU محلية. استخدمه للمسودات السريعة وتموضع المشاهد، ثم أعد تصيير المقاطع النهائية على نموذج أثقل؛ وبما أن المخرجات صامتة، يمكنك إضافة تعليق صوتي بتقنية الذكاء الاصطناعي وموسيقى داخل نفس المشروع قبل التصدير، أو دمج المقاطع في مونتاج أطول يصل إلى 10 دقائق.
يمكنك تجربة CogVideoX مجانًا على Vivideo للبدء — دون بطاقة ائتمان. الاستخدام الأثقل والنماذج المميزة مشمولة في خطة مدفوعة.
CogVideoX نموذج مفتوح سهل الوصول يتعامل جيدًا مع التحويل من نص إلى فيديو ومن صورة إلى فيديو، ما يجعله خيارًا يوميًا مرنًا.
نعم — على Vivideo يمكنك استخدام CogVideoX لكلٍ من التحويل من نص إلى فيديو ومن صورة إلى فيديو، والتبديل إلى نماذج أخرى لكل لقطة.
نعم — يتيح لك Vivideo تبديل النماذج على مستوى اللقطة، بحيث تمزج CogVideoX مع محركات أخرى ضمن مشروع واحد.
نسخة 2B مفتوحة الترخيص تحت Apache 2.0 — مجانية حتى للاستخدام التجاري إذا استضفتها بنفسك. على Vivideo يمكنك أيضًا تجربتها مجانًا، مع توليدات مجانية يومية وبدون إعداد محلي.
الإصدارات المفتوحة تصل إلى 1360×768 كحد أقصى. للحصول على إخراج بدقة 1080p أو 4K، أنشئ اللقطة باستخدام نموذج أحدث مثل Veo 3.1 أو LTX-2 بدلاً من ذلك.