Створення відео за допомогою ШІ поєднує дві лексики — традиційного відео (співвідношення сторін, роздільна здатність, кодеки) та генеративного штучного інтелекту (дифузія, підказки, масштаб CFG, image-to-video). Цей глосарій відео ШІ визначає кожен термін, з яким ви зіткнетеся, щоб жаргон не гальмував роботу.
Почніть з основ — співвідношення сторін, роздільна здатність, частота кадрів — а далі перейдіть до термінів ШІ, що визначають результат: text-to-video, image-to-video, дифузія, lip-sync, аватари тощо. Кожне визначення написане для творця, а не для дослідника.
Шукайте термін або переглядайте за категоріями. Кожна стаття — простою англійською без математики та з посиланнями на те, де концепт справді важить під час створення відео.

Відео ШІ стоїть на перетині двох сфер, кожна з власним жаргоном: традиційне відеовиробництво (співвідношення сторін, роздільна здатність, частота кадрів, кодеки, бітрейт) і генеративний штучний інтелект (дифузія, підказки, шкала CFG, text-to-video, image-to-video, латентний простір). Цей глосарій пояснює кожен термін простою англійською, щоб словник перестав бути бар’єром між вами та готовим відео.
Деякі терміни безпосередньо визначають результат. Розуміння різниці між text-to-video та image-to-video змінює, як ви починаєте проєкт; знання співвідношення сторін і роздільної здатності впливає на платформи публікації; осягнення дифузії та денойзингу пояснює, чому моделі поводяться саме так. Кожне визначення тут написане для творця відео, а не для дослідника.
Використовуйте як довідник: шукайте термін, щойно зіткнулися з ним, або переглядайте за категоріями — основи відео, концепти ШІ та специфіка відео ШІ. Кожен запис пов’язує поняття з практикою, і ви можете одразу перейти в студію, щоб побачити це в дії в понад 30 моделях.
Словник простою мовою для всіх термінів у відео ШІ — від основ відео, як-от співвідношення сторін і кодек, до понять ШІ, як-от дифузія, підказки та text-to-video. Шукайте або переглядайте за категоріями, щоб розвіяти жаргон.
Text-to-video генерує кліп із текстової підказки; image-to-video анімує статичне фото у рух. Обидва визначення є тут, і Vivideo підтримує обидва у понад 30 моделях.
Дифузія — це процес, який більшість відеомоделей використовує для генерування кадрів: стартуючи з шуму та поступово уточнюючи його в чітке зображення за вашою підказкою. Повне визначення з контекстом — у глосарії.
Ні — можна робити чудові відео без теорії. Але знання кількох ключових термінів (співвідношення сторін, різниця між text-to-video та image-to-video, підказка) допоможе швидше отримувати кращі результати — саме для цього глосарій.
Шкала CFG визначає, наскільки суворо модель дотримується вашої підказки чи імпровізує. Вища — ближче до формулювань; нижча — більш креативна. Це один із багатьох термінів тут, пояснених зрозуміло для творців.
Кожне визначення вказує, де поняття важливе у реальному воркфлоу, і ви можете одразу спробувати це у Vivideo — одна студія, 30+ моделей, безкоштовний старт.