Créer une vidéo avec l’IA mêle deux vocabulaires — vidéo traditionnelle (format d’image, résolution, codecs) et IA générative (diffusion, prompts, échelle CFG, image‑vers‑vidéo). Ce glossaire de la vidéo IA définit chaque terme que vous rencontrerez, pour que le jargon ne vous ralentisse plus.
Commencez par les fondamentaux — format d’image, résolution, nombre d’images par seconde — puis passez aux termes propres à l’IA qui déterminent votre rendu : texte‑vers‑vidéo, image‑vers‑vidéo, diffusion, synchronisation labiale, avatars, et plus encore. Chaque définition est rédigée pour un créateur, pas pour un chercheur.
Recherchez un terme ou parcourez par catégorie. Chaque entrée est en français clair, sans mathématiques, avec des liens vers l’endroit où le concept compte vraiment lorsque vous réalisez une vidéo.

La vidéo IA se situe à l’intersection de deux domaines, chacun avec son propre jargon : la production vidéo traditionnelle (format d’image, résolution, fréquence d’images, codecs, débit binaire) et l’intelligence artificielle générative (diffusion, prompts, échelle CFG, texte‑vers‑vidéo, image‑vers‑vidéo, espace latent). Ce glossaire définit chaque terme en langage clair, pour que le vocabulaire ne soit plus un frein entre vous et une vidéo finalisée.
Certains termes influencent directement votre rendu. Connaître la différence entre texte‑vers‑vidéo et image‑vers‑vidéo change votre manière de démarrer un projet ; comprendre le format d’image et la résolution détermine où publier votre vidéo ; saisir la diffusion et le débruitage démystifie le comportement des modèles. Chaque définition s’adresse à un créateur de vidéos, pas à un chercheur lisant des articles.
Utilisez‑le comme une base de référence : cherchez un terme dès que vous y êtes confronté, ou parcourez par catégorie — bases de la vidéo, concepts d’IA et spécificités de la vidéo IA. Chaque entrée relie le concept à son usage concret, et vous pouvez passer directement au studio pour le voir en action sur plus de 30 modèles.
Un dictionnaire en langage clair de tous les termes de la vidéo IA — des bases vidéo comme le format d’image et le codec aux concepts d’IA comme la diffusion, les prompts et le texte‑vers‑vidéo. Recherchez ou parcourez par catégorie pour démystifier le jargon.
Le texte‑vers‑vidéo génère un clip à partir d’un prompt écrit ; l’image‑vers‑vidéo anime une photo fixe. Les deux sont définis ici, et Vivideo propose les deux sur plus de 30 modèles.
La diffusion est le procédé utilisé par la plupart des modèles vidéo pour générer des séquences — en partant du bruit puis en affinant progressivement vers une image nette guidée par votre prompt. La définition complète, en langage simple, est dans le glossaire.
Non — vous pouvez créer d’excellentes vidéos sans la théorie. Mais connaître quelques notions clés (format d’image, texte‑vers‑vidéo vs image‑vers‑vidéo, prompt) vous aide à obtenir de meilleurs résultats plus vite, ce à quoi sert ce glossaire.
L’échelle CFG contrôle à quel point un modèle suit votre prompt ou improvise. Plus elle est élevée, plus il reste proche des mots ; plus elle est basse, plus il est créatif. C’est l’un des nombreux termes définis ici avec un langage accessible aux créateurs.
Chaque définition renvoie aux étapes où le concept compte dans un flux de travail réel, et vous pouvez l’essayer directement sur Vivideo — un studio, plus de 30 modèles, gratuit pour commencer.