Lo que aprenderás
- Una estructura de prompt en cinco partes (sujeto, acción, entorno, estilo, cámara) que puedes reutilizar siempre
- Cómo reescribir un prompt vago en uno preciso — con ejemplos de antes y después
- Por qué las indicaciones negativas (“sin texto, sin marca de agua”) mejoran tus resultados
- Un ciclo de iteración de un cambio a la vez que mejora los planos sin adivinar
Cómo los modelos leen tu prompt
Un modelo de texto a video no “entiende” una historia como una persona — hace coincidir patrones entre tus palabras y los visuales que aprendió. Cuanto más concretamente describas qué debe verse en pantalla y cómo se comporta la cámara, menos tendrá que adivinar. Sustantivos específicos, una acción clara y un movimiento de cámara nombrado superan un montón de adjetivos de ambiente.
Una estructura de prompt que funciona
Describe el plano como lo haría un director — sujeto, acción, entorno, estilo y cámara. Manténlo en una o dos oraciones claras.
- 1Sujeto: quién o qué aparece en pantalla (“un barista”, “un teléfono elegante”).
- 2Acción: qué sucede (“sirve arte latte”, “gira lentamente sobre un pedestal”).
- 3Entorno: dónde (“cafetería de especialidad con luz solar”, “estudio minimalista, sombras suaves”).
- 4Estilo: el look (“cinematográfico, poca profundidad de campo, gradación cálida”).
- 5Cámara: el movimiento (“acercamiento lento”, “órbita”, “plano general estático”).
Antes y después
Vago: “un video de café”. Mejor: “Primer plano de un barista sirviendo arte latte en una taza blanca sobre una barra de madera, cafetería de especialidad iluminada por el sol, cinematográfico, poca profundidad de campo, acercamiento lento, sin texto”. El segundo prompt controla sujeto, entorno, iluminación, lente y movimiento — así el modelo tiene mucho menos que inventar y obtienes un plano útil con más frecuencia.
Di lo que no quieres
Las indicaciones negativas limpian los resultados. Añade “sin texto, sin marca de agua, sin logotipos, sin dedos extra” para evitar los artefactos clásicos de la IA. Para un resultado seguro para marcas, añade “empaque genérico, sin logotipos de marca”. Una lista corta de exclusiones a menudo mejora más la calidad que otro adjetivo.
Itera, no sobreespecifiques
Empieza con un prompt enfocado, genera y luego cambia una cosa a la vez — la iluminación, luego el movimiento de cámara, luego el mood. Apilar diez adjetivos de una vez hace imposible saber qué ayudó realmente. Trata cada generación como un experimento con una sola variable.
Crea un “estilo de casa” reutilizable
Cuando encuentres un look que te guste, guarda la mitad de estilo del prompt como un sufijo (p. ej., “cinematográfico, 4K, luz natural suave, poca profundidad de campo”) y reutilízalo en los clips. Cambias el sujeto y la acción por plano, pero el estilo de casa mantiene una serie visualmente coherente — eso es lo que hace que un canal se vea intencional.
Consejos rápidos
- Empieza con lo visual más importante — los modelos ponderan más el inicio del prompt.
- Nombra el movimiento de cámara (“paneo lento”, “órbita”, “estático”) para controlar la energía y el ritmo.
- Reutiliza un sufijo de “estilo de casa” para un look consistente en cada clip.
- Una acción por plano — divide “entra y se sienta y habla” en escenas separadas.
- Guarda un archivo de swipes con prompts que dieron tomas geniales; reutilízalos y remézclalos.
Preguntas frecuentes
¿Qué tan largo debe ser un prompt?
Una o dos frases claras suelen superar a un párrafo. Sé específico, no largo.
¿Puedo usar el mismo prompt en distintos modelos?
Sí — en Vivideo puedes ejecutar un prompt en diferentes modelos (Sora, Veo, Kling y más) y comparar.
¿Por qué mi video ignora parte del prompt?
Los modelos priorizan el inicio y pueden omitir detalles posteriores. Mueve el elemento clave antes o divídelo en otra escena.
¿Los prompts también sirven para imagen a video?
Sí — con una imagen de entrada, el prompt dirige sobre todo el movimiento y la cámara, no el sujeto.
¿Cómo mantengo un personaje consistente entre tomas?
Reutiliza la misma descripción detallada del sujeto o usa un avatar/imagen de referencia para que el look se mantenga estable.










