Video
Texto a video
El texto a video (text-to-video) consiste en generar un clip de video solo a partir de un prompt escrito. El modelo sintetiza sujeto, movimiento, cámara e iluminación a partir de la descripción y suele producir clips de pocos segundos.
Los motores actuales de texto a video generan un movimiento coherente durante unos segundos, hasta 30 en los que más duran. El prompt describe qué hay en el encuadre, qué se mueve, cómo se comporta la cámara y qué hace la luz; el motor inventa todo lo demás. La calidad varía según el motor: algunos destacan en el movimiento humano, otros en la física o en la luz dramática, y cada vez más generan el sonido junto con la imagen.
Las piezas más largas se montan a partir de varios clips (un storyboard) en lugar de generarse de una sola vez.
En eroq
El estudio de video reúne 16 motores en un solo editor: Seedance, Veo, Sora, Kling, Hailuo, Runway, Grok y Wan, además de Motion One, el motor sin censura. Los movimientos de cámara y el panel de dirección se incorporan al prompt en el servidor; el modo película encadena escenas en un solo montaje.
Preguntas
¿Cuánto pueden durar los clips de texto a video?
De 1 a 30 segundos según el motor y tu plan: Seedance 2.5 y Wan 3.0 llegan a 30, Sora 2 Pro a 20; la mayoría de los demás se quedan en 15, y los motores Veo 3.1 en 8.
¿Cómo se escribe un buen prompt de texto a video?
Un párrafo que nombre sujeto, movimiento, cámara, luz y ambiente, de 30 a 80 palabras, con una sola acción por clip.
¿Con qué motor de video empiezo?
Con cualquier cuenta: Seedance 2.0 Mini (un clip de cinco segundos en 480p cuesta 45 créditos, dentro del saldo de bienvenida), Veo 3.1 Lite y Wan 3.0, además de Motion One, el único sin censura. El resto requiere un plan: Veo 3.1 Fast, Kling 3.0, Seedance 2.0 Fast, Hailuo 3 Max y Grok Imagine desde Hobby; Seedance 2.5 y 2.0, Veo 3.1, Sora 2 Pro, Kling 3.0 Pro, Hailuo 3 y Runway Gen-4.5 desde Creator.
Más términos de video