Di quién o qué protagoniza la toma y añade dos o tres detalles visibles: edad, ropa, material, color. «Una enfermera cansada con uniforme verde azulado» le da al modelo mucho más con qué trabajar que «una persona». Deja un solo protagonista por clip para que la mirada sepa dónde ir.
IAllegro
Generador de texto a video con IA
Describe una toma con tus propias palabras y recibe un clip de video. Este generador de texto a video te deja elegir entre MiniMax H3, Wan 3.0 y Seedance 2.5, ajustar la duración, la resolución y el formato, y ver cuántos créditos costará antes de enviarlo. Debajo del generador encontrarás cómo escribir un prompt que un modelo de video pueda seguir, cómo elegir el modelo según tu toma y cómo probar ideas sin gastar de más.
Modelo actualMiniMax H3
Andante
Los tres modelos de un vistazo
Todo se ajusta en el generador de arriba. Los rangos cambian de un modelo a otro, así que compáralos con lo que necesita tu toma. Ninguno de los tres es la opción correcta para todos los clips.
- Entrada
- Un prompt escrito de hasta 5.000 caracteres. El texto es el punto de partida por defecto; si prefieres empezar desde una imagen, puedes añadir un primer fotograma o imágenes de referencia.
- Modelos
- MiniMax H3, Wan 3.0 y Seedance 2.5, que se cambian en el selector de modelo de esta página.
- Duración
- MiniMax H3: de 4 a 15 segundos. Wan 3.0: de 2 a 30 segundos. Seedance 2.5: de 4 a 15 segundos.
- Resolución
- MiniMax H3: 768P o 2K. Wan 3.0: 480P, 720P o 1080P. Seedance 2.5: 480p, 720p o 1080p.
- Formato
- 16:9, 9:16, 1:1, 4:3 y 3:4 en los tres. 21:9 en MiniMax H3 y Seedance 2.5. Una opción adaptativa en Wan 3.0 y Seedance 2.5.
- Sonido
- MiniMax H3 genera siempre una pista de sonido estéreo junto con la imagen. En Wan 3.0 y Seedance 2.5 puedes desactivar el audio para obtener un clip mudo.
- Costo
- Se paga con créditos. La cifra del botón Generar se actualiza cuando cambias el modelo, la duración o la resolución, así que conoces el precio antes de enviar.
- Fallos
- Si una generación falla, sus créditos se reembolsan automáticamente.
- Tus videos
- Se guardan en el Historial de tu cuenta. Para generar necesitas iniciar sesión.
Adagio
Seis cosas que debe decir un prompt de texto a video
Un modelo de video solo cuenta con lo que escribes. Lo que no dices, lo decide por su cuenta, y esa decisión rara vez coincide con la imagen que tienes en la cabeza. Si cubres estas seis partes, más o menos en este orden, una toma tendrá todo lo que necesita.
Scherzo
Del primer borrador al clip final
Cada generación cuesta créditos, así que conviene detectar los problemas en borradores baratos y pagar la duración completa y la alta resolución solo cuando el prompt ya funciona.
Inicia sesión y elige un modelo
Con la sesión iniciada, elige MiniMax H3, Wan 3.0 o Seedance 2.5 según lo que pida la toma: cuánto dura, qué nitidez necesita, qué formato usa y si quieres sonido generado. Los rangos de cada modelo están en la tabla comparativa de más arriba.
Escribe un solo párrafo
Reúne las seis partes en unas pocas frases sencillas, empezando por el sujeto. El campo admite hasta 5.000 caracteres, pero un clip de pocos segundos no puede mostrar una página entera de detalles: gasta las palabras en lo que el espectador va a ver y oír de verdad. Basta con texto; las imágenes son opcionales.
Lanza un borrador barato
Elige la duración más corta y la resolución más baja que permita el modelo, por ejemplo 480P en Wan 3.0 o Seedance 2.5, o 768P en MiniMax H3, y verás bajar la cifra del botón Generar. Un borrador basta para juzgar el encuadre, el movimiento y el ambiente.
Cambia una sola cosa por intento
Si falla la cámara, reescribe solo la frase de la cámara; si la luz queda plana, toca solo la luz. Cambiarlo todo a la vez impide saber qué cambio funcionó. Cada resultado queda en el Historial, así que puedes volver atrás y comparar versiones antes de decidir la redacción final.
Genera la versión final
Cuando un borrador te convenza, sube la duración y la resolución y genera de nuevo. La versión final es una generación nueva, no una ampliación del borrador, así que habrá pequeñas diferencias; un clip más largo puede necesitar además un momento más en la acción. Si algo falla, los créditos vuelven solos.
Adagio
Qué modelo encaja con cada trabajo
Aquí ningún modelo sirve para todo. Empieza por lo que tiene que hacer el clip terminado y luego revisa qué límites encajan con eso.
Adagio
Un prompt, pieza por pieza
Este es un ejemplo escrito para esta página, seguido del motivo de cada parte. Toma prestada la estructura, no las palabras, y pon tu propio sujeto.
Coda
Preguntas frecuentes sobre texto a video
Respuestas breves sobre prompts, modelos, créditos y resultados en esta página.
01¿Qué hace en realidad un generador de texto a video?
Lee una descripción escrita y genera un clip corto que intenta ajustarse a ella: el sujeto, el movimiento, el escenario, la cámara y, en los modelos con audio, el sonido. El clip se genera desde cero, no se arma con material ya grabado; por eso la redacción del prompt pesa tanto en el resultado.
02¿Cuál de los tres modelos debo usar?
Depende del clip, no de un ranking. ¿Más de 15 segundos? Wan 3.0 llega a 30. ¿Necesitas 21:9? MiniMax H3 o Seedance 2.5. ¿Sonido siempre? MiniMax H3 añade siempre una pista estéreo. ¿Un clip mudo? Wan 3.0 o Seedance 2.5 con el audio desactivado. ¿2K? MiniMax H3.
03¿Qué tan largo debe ser el prompt?
El campo admite hasta 5.000 caracteres, pero una sola toma suele quedar bien descrita en tres a seis frases. Las palabras de más no añaden tiempo en pantalla: un clip de pocos segundos solo puede mostrar cierta cantidad. Si tu prompt no para de crecer, probablemente contiene dos escenas, que funcionan mejor como dos generaciones.
04¿Cuántos créditos cuesta un video?
Depende del modelo, la duración y la resolución que elijas. El costo se actualiza al cambiar esos ajustes y aparece en el botón Generar antes de enviar. Los borradores cortos y de baja resolución son los que menos cuestan, por eso sirven tan bien como pruebas.
05¿Qué pasa si una generación falla?
Los créditos de esa generación se reembolsan automáticamente, sin que tengas que reclamar nada. Una solicitud puede fallar cuando el modelo rechaza el contenido del prompt o cuando hay un error temporal de su lado. Si el mismo prompt falla dos veces, reformula la parte con más probabilidades de ser rechazada y vuelve a intentarlo.
06¿Por qué mi video no se parece a lo que escribí?
Las causas habituales son demasiadas acciones para la duración del clip, indicaciones de cámara que se contradicen, palabras vagas como «precioso» o «épico» sin nada concreto detrás, o dos sujetos peleando por la imagen. Vuelve a un sujeto y una acción, lanza un borrador corto y luego añade detalle.
07¿Los videos tienen sonido?
Con MiniMax H3, siempre: cada clip trae una pista de sonido estéreo generada. Wan 3.0 y Seedance 2.5 también pueden generar audio, y ambos tienen un interruptor para apagarlo cuando quieres un clip mudo para tu propia música o voz en off.
08¿Puedo empezar desde una imagen en vez de texto?
Sí. Aquí el texto es la opción por defecto, pero la misma página también acepta un primer fotograma o imágenes de referencia. Si tu proyecto parte sobre todo de imágenes, por ejemplo para animar la foto de un producto, las páginas de cada modelo enlazadas arriba explican esos flujos con más detalle.
09¿Dónde se guardan mis videos?
Los videos terminados se guardan en el Historial de tu cuenta, así que puedes volver a ellos más tarde y comparar los borradores con la versión final. Para generar hay que iniciar sesión, porque los créditos y el Historial están ligados a tu cuenta.
10¿Sonata AI está afiliada a MiniMax, Alibaba o ByteDance?
No. Sonata AI es una plataforma independiente y no tiene relación con MiniMax, Alibaba ni ByteDance. MiniMax H3, Wan 3.0 y Seedance 2.5 se mencionan solo para identificar los modelos que puedes usar aquí; esos nombres son marcas comerciales de sus respectivos dueños.