IAllegro

Crea un video City Giant con una sola foto

City Giant es una plantilla que convierte una foto en video: subes la imagen de una persona o de un personaje y el modelo de video la recrea como un gigante de pie en una calle del centro, más alto que los edificios que lo rodean. Autos y peatones pasan junto a sus pies mientras la cámara se aleja despacio e inclina hacia arriba, hasta mostrar al gigante completo con el skyline detrás. La escena ya está lista; los detalles opcionales te permiten ajustarla.

Modelo actualMiniMax H3
Tu foto0/1

Una sola persona, con la cara y la ropa bien visibles, buena luz y sin filtros fuertes. Usa solo fotos de personas que hayan dado su permiso.JPG, PNG o WebP, hasta 20 MB.

0 / 300
Ajustes avanzadosMiniMax H3 · 768P · 9:16 · 6 s
Modelo
6 s
Resolución
Relación de aspecto
Sonido

MiniMax H3 siempre genera el video con sonido.

El precio se actualiza al cambiar los ajustes. Si la generación falla, los créditos se devuelven automáticamente.

Vista previa
No hay videos. ¡Genera un video primero!
Andante

La plantilla en resumen

La escena y el movimiento de cámara los define la plantilla. Todo lo demás de esta lista se puede cambiar en el generador antes de enviar.

Entrada
Una foto de una persona o de un personaje. Un solo sujeto bien visible funciona mejor que una foto grupal.
Escena
Integrada: el sujeto aparece como un gigante en una calle del centro, con autos y peatones pequeños moviéndose a ras de suelo.
Cámara
Un alejamiento lento combinado con una inclinación hacia arriba que termina en la figura completa frente al skyline.
Detalles opcionales
Ropa, clima, hora del día y hacia dónde mira el gigante.
Formato
Vertical 9:16 por defecto; cámbialo a otro formato, como 16:9, si quieres una versión horizontal.
Duración
6 segundos por defecto, ajustable en el generador.
Modelos
MiniMax H3 (predeterminado), Wan 3.0 o Seedance 2.5.
Sonido
Ambiente de ciudad generado junto con el video en los modelos que admiten audio.
Costo
Se paga con créditos tras iniciar sesión. El costo exacto aparece antes de generar y, si la generación falla, los créditos se devuelven automáticamente.
Adagio

Por qué una toma City Giant se ve enorme

Nadie calcula el tamaño de algo en el vacío: el ojo compara. La plantilla incluye las comparaciones principales, y entender cómo funcionan te ayuda a elegir una foto y unos detalles que refuercen la ilusión en lugar de estropearla.

Scherzo

Cómo hacer el video paso a paso

Son cinco pasos cortos. El único que pide pensarlo un poco es elegir la foto.

  1. Inicia sesión

    Entra con Google o con tu correo. La plantilla se paga con créditos de Sonata AI, así que revisa tu saldo primero; el botón Generar muestra el costo de la configuración actual antes de cobrar nada.

  2. Sube una foto

    Elige una imagen en la que se vea con claridad a una sola persona o personaje, con el rostro y la ropa a la vista. Una foto nítida, bien iluminada y sin filtros fuertes le da al modelo la mayor cantidad de información; más abajo, en los consejos sobre la foto, te explicamos por qué.

  3. Agrega detalles si quieres

    Deja vacío el campo de detalles para obtener la escena estándar, o escribe una nota breve sobre la ropa, el clima, la hora del día o hacia dónde mira el gigante. Basta con una o dos frases, porque el prompt de la escena ya está escrito.

  4. Elige modelo, duración y formato

    MiniMax H3 viene seleccionado con un video vertical 9:16 de 6 segundos. Cambia el modelo, la duración o el formato si tu publicación lo necesita; el costo en créditos se actualiza al cambiar modelo, duración y resolución.

  5. Genera y revisa

    Envía y espera mientras se renderiza el video. El resultado aparece en la vista previa y se guarda en tu Historial para que puedas volver a él cuando quieras. Si la generación falla, los créditos regresan a tu saldo automáticamente.

Adagio

Dónde usar un video de gigante

La versión vertical de seis segundos que viene por defecto está pensada para los feeds del celular, y con un par de ajustes sirve para otros lugares.

Adagio

Cómo elegir la foto y los detalles

Hay dos cosas que influyen más que cualquier ajuste: la imagen que subes y las pocas palabras que agregas. El prompt de la escena ya está redactado, así que ninguna de las dos necesita ser elaborada.

Coda

Preguntas frecuentes sobre City Giant

Fotos, parecido, modelos, sonido, créditos y uso responsable.

01

¿El gigante se verá exactamente como la persona de mi foto?

No exactamente. El modelo interpreta tu foto y recrea a la persona a una escala muy distinta dentro de una escena nueva, así que el rostro, la ropa y las proporciones salen como un parecido, no como una copia. Los resultados cambian de una generación a otra; una foto nítida y bien iluminada ayuda, y un segundo intento puede acercarse más.

02

¿Tengo que escribir un prompt?

No. La escena, el tráfico de la calle y el movimiento de cámara ya están descritos en la plantilla. El campo de detalles es opcional y sirve para cambios pequeños: ropa, clima, hora del día o hacia dónde mira el gigante. Si lo dejas vacío, obtienes la versión estándar.

03

¿Puedo usar una foto grupal o un dibujo?

La plantilla está hecha para un solo sujeto, ya sea una persona o un personaje. En una foto grupal el modelo puede agrandar a quien no era o fundir a varias personas en una, así que recorta primero a una sola figura. Un dibujo de personaje puede funcionar siempre que la figura sea clara y no esté rodeada de muchos otros elementos.

04

¿Qué modelo conviene elegir?

Empieza con MiniMax H3, el predeterminado. Wan 3.0 y Seedance 2.5 generan la misma escena, pero cada uno dibuja la ciudad, la luz y el movimiento a su manera, y el costo en créditos varía entre ellos. Si te gusta la idea pero no el resultado visual, deja la foto y los detalles igual y cambia solo el modelo.

05

¿El video tiene sonido?

En los modelos que admiten audio, el video incluye un ambiente de ciudad generado junto con la imagen, para que la calle suene como una calle de verdad. Que haya audio o no depende del modelo que elijas en el generador.

06

¿Por qué mi gigante se ve pequeño o fuera de lugar?

Casi siempre la foto o los detalles juegan en contra de la escala. Los primeros planos cerrados, varias personas en cuadro, los filtros fuertes y las imágenes oscuras le dan menos información al modelo, y los detalles que añaden otras acciones o personajes distraen de la revelación. Una duración muy corta también puede dejar menos tiempo para el alejamiento.

07

¿Puedo cambiar la duración o hacerlo horizontal?

Sí. La plantilla arranca con 6 segundos en vertical 9:16, y ambos ajustes se cambian en el generador. Elige un formato ancho como 16:9 para YouTube o presentaciones; un video más largo le da más tiempo a la revelación, y el costo en créditos se actualiza en consecuencia.

08

¿Cómo se cobran los créditos?

Necesitas iniciar sesión, y cada video se paga con créditos. El costo depende del modelo, la duración y la resolución, y se actualiza en el botón Generar a medida que los cambias, así que lo ves antes de enviar. Si una generación falla, los créditos se reembolsan automáticamente.

09

¿Dónde encuentro mis videos terminados?

Cada video terminado se guarda en tu Historial de Sonata AI. Así puedes volver a tomas anteriores, comparar la misma foto con distintos modelos y quedarte con la versión que más te guste.

10

¿Puedo hacer un video de gigante con la foto de otra persona?

Solo con su permiso. Sube únicamente fotos de personas que estén de acuerdo, y no uses el resultado para engañar a nadie, por ejemplo haciéndolo pasar por una grabación real, ni para burlarte de la persona o acosarla. Los videos de desconocidos hechos sin consentimiento no son el propósito de esta plantilla.

11

¿Sonata AI tiene relación con MiniMax, Alibaba o ByteDance?

No. Sonata AI es una plataforma independiente y no está afiliada a MiniMax, Alibaba ni ByteDance. MiniMax H3, Wan 3.0 y Seedance 2.5 son marcas de sus respectivos propietarios; los nombres aparecen aquí solo para indicarte qué modelo genera tu video.