Taxis, autobuses, postes de luz, pasos peatonales y gente en la acera funcionan como reglas de medir. Cualquiera sabe más o menos cuánto mide una persona o un auto, así que una figura que los hace ver como juguetes se percibe enorme en un segundo. Por eso la escena mantiene el tráfico pequeño y constante alrededor de los pies del gigante en vez de dejar la calle vacía.
IAllegro
Crea un video City Giant con una sola foto
City Giant es una plantilla que convierte una foto en video: subes la imagen de una persona o de un personaje y el modelo de video la recrea como un gigante de pie en una calle del centro, más alto que los edificios que lo rodean. Autos y peatones pasan junto a sus pies mientras la cámara se aleja despacio e inclina hacia arriba, hasta mostrar al gigante completo con el skyline detrás. La escena ya está lista; los detalles opcionales te permiten ajustarla.
Modelo actualMiniMax H3
Andante
La plantilla en resumen
La escena y el movimiento de cámara los define la plantilla. Todo lo demás de esta lista se puede cambiar en el generador antes de enviar.
- Entrada
- Una foto de una persona o de un personaje. Un solo sujeto bien visible funciona mejor que una foto grupal.
- Escena
- Integrada: el sujeto aparece como un gigante en una calle del centro, con autos y peatones pequeños moviéndose a ras de suelo.
- Cámara
- Un alejamiento lento combinado con una inclinación hacia arriba que termina en la figura completa frente al skyline.
- Detalles opcionales
- Ropa, clima, hora del día y hacia dónde mira el gigante.
- Formato
- Vertical 9:16 por defecto; cámbialo a otro formato, como 16:9, si quieres una versión horizontal.
- Duración
- 6 segundos por defecto, ajustable en el generador.
- Modelos
- MiniMax H3 (predeterminado), Wan 3.0 o Seedance 2.5.
- Sonido
- Ambiente de ciudad generado junto con el video en los modelos que admiten audio.
- Costo
- Se paga con créditos tras iniciar sesión. El costo exacto aparece antes de generar y, si la generación falla, los créditos se devuelven automáticamente.
Adagio
Por qué una toma City Giant se ve enorme
Nadie calcula el tamaño de algo en el vacío: el ojo compara. La plantilla incluye las comparaciones principales, y entender cómo funcionan te ayuda a elegir una foto y unos detalles que refuercen la ilusión en lugar de estropearla.
Scherzo
Cómo hacer el video paso a paso
Son cinco pasos cortos. El único que pide pensarlo un poco es elegir la foto.
Inicia sesión
Entra con Google o con tu correo. La plantilla se paga con créditos de Sonata AI, así que revisa tu saldo primero; el botón Generar muestra el costo de la configuración actual antes de cobrar nada.
Sube una foto
Elige una imagen en la que se vea con claridad a una sola persona o personaje, con el rostro y la ropa a la vista. Una foto nítida, bien iluminada y sin filtros fuertes le da al modelo la mayor cantidad de información; más abajo, en los consejos sobre la foto, te explicamos por qué.
Agrega detalles si quieres
Deja vacío el campo de detalles para obtener la escena estándar, o escribe una nota breve sobre la ropa, el clima, la hora del día o hacia dónde mira el gigante. Basta con una o dos frases, porque el prompt de la escena ya está escrito.
Elige modelo, duración y formato
MiniMax H3 viene seleccionado con un video vertical 9:16 de 6 segundos. Cambia el modelo, la duración o el formato si tu publicación lo necesita; el costo en créditos se actualiza al cambiar modelo, duración y resolución.
Genera y revisa
Envía y espera mientras se renderiza el video. El resultado aparece en la vista previa y se guarda en tu Historial para que puedas volver a él cuando quieras. Si la generación falla, los créditos regresan a tu saldo automáticamente.
Adagio
Dónde usar un video de gigante
La versión vertical de seis segundos que viene por defecto está pensada para los feeds del celular, y con un par de ajustes sirve para otros lugares.
Adagio
Cómo elegir la foto y los detalles
Hay dos cosas que influyen más que cualquier ajuste: la imagen que subes y las pocas palabras que agregas. El prompt de la escena ya está redactado, así que ninguna de las dos necesita ser elaborada.
Coda
Preguntas frecuentes sobre City Giant
Fotos, parecido, modelos, sonido, créditos y uso responsable.
01¿El gigante se verá exactamente como la persona de mi foto?
No exactamente. El modelo interpreta tu foto y recrea a la persona a una escala muy distinta dentro de una escena nueva, así que el rostro, la ropa y las proporciones salen como un parecido, no como una copia. Los resultados cambian de una generación a otra; una foto nítida y bien iluminada ayuda, y un segundo intento puede acercarse más.
02¿Tengo que escribir un prompt?
No. La escena, el tráfico de la calle y el movimiento de cámara ya están descritos en la plantilla. El campo de detalles es opcional y sirve para cambios pequeños: ropa, clima, hora del día o hacia dónde mira el gigante. Si lo dejas vacío, obtienes la versión estándar.
03¿Puedo usar una foto grupal o un dibujo?
La plantilla está hecha para un solo sujeto, ya sea una persona o un personaje. En una foto grupal el modelo puede agrandar a quien no era o fundir a varias personas en una, así que recorta primero a una sola figura. Un dibujo de personaje puede funcionar siempre que la figura sea clara y no esté rodeada de muchos otros elementos.
04¿Qué modelo conviene elegir?
Empieza con MiniMax H3, el predeterminado. Wan 3.0 y Seedance 2.5 generan la misma escena, pero cada uno dibuja la ciudad, la luz y el movimiento a su manera, y el costo en créditos varía entre ellos. Si te gusta la idea pero no el resultado visual, deja la foto y los detalles igual y cambia solo el modelo.
05¿El video tiene sonido?
En los modelos que admiten audio, el video incluye un ambiente de ciudad generado junto con la imagen, para que la calle suene como una calle de verdad. Que haya audio o no depende del modelo que elijas en el generador.
06¿Por qué mi gigante se ve pequeño o fuera de lugar?
Casi siempre la foto o los detalles juegan en contra de la escala. Los primeros planos cerrados, varias personas en cuadro, los filtros fuertes y las imágenes oscuras le dan menos información al modelo, y los detalles que añaden otras acciones o personajes distraen de la revelación. Una duración muy corta también puede dejar menos tiempo para el alejamiento.
07¿Puedo cambiar la duración o hacerlo horizontal?
Sí. La plantilla arranca con 6 segundos en vertical 9:16, y ambos ajustes se cambian en el generador. Elige un formato ancho como 16:9 para YouTube o presentaciones; un video más largo le da más tiempo a la revelación, y el costo en créditos se actualiza en consecuencia.
08¿Cómo se cobran los créditos?
Necesitas iniciar sesión, y cada video se paga con créditos. El costo depende del modelo, la duración y la resolución, y se actualiza en el botón Generar a medida que los cambias, así que lo ves antes de enviar. Si una generación falla, los créditos se reembolsan automáticamente.
09¿Dónde encuentro mis videos terminados?
Cada video terminado se guarda en tu Historial de Sonata AI. Así puedes volver a tomas anteriores, comparar la misma foto con distintos modelos y quedarte con la versión que más te guste.
10¿Puedo hacer un video de gigante con la foto de otra persona?
Solo con su permiso. Sube únicamente fotos de personas que estén de acuerdo, y no uses el resultado para engañar a nadie, por ejemplo haciéndolo pasar por una grabación real, ni para burlarte de la persona o acosarla. Los videos de desconocidos hechos sin consentimiento no son el propósito de esta plantilla.
11¿Sonata AI tiene relación con MiniMax, Alibaba o ByteDance?
No. Sonata AI es una plataforma independiente y no está afiliada a MiniMax, Alibaba ni ByteDance. MiniMax H3, Wan 3.0 y Seedance 2.5 son marcas de sus respectivos propietarios; los nombres aparecen aquí solo para indicarte qué modelo genera tu video.