Táxis, ônibus, postes, faixas de pedestre e pessoas na calçada funcionam como réguas. Todo mundo sabe mais ou menos a altura de uma pessoa ou de um carro, então uma figura que faz tudo isso parecer brinquedo é percebida como enorme em um segundo. É por isso que a cena mantém o trânsito pequeno e movimentado em volta dos pés do gigante, em vez de deixar a rua vazia.
IAllegro
Crie um vídeo City Giant com uma única foto
City Giant é um template que transforma foto em vídeo: você envia a imagem de uma pessoa ou de um personagem, e o modelo de vídeo recria essa figura como um gigante parado no meio de uma rua do centro, mais alto que os prédios ao redor. Carros e pedestres passam rente aos pés dele enquanto a câmera se afasta devagar e inclina para cima, até revelar o gigante inteiro contra o skyline. A cena já vem pronta; detalhes opcionais deixam tudo com a sua cara.
Modelo atualMiniMax H3
Andante
O template em resumo
A cena e o movimento de câmera são definidos pelo template. Todo o resto desta lista pode ser alterado no gerador antes de enviar.
- Entrada
- Uma foto de uma pessoa ou de um personagem. Um único assunto bem visível funciona melhor do que uma foto em grupo.
- Cena
- Embutida: o assunto aparece como um gigante numa rua do centro, com carros e pedestres pequenos circulando no nível da calçada.
- Câmera
- Um afastamento lento combinado com uma inclinação para cima, terminando na figura inteira diante do skyline.
- Detalhes opcionais
- Roupa, clima, hora do dia e para onde o gigante está olhando.
- Formato
- Vertical 9:16 por padrão; troque para outro formato, como 16:9, se quiser uma versão horizontal.
- Duração
- 6 segundos por padrão, ajustável no gerador.
- Modelos
- MiniMax H3 (padrão), Wan 3.0 ou Seedance 2.5.
- Som
- Ambiente sonoro de cidade gerado junto com o vídeo nos modelos que têm suporte a áudio.
- Custo
- Pago com créditos depois de entrar na conta. O custo exato aparece antes de gerar, e gerações que falham são reembolsadas automaticamente.
Adagio
Por que uma cena City Giant parece tão grande
Ninguém avalia tamanho no vazio: o olho compara. O template já traz as comparações mais importantes, e entender como elas funcionam ajuda você a escolher uma foto e detalhes que reforcem a ilusão em vez de atrapalhá-la.
Scherzo
Como fazer o vídeo
São cinco passos rápidos. O único que pede um pouco de atenção é escolher a foto.
Entre na sua conta
Entre com o Google ou com seu e-mail. O template é pago com créditos da Sonata AI, então confira o saldo antes; o botão Gerar mostra o custo das configurações atuais antes de qualquer cobrança.
Envie uma foto
Escolha uma imagem em que uma única pessoa ou personagem apareça com clareza, com rosto e roupa à mostra. Uma foto nítida, bem iluminada e sem filtros pesados dá ao modelo o máximo de informação; as dicas de foto mais abaixo explicam o porquê.
Adicione detalhes, se quiser
Deixe o campo de detalhes vazio para ter a cena padrão, ou escreva uma nota curta sobre roupa, clima, hora do dia ou para onde o gigante olha. Uma ou duas expressões bastam, porque o prompt da cena já está escrito.
Escolha modelo, duração e formato
O MiniMax H3 já vem selecionado, com um vídeo vertical 9:16 de 6 segundos. Mude o modelo, a duração ou o formato se o seu post precisar; o custo em créditos se atualiza conforme você muda modelo, duração e resolução.
Gere e confira
Envie e aguarde enquanto o vídeo é renderizado. O resultado aparece na prévia e fica salvo no seu Histórico, para você voltar a ele quando quiser. Se a geração falhar, os créditos voltam automaticamente para o seu saldo.
Adagio
Onde usar um vídeo de gigante
A versão vertical de seis segundos que vem por padrão foi pensada para o feed do celular, e com um ou dois ajustes ela serve para outros lugares.
Adagio
Como escolher a foto e os detalhes
Duas coisas pesam mais do que qualquer configuração: a imagem que você envia e as poucas palavras que acrescenta. O prompt da cena já está pronto, então nenhuma das duas precisa ser elaborada.
Coda
Perguntas frequentes sobre o City Giant
Fotos, semelhança, modelos, som, créditos e uso responsável.
01O gigante vai ficar idêntico à pessoa da foto?
Não exatamente. O modelo interpreta a sua foto e recria a pessoa numa escala bem diferente, dentro de uma cena nova, então rosto, roupa e proporções saem parecidos, não copiados. Os resultados variam de uma geração para outra; uma foto nítida e bem iluminada ajuda, e uma segunda tentativa pode chegar mais perto.
02Preciso escrever um prompt?
Não. A cena, o trânsito da rua e o movimento de câmera já estão descritos no template. O campo de detalhes é opcional e serve para pequenos ajustes: roupa, clima, hora do dia ou para onde o gigante olha. Deixe em branco para receber a versão padrão.
03Posso usar uma foto em grupo ou um desenho?
O template foi feito para um único assunto, seja uma pessoa ou um personagem. Numa foto em grupo, o modelo pode aumentar a pessoa errada ou fundir várias em uma só, então recorte para uma figura antes. Um desenho de personagem pode funcionar, desde que a figura esteja clara e não fique cercada de outros elementos.
04Qual modelo devo escolher?
Comece pelo MiniMax H3, o padrão. O Wan 3.0 e o Seedance 2.5 geram a mesma cena, mas cada um desenha a cidade, a luz e o movimento do seu jeito, e o custo em créditos muda entre eles. Se você gostou da ideia mas não do visual, mantenha a foto e os detalhes e troque só o modelo.
05O vídeo tem som?
Nos modelos com suporte a áudio, o vídeo vem com um ambiente sonoro de cidade gerado junto com a imagem, para a rua soar como rua de verdade. Ter som ou não depende do modelo que você escolher no gerador.
06Por que meu gigante parece pequeno ou fora de lugar?
Quase sempre a foto ou os detalhes estão jogando contra a escala. Closes fechados, várias pessoas no quadro, filtros pesados e imagens escuras dão menos material ao modelo, e detalhes que acrescentam outras ações ou personagens tiram a atenção da revelação. Uma duração muito curta também pode deixar menos tempo para o afastamento da câmera.
07Posso mudar a duração ou fazer na horizontal?
Pode. O template começa com 6 segundos na vertical 9:16, e as duas opções podem ser alteradas no gerador. Escolha um formato largo, como 16:9, para YouTube ou apresentações; um vídeo mais longo dá mais tempo para a revelação lenta, e o custo em créditos é atualizado de acordo.
08Como os créditos são cobrados?
É preciso entrar na conta, e cada vídeo é pago com créditos. O custo depende do modelo, da duração e da resolução, e se atualiza no botão Gerar conforme você muda essas opções, então você vê o valor antes de enviar. Se uma geração falhar, os créditos são reembolsados automaticamente.
09Onde encontro meus vídeos prontos?
Todo vídeo pronto fica salvo no seu Histórico da Sonata AI. Assim dá para voltar a tomadas anteriores, comparar a mesma foto em modelos diferentes e ficar com a versão de que você mais gostou.
10Posso fazer um vídeo de gigante com a foto de outra pessoa?
Só com a autorização dela. Envie apenas fotos de pessoas que concordaram, e não use o resultado para enganar ninguém, por exemplo fazendo o vídeo passar por uma gravação real, nem para zombar da pessoa ou assediá-la. Vídeos de desconhecidos feitos sem consentimento não são a proposta deste template.
11A Sonata AI tem ligação com a MiniMax, a Alibaba ou a ByteDance?
Não. A Sonata AI é uma plataforma independente e não tem vínculo com a MiniMax, a Alibaba ou a ByteDance. MiniMax H3, Wan 3.0 e Seedance 2.5 são marcas dos respectivos donos; os nomes aparecem aqui só para indicar qual modelo gera o seu vídeo.