Taxis, bus, lampadaires, passages piétons et passants sur le trottoir servent d'étalons. Chacun sait à peu près quelle hauteur fait une personne ou une voiture, si bien qu'une silhouette qui les écrase paraît gigantesque en une seconde. C'est pour cela que la scène garde une circulation dense et minuscule autour des pieds du géant plutôt qu'une rue vide.
IAllegro
Créez une vidéo City Giant à partir d'une seule photo
City Giant est un modèle de scène qui transforme une photo en vidéo : importez le portrait d'une personne ou d'un personnage, et le modèle vidéo le recrée en géant debout au milieu d'une rue du centre-ville, plus grand que les immeubles qui l'entourent. Voitures et passants défilent à ses pieds pendant que la caméra recule lentement et pivote vers le haut, jusqu'à révéler le géant tout entier sur fond de skyline. La scène est prête ; quelques détails facultatifs suffisent pour la personnaliser.
Modèle actuelMiniMax H3
Andante
Ce que fait l'effet par défaut
La scène et le mouvement de caméra sont fixés par l'effet. Tout le reste de cette liste se règle dans le générateur avant l'envoi.
- Entrée
- Une photo d'une personne ou d'un personnage. Un seul sujet bien visible donne de meilleurs résultats qu'une photo de groupe.
- Scène
- Intégrée : le sujet se tient en géant dans une rue du centre-ville, avec de petites voitures et des passants qui circulent au niveau du trottoir.
- Caméra
- Un lent travelling arrière associé à une bascule vers le haut, qui se termine sur la silhouette entière devant la skyline.
- Détails facultatifs
- Tenue, météo, moment de la journée et direction du regard du géant.
- Format
- Vertical 9:16 par défaut ; passez à un autre format, comme le 16:9, pour une version horizontale.
- Durée
- 6 secondes par défaut, modifiable dans le générateur.
- Modèles
- MiniMax H3 (par défaut), Wan 3.0 ou Seedance 2.5.
- Son
- Ambiance sonore urbaine générée avec la vidéo sur les modèles qui gèrent l'audio.
- Coût
- Payé en crédits après connexion. Le coût exact s'affiche avant la génération, et les crédits d'une génération échouée sont remboursés automatiquement.
Adagio
Pourquoi un plan City Giant paraît immense
L'œil ne mesure jamais une taille dans l'absolu : il compare. L'effet met en place les principales comparaisons ; savoir comment elles fonctionnent aide à choisir une photo et des détails qui renforcent l'illusion au lieu de la contrarier.
Scherzo
Réaliser la vidéo en cinq étapes
Chaque étape prend quelques secondes. La seule qui demande un peu de réflexion, c'est le choix de la photo.
Connectez-vous
Connectez-vous avec Google ou par e-mail. L'effet se paie en crédits Sonata AI, alors jetez d'abord un œil à votre solde ; le bouton Générer affiche le coût des réglages en cours avant tout débit.
Importez une photo
Choisissez une image où une seule personne ou un seul personnage est bien visible, visage et tenue compris. Une photo nette, bien éclairée et sans filtre appuyé donne au modèle le plus d'informations ; les conseils photo plus bas expliquent pourquoi.
Ajoutez des détails si vous voulez
Laissez le champ des détails vide pour obtenir la scène standard, ou ajoutez une courte note sur la tenue, la météo, le moment de la journée ou la direction du regard. Une ou deux expressions suffisent, puisque le prompt de la scène est déjà écrit.
Choisissez modèle, durée et format
MiniMax H3 est présélectionné, avec une vidéo verticale 9:16 de 6 secondes. Changez de modèle, de durée ou de format si votre publication l'exige ; le coût en crédits se met à jour selon le modèle, la durée et la résolution.
Générez et retrouvez la vidéo
Lancez la génération et patientez pendant le rendu. La vidéo terminée apparaît dans l'aperçu et reste enregistrée dans votre Historique, où vous pouvez la retrouver plus tard. Si la génération échoue, les crédits reviennent automatiquement sur votre solde.
Adagio
Où utiliser une vidéo de géant
La version verticale de six secondes proposée par défaut est pensée pour les fils d'actualité sur mobile, et deux ou trois réglages suffisent pour l'adapter à d'autres usages.
Adagio
Bien choisir la photo et les détails
Deux choses pèsent plus que n'importe quel réglage : l'image que vous importez et les quelques mots que vous ajoutez. Le prompt de la scène est déjà rédigé, donc ni l'une ni les autres n'ont besoin d'être élaborés.
Coda
City Giant : questions fréquentes
Photos, ressemblance, modèles, son, crédits et usage responsable.
01Le géant ressemblera-t-il exactement à la personne de la photo ?
Pas exactement. Le modèle interprète votre photo et recrée la personne à une tout autre échelle dans une nouvelle scène : le visage, la tenue et les proportions donnent une ressemblance, pas une copie. Les résultats varient d'une génération à l'autre ; une photo nette et bien éclairée aide, et un second essai peut tomber plus juste.
02Faut-il écrire un prompt ?
Non. La scène, la circulation et le mouvement de caméra sont déjà décrits par l'effet. Le champ des détails est facultatif et sert aux petits ajustements : tenue, météo, moment de la journée ou direction du regard du géant. Laissez-le vide pour obtenir la version standard.
03Puis-je utiliser une photo de groupe ou un dessin ?
L'effet est conçu pour un seul sujet, personne réelle ou personnage. Sur une photo de groupe, le modèle risque d'agrandir la mauvaise personne ou de fondre plusieurs visages en un seul ; recadrez d'abord sur une silhouette. Un dessin de personnage peut fonctionner tant que la figure est claire et pas noyée dans d'autres éléments.
04Quel modèle choisir ?
Commencez par MiniMax H3, le modèle par défaut. Wan 3.0 et Seedance 2.5 génèrent la même scène, mais chacun dessine la ville, la lumière et le mouvement à sa manière, et le coût en crédits n'est pas le même. Si l'idée vous plaît mais pas le rendu, gardez la photo et les détails et changez uniquement de modèle.
05La vidéo a-t-elle du son ?
Sur les modèles qui gèrent l'audio, la vidéo est accompagnée d'une ambiance urbaine générée en même temps que l'image, pour que la rue sonne comme une vraie rue. La présence du son dépend du modèle choisi dans le générateur.
06Pourquoi mon géant paraît-il petit ou mal intégré ?
En général, la photo ou les détails travaillent contre l'échelle. Gros plans serrés, plusieurs personnes dans le cadre, filtres appuyés et images sombres donnent moins de matière au modèle, et des détails qui ajoutent d'autres actions ou personnages détournent l'attention de la révélation. Une durée très courte peut aussi laisser moins de temps au recul de la caméra.
07Puis-je changer la durée ou passer en horizontal ?
Oui. L'effet démarre à 6 secondes en vertical 9:16, et les deux réglages se modifient dans le générateur. Choisissez un format large comme le 16:9 pour YouTube ou une présentation ; une vidéo plus longue donne plus de temps à la lente révélation, et le coût en crédits s'ajuste en conséquence.
08Comment les crédits sont-ils décomptés ?
Il faut être connecté, et chaque vidéo se paie en crédits. Le coût dépend du modèle, de la durée et de la résolution ; il se met à jour sur le bouton Générer quand vous modifiez ces réglages, donc vous le voyez avant d'envoyer. Si une génération échoue, les crédits sont remboursés automatiquement.
09Où retrouver mes vidéos terminées ?
Chaque vidéo terminée est enregistrée dans votre Historique sur Sonata AI. Vous pouvez ainsi revoir les prises précédentes, comparer la même photo sur différents modèles et garder la version que vous préférez.
10Puis-je faire une vidéo de géant avec la photo de quelqu'un d'autre ?
Seulement avec son accord. N'importez que des photos de personnes qui ont accepté, et n'utilisez pas le résultat pour tromper qui que ce soit, par exemple en le faisant passer pour une vraie vidéo, ni pour vous moquer de la personne ou la harceler. Des vidéos d'inconnus réalisées sans consentement ne sont pas la vocation de cet effet.
11Sonata AI est-il lié à MiniMax, Alibaba ou ByteDance ?
Non. Sonata AI est une plateforme indépendante, sans lien avec MiniMax, Alibaba ou ByteDance. MiniMax H3, Wan 3.0 et Seedance 2.5 sont des marques appartenant à leurs propriétaires respectifs ; ces noms figurent ici uniquement pour indiquer quel modèle génère votre vidéo.