Taxis, Busse, Straßenlaternen, Zebrastreifen und Menschen auf dem Gehweg dienen als Maßstab. Jeder weiß ungefähr, wie groß ein Mensch oder ein Auto ist, deshalb wirkt eine Gestalt, neben der sie wie Spielzeug aussehen, innerhalb einer Sekunde gewaltig. Aus diesem Grund lässt die Szene den Verkehr klein und dicht um die Füße des Riesen fließen, statt die Straße leer zu lassen.
- Startseite
- Effekte
- City Giant
IAllegro
Vom Foto zum Stadtriesen-Video
City Giant ist eine Vorlage, die aus einem Foto ein Video macht: Sie laden das Bild einer Person oder Figur hoch, und das Videomodell baut sie als Riesen neu auf, der mitten in einer Innenstadtstraße steht und die Häuser ringsum überragt. Autos und Fußgänger ziehen an seinen Füßen vorbei, während die Kamera langsam zurückfährt und nach oben schwenkt, bis der ganze Stadtriese vor der Skyline steht. Die Szene ist fertig vorbereitet; optionale Details passen sie an.
Aktuelles ModellMiniMax H3
Andante
Die Vorlage im Überblick
Szene und Kamerabewegung legt die Vorlage fest. Alles Weitere in dieser Liste lässt sich vor dem Absenden im Generator ändern.
- Eingabe
- Ein Foto einer Person oder einer Figur. Ein einzelnes, gut erkennbares Motiv funktioniert besser als ein Gruppenbild.
- Szene
- Fest eingebaut: Das Motiv steht als Riese in einer Innenstadtstraße, unten bewegen sich kleine Autos und Fußgänger auf Straßenhöhe.
- Kamera
- Eine langsame Rückwärtsfahrt kombiniert mit einem Schwenk nach oben, die mit der ganzen Figur vor der Skyline endet.
- Optionale Details
- Kleidung, Wetter, Tageszeit und wohin der Riese schaut.
- Seitenverhältnis
- Standardmäßig Hochformat 9:16; für eine Querformat-Version auf ein anderes Format wie 16:9 umstellen.
- Dauer
- Standardmäßig 6 Sekunden, im Generator einstellbar.
- Modelle
- MiniMax H3 (Standard), Wan 3.0 oder Seedance 2.5.
- Ton
- Großstadtgeräusche, die bei Modellen mit Audiounterstützung zusammen mit dem Clip entstehen.
- Kosten
- Bezahlt wird nach der Anmeldung mit Credits. Die genauen Kosten stehen vor dem Generieren fest, und fehlgeschlagene Generierungen werden automatisch erstattet.
Adagio
Warum der Stadtriese so gewaltig wirkt
Größe beurteilt das Auge nie für sich allein, es vergleicht. Die Vorlage bringt die wichtigsten Vergleiche schon mit. Wer weiß, wie sie wirken, wählt leichter ein Foto und Details, die die Illusion stützen, statt sie zu stören.
Scherzo
So entsteht der Clip
Fünf kurze Schritte. Nachdenken müssen Sie eigentlich nur bei der Wahl des Fotos.
Anmelden
Melden Sie sich mit Google oder per E-Mail an. Die Vorlage wird mit Sonata-AI-Credits bezahlt, prüfen Sie also zuerst Ihr Guthaben; der Generieren-Button zeigt die Kosten der aktuellen Einstellungen, bevor etwas abgebucht wird.
Ein Foto hochladen
Wählen Sie ein Bild, auf dem eine einzelne Person oder Figur gut zu sehen ist, samt Gesicht und Kleidung. Ein scharfes, gut ausgeleuchtetes Foto ohne starke Filter liefert dem Modell die meisten Informationen; warum, erklären die Foto-Tipps weiter unten.
Bei Bedarf Details ergänzen
Lassen Sie das Detailfeld leer, erhalten Sie die Standardszene. Sie können aber auch kurz Kleidung, Wetter, Tageszeit oder die Blickrichtung des Riesen angeben. Ein, zwei Stichworte genügen, denn der Szenen-Prompt ist bereits geschrieben.
Modell, Dauer und Format wählen
Voreingestellt sind MiniMax H3 und ein 6 Sekunden langer Clip im Hochformat 9:16. Ändern Sie Modell, Länge oder Seitenverhältnis, wenn Ihr Beitrag es verlangt; die Credit-Kosten passen sich an Modell, Dauer und Auflösung an.
Generieren und ansehen
Absenden und warten, während das Video gerendert wird. Der fertige Clip erscheint in der Vorschau und wird in Ihrem Verlauf gespeichert, sodass Sie später darauf zurückgreifen können. Schlägt eine Generierung fehl, gehen die Credits automatisch auf Ihr Guthaben zurück.
Adagio
Wofür sich ein Riesen-Clip eignet
Die voreingestellte Hochformat-Version mit sechs Sekunden ist für Smartphone-Feeds gemacht. Mit ein, zwei geänderten Einstellungen passt sie auch anderswo.
Adagio
Das richtige Foto und passende Details
Zwei Dinge beeinflussen das Ergebnis stärker als jede Einstellung: das hochgeladene Bild und die wenigen Worte, die Sie ergänzen. Der Szenen-Prompt steht bereits, keines von beiden muss also aufwendig sein.
Coda
Häufige Fragen zu City Giant
Fotos, Ähnlichkeit, Modelle, Ton, Credits und verantwortungsvolle Nutzung.
01Sieht der Riese genauso aus wie die Person auf meinem Foto?
Nicht genau. Das Modell interpretiert Ihr Foto und baut die Person in einem völlig anderen Maßstab in einer neuen Szene auf. Gesicht, Kleidung und Proportionen ergeben deshalb eine Ähnlichkeit, keine Kopie. Die Ergebnisse unterscheiden sich von Generierung zu Generierung; ein klares, gut beleuchtetes Foto hilft, und ein zweiter Versuch trifft es vielleicht besser.
02Muss ich einen Prompt schreiben?
Nein. Szene, Straßenverkehr und Kamerabewegung sind in der Vorlage bereits beschrieben. Das Detailfeld ist optional und für kleine Änderungen gedacht: Kleidung, Wetter, Tageszeit oder wohin der Riese schaut. Bleibt es leer, erhalten Sie die Standardversion.
03Kann ich ein Gruppenfoto oder eine Zeichnung verwenden?
Die Vorlage ist für ein einzelnes Motiv gedacht, egal ob Person oder Figur. Bei einem Gruppenfoto vergrößert das Modell womöglich die falsche Person oder verschmilzt mehrere zu einer, schneiden Sie also vorher auf eine Gestalt zu. Eine gezeichnete Figur kann funktionieren, solange sie klar erkennbar ist und nicht zwischen vielen anderen Elementen untergeht.
04Welches Modell sollte ich nehmen?
Starten Sie mit MiniMax H3, dem Standard. Wan 3.0 und Seedance 2.5 erzeugen dieselbe Szene, stellen Stadt, Licht und Bewegung aber jeweils anders dar, und auch die Credit-Kosten unterscheiden sich. Gefällt Ihnen die Idee, aber nicht der Look, behalten Sie Foto und Details bei und tauschen Sie nur das Modell.
05Hat das Video Ton?
Bei Modellen mit Audiounterstützung erhält der Clip Großstadtgeräusche, die zusammen mit dem Bild entstehen, damit die Straße auch nach Straße klingt. Ob Ton dabei ist, hängt vom Modell ab, das Sie im Generator auswählen.
06Warum wirkt mein Riese klein oder fehl am Platz?
Meist arbeiten Foto oder Details gegen den Größeneindruck. Enge Porträts, mehrere Personen im Bild, starke Filter und dunkle Aufnahmen geben dem Modell weniger Material, und Details mit zusätzlichen Aktionen oder Figuren lenken von der Enthüllung ab. Eine sehr kurze Dauer kann außerdem weniger Zeit für die Rückwärtsfahrt lassen.
07Kann ich die Länge ändern oder ein Querformat erstellen?
Ja. Die Vorlage startet mit 6 Sekunden im Hochformat 9:16, und beides lässt sich im Generator ändern. Wählen Sie für YouTube oder Präsentationen ein breites Format wie 16:9; ein längerer Clip gibt der langsamen Enthüllung mehr Zeit, und die Credit-Kosten passen sich entsprechend an.
08Wie werden Credits abgerechnet?
Sie müssen angemeldet sein, und jedes Video wird mit Credits bezahlt. Die Kosten hängen von Modell, Dauer und Auflösung ab und werden auf dem Generieren-Button aktualisiert, sobald Sie etwas ändern. So sehen Sie den Betrag vor dem Absenden. Schlägt eine Generierung fehl, werden die Credits automatisch erstattet.
09Wo finde ich meine fertigen Videos?
Jedes fertige Video wird in Ihrem Verlauf auf Sonata AI gespeichert. So können Sie frühere Takes wieder aufrufen, dasselbe Foto mit verschiedenen Modellen vergleichen und die Version behalten, die Ihnen am besten gefällt.
10Darf ich ein Riesen-Video von jemand anderem machen?
Nur mit dessen Einverständnis. Laden Sie ausschließlich Fotos von Menschen hoch, die zugestimmt haben, und nutzen Sie das Ergebnis nicht, um andere zu täuschen, etwa indem Sie es als echte Aufnahme ausgeben, oder um die gezeigte Person bloßzustellen oder zu belästigen. Clips von Fremden ohne deren Zustimmung sind nicht das, wofür diese Vorlage gedacht ist.
11Gehört Sonata AI zu MiniMax, Alibaba oder ByteDance?
Nein. Sonata AI ist eine unabhängige Plattform und steht in keiner Verbindung zu MiniMax, Alibaba oder ByteDance. MiniMax H3, Wan 3.0 und Seedance 2.5 sind Marken ihrer jeweiligen Inhaber; die Namen stehen hier nur, damit Sie wissen, welches Modell Ihren Clip erzeugt.