IAllegro

Vom Foto zum Stadtriesen-Video

City Giant ist eine Vorlage, die aus einem Foto ein Video macht: Sie laden das Bild einer Person oder Figur hoch, und das Videomodell baut sie als Riesen neu auf, der mitten in einer Innenstadtstraße steht und die Häuser ringsum überragt. Autos und Fußgänger ziehen an seinen Füßen vorbei, während die Kamera langsam zurückfährt und nach oben schwenkt, bis der ganze Stadtriese vor der Skyline steht. Die Szene ist fertig vorbereitet; optionale Details passen sie an.

Aktuelles ModellMiniMax H3
Ihr Foto0/1

Eine Person, Gesicht und Outfit gut erkennbar, gutes Licht, keine starken Filter. Verwenden Sie nur Fotos von Personen, die zugestimmt haben.JPG, PNG oder WebP, bis 20 MB.

0 / 300
Erweiterte EinstellungenMiniMax H3 · 768P · 9:16 · 6 s
Modell
6 s
Auflösung
Seitenverhältnis
Ton

MiniMax H3 erzeugt Videos immer mit Ton.

Der Preis passt sich Ihren Einstellungen an. Schlägt eine Generierung fehl, werden die Credits automatisch erstattet.

Vorschau
Keine Videos. Bitte erstellen Sie zuerst ein Video!
Andante

Die Vorlage im Überblick

Szene und Kamerabewegung legt die Vorlage fest. Alles Weitere in dieser Liste lässt sich vor dem Absenden im Generator ändern.

Eingabe
Ein Foto einer Person oder einer Figur. Ein einzelnes, gut erkennbares Motiv funktioniert besser als ein Gruppenbild.
Szene
Fest eingebaut: Das Motiv steht als Riese in einer Innenstadtstraße, unten bewegen sich kleine Autos und Fußgänger auf Straßenhöhe.
Kamera
Eine langsame Rückwärtsfahrt kombiniert mit einem Schwenk nach oben, die mit der ganzen Figur vor der Skyline endet.
Optionale Details
Kleidung, Wetter, Tageszeit und wohin der Riese schaut.
Seitenverhältnis
Standardmäßig Hochformat 9:16; für eine Querformat-Version auf ein anderes Format wie 16:9 umstellen.
Dauer
Standardmäßig 6 Sekunden, im Generator einstellbar.
Modelle
MiniMax H3 (Standard), Wan 3.0 oder Seedance 2.5.
Ton
Großstadtgeräusche, die bei Modellen mit Audiounterstützung zusammen mit dem Clip entstehen.
Kosten
Bezahlt wird nach der Anmeldung mit Credits. Die genauen Kosten stehen vor dem Generieren fest, und fehlgeschlagene Generierungen werden automatisch erstattet.
Adagio

Warum der Stadtriese so gewaltig wirkt

Größe beurteilt das Auge nie für sich allein, es vergleicht. Die Vorlage bringt die wichtigsten Vergleiche schon mit. Wer weiß, wie sie wirken, wählt leichter ein Foto und Details, die die Illusion stützen, statt sie zu stören.

Scherzo

So entsteht der Clip

Fünf kurze Schritte. Nachdenken müssen Sie eigentlich nur bei der Wahl des Fotos.

  1. Anmelden

    Melden Sie sich mit Google oder per E-Mail an. Die Vorlage wird mit Sonata-AI-Credits bezahlt, prüfen Sie also zuerst Ihr Guthaben; der Generieren-Button zeigt die Kosten der aktuellen Einstellungen, bevor etwas abgebucht wird.

  2. Ein Foto hochladen

    Wählen Sie ein Bild, auf dem eine einzelne Person oder Figur gut zu sehen ist, samt Gesicht und Kleidung. Ein scharfes, gut ausgeleuchtetes Foto ohne starke Filter liefert dem Modell die meisten Informationen; warum, erklären die Foto-Tipps weiter unten.

  3. Bei Bedarf Details ergänzen

    Lassen Sie das Detailfeld leer, erhalten Sie die Standardszene. Sie können aber auch kurz Kleidung, Wetter, Tageszeit oder die Blickrichtung des Riesen angeben. Ein, zwei Stichworte genügen, denn der Szenen-Prompt ist bereits geschrieben.

  4. Modell, Dauer und Format wählen

    Voreingestellt sind MiniMax H3 und ein 6 Sekunden langer Clip im Hochformat 9:16. Ändern Sie Modell, Länge oder Seitenverhältnis, wenn Ihr Beitrag es verlangt; die Credit-Kosten passen sich an Modell, Dauer und Auflösung an.

  5. Generieren und ansehen

    Absenden und warten, während das Video gerendert wird. Der fertige Clip erscheint in der Vorschau und wird in Ihrem Verlauf gespeichert, sodass Sie später darauf zurückgreifen können. Schlägt eine Generierung fehl, gehen die Credits automatisch auf Ihr Guthaben zurück.

Adagio

Wofür sich ein Riesen-Clip eignet

Die voreingestellte Hochformat-Version mit sechs Sekunden ist für Smartphone-Feeds gemacht. Mit ein, zwei geänderten Einstellungen passt sie auch anderswo.

Adagio

Das richtige Foto und passende Details

Zwei Dinge beeinflussen das Ergebnis stärker als jede Einstellung: das hochgeladene Bild und die wenigen Worte, die Sie ergänzen. Der Szenen-Prompt steht bereits, keines von beiden muss also aufwendig sein.

Coda

Häufige Fragen zu City Giant

Fotos, Ähnlichkeit, Modelle, Ton, Credits und verantwortungsvolle Nutzung.

01

Sieht der Riese genauso aus wie die Person auf meinem Foto?

Nicht genau. Das Modell interpretiert Ihr Foto und baut die Person in einem völlig anderen Maßstab in einer neuen Szene auf. Gesicht, Kleidung und Proportionen ergeben deshalb eine Ähnlichkeit, keine Kopie. Die Ergebnisse unterscheiden sich von Generierung zu Generierung; ein klares, gut beleuchtetes Foto hilft, und ein zweiter Versuch trifft es vielleicht besser.

02

Muss ich einen Prompt schreiben?

Nein. Szene, Straßenverkehr und Kamerabewegung sind in der Vorlage bereits beschrieben. Das Detailfeld ist optional und für kleine Änderungen gedacht: Kleidung, Wetter, Tageszeit oder wohin der Riese schaut. Bleibt es leer, erhalten Sie die Standardversion.

03

Kann ich ein Gruppenfoto oder eine Zeichnung verwenden?

Die Vorlage ist für ein einzelnes Motiv gedacht, egal ob Person oder Figur. Bei einem Gruppenfoto vergrößert das Modell womöglich die falsche Person oder verschmilzt mehrere zu einer, schneiden Sie also vorher auf eine Gestalt zu. Eine gezeichnete Figur kann funktionieren, solange sie klar erkennbar ist und nicht zwischen vielen anderen Elementen untergeht.

04

Welches Modell sollte ich nehmen?

Starten Sie mit MiniMax H3, dem Standard. Wan 3.0 und Seedance 2.5 erzeugen dieselbe Szene, stellen Stadt, Licht und Bewegung aber jeweils anders dar, und auch die Credit-Kosten unterscheiden sich. Gefällt Ihnen die Idee, aber nicht der Look, behalten Sie Foto und Details bei und tauschen Sie nur das Modell.

05

Hat das Video Ton?

Bei Modellen mit Audiounterstützung erhält der Clip Großstadtgeräusche, die zusammen mit dem Bild entstehen, damit die Straße auch nach Straße klingt. Ob Ton dabei ist, hängt vom Modell ab, das Sie im Generator auswählen.

06

Warum wirkt mein Riese klein oder fehl am Platz?

Meist arbeiten Foto oder Details gegen den Größeneindruck. Enge Porträts, mehrere Personen im Bild, starke Filter und dunkle Aufnahmen geben dem Modell weniger Material, und Details mit zusätzlichen Aktionen oder Figuren lenken von der Enthüllung ab. Eine sehr kurze Dauer kann außerdem weniger Zeit für die Rückwärtsfahrt lassen.

07

Kann ich die Länge ändern oder ein Querformat erstellen?

Ja. Die Vorlage startet mit 6 Sekunden im Hochformat 9:16, und beides lässt sich im Generator ändern. Wählen Sie für YouTube oder Präsentationen ein breites Format wie 16:9; ein längerer Clip gibt der langsamen Enthüllung mehr Zeit, und die Credit-Kosten passen sich entsprechend an.

08

Wie werden Credits abgerechnet?

Sie müssen angemeldet sein, und jedes Video wird mit Credits bezahlt. Die Kosten hängen von Modell, Dauer und Auflösung ab und werden auf dem Generieren-Button aktualisiert, sobald Sie etwas ändern. So sehen Sie den Betrag vor dem Absenden. Schlägt eine Generierung fehl, werden die Credits automatisch erstattet.

09

Wo finde ich meine fertigen Videos?

Jedes fertige Video wird in Ihrem Verlauf auf Sonata AI gespeichert. So können Sie frühere Takes wieder aufrufen, dasselbe Foto mit verschiedenen Modellen vergleichen und die Version behalten, die Ihnen am besten gefällt.

10

Darf ich ein Riesen-Video von jemand anderem machen?

Nur mit dessen Einverständnis. Laden Sie ausschließlich Fotos von Menschen hoch, die zugestimmt haben, und nutzen Sie das Ergebnis nicht, um andere zu täuschen, etwa indem Sie es als echte Aufnahme ausgeben, oder um die gezeigte Person bloßzustellen oder zu belästigen. Clips von Fremden ohne deren Zustimmung sind nicht das, wofür diese Vorlage gedacht ist.

11

Gehört Sonata AI zu MiniMax, Alibaba oder ByteDance?

Nein. Sonata AI ist eine unabhängige Plattform und steht in keiner Verbindung zu MiniMax, Alibaba oder ByteDance. MiniMax H3, Wan 3.0 und Seedance 2.5 sind Marken ihrer jeweiligen Inhaber; die Namen stehen hier nur, damit Sie wissen, welches Modell Ihren Clip erzeugt.