Alle Tools

Mit KI zum Riesen in der eigenen Stadt werden

Ihr Selfie geht an drei Wan-3.0-Nodes, die Sie in einer echten Straße auf Hausgröße bringen: Sie steigen über die Autos, Sie sitzen auf einem Dach, Sie heben einen Bus zwischen zwei Fingern hoch.

Interaktive Demo

Echter Workflow, echte Ergebnisse. Beweg dich frei und zoome nach Belieben.

Diesen Workflow verwenden

Der echte Workflow: das Selfie, als Referenz an drei Wan-3.0-Nodes verkabelt, eine Inszenierung pro Node. Die drei Videos sind die der Demo, dasselbe Gesicht und dieselbe Jacke.

Auf einen Blick

Was der Workflow liefert
3 Videos mit 15 s in 720p, Format 9:16
Aufbau des Canvas
8 Nodes, verbunden durch 6 Kabel
Verdrahtete Modelle
Wan 3.0
Kosten eines kompletten Durchlaufs
rund 180 Credits, also 1,80 €

Ein Selfie genügt. Kein Clip zu drehen, kein Greenscreen, kein Schnitt: Ihr Foto kommt in drei Nodes, und Sie kommen in der Größe eines Hauses wieder heraus, mitten in einer echten Straße, vom Gehweg aus in Untersicht gefilmt.

Die drei Inszenierungen der Demo erzählen drei Größenverhältnisse: Sie steigen über eine Reihe stehender Autos, Sie sitzen wie auf einer Bank auf einem Haussmann-Dach, Sie heben einen ganzen Bus zwischen Daumen und Zeigefinger hoch, um ihn anzusehen.

Den Effekt macht nicht Ihre Größe, sondern der MASSSTAB der Kulisse. Die Anweisungen bestehen darauf, dass Autos, Fußgänger und Busse ihre echten Größen behalten, sonst liefert das Modell eine Modellbaulandschaft. Wan 3.0 nimmt ein echtes Gesicht als Referenz an und behält es, wo andere Modelle es ablehnen oder neu zeichnen. Die drei Videos kosten hundertachtzig Credits.

So geht's

  1. 1

    Geben Sie ein scharfes Selfie

    Auf Brusthöhe gerahmt, von vorn, bei Tageslicht, vor irgendeinem Hintergrund. Das ist das Einzige, was verlangt wird, und es muss nicht schön sein, es muss scharf sein.

  2. 2

    Beschreiben Sie Ihr Gesicht nicht

    Die Anweisung verweist auf das Referenzfoto und beschreibt Ihre Züge nie. Sobald ein Gesicht beschrieben wird, glaubt das Modell, es neu machen zu müssen, und macht es auf seine Art.

  3. 3

    Behalten Sie die Untersicht

    Die Kamera auf Straßenniveau, nach oben gerichtet, erzeugt das Gefühl von Höhe. Frontal auf Ihrer Augenhöhe erzählt dasselbe Bild nichts mehr.

  4. 4

    Generieren Sie alle drei und wechseln Sie dann die Stadt

    „Alles generieren“ liefert die drei Einstellungen. Danach ersetzen Sie die Haussmann-Fassaden in der Anweisung durch Ihre echte Stadt und starten den Node neu, der Sie interessiert.

Varianten und Anwendungsfälle

Derselbe Canvas, anders eingestellt: jede Variante kostet zwei bis drei geänderte Prompt-Zeilen.

Über die Straße steigen

Die Referenzeinstellung der Gattung: Autos in Schuhgröße zwischen Ihren Sneakern, Fußgänger, die zur Seite weichen, Ihr Kopf über den Dächern. Sie wird am schnellsten verstanden.

Auf einem Haus sitzen

Die Unterarme auf den Knien, die Füße vor den Fenstern des dritten Stocks hängend. Die Ruhe der Haltung steht im Gegensatz zur Größe, und dieser Gegensatz macht das Bild.

Der Bus zwischen zwei Fingern

Ein echter Bus, mit seinen Scheiben und seinen Fahrgästen, winzig in Ihrer Hand. Diese Einstellung gibt das beste Maß, denn jeder weiß, wie groß ein Bus ist.

Ihre Stadt statt Paris

Ersetzen Sie die Haussmann-Fassaden durch das, was bei Ihnen typisch ist: Backsteinhäuser, ein Marktplatz, eine Strandpromenade. Der Effekt gewinnt viel, wenn die Kulisse wiedererkennbar ist.

Die Ankündigung einer Veranstaltung

Ein Riese, der die Stadt überragt, ergibt den Aufhänger eines bewegten Plakats für ein Konzert, einen Abend oder eine Eröffnung. Name und Datum kommen danach im Schnitt dazu, nicht ins Video.

Umgekehrt, ganz klein

Dieselbe Mechanik funktioniert in Miniatur: Verlangen Sie, dass Sie zehn Zentimeter groß auf einem Küchentisch stehen, mit Besteck in Ihrem Maßstab. Die Sperre für den Maßstab bleibt dieselbe.

Häufige Fehler

Ein nächtliches oder unscharfes Selfie geben

Das Modell übernimmt, was es sieht: Ein dunkles oder verwackeltes Gesicht kommt auf allen drei Einstellungen dunkel oder ungefähr heraus. Ein scharfes Foto bei Tageslicht ändert das ganze Ergebnis.

Sein Gesicht in der Anweisung beschreiben

Sobald die Augenfarbe oder die Form der Nase dasteht, baut das Modell ein Gesicht neu, statt Ihres zu übernehmen. Die Anweisung spricht von der Kulisse, das Foto spricht von Ihnen.

Den Maßstab der Kulisse vergessen

Ohne den Satz, der echte Autos und echte Passanten verlangt, baut das Modell eine Modellbaulandschaft, in der alles klein ist, und Sie wirken nicht mehr groß, sondern normal in einer Spielzeugeisenbahn.

Die Kamera auf Ihrer Augenhöhe setzen

Frontal auf Gesichtshöhe gesehen, sieht ein Riese aus wie ein Porträt. Die Untersicht von der Straße aus erzeugt die Höhe, und die Anweisung muss das sagen.

Empfohlene Modelle

Häufige Fragen

Brauche ich ein Foto der Straße?

Nein, die Straße steht in der Anweisung und wird vom Modell gebaut. Wenn Sie genau Ihre Straße wollen, beschreiben Sie sie präzise oder gehen Sie über das Meme-Video, das von einem Foto Ihrer Straße ausgeht.

Ist die Ähnlichkeit gut?

Auf den drei Einstellungen der Demo ja: dasselbe Gesicht und dieselbe Jacke wie am Anfang. Die Ähnlichkeit hält in der Totale besser als in der ganz nahen Einstellung, was bei einem Riesen gut passt.

Können wir zu zweit auftauchen?

Der Node nimmt bis zu zehn Referenzbilder an, also ja: Fügen Sie ein zweites Selfie hinzu und benennen Sie beide Personen in der Anweisung. Rechnen Sie mit mehr Versuchen, damit beide Gesichter zusammen halten.

Was kosten die drei Einstellungen?

Hundertachtzig Credits, sechzig pro Video von fünf Sekunden in 720p mit Ton. Eine einzelne Einstellung nach einem Wechsel der Stadt neu zu starten kostet nur sechzig Credits.

Kann ich die drei Einstellungen aneinanderhängen?

Ja, der Schnitt-Node setzt die drei im Browser zusammen, ohne Software und ohne zusätzliche Credits. Fünfzehn Sekunden Riese ergeben ein vollständiges Video.

Darf ich das Ergebnis kommerziell nutzen?

Die Bilder ja, unter den Bedingungen, die der Leitfaden zu den Rechten an KI-Bildern erklärt. Achten Sie dagegen auf die Marken, die das Modell auf Bussen und Schaufenstern erfindet.

Warum ein Bild als Referenz und kein Video?

Weil es nichts zu filmen gibt: Die Szene existiert nicht. Der Node hat also keinen Ausgangsclip, das Modell baut den Bildausschnitt um Ihr Foto herum.

Welches Format kommt heraus?

Hochformat 9:16 in 720p, das native Format der sozialen Netzwerke. Der Node bietet auch 16:9 an, wenn das Video auf YouTube geht.

Mit KI zum Riesen in der eigenen Stadt werden

Diesen Workflow verwenden

Kostenloses Konto, ohne Kreditkarte. Der Workflow öffnet sich vorausgefüllt in deinem Canvas.