Canvas und Nodes
Text, Bild, Video, Media, Referenz, Stil: wie du Nodes zu Workflows verbindest.
Die Node-Typen
Text enthält eine Idee oder einen Prompt, und kann ihn sogar mit einem Sprachmodell für dich schreiben (GPT-5, Claude, Gemini…). Bild und Video generieren Inhalte mit KI. Media importiert eigene Dateien. Kamera bestimmt den Blick auf die Szene. Referenz merkt sich eine wiederkehrende Figur oder ein Objekt. Stil setzt eine Art Direction durch.
Jeder Node lässt sich frei bewegen; löschen mit dem Kreuz oder der Entf-Taste. Rückgängig und Wiederholen mit Strg+Z / Strg+Y.
Nodes verbinden
Ziehe eine Verbindung vom rechten Anschluss eines Nodes zum linken eines anderen. Ein Text-Node am „Prompt“-Port eines Bildes fügt seinen Text dem Prompt hinzu: ein blauer Kasten im Node bestätigt, was berücksichtigt wird. Ein Bild am Video-Node wird zu dessen erstem Frame. Ein Bild-Media dient als visuelle Referenz.
Manche Videomodelle akzeptieren auch ein Endbild: der Port „Endbild“ erscheint automatisch, wenn das Modell es unterstützt.
@Referenzen und Stile
Erstelle einen Referenz-Node mit Name, Beschreibung und Fotos: deine Figur. Tippe dann @ in einen beliebigen Prompt: deine Referenzen erscheinen, und die gewählte Erwähnung wird neongrün angezeigt. Bei der Generierung wird die Beschreibung in den Prompt eingefügt und die Bilder angehängt (mit einem editierfähigen Modell wie Seedream 5 Lite oder GPT Image Mini).
Der Stil-Node funktioniert genauso, nur über Verbindungen: verbinde ihn mit deinen Bild- und Video-Nodes, um überall dieselbe Art Direction zu halten.
Kombinieren
Ein kompletter Beispiel-Workflow: Text → Bild (Flux 2 Klein) → Video (Kling), mit einem Kamera-Node an beiden für einen stimmigen Look und einem geteilten Stil. Jeder Bild- und Video-Node behält seinen Generierungsverlauf: klicke auf ein Vorschaubild, um zurückzukehren. Alles speichert automatisch.
Der Retusche-Node
Der Retusche-Node ist eine kleine Ebenen-Werkstatt auf dem Canvas. Verbinde Bild- oder Medien-Nodes mit seinem Port Ebenen: jedes Bild wird zu einer Ebene, die du verschiebst, skalierst, drehst, abschwächst und mit den anderen mischst. Der Radierer macht einen Bereich transparent (um ein Motiv freizustellen oder ein Fenster auf die Ebene darunter zu öffnen), der Pinsel Wiederherstellen holt ihn zurück. Setze einen Text darüber, wähle Dokumentgröße und Hintergrund, dann exportiere: das PNG behält seine Transparenz, alles wird in deinem Browser berechnet, ohne Credits.
Jede Bildebene hat zwei KI-Aktionen: einen Bereich retuschieren (markieren, beschreiben, Nano Banana ersetzt) und vergrößern (Topaz, ×2 oder ×4), zum selben Preis wie auf den anderen Nodes. Ein Klick führt zum vorherigen Bild zurück. Der Ausgang des Nodes lässt sich überall anschließen, wo ein Bild passt: Startbild eines Videos, Referenz, Montage.
Die Video-Werkzeuge: Bewegung, Verlängerung, Lippen, Hintergrund
Der Video-Node generiert nicht nur: Je nach gewähltem Modell verwandelt er ein bestehendes Video. Kling 3.0 Motion Control übernimmt die Bewegung eines Videos (Anschluss „Bewegungsvideo“) und lässt sie von der Figur eines Bildes (Bildanschluss) nachspielen: ein Tanz, ein Gang, eine Choreografie, auf beliebigem Gesicht. Grok Imagine (verlängern) erzeugt die Fortsetzung eines Videos ab dessen letztem Bild, im gleichen Format: Sie legen die Anzahl der hinzugefügten Sekunden fest und beschreiben, was danach passiert. Die Fortsetzung kommt eigenständig heraus, zum Verketten im Montage-Node.
Sync Lipsync 3 passt die Lippen eines Videos an eine angeschlossene Stimme an (Stimmenanschluss): eine andere Sprache, ein anderer Text, auf derselben Einstellung. InfiniTalk macht dasselbe ausgehend von einem Foto: Das Gesicht spricht während der gesamten Dauer der Stimme, Mimik inklusive. Bria Video-Hintergrund entfernt die Umgebung aus einem Video und behält das Motiv und dessen Ton: Ausgabe als transparentes webm für Ihre Schnitte, oder als mp4 mit grünem, schwarzem oder weißem Hintergrund.
Diese fünf Werkzeuge werden nach der serverseitig gemessenen Quelle berechnet, niemals nach einer angegebenen Dauer: Der Node liest die Länge des angeschlossenen Videos oder der Stimme aus und zeigt den genauen Preis, bevor Sie klicken. Ein Modell zeigt nur die Einstellungen, die es tatsächlich berücksichtigt: Fehlt eine Auswahl, bedeutet das, dass das Modell sie nicht einbezieht.
Ein PDF in einem Text-Node lesen
Ziehen Sie ein PDF auf die Arbeitsfläche: Ein Media-Node nimmt es entgegen, wie ein Bild oder ein Video. Verbinden Sie es mit dem Anschluss „Zu analysierendes Bild oder PDF“ eines Text-Nodes, der auf ein Modell eingestellt ist, das Dokumente lesen kann (GPT, Claude, Gemini, Kimi K3, Grok 4.6, DeepSeek V4 und die anderen entsprechend gekennzeichneten): Das Modell erhält das gesamte Dokument und beantwortet Ihre Anweisung, Zusammenfassung, Extraktion, Umschreibung, Inhaltsplan, Illustrationsprompts.
Der Preis richtet sich nach der Größe des Dokuments: Der Node reserviert die Kosten beim Hochladen der Datei und rechnet dann anhand der tatsächlich gelesenen Tokenanzahl ab, die Differenz wird Ihrem Guthaben gutgeschrieben. Bis zu drei Dokumente pro Node. Die Antwort speist direkt die dahinter angeschlossenen Image- und Video-Nodes: Ein Bericht wird zum Karussell, eine Anleitung wird zum Video-Tutorial.
Meine Figuren
Ein gut ausgefüllter Reference-Node (Name, Beschreibung, Fotos) lohnt es, aufbewahrt zu werden. Die Schaltfläche „In Meine Figuren speichern“ legt ihn in Ihrem Konto ab. In jedem anderen Projekt öffnet „Meine Figuren“ die Liste und füllt einen Reference-Node mit einem Klick, Name, Beschreibung und Bilder inklusive. Bis zu dreißig Figuren pro Konto, jeweils acht Bilder.
Eine bearbeitete Figur wird über den Node aktualisiert, der sie geladen hat, und lässt sich über die Liste löschen. So können Sie dieselbe Maskottchenfigur, denselben Moderator oder dasselbe Produkt von einer Woche zur nächsten behalten, ohne die Karte neu anzulegen.
Der 3D-Objekt-Node
Der 3D-Objekt-Node verwandelt ein Bild in eine 3D-Datei. Verbinden Sie ein Bild (ein hochgeladenes Foto oder das Rendering eines Image-Nodes): Tripo 2.5 oder Trellis 2 erstellen daraus ein texturiertes GLB, das Format, das Blender, Unity, Unreal und Webbrowser lesen. Das Modell wird im Node angezeigt, lässt sich mit dem Finger oder der Maus drehen und herunterladen.
Anschließend werden zwei Renderings in Ihrem Browser erstellt, ohne Kosten: eine fünfsekündige Rundumansicht (Videoanschluss) und eine feste Ansicht (Bildanschluss). Die Rundumansicht wird als Referenz in einen Video-Node, Wan 3.0 oder Seedance 2.5, eingespeist, der die Form des Objekts beibehält und es in Szene setzt. Die Ansicht lässt sich überall anschließen, wo ein Bild eingeht. Ein vollständiges Objekt auf schlichtem Hintergrund liefert das beste Volumen; eine Szene oder ein vom Bildausschnitt abgeschnittenes Motiv liefert ein schlechteres.