Ein Kapitel oder ein Exposé als PDF, auf die Canvas gezogen: Ein Text-Node schreibt das Voice-over, vier weitere schreiben je eine Einstellung, die Einstellungen werden gezeichnet und dann in sieben Sekunden animiert, eine Stimme liest sie, eine Klangfläche trägt sie, und der Montage-Node fügt daraus dreißig Sekunden Trailer zusammen. Die Demo geht von einem Originalkapitel aus.
Interaktive Demo
Echter Workflow, echte Ergebnisse. Beweg dich frei und zoome nach Belieben.
Der echte Workflow: das erste Kapitel eines Romans als PDF in einem Media-Node, Claude Sonnet 5 für das Voice-over und die vier Einstellungen, Nano Banana Pro für die ersten Bilder, Wan 3.0 für die vier siebensekündigen Videos, ElevenLabs v3 für die Stimme, ElevenLabs Music für die Klangfläche, ein Montage-Node. Die angezeigten Texte sind die Antworten der Modelle, unbearbeitet.
Auf einen Blick
Sie stellen bereit
1 PDF · ein Text oder ein Briefing
Was der Workflow liefert
4 Bilder in 16:9 · 4 Videos mit 28 s in 720p, Format 16:9 · 1 Tonspur, zusammen 30 s · 1 Voice-over
Aufbau des Canvas
19 Nodes, verbunden durch 25 Kabel
Verdrahtete Modelle
Claude Sonnet 5, ElevenLabs v3, ElevenLabs Music, Nano Banana Pro, Wan 3.0
Kosten eines kompletten Durchlaufs
rund 518 Credits, also 5,18 €
Konto
Die Demo ist ohne Konto sichtbar; zum Generieren ist ein kostenloses Konto nötig, Test-Credits inklusive
Ein Buchtrailer passt in dreißig Sekunden: ein Ort, eine Figur, eine Bedrohung, ein Titel. Das PDF Ihres Kapitels oder Exposés gelangt in einen Media-Node, und fünf Text-Nodes lesen es über ihren Port „Bild oder PDF zur Analyse“. Der erste schreibt das Voice-over in vier Sätzen, der letzte den Titel. Die anderen vier schreiben je eine siebensekündige Einstellung, jeweils mit demselben Stilblock am Anfang: Das gibt dem Trailer ein einheitliches Licht und eine einheitliche Textur.
Jede Einstellung wird zunächst zu einem ersten Bild auf Nano Banana Pro, dann zu einem siebensekündigen Video auf Wan 3.0, ohne Ton: Stimme und Musik kommen erst über den Montage-Node hinzu. Der Voice-over-Node liest die vier Sätze mit ElevenLabs v3, der Musik-Node komponiert eine dreißigsekündige Klangfläche nach einem verkabelten Briefing. Der Montage-Node reiht die vier Einstellungen aneinander, setzt die Stimme eine halbe Sekunde nach dem Start ein und die Musik auf niedrige Lautstärke.
Die Demo geht von „North of Silence“ aus, dem ersten Kapitel eines eigens für dieses Beispiel geschriebenen Originalromans: eine Leuchtturmwärterin, ein Beamter, der kommt, um die Lampe zu löschen, ein Sturm. Ersetzen Sie das PDF durch Ihr eigenes, tragen Sie Ihren Titel in die Voice-over-Anweisung ein, der Rest folgt von selbst. Eine Einstellung mehr bedeutet eine Zeile mehr an Nodes. Das Ganze kostet rund 350 Credits, wovon die Videos zwei Drittel ausmachen.
Tatsächliche Ergebnisse aus der Demo
Das sind die Dateien des obigen Workflows, genau so, wie die Modelle sie erzeugt haben, ohne Nachbearbeitung. Der Ausgangspunkt wird angezeigt, sofern es einen gibt.
Ergebnis
Das Voice-over in vier Sätzen, gelesen von ElevenLabs v3 aus dem verkabelten TextErstellt mit ElevenLabs v3Die dreißigsekündige Klangfläche, komponiert von ElevenLabs Music nach dem verkabelten BriefingErstellt mit ElevenLabs MusicErstes Bild von Einstellung 1: der Leuchtturm auf seinem schwarzen Felsen in der DämmerungErstellt mit Nano Banana ProErstes Bild von Einstellung 2: die Wärterin, die die Linse poliertErstellt mit Nano Banana ProErstes Bild von Einstellung 3: der Fremde, der bei Gischt am Steg anlegtErstellt mit Nano Banana ProErstes Bild von Einstellung 4: die von Hand wieder entzündete Lampe während des SturmsErstellt mit Nano Banana ProEinstellung 1, animiert von Wan 3.0 aus ihrem ersten Bild, sieben SekundenErstellt mit Wan 3.0Einstellung 2: die Wärterin und die Linse, sieben SekundenErstellt mit Wan 3.0Einstellung 3: die Ankunft am Steg, sieben SekundenErstellt mit Wan 3.0Einstellung 4: der Sturm und die Lampe, sieben SekundenErstellt mit Wan 3.0Der geschnittene Trailer: vier Einstellungen, das Voice-over und die Klangfläche, dreißig Sekunden
Für wen
Autoren und Verlage, die für eine Buchveröffentlichung ein dreißigsekündiges Video ohne Dreh wünschen.
Welche Dateien bereitzustellen sind
Ein Kapitel oder Exposé als Text-PDF, zwei Seiten reichen aus: Die Modelle lesen das gesamte Dokument und entnehmen ihm Ort, Figur und Konflikt.
So geht's
1
Ziehen Sie das Kapitel oder Exposé als PDF hinein
Ein Media-Node nimmt es entgegen. Ein Kapitel reicht für einen Trailer aus, ein einseitiges Exposé ebenso: Die Modelle lesen das gesamte Dokument und entnehmen ihm Ort, Figur und Konflikt.
2
Lassen Sie die Text-Nodes das Voice-over und die Einstellungen schreiben
Fünf Nodes lesen das PDF. Der erste schreibt vier Voice-over-Sätze; die anderen vier schreiben je eine Einstellung mit dem gemeinsamen Stil, dem Schauplatz oder der Figur, dem Licht, einer Kamerabewegung. Ändern Sie Titel und Einstellungs-Vorgaben in den Anweisungen für Ihr Buch.
3
Erzeugen Sie die ersten Bilder, dann die Videos
Jede Einstellung hat ihren Image-Node, dann ihren Video-Node, eingestellt auf sieben Sekunden, ohne Ton. Sehen Sie sich die vier Bilder an, bevor Sie animieren: Genau dort korrigiert man einen Schauplatz oder eine Figur für zwei Credits, nicht danach.
4
Lesen Sie die Stimme ein und komponieren Sie die Klangfläche
Der Voice-over-Node erhält den Text per Kabel und liest ihn mit der aus der Liste gewählten Stimme. Der Musik-Node komponiert dreißig Sekunden nach dem verkabelten Briefing, standardmäßig instrumental. Beide gelangen im Montage-Node auf ihre eigene Spur.
5
Schneiden und exportieren
Die vier Einstellungen folgen einander in der Reihenfolge der Kabel, die Stimme setzt eine halbe Sekunde nach dem Start ein, die Musik bleibt leise und blendet aus. Der Schnitt wird im Browser gerendert, ohne Credits, und wird als mp4 für soziale Netzwerke und die Buchseite exportiert.
Varianten und Anwendungsfälle
Derselbe Canvas, anders eingestellt: jede Variante kostet zwei bis drei geänderte Prompt-Zeilen.
Der Trailer eines Romans
Das ist die Demo: vier Einstellungen, ein Voice-over in vier Sätzen, eine Klangfläche. Ersetzen Sie das PDF durch Ihr erstes Kapitel, tragen Sie Ihren Titel in die Voice-over-Anweisung ein und behalten Sie die Einstellungs-Vorgaben (Ort, Figur, Fremder, Sturm) bei oder schreiben Sie sie für Ihre Geschichte neu.
Der Teaser eines Sachbuchs oder Ratgebers
Keine Figur: Bitten Sie die vier Einstellungs-Nodes um Situationsbilder (das Problem, die Handbewegung, das Ergebnis, das Buch auf dem Tisch) und das Voice-over um drei zugespitzte Fragen, dann den Titel. Derselbe Graph ergibt einen Sachbuch-Teaser.
Die vertikale Version für soziale Netzwerke
Stellen Sie die vier Image- und Video-Nodes sowie den Montage-Node auf 9:16: Dieselben Einstellungen werden für Stories und Shorts neu ausgeschnitten. Erzeugen Sie zuerst die Bilder, ein breit gerahmter Schauplatz funktioniert im Hochformat nicht immer.
Eine Einstellung mehr, oder eine weniger
Eine Node-Zeile pro Einstellung: Duplizieren Sie die letzte für eine fünfte Einstellung, löschen Sie eine für einen zwanzigsekündigen Teaser. Der Montage-Node folgt den Kabeln, das Voice-over muss noch für die endgültige Anzahl an Einstellungen geschrieben werden.
Der Trailer mit den echten Figuren
Erzeugen Sie zunächst die Charakterblätter aus dem Manuskript und verkabeln Sie sie dann mit dem Bild-Port der Einstellungs-Image-Nodes: Die Gesichter bleiben von einer Einstellung zur nächsten konstant, wie im Film-Template.
Häufige Fehler
Einstellungen, die nicht zueinander passen
Die vier Anweisungen müssen denselben Stilblock am Anfang wiederholen: Filmmaterial, Palette, Körnung. Eine Einstellung ohne diesen Block gerät in ein anderes Licht, und der Trailer wirkt wie aus vier verschiedenen Filmen zusammengeschnitten.
Ein zu langes Voice-over
Vier siebensekündige Einstellungen ergeben achtundzwanzig Sekunden; ein Voice-over mit mehr als fünfundfünfzig Wörtern läuft über, und der Montage-Node schneidet es ab. Fordern Sie vierzig bis fünfundfünfzig Wörter, einen Satz pro Einstellung.
Ton in den Einstellungen und im Schnitt
Die Video-Nodes sind ohne Ton eingestellt: Stimme und Musik kommen von den Spuren des Montage-Nodes. Schalten Sie den Ton der Einstellungen wieder ein, überlagern sich Atmosphären und übertönen die Stimme. Wenn Sie den Klang des Orts möchten, senken Sie die Klangfläche.
Rund 350 Credits für die Demo: vier siebensekündige Videos in 720p auf Wan 3.0 (jeweils rund 60 Credits), vier erste Bilder (jeweils rund zehn), die dreißigsekündige Klangfläche (rund fünfzig), das Voice-over und das Lesen des PDFs (einige Credits). Der Preis wird auf jedem Node angezeigt, bevor Sie klicken.
Kann ich Textauszüge anstelle eines Voice-overs verwenden?
Ja: Ersetzen Sie die Anweisung des Voice-over-Nodes durch „gib drei Sätze aus dem Kapitel wieder, die Lust auf das Weiterlesen machen“. Die Stimme liest, was mit ihr verkabelt ist. Für Texttafeln auf dem Bildschirm fügen Sie Image-Nodes mit GPT Image 2.5 Flare hinzu, das einen kurzen Titel in das Bild schreibt.
In welcher Sprache ist das Voice-over?
In der Sprache, die die Anweisung des Text-Nodes vorgibt, in der Demo Englisch. ElevenLabs v3 liest vierzehn Sprachen: Schreiben Sie die Anweisung in Ihrer Sprache und wählen Sie eine Stimme, die sie gut spricht.
Braucht man ein ganzes Kapitel oder ein Exposé?
Beides funktioniert. Ein Kapitel liefert präzise Bilder und zitierbare Sätze; ein Exposé liefert den gesamten Handlungsbogen, nützlich für einen Teaser, der den Konflikt erzählt. Ein zweiseitiges PDF reicht aus.
Kann ich eine andere Stimme wählen?
Ja, in der Liste des Voice-over-Nodes: rund zwanzig ElevenLabs-v3-Stimmen, oder eine aus Ihrer Bibliothek geklonte Stimme. Die Demo verwendet Daniel, einen tiefen Erzähler.
Wie bringe ich den Titel auf den Bildschirm?
Fügen Sie einen Image-Node mit GPT Image 2.5 Flare hinzu, mit dem Titel als Prompt, und platzieren Sie ihn als letzten Clip des Montage-Nodes, drei Sekunden lang, mit einer Abblendung. Flare schreibt einen kurzen Titel, ohne ihn zu verzerren.
Ist die Musik lizenzfrei?
Sie wird eigens für Sie von ElevenLabs Music nach dem verkabelten Briefing komponiert, standardmäßig instrumental: kein bestehendes Stück, keine Lizenz einzuholen. Ändern Sie das Briefing für eine andere Stimmung.