Die Lesung einer Dialogszene
Das ist die Demo: zehn Repliken, zwei Figuren und ein Erzähler, eine Aufnahme. Für eine längere Szene: zwei Stimme-Nodes mit je zehn Repliken, hintereinander in einem Montage-Node.
Das Drehbuch als PDF auf den Canvas gezogen: Ein Text-Node zieht daraus zehn lesefertige Repliken, einen Erzähler für die Handlung und die Figuren wortgetreu, und ein Stimme-Node im Dialogmodus spielt sie in einer einzigen Aufnahme mit drei ElevenLabs-Stimmen. Die Lesung, die man sonst mit Schauspielern macht, in drei Klicks. Der gesamte Workflow ist ohne Konto sichtbar.
Interaktive DemoEchter Workflow, echte Ergebnisse. Beweg dich frei und zoome nach Belieben.
Diesen Workflow verwendenDer echte Workflow: das Original-Drehbuch mit drei Szenen als PDF in einem Media-Node, Claude Sonnet 5 für die zehn Repliken, ein Stimme-Node im Dialogmodus mit ElevenLabs Dialogue v3 und drei Stimmen. Die angezeigten Texte sind die Antworten der Modelle, unbearbeitet.
Auf einen Blick
Ein Dialog wird nur nach Gehör beurteilt. Das PDF des Drehbuchs kommt in einen Media-Node, und ein Text-Node liest es über seinen Port „Bild oder PDF zu analysieren“, um daraus zehn Repliken im Format NAME: Text zu ziehen: ein Erzähler, der die wesentliche Handlung in einem Satz sagt, und die Figuren wortgetreu, wie im Skript.
Der Stimme-Node im Dialogmodus trägt diese zehn Repliken, jede mit ihrer Stimme, und ElevenLabs Dialogue v3 spielt sie in einem einzigen Durchgang: Übergänge, Stillen, Wiederaufnahmen kommen vom Modell, nicht von einem Schnitt. Drei Stimmen in der Demo: ein tiefer Erzähler, eine Stimme einer reifen Frau für Maren, eine Stimme eines jungen Mannes für Elias.
Die Demo liest die Szenen 2 und 3 von „North of Silence“, dem Original-Drehbuch der Vorlage Drehbuch zu Film. Zehn Repliken pro Node: Für die nächste Szene duplizieren Sie den Stimme-Node und fügen die nächsten zehn ein, die vom Text-Node geschrieben wurden. Ersetzen Sie das PDF durch Ihr Drehbuch und die Namen in der Anweisung.
Das sind die Dateien des obigen Workflows, genau so, wie die Modelle sie erzeugt haben, ohne Nachbearbeitung. Der Ausgangspunkt wird angezeigt, sofern es einen gibt.
Ergebnis
Drehbuchautoren, Dramatiker und Fiktionsautoren, die einen Dialog hören möchten, bevor sie ihn umschreiben oder von Schauspielern lesen lassen.
Ein Drehbuch oder ein Kapitel als Text-PDF: Namen in Großbuchstaben und Szenenüberschriften helfen, Handlung und Repliken zu trennen.
Ziehen Sie das Drehbuch als PDF hinein
Ein Media-Node nimmt es entgegen. Klassisches Drehbuchformat bevorzugt: Namen in Großbuchstaben und Szenenüberschriften helfen dem Modell, Handlung und Repliken zu trennen.
Lassen Sie den Text-Node die Repliken schreiben
Zehn Zeilen im Format NAME: Text, wobei die zu lesenden Szenen und die Namen Ihrer Figuren in der Anweisung angegeben werden. NARRATOR fasst die Handlung zusammen, die Figuren sprechen wortgetreu.
Fügen Sie die Repliken in den Stimme-Node ein
Der Stimme-Node im Dialogmodus hat seine eigenen Zeilen: eine Replik pro Zeile, eine Stimme pro Figur aus der Liste ausgewählt. Zehn Zeilen pro Node; ein zweiter Node für die nächste Szene.
Hören Sie sich das an, dann passen Sie an
Eine Aufnahme spielt den ganzen Austausch. Eine zu flache Replik: fügen Sie im Text ein Spiel-Tag ein, [sighs] oder [whispers]. Eine Stimme, die nicht passt: ändern Sie sie in der Zeile, nicht im ganzen Node.
Derselbe Canvas, anders eingestellt: jede Variante kostet zwei bis drei geänderte Prompt-Zeilen.
Das ist die Demo: zehn Repliken, zwei Figuren und ein Erzähler, eine Aufnahme. Für eine längere Szene: zwei Stimme-Nodes mit je zehn Repliken, hintereinander in einem Montage-Node.
Ein Romankapitel als PDF funktioniert ebenfalls: Der Erzähler liest die Prosa, die Figuren die Dialoge in Anführungszeichen. Bitten Sie den Text-Node, die genauen Sätze zu behalten.
Die Sprechblasen einer Seite, eine pro Zeile mit dem Namen der Figur: Der Stimme-Node spielt die Seite, und ein Montage-Node legt sie mit dem Ton auf den Bildschirm.
Duplizieren Sie den Stimme-Node und ändern Sie in jeder Kopie nur die Stimme einer Figur: drei Aufnahmen, drei Klangfarben, der Vergleich gelingt in einer Minute nach Gehör.
Bitten Sie den Text-Node, die Repliken zu übersetzen, und stellen Sie die Sprache des Stimme-Nodes ein: ElevenLabs Dialogue spielt vierzehn Sprachen, mit denselben Stimmen.
Der Dialogmodus nimmt zehn Zeilen pro Aufnahme. Eine Szene mit dreißig Repliken sind drei Stimme-Nodes, verkettet in einem Montage-Node mit einer halben Sekunde Stille zwischen den Aufnahmen.
Zwei benachbarte Klangfarben wirken wie ein Monolog. Nehmen Sie eine tiefe und eine helle Stimme, oder eine Frau und einen Mann, bevor Sie feinere Nuancen suchen.
Der Erzähler soll die Handlung in einem Satz sagen, nicht die Klammerangaben des Drehbuchs. Die Anweisung des Text-Nodes fordert das: prüfen Sie die zehn Zeilen vor dem Einfügen.
Weil der Dialogmodus seine Zeilen mit je einer Stimme trägt, höchstens zehn pro Aufnahme: Das ist es, was das Modell in einem einzigen Durchgang spielt. Der Text-Node bereitet sie im richtigen Format vor, und das Einfügen dauert zehn Sekunden.
Rund zwanzig ElevenLabs-Stimmklänge, so viele wie Figuren in den zehn Repliken. Drei in der Demo: Erzähler, Maren, Elias. Stimmen mit gegensätzlichen Klangfarben unterscheiden sich besser als bei einem Monolog.
Rund zehn Credits für zehn Repliken: das Lesen des PDFs durch Claude Sonnet 5 und der ElevenLabs-Dialog, abgerechnet pro Zeichen. Der Preis wird auf dem Node vor dem Klick angezeigt.
Ja: eine aus Ihrer Bibliothek geklonte Stimme wird auf einer Zeile wie jede andere Klangfarbe ausgewählt. Klonen Sie die Stimme zunächst in einem Voice-over-Node, und weisen Sie sie dann der Figur zu.
Das Modell setzt die Atempausen selbst. Für eine echte Stille teilen Sie die Lesung in zwei Nodes auf und lassen im Montage eine Sekunde zwischen den beiden.
Die der Repliken, eingestellt am Stimme-Node: Englisch in der Demo, vierzehn verfügbare Sprachen. Ein Drehbuch auf Französisch wird auf Französisch gelesen, mit denselben Stimmen.
Ja: ein Montage-Node mit dem Cover oder einem Bild der Szene als Clip, die Lesung auf der Audiospur, exportiert ein mp4 für soziale Netzwerke oder einen Produktionsordner.
Ein Drehbuch mit mehreren Stimmen von der KI lesen lassen
Diesen Workflow verwendenKostenloses Konto, ohne Kreditkarte. Der Workflow öffnet sich vorausgefüllt in deinem Canvas.