Ein Drehbuch mit mehreren Stimmen von der KI lesen lassen

Das Drehbuch als PDF auf den Canvas gezogen: Ein Text-Node zieht daraus zehn lesefertige Repliken, einen Erzähler für die Handlung und die Figuren wortgetreu, und ein Stimme-Node im Dialogmodus spielt sie in einer einzigen Aufnahme mit drei ElevenLabs-Stimmen. Die Lesung, die man sonst mit Schauspielern macht, in drei Klicks. Der gesamte Workflow ist ohne Konto sichtbar.

Das Original-Drehbuch mit drei Szenen, ein PDF, das in den Media-Node gezogen wurdeInteraktive Demo

Echter Workflow, echte Ergebnisse. Beweg dich frei und zoome nach Belieben.

Diesen Workflow verwenden

Der echte Workflow: das Original-Drehbuch mit drei Szenen als PDF in einem Media-Node, Claude Sonnet 5 für die zehn Repliken, ein Stimme-Node im Dialogmodus mit ElevenLabs Dialogue v3 und drei Stimmen. Die angezeigten Texte sind die Antworten der Modelle, unbearbeitet.

Auf einen Blick

Sie stellen bereit
1 PDF · ein Text oder ein Briefing
Was der Workflow liefert
1 Voice-over
Aufbau des Canvas
4 Nodes, verbunden durch 1 Kabel
Verdrahtete Modelle
Claude Sonnet 5, ElevenLabs Dialogue v3
Kosten eines kompletten Durchlaufs
rund 10 Credits, also 0,10 €
Konto
Die Demo ist ohne Konto sichtbar; zum Generieren ist ein kostenloses Konto nötig, Test-Credits inklusive

Ein Dialog wird nur nach Gehör beurteilt. Das PDF des Drehbuchs kommt in einen Media-Node, und ein Text-Node liest es über seinen Port „Bild oder PDF zu analysieren“, um daraus zehn Repliken im Format NAME: Text zu ziehen: ein Erzähler, der die wesentliche Handlung in einem Satz sagt, und die Figuren wortgetreu, wie im Skript.

Der Stimme-Node im Dialogmodus trägt diese zehn Repliken, jede mit ihrer Stimme, und ElevenLabs Dialogue v3 spielt sie in einem einzigen Durchgang: Übergänge, Stillen, Wiederaufnahmen kommen vom Modell, nicht von einem Schnitt. Drei Stimmen in der Demo: ein tiefer Erzähler, eine Stimme einer reifen Frau für Maren, eine Stimme eines jungen Mannes für Elias.

Die Demo liest die Szenen 2 und 3 von „North of Silence“, dem Original-Drehbuch der Vorlage Drehbuch zu Film. Zehn Repliken pro Node: Für die nächste Szene duplizieren Sie den Stimme-Node und fügen die nächsten zehn ein, die vom Text-Node geschrieben wurden. Ersetzen Sie das PDF durch Ihr Drehbuch und die Namen in der Anweisung.

Tatsächliche Ergebnisse aus der Demo

Das sind die Dateien des obigen Workflows, genau so, wie die Modelle sie erzeugt haben, ohne Nachbearbeitung. Der Ausgangspunkt wird angezeigt, sofern es einen gibt.

Ergebnis

Die Lesung der Szenen 2 und 3: zehn Repliken, gespielt in einer einzigen Aufnahme von ElevenLabs Dialogue v3, ein Erzähler, Maren und EliasErstellt mit ElevenLabs Dialogue v3

Für wen

Drehbuchautoren, Dramatiker und Fiktionsautoren, die einen Dialog hören möchten, bevor sie ihn umschreiben oder von Schauspielern lesen lassen.

Welche Dateien bereitzustellen sind

Ein Drehbuch oder ein Kapitel als Text-PDF: Namen in Großbuchstaben und Szenenüberschriften helfen, Handlung und Repliken zu trennen.

So geht's

  1. 1

    Ziehen Sie das Drehbuch als PDF hinein

    Ein Media-Node nimmt es entgegen. Klassisches Drehbuchformat bevorzugt: Namen in Großbuchstaben und Szenenüberschriften helfen dem Modell, Handlung und Repliken zu trennen.

  2. 2

    Lassen Sie den Text-Node die Repliken schreiben

    Zehn Zeilen im Format NAME: Text, wobei die zu lesenden Szenen und die Namen Ihrer Figuren in der Anweisung angegeben werden. NARRATOR fasst die Handlung zusammen, die Figuren sprechen wortgetreu.

  3. 3

    Fügen Sie die Repliken in den Stimme-Node ein

    Der Stimme-Node im Dialogmodus hat seine eigenen Zeilen: eine Replik pro Zeile, eine Stimme pro Figur aus der Liste ausgewählt. Zehn Zeilen pro Node; ein zweiter Node für die nächste Szene.

  4. 4

    Hören Sie sich das an, dann passen Sie an

    Eine Aufnahme spielt den ganzen Austausch. Eine zu flache Replik: fügen Sie im Text ein Spiel-Tag ein, [sighs] oder [whispers]. Eine Stimme, die nicht passt: ändern Sie sie in der Zeile, nicht im ganzen Node.

Varianten und Anwendungsfälle

Derselbe Canvas, anders eingestellt: jede Variante kostet zwei bis drei geänderte Prompt-Zeilen.

Die Lesung einer Dialogszene

Das ist die Demo: zehn Repliken, zwei Figuren und ein Erzähler, eine Aufnahme. Für eine längere Szene: zwei Stimme-Nodes mit je zehn Repliken, hintereinander in einem Montage-Node.

Die Lesung eines Romans mit mehreren Stimmen

Ein Romankapitel als PDF funktioniert ebenfalls: Der Erzähler liest die Prosa, die Figuren die Dialoge in Anführungszeichen. Bitten Sie den Text-Node, die genauen Sätze zu behalten.

Die Synchronisation eines Comics

Die Sprechblasen einer Seite, eine pro Zeile mit dem Namen der Figur: Der Stimme-Node spielt die Seite, und ein Montage-Node legt sie mit dem Ton auf den Bildschirm.

Der Stimmen-Casting-Test

Duplizieren Sie den Stimme-Node und ändern Sie in jeder Kopie nur die Stimme einer Figur: drei Aufnahmen, drei Klangfarben, der Vergleich gelingt in einer Minute nach Gehör.

Die Lesung in einer anderen Sprache

Bitten Sie den Text-Node, die Repliken zu übersetzen, und stellen Sie die Sprache des Stimme-Nodes ein: ElevenLabs Dialogue spielt vierzehn Sprachen, mit denselben Stimmen.

Häufige Fehler

Mehr als zehn Repliken in einem Node

Der Dialogmodus nimmt zehn Zeilen pro Aufnahme. Eine Szene mit dreißig Repliken sind drei Stimme-Nodes, verkettet in einem Montage-Node mit einer halben Sekunde Stille zwischen den Aufnahmen.

Zwei zu ähnliche Stimmen

Zwei benachbarte Klangfarben wirken wie ein Monolog. Nehmen Sie eine tiefe und eine helle Stimme, oder eine Frau und einen Mann, bevor Sie feinere Nuancen suchen.

Regieanweisungen laut vorgelesen

Der Erzähler soll die Handlung in einem Satz sagen, nicht die Klammerangaben des Drehbuchs. Die Anweisung des Text-Nodes fordert das: prüfen Sie die zehn Zeilen vor dem Einfügen.

Empfohlene Modelle

Häufige Fragen

Warum die Repliken in den Stimme-Node einfügen?

Weil der Dialogmodus seine Zeilen mit je einer Stimme trägt, höchstens zehn pro Aufnahme: Das ist es, was das Modell in einem einzigen Durchgang spielt. Der Text-Node bereitet sie im richtigen Format vor, und das Einfügen dauert zehn Sekunden.

Wie viele Stimmen lassen sich mischen?

Rund zwanzig ElevenLabs-Stimmklänge, so viele wie Figuren in den zehn Repliken. Drei in der Demo: Erzähler, Maren, Elias. Stimmen mit gegensätzlichen Klangfarben unterscheiden sich besser als bei einem Monolog.

Wie viel kostet eine Lesung?

Rund zehn Credits für zehn Repliken: das Lesen des PDFs durch Claude Sonnet 5 und der ElevenLabs-Dialog, abgerechnet pro Zeichen. Der Preis wird auf dem Node vor dem Klick angezeigt.

Kann man seine eigene Stimme verwenden?

Ja: eine aus Ihrer Bibliothek geklonte Stimme wird auf einer Zeile wie jede andere Klangfarbe ausgewählt. Klonen Sie die Stimme zunächst in einem Voice-over-Node, und weisen Sie sie dann der Figur zu.

Sind die Stillen einstellbar?

Das Modell setzt die Atempausen selbst. Für eine echte Stille teilen Sie die Lesung in zwei Nodes auf und lassen im Montage eine Sekunde zwischen den beiden.

Welche Sprache für die Lesung?

Die der Repliken, eingestellt am Stimme-Node: Englisch in der Demo, vierzehn verfügbare Sprachen. Ein Drehbuch auf Französisch wird auf Französisch gelesen, mit denselben Stimmen.

Kann man die Lesung als Video exportieren?

Ja: ein Montage-Node mit dem Cover oder einem Bild der Szene als Clip, die Lesung auf der Audiospur, exportiert ein mp4 für soziale Netzwerke oder einen Produktionsordner.

Ein Drehbuch mit mehreren Stimmen von der KI lesen lassen

Diesen Workflow verwenden

Kostenloses Konto, ohne Kreditkarte. Der Workflow öffnet sich vorausgefüllt in deinem Canvas.