Alle Tools

Ein Video mit KI vertonen

Eine stumme Einstellung, eine Atmo und ein Musikbett: die drei Teile entstehen hier, der Schnitt fügt sie zusammen. Der komplette Workflow, ohne Konto.

Interaktive Demo

Echter Workflow, echte Ergebnisse. Beweg dich frei und zoome nach Belieben.

Diesen Workflow verwenden

Der echte Workflow: die Einstellung der Terrasse im Regen ist stumm, und die beiden Nodes liefern die Atmo und die Musik, die ihr fehlten.

Auf einen Blick

Was der Workflow liefert
2 Tonspuren, zusammen 40 s
Aufbau des Canvas
7 Nodes, verbunden durch 5 Kabel
Verdrahtete Modelle
ElevenLabs Sound Effects, ElevenLabs Music
Kosten eines kompletten Durchlaufs
rund 87 Credits, also 0,87 €

Die meisten erzeugten Videos kommen stumm heraus, und dieses Schweigen verrät sie vor allem anderen. Dieser Workflow baut die beiden fehlenden Spuren: eine Atmo mit ElevenLabs Sound Effects, ein Musikbett mit ElevenLabs Music.

Der Medien-Node ist an nichts angeschlossen, und das ist kein Versehen. Kein Modell im Katalog nimmt ein Video als Eingang, um daraus Geräusche abzuleiten: Ton wird im Text beschrieben. Die Einstellung bleibt also vor Augen, während Sie die beiden Anweisungen schreiben, und genau dafür ist sie da.

Zwei getrennte Nodes statt eines, weil Atmo und Musik sich nicht gleich einstellen: die erste passt auf die Länge der Einstellung, die zweite wird länger erzeugt und im Schnitt gekürzt. Zusammengefügt wird im Schnitt, dem Werkzeug der Canvas-Leiste, das eine einzige Datei ausgibt. Ein kompletter Durchgang kostet unter einem Euro.

So geht's

  1. 1

    Stumme Einstellung importieren

    Ein erzeugtes Video, ein Handy-Rohmaterial, eine Bildschirmaufnahme: der Medien-Node nimmt es, wie es ist. Merken Sie sich die Länge, sie bestimmt die Dauer der Atmo.

  2. 2

    Beschreiben, was zu hören sein soll

    Nicht die Stimmung, die Quellen. Regen auf Stoff, Wasser, das in eine Pfütze tropft, Reifen auf nasser Fahrbahn. Ein Geräusch beschreibt man wie eine Inventarliste, nicht wie eine Absicht.

  3. 3

    Die Musik getrennt beschreiben

    Instrumente, Tempo, kein Schlagzeug, kein Gesang. Sagen Sie, dass sie Platz für die Geräusche lassen muss: eine Musik, die das ganze Spektrum füllt, erdrückt die eben erzeugte Atmo.

  4. 4

    Im Schnitt zusammensetzen

    Video, Atmo und Musik auf drei Spuren, die Pegel gesetzt, und eine einzige Datei hinaus. Dort hört die Einstellung auf, stumm zu sein.

Varianten und Anwendungsfälle

Derselbe Canvas, anders eingestellt: jede Variante kostet zwei bis drei geänderte Prompt-Zeilen.

Eine erzeugte Einstellung vertonen

Der direkte Anwendungsfall: alle Videos, die ohne Ton aus einem Video-Node kommen, also die meisten. Nehmen Sie die Beschreibung, die das Bild erzeugt hat, behalten Sie die Quellen und werfen Sie die Absichten weg, und Sie haben schon drei Viertel der Atmo-Anweisung.

Atmo-Schleife für eine Website oder ein Terminal

Eine Einstellung, die am Kopf einer Seite läuft, fährt besser mit reiner Atmo ohne Musik. Das Geräusch wird auf die genaue Länge der Schleife gesetzt, damit der Übergang nicht hörbar ist, was geschnittene Musik nie erlaubt.

Einen enttäuschenden Originalton ersetzen

Ein Handy-Rohmaterial bringt Wind im Mikrofon und die Stimme des Nachbarn mit. Eine saubere Atmo zu erzeugen und im Schnitt zu tauschen kostet weniger als ein Nachdreh und fällt weniger auf als eine stumme Einstellung.

Musik allein für einen Schnitt

Der Musik-Node lässt sich ohne den Rest des Workflows nutzen: dreißig Sekunden Instrumentalbett für einen Schnitt aus mehreren Einstellungen. Erzeugen Sie länger als nötig, gekürzt wird im Schnitt, und eine Blende schlägt ein abruptes Ende.

Einzelgeräusch statt Fläche

Eine Tür, ein abgestelltes Glas, ein Schritt auf Kies. ElevenLabs Sound Effects kann kurz und präzise, und solche Einzelgeräusche werden im Schnitt bildgenau gesetzt. Eine Anweisung pro Geräusch, nie eine Liste.

Atmo für eine Diaschau oder ein Karussell

Nichts zwingt dazu, von einem Video auszugehen. Eine Folge von Standbildern als Diaschau geschnitten wird genauso vertont, und oft ist es das, was ein Karussell wie eine echte Sequenz wirken lässt.

Häufige Fehler

Eine Stimmung statt einer Quelle beschreiben

Eine melancholische, schwere Atmo sagt einer Geräusch-Engine nichts. Regen auf Stoff, tropfendes Wasser, Reifen auf nasser Fahrbahn: das kann sie. Die Stimmung ist das Ergebnis, nicht die Anweisung.

Musik und Geräusche zusammen verlangen

Der Fehler mit dem enttäuschendsten Ergebnis. Das Modell mischt beide Register und liefert ein Zwitterding, in dem der Regen wie eine Shaker-Rassel klingt. Zwei Nodes, zwei Anweisungen, zwei im Schnitt regelbare Pegel.

Vergessen, Gesang zu verbieten

Ein frei gelassenes Musikmodell fügt bereitwillig Gesang hinzu, und Gesang unter einem Video schließt danach jede Sprecherstimme aus. Schreiben Sie kein Gesang in die Anweisung, auch wenn es selbstverständlich scheint.

Die Atmo auf die Länge des Films erzeugen

Die Atmo richtet sich nach der Einstellung, nicht nach dem Film. Zwanzig Sekunden Regen für eine Einstellung von fünf Sekunden zwingen zu einem willkürlichen Schnitt, während eine in der richtigen Länge erzeugte Fläche sich ohne Nachdenken einfügt.

Empfohlene Modelle

Häufige Fragen

Warum ist der Medien-Node an nichts angeschlossen?

Weil noch kein Modell ein Bild hören kann. Geräusche und Musik entstehen aus einem Text, nicht aus dem Video. Die Einstellung ist da, um beim Schreiben angesehen zu werden, und danach mit den beiden Spuren in den Schnitt zu gehen.

Braucht es wirklich zwei Nodes?

Ja, und das ist der nützlichste Punkt der Vorlage. Eine einzige Anweisung, die Regen und ein Klavier verlangt, ergibt einen Brei, in dem die Geräusche wie ein Instrument klingen. Getrennt stellt sich jedes auf seine Dauer und seinen Pegel ein.

Kann man hier eine Sprecherstimme erzeugen?

Nicht mit diesen beiden Nodes, die Geräusche und Musik machen. Die Stimme hat ihren eigenen Node, und der Workflow Dokumentarvideo zeigt, wie sie an einen Text angeschlossen wird.

Was kostet ein kompletter Durchgang?

Unter einem Euro für die zehn Sekunden Atmo und die dreißig Sekunden Musik. Der Preis steht vor dem Klick auf jedem Node und hängt von der verlangten Dauer ab.

Gibt der Schnitt wirklich eine einzige Datei aus?

Ja, Video und Tonspuren gemischt in einer MP4, im Browser kodiert. Es ist das Werkzeug Schnitt in der Canvas-Leiste, das die Renderings des Projekts nimmt, ohne dass man sie einzeln herunterladen müsste.

Darf ich die Musik kommerziell nutzen?

Ja, die Ergebnisse gehören Ihnen. Vorsicht gilt dem, was Sie verlangen: eine Anweisung, die eine Künstlerin oder ein bestehendes Stück nennt, sucht die Nachahmung, und dort wird der Boden rutschig.

Wie lang darf es höchstens sein?

Zweiundzwanzig Sekunden für ein Geräusch, mehrere Minuten für Musik. Für eine längere Atmo ist es besser, eine schleifenfähige Fläche zu erzeugen und sie im Schnitt zu wiederholen, als eine sehr lange zu verlangen.

Worin liegt der Unterschied zum Ton aus dem Videomodell?

Manche Videomodelle erzeugen ihre eigene Tonspur, was praktisch ist, wenn sie passt. Hier behalten Sie die Kontrolle: zwei getrennte, regelbare, austauschbare Spuren, und die Einstellung bleibt brauchbar, auch wenn die Atmo nicht überzeugt.

Ein Video mit KI vertonen

Diesen Workflow verwenden

Kostenloses Konto, ohne Kreditkarte. Der Workflow öffnet sich vorausgefüllt in deinem Canvas.