Alle Tools

Einen Song mit KI erstellen

Derselbe Text, zweimal gesungen von ElevenLabs Music: ein heller Pop und ein akustischer Folk, je eine Minute. Der komplette Workflow ist ohne Konto sichtbar, mit beiden Songs.

Interaktive Demo

Echter Workflow, echte Ergebnisse. Beweg dich frei und zoome nach Belieben.

Diesen Workflow verwenden

Echter Workflow: zwei Text-Nodes, jeder mit dem Stil und demselben Text, verkabelt mit zwei Musik-Nodes auf ElevenLabs Music. Hör dir beide Versionen an.

Auf einen Blick

Was der Workflow liefert
2 Tonspuren, zusammen 120 s
Aufbau des Canvas
5 Nodes, verbunden durch 2 Kabel
Verdrahtete Modelle
ElevenLabs Music
Kosten eines kompletten Durchlaufs
rund 168 Credits, also 1,68 €

Ein Song sind Worte, die jemand singt. Musikgeneratoren können die Melodie schon lange; neu ist, dass sie jetzt deinen Text singen, in deiner Sprache, ohne ihn umzuschreiben. Dieser Workflow zeigt es an einem Text von acht Zeilen: eine Strophe und ein Refrain über eine Landstraße im Morgengrauen, zweimal an ElevenLabs Music geschickt, mit zwei Stilanweisungen.

Jede Anweisung hat zwei Teile, und die Reihenfolge zählt. Zuerst der Stil, in einem Satz: Genre, Stimme (weiblich oder männlich), Instrumente, Tempo, Stimmung. Dann der Text, eingeleitet mit „sing genau diesen Text“. Ohne diesen Satz nimmt das Modell deine Zeilen als Inspiration und erfindet eigene; mit ihm singt es sie der Reihe nach. Die Demo lässt es hören: Pop und Folk singen denselben Refrain, Wort für Wort.

Sechzig Sekunden kosten so viel wie dreißig, weil der Anbieter die angefangene Minute abrechnet: Fordere immer mindestens eine Minute an. Die beiden Versionen der Demo kosten einen Euro achtundsechzig, vierundachtzig Credits pro Stück. Das ist der Preis eines ganzen Songs, mit Stimme, Arrangement und Mix.

So geht's

  1. 1

    Schreib den Text

    Eine Strophe und ein Refrain reichen für eine Minute. Markiere sie, „Strophe:“, „Refrain:“, das Modell liest die Struktur. Kurze Zeilen singen sich besser als lange Sätze.

  2. 2

    Beschreib den Stil in einem Satz

    Genre, Stimme, Instrumente, Tempo, Stimmung: „mitreißender Pop, Frauenstimme, helle Synthesizer, 120 Schläge pro Minute“. Was du weglässt, wählt das Modell.

  3. 3

    Füge „sing genau diesen Text“ ein

    Zwischen Stil und Text. Dieser Satz macht aus deinem Text gesungene Zeilen statt eines Themas. Dupliziere den Text-Node für einen zweiten Stil: Der Text bleibt, der Stil ändert sich.

  4. 4

    Hör beide, behalte einen

    „Alles generieren“ startet beide Songs. Hör zuerst den Refrain: Den behält man im Ohr. Behalte die Version, die dir gefällt, oder ändere ein Wort im Stil und starte nur diesen Node neu.

Varianten und Anwendungsfälle

Derselbe Canvas, anders eingestellt: jede Variante kostet zwei bis drei geänderte Prompt-Zeilen.

Ein Geburtstagslied

Der Vorname im Refrain, zwei Erinnerungen in der Strophe, ein Stil, der zur Person passt. Das Geschenk, das weniger als einen Euro kostet und zehn Jahre später noch einmal gehört wird.

Der Jingle einer Marke oder eines Podcasts

Fünfzehn Sekunden Refrain reichen, aber fordere die Minute an: Sie kostet dasselbe, und du kürzt im Schnitt. Der Markenname im Text, der Geschmack der Zielgruppe im Stil.

Das Demo eines Stücks

Dein Text, drei verschiedene Stile, je eine Minute: Ein Autor hört seinen Text gesungen, bevor er ein Arrangement wählt. Ein Demo überzeugt einen Musiker besser als eine Textdatei.

Ein Song für ein Video

Der Text erzählt das Video, der Stil folgt seinem Rhythmus. Der Musik-Node wird dann in den Schnitt-Node verkabelt, der den Song unter die Einstellungen legt und am Ende schneidet.

Ein Kinderlied

Sehr kurze Zeilen, einfache Reime, ein Refrain, der den Vornamen wiederholt, ein Stil wie „sanftes Schlaflied, Frauenstimme, Gitarre und Xylophon, langsam“. Das Modell kann langsam werden.

Der Song, dann die Stimme isoliert

Ist der Song erzeugt, zieht der Workflow die Stimme aus einem Song trennen die Gesangsspur allein heraus, zum Remixen oder für ein anderes Arrangement.

Häufige Fehler

„Sing genau diesen Text“ vergessen

Ohne diesen Satz werden deine Zeilen zum Thema und das Modell schreibt eigene Worte. Es ist der häufigste Fehler, und der am leichtesten zu behebende.

Dreißig Sekunden anfordern, um weniger zu zahlen

Der Anbieter rechnet die angefangene Minute ab: Dreißig Sekunden kosten so viel wie sechzig. Fordere die Minute an und kürze bei Bedarf danach.

Ein Stil ohne Stimme

„Mitreißender Pop“ sagt nicht, wer singt. Nenne „Frauenstimme“ oder „Männerstimme“, und die Sprache: Was man dem Modell nicht sagt, entscheidet es nach Zufall.

Ein zu langer Text für die Dauer

Vier Strophen in einer Minute ergeben Rap-Tempo auf einer Ballade. Eine Strophe und ein Refrain pro Minute, der Refrain zweimal gesungen, das ist das richtige Verhältnis.

Empfohlene Modelle

Häufige Fragen

Singt das Modell wirklich meinen Text?

Ja, wenn die Anweisung „sing genau diesen Text“ enthält. Beide Songs der Demo singen den Refrain Wort für Wort. Ohne diesen Satz lässt es sich nur frei davon inspirieren.

Bekomme ich auch die Version ohne Stimme?

Ja. Der Musik-Node hat einen Schalter „instrumental“: eingeschaltet erzeugt das Modell nur das Arrangement, aus derselben Anweisung. Das ist die Version zum Drübersingen oder für ein Video.

In welchen Sprachen singt das Modell?

In der Sprache des Textes. Schreib ihn auf Deutsch, Spanisch oder Japanisch und nenne die Sprache im Stil: „Gesang auf Deutsch“. Die Demo ist auf Französisch.

Was kostet ein Song?

Vierundachtzig Credits pro Minute, also vierundachtzig Cent, ob du dreißig oder sechzig Sekunden anforderst. Zwei Minuten kosten das Doppelte. Der Preis steht vor dem Klick auf dem Node.

Wie lang darf ein Song sein?

Drei Minuten pro Node, in Stufen: dreißig Sekunden, eine, zwei oder drei Minuten. Für ein längeres Stück zwei Nodes aneinanderreihen und im Schnitt-Node zusammensetzen.

Darf ich den Song in einem kommerziellen Video nutzen?

Generierte Musik gehört nach den Bedingungen von ElevenLabs auf einem bezahlten Konto dir, und so läuft es hier. Prüfe den Text: Er muss deiner sein, nicht der eines bestehenden Songs.

Kann es einen Künstler imitieren?

Nein, der Anbieter lehnt die Anfrage ab. Beschreib einen Stil, eine Epoche, Instrumente, ein Stimmtimbre: „tiefe, raue Stimme, Blues der Sechziger“. Keinen Namen.

Geht das vom Handy aus?

Ja. Die Leinwand läuft auf dem Handy, der Text wird im Text-Node getippt und der Song im Musik-Node abgespielt. Der Leitfaden mobil erstellen erklärt die Gesten.

Einen Song mit KI erstellen

Diesen Workflow verwenden

Kostenloses Konto, ohne Kreditkarte. Der Workflow öffnet sich vorausgefüllt in deinem Canvas.