Ein Geburtstagslied
Der Vorname im Refrain, zwei Erinnerungen in der Strophe, ein Stil, der zur Person passt. Das Geschenk, das weniger als einen Euro kostet und zehn Jahre später noch einmal gehört wird.
Derselbe Text, zweimal gesungen von ElevenLabs Music: ein heller Pop und ein akustischer Folk, je eine Minute. Der komplette Workflow ist ohne Konto sichtbar, mit beiden Songs.
Echter Workflow, echte Ergebnisse. Beweg dich frei und zoome nach Belieben.
Diesen Workflow verwendenEchter Workflow: zwei Text-Nodes, jeder mit dem Stil und demselben Text, verkabelt mit zwei Musik-Nodes auf ElevenLabs Music. Hör dir beide Versionen an.
Auf einen Blick
Ein Song sind Worte, die jemand singt. Musikgeneratoren können die Melodie schon lange; neu ist, dass sie jetzt deinen Text singen, in deiner Sprache, ohne ihn umzuschreiben. Dieser Workflow zeigt es an einem Text von acht Zeilen: eine Strophe und ein Refrain über eine Landstraße im Morgengrauen, zweimal an ElevenLabs Music geschickt, mit zwei Stilanweisungen.
Jede Anweisung hat zwei Teile, und die Reihenfolge zählt. Zuerst der Stil, in einem Satz: Genre, Stimme (weiblich oder männlich), Instrumente, Tempo, Stimmung. Dann der Text, eingeleitet mit „sing genau diesen Text“. Ohne diesen Satz nimmt das Modell deine Zeilen als Inspiration und erfindet eigene; mit ihm singt es sie der Reihe nach. Die Demo lässt es hören: Pop und Folk singen denselben Refrain, Wort für Wort.
Sechzig Sekunden kosten so viel wie dreißig, weil der Anbieter die angefangene Minute abrechnet: Fordere immer mindestens eine Minute an. Die beiden Versionen der Demo kosten einen Euro achtundsechzig, vierundachtzig Credits pro Stück. Das ist der Preis eines ganzen Songs, mit Stimme, Arrangement und Mix.
Schreib den Text
Eine Strophe und ein Refrain reichen für eine Minute. Markiere sie, „Strophe:“, „Refrain:“, das Modell liest die Struktur. Kurze Zeilen singen sich besser als lange Sätze.
Beschreib den Stil in einem Satz
Genre, Stimme, Instrumente, Tempo, Stimmung: „mitreißender Pop, Frauenstimme, helle Synthesizer, 120 Schläge pro Minute“. Was du weglässt, wählt das Modell.
Füge „sing genau diesen Text“ ein
Zwischen Stil und Text. Dieser Satz macht aus deinem Text gesungene Zeilen statt eines Themas. Dupliziere den Text-Node für einen zweiten Stil: Der Text bleibt, der Stil ändert sich.
Hör beide, behalte einen
„Alles generieren“ startet beide Songs. Hör zuerst den Refrain: Den behält man im Ohr. Behalte die Version, die dir gefällt, oder ändere ein Wort im Stil und starte nur diesen Node neu.
Derselbe Canvas, anders eingestellt: jede Variante kostet zwei bis drei geänderte Prompt-Zeilen.
Der Vorname im Refrain, zwei Erinnerungen in der Strophe, ein Stil, der zur Person passt. Das Geschenk, das weniger als einen Euro kostet und zehn Jahre später noch einmal gehört wird.
Fünfzehn Sekunden Refrain reichen, aber fordere die Minute an: Sie kostet dasselbe, und du kürzt im Schnitt. Der Markenname im Text, der Geschmack der Zielgruppe im Stil.
Dein Text, drei verschiedene Stile, je eine Minute: Ein Autor hört seinen Text gesungen, bevor er ein Arrangement wählt. Ein Demo überzeugt einen Musiker besser als eine Textdatei.
Der Text erzählt das Video, der Stil folgt seinem Rhythmus. Der Musik-Node wird dann in den Schnitt-Node verkabelt, der den Song unter die Einstellungen legt und am Ende schneidet.
Sehr kurze Zeilen, einfache Reime, ein Refrain, der den Vornamen wiederholt, ein Stil wie „sanftes Schlaflied, Frauenstimme, Gitarre und Xylophon, langsam“. Das Modell kann langsam werden.
Ist der Song erzeugt, zieht der Workflow die Stimme aus einem Song trennen die Gesangsspur allein heraus, zum Remixen oder für ein anderes Arrangement.
Ohne diesen Satz werden deine Zeilen zum Thema und das Modell schreibt eigene Worte. Es ist der häufigste Fehler, und der am leichtesten zu behebende.
Der Anbieter rechnet die angefangene Minute ab: Dreißig Sekunden kosten so viel wie sechzig. Fordere die Minute an und kürze bei Bedarf danach.
„Mitreißender Pop“ sagt nicht, wer singt. Nenne „Frauenstimme“ oder „Männerstimme“, und die Sprache: Was man dem Modell nicht sagt, entscheidet es nach Zufall.
Vier Strophen in einer Minute ergeben Rap-Tempo auf einer Ballade. Eine Strophe und ein Refrain pro Minute, der Refrain zweimal gesungen, das ist das richtige Verhältnis.
Ja, wenn die Anweisung „sing genau diesen Text“ enthält. Beide Songs der Demo singen den Refrain Wort für Wort. Ohne diesen Satz lässt es sich nur frei davon inspirieren.
Ja. Der Musik-Node hat einen Schalter „instrumental“: eingeschaltet erzeugt das Modell nur das Arrangement, aus derselben Anweisung. Das ist die Version zum Drübersingen oder für ein Video.
In der Sprache des Textes. Schreib ihn auf Deutsch, Spanisch oder Japanisch und nenne die Sprache im Stil: „Gesang auf Deutsch“. Die Demo ist auf Französisch.
Vierundachtzig Credits pro Minute, also vierundachtzig Cent, ob du dreißig oder sechzig Sekunden anforderst. Zwei Minuten kosten das Doppelte. Der Preis steht vor dem Klick auf dem Node.
Drei Minuten pro Node, in Stufen: dreißig Sekunden, eine, zwei oder drei Minuten. Für ein längeres Stück zwei Nodes aneinanderreihen und im Schnitt-Node zusammensetzen.
Generierte Musik gehört nach den Bedingungen von ElevenLabs auf einem bezahlten Konto dir, und so läuft es hier. Prüfe den Text: Er muss deiner sein, nicht der eines bestehenden Songs.
Nein, der Anbieter lehnt die Anfrage ab. Beschreib einen Stil, eine Epoche, Instrumente, ein Stimmtimbre: „tiefe, raue Stimme, Blues der Sechziger“. Keinen Namen.
Ja. Die Leinwand läuft auf dem Handy, der Text wird im Text-Node getippt und der Song im Musik-Node abgespielt. Der Leitfaden mobil erstellen erklärt die Gesten.
Einen Song mit KI erstellen
Diesen Workflow verwendenKostenloses Konto, ohne Kreditkarte. Der Workflow öffnet sich vorausgefüllt in deinem Canvas.