Cuplikan bab pertama
Ini adalah demo: pembukaan yang disalin kata demi kata, suara narator, lapisan instrumental, sampul di layar. Ganti PDF dan judulnya, pertahankan sisanya, dan video akan dibuat ulang untuk buku Anda.
Bab dalam PDF yang diseret ke canvas: satu node Teks menyalin ulang pembukaannya kata demi kata, suara narator ElevenLabs membacakannya, lapisan instrumental mengalun di bawahnya, dan sampul tetap tampil di layar dalam Montase 16:9: video yang siap diunggah agar orang bisa mendengarkan bab pertama. Seluruh workflow ini bisa dilihat tanpa akun.
Workflow sebenarnya: bab pertama sebuah novel dalam format PDF di node Media, Claude Sonnet 5 yang menyalin ulang pembukaannya, ElevenLabs v3 untuk narasi, ElevenLabs Music untuk lapisan instrumental, GPT Image 2.5 Flare untuk sampul, sebuah node Montase. Teks yang ditampilkan adalah jawaban dari model-model tersebut, tanpa diubah.
Sekilas info
Membuat orang bisa mendengarkan bab pertama adalah promosi terbaik untuk sebuah buku. PDF dimasukkan ke node Media, dan node Teks membacanya melalui port "Gambar atau PDF untuk dianalisis" untuk menyalin ulang pembukaannya kata demi kata, tanpa menulis ulang apa pun, hingga akhir sebuah paragraf sebelum mencapai 1.400 karakter: panjang bacaan selama satu setengah menit.
Node Voice-over membacakan teks yang terhubung ini dengan ElevenLabs v3, suara narator yang dipilih dari daftar. Node Musik menggubah enam puluh detik lapisan instrumental berdasarkan brief yang terhubung, diulang (loop) di Montase dengan volume rendah. Node Gambar menggambar sampul dengan judul menggunakan GPT Image 2.5 Flare, dan Montase menampilkannya secara utuh, dengan latar hitam, selama narasi berlangsung.
Demo ini membacakan pembukaan "North of Silence", sebuah novel asli yang ditulis khusus untuk contoh ini. Ganti PDF dengan bab Anda, suara di node, judul dalam prompt sampul. Satu bab utuh dibacakan dalam beberapa node Voice-over berisi 3.000 karakter, yang disusun berurutan di Montase. Sampul dan trailer melengkapi seri ini.
Ini adalah file dari workflow di atas, persis seperti yang dihasilkan model, tanpa disunting. Titik awal ditampilkan jika ada.
Hasil render
Penulis dan penerbit yang ingin membuat orang mendengarkan bab pertama tanpa studio atau pengisi suara, atau menguji suara sebelum membuat buku audio lengkap.
Sebuah bab dalam format PDF berbasis teks, bukan hasil pindaian: node Teks menyalin ulang prosa apa adanya dan suara membacakannya kalimat demi kalimat.
Seret bab dalam format PDF
Node Media menerimanya. Node Teks menyalin ulang pembukaannya, bukan ringkasan: prosa Anda sendiri yang dibacakan, kalimat demi kalimat, hingga akhir sebuah paragraf.
Pilih suara dan bacakan
Node Voice-over menerima teks melalui kabel. Sekitar dua puluh warna suara ElevenLabs v3, atau suara hasil kloning: demo ini menggunakan George, seorang narator yang tenang. Tag [pause] atau [whispers] dalam teks mengarahkan gaya pembacaan.
Gubah lapisan instrumental dan gambar sampul
Node Musik menggubah enam puluh detik berdasarkan brief yang terhubung, bersifat instrumental. Node Gambar menuliskan judul di dalam sampul berformat 3:4, dua kredit. Keduanya bisa dibuat ulang tanpa menyentuh narasi.
Susun dan unggah
Montase menempatkan sampul secara utuh dengan latar hitam dalam format 16:9, narasi pada satu jalur, lapisan instrumental yang diulang dengan volume rendah pada jalur lain, dengan fade akhir. Dirender di browser, tanpa kredit, diekspor dalam format mp4.
Canvas yang sama, disetel untuk kebutuhan berbeda: setiap variasi hanya butuh dua atau tiga baris prompt yang diubah.
Ini adalah demo: pembukaan yang disalin kata demi kata, suara narator, lapisan instrumental, sampul di layar. Ganti PDF dan judulnya, pertahankan sisanya, dan video akan dibuat ulang untuk buku Anda.
Satu node Teks untuk setiap bagian 3.000 karakter, satu node Voice-over untuk masing-masing, semuanya dalam Montase yang sama: bab berdurasi lima belas menit dibacakan dalam sekitar sepuluh node, lapisan instrumental diulang di bawahnya.
Klon suara Anda di node Voice-over dari satu menit rekaman, lalu pilih suara tersebut untuk narasi: bab pertama dibacakan oleh Anda sendiri, tanpa studio.
Hapus node Gambar dan Montase: narasi dan lapisan instrumental diekspor dalam format mp3 langsung dari node, untuk platform podcast atau halaman buku.
Minta node Teks untuk menerjemahkan bagian teks, atur bahasa pada node Voice-over, pertahankan sampulnya: video yang sama tersedia dalam bahasa Inggris, Spanyol, Jerman, dengan suara yang sama.
Instruksinya adalah menyalin ulang prosa secara persis. Jika model membuat ringkasan, berarti ia membaca PDF hasil pindaian tanpa teks: ubah manuskrip ke PDF berbasis teks, bukan gambar halaman.
Musik diatur pada 0,25 di Montase agar tetap berada di bawah narasi. Lapisan instrumental dengan melodi yang menonjol akan menarik perhatian telinga: minta brief untuk latar tanpa tema, tanpa perkusi.
Montase diatur untuk menampilkan gambar secara utuh dengan latar hitam. Dalam mode cover, sampul berformat 3:4 akan kehilangan judul di bagian atas dan bawah: gunakan mode contain untuk cuplikan.
Bisa, secara bertahap: satu node Voice-off membacakan hingga 3.000 karakter. Minta node Teks untuk bagian berikutnya, duplikasi node Voice-over, dan susun bagian-bagian tersebut secara berurutan di Montase. Harga mengikuti jumlah karakter yang dibacakan.
Sekitar enam puluh kredit untuk demo ini: narasi 1.400 karakter (sekitar dua belas kredit), lapisan instrumental enam puluh detik (sekitar lima puluh), sampul (dua), dan pembacaan PDF (dua sampai tiga). Harga ditampilkan pada setiap node sebelum Anda mengklik.
Ya: ElevenLabs v3 menandai koma, titik, dan paragraf yang dipisahkan oleh baris kosong. Untuk jeda yang lebih panjang, gunakan tag [pause]; untuk bisikan, [whispers]. Tag-tag ini tidak dibacakan.
Satu setengah hingga dua menit, yaitu 1.400 hingga 1.800 karakter: cukup untuk membangun suara dan suasana, cukup singkat untuk didengarkan sampai selesai di ponsel.
Bisa, pada node Voice-over, tanpa perlu membuat ulang teks: pilih warna suara lain dan jalankan kembali pembacaan, Montase akan otomatis diperbarui.
Tidak, klip gambar apa pun sudah cukup untuk Montase: foto penulis, ilustrasi tempat. Namun sampul dengan judul tetap yang paling mudah dibagikan.
Di halaman buku, di media sosial, sebagai episode nol sebuah podcast: file mp4 dihasilkan dalam format 16:9, 1080p, dengan suara yang sudah dicampur. Montase 9:16 menghasilkan versi vertikalnya.
Membuat cuplikan audio buku dengan AI
Gunakan workflow iniAkun gratis, tanpa kartu kredit. Workflow terbuka sudah terisi di canvas Anda.