Membuat cuplikan audio buku dengan AI

Bab dalam PDF yang diseret ke canvas: satu node Teks menyalin ulang pembukaannya kata demi kata, suara narator ElevenLabs membacakannya, lapisan instrumental mengalun di bawahnya, dan sampul tetap tampil di layar dalam Montase 16:9: video yang siap diunggah agar orang bisa mendengarkan bab pertama. Seluruh workflow ini bisa dilihat tanpa akun.

Bab pertama dari novel asli, sebuah PDF yang diseret ke dalam node MediaDemo interaktif

Workflow sungguhan, hasil nyata. Geser dan zoom sesuka Anda.

Gunakan workflow ini

Workflow sebenarnya: bab pertama sebuah novel dalam format PDF di node Media, Claude Sonnet 5 yang menyalin ulang pembukaannya, ElevenLabs v3 untuk narasi, ElevenLabs Music untuk lapisan instrumental, GPT Image 2.5 Flare untuk sampul, sebuah node Montase. Teks yang ditampilkan adalah jawaban dari model-model tersebut, tanpa diubah.

Sekilas info

Yang Anda sediakan
1 PDF · sebuah teks atau brief
Apa yang dihasilkan workflow ini
1 gambar dalam 3:4 · 1 jalur audio, total 60 d · 1 sulih suara
Struktur canvas
8 node terhubung oleh 6 sambungan
Model yang terpasang
Claude Sonnet 5, ElevenLabs v3, ElevenLabs Music, GPT Image 2.5 Flare
Biaya satu kali proses lengkap
sekitar 97 kredit, setara US$1,16
Akun
Demo bisa dilihat tanpa akun; untuk menghasilkan karya diperlukan akun gratis, termasuk kredit percobaan

Membuat orang bisa mendengarkan bab pertama adalah promosi terbaik untuk sebuah buku. PDF dimasukkan ke node Media, dan node Teks membacanya melalui port "Gambar atau PDF untuk dianalisis" untuk menyalin ulang pembukaannya kata demi kata, tanpa menulis ulang apa pun, hingga akhir sebuah paragraf sebelum mencapai 1.400 karakter: panjang bacaan selama satu setengah menit.

Node Voice-over membacakan teks yang terhubung ini dengan ElevenLabs v3, suara narator yang dipilih dari daftar. Node Musik menggubah enam puluh detik lapisan instrumental berdasarkan brief yang terhubung, diulang (loop) di Montase dengan volume rendah. Node Gambar menggambar sampul dengan judul menggunakan GPT Image 2.5 Flare, dan Montase menampilkannya secara utuh, dengan latar hitam, selama narasi berlangsung.

Demo ini membacakan pembukaan "North of Silence", sebuah novel asli yang ditulis khusus untuk contoh ini. Ganti PDF dengan bab Anda, suara di node, judul dalam prompt sampul. Satu bab utuh dibacakan dalam beberapa node Voice-over berisi 3.000 karakter, yang disusun berurutan di Montase. Sampul dan trailer melengkapi seri ini.

Hasil render nyata dari demo

Ini adalah file dari workflow di atas, persis seperti yang dihasilkan model, tanpa disunting. Titik awal ditampilkan jika ada.

Hasil render

Narasi pembukaan bab, dibacakan oleh ElevenLabs v3 dengan suara GeorgeDihasilkan dengan ElevenLabs v3
Lapisan instrumental enam puluh detik yang digubah oleh ElevenLabs Music, diulang di bawah suaraDihasilkan dengan ElevenLabs Music
Sampul dengan judul, digambar oleh GPT Image 2.5 Flare, ditampilkan utuh di MontaseDihasilkan dengan GPT Image 2.5 Flare
Cuplikan yang sudah disusun: sampul di layar, narasi dan lapisan instrumental, siap untuk diunggah

Untuk siapa

Penulis dan penerbit yang ingin membuat orang mendengarkan bab pertama tanpa studio atau pengisi suara, atau menguji suara sebelum membuat buku audio lengkap.

File apa yang harus disediakan

Sebuah bab dalam format PDF berbasis teks, bukan hasil pindaian: node Teks menyalin ulang prosa apa adanya dan suara membacakannya kalimat demi kalimat.

Cara melakukannya

  1. 1

    Seret bab dalam format PDF

    Node Media menerimanya. Node Teks menyalin ulang pembukaannya, bukan ringkasan: prosa Anda sendiri yang dibacakan, kalimat demi kalimat, hingga akhir sebuah paragraf.

  2. 2

    Pilih suara dan bacakan

    Node Voice-over menerima teks melalui kabel. Sekitar dua puluh warna suara ElevenLabs v3, atau suara hasil kloning: demo ini menggunakan George, seorang narator yang tenang. Tag [pause] atau [whispers] dalam teks mengarahkan gaya pembacaan.

  3. 3

    Gubah lapisan instrumental dan gambar sampul

    Node Musik menggubah enam puluh detik berdasarkan brief yang terhubung, bersifat instrumental. Node Gambar menuliskan judul di dalam sampul berformat 3:4, dua kredit. Keduanya bisa dibuat ulang tanpa menyentuh narasi.

  4. 4

    Susun dan unggah

    Montase menempatkan sampul secara utuh dengan latar hitam dalam format 16:9, narasi pada satu jalur, lapisan instrumental yang diulang dengan volume rendah pada jalur lain, dengan fade akhir. Dirender di browser, tanpa kredit, diekspor dalam format mp4.

Variasi dan contoh penggunaan

Canvas yang sama, disetel untuk kebutuhan berbeda: setiap variasi hanya butuh dua atau tiga baris prompt yang diubah.

Cuplikan bab pertama

Ini adalah demo: pembukaan yang disalin kata demi kata, suara narator, lapisan instrumental, sampul di layar. Ganti PDF dan judulnya, pertahankan sisanya, dan video akan dibuat ulang untuk buku Anda.

Bab lengkap dalam beberapa bagian

Satu node Teks untuk setiap bagian 3.000 karakter, satu node Voice-over untuk masing-masing, semuanya dalam Montase yang sama: bab berdurasi lima belas menit dibacakan dalam sekitar sepuluh node, lapisan instrumental diulang di bawahnya.

Cuplikan yang dibacakan oleh penulis sendiri

Klon suara Anda di node Voice-over dari satu menit rekaman, lalu pilih suara tersebut untuk narasi: bab pertama dibacakan oleh Anda sendiri, tanpa studio.

Versi podcast, tanpa gambar

Hapus node Gambar dan Montase: narasi dan lapisan instrumental diekspor dalam format mp3 langsung dari node, untuk platform podcast atau halaman buku.

Cuplikan dalam berbagai bahasa

Minta node Teks untuk menerjemahkan bagian teks, atur bahasa pada node Voice-over, pertahankan sampulnya: video yang sama tersedia dalam bahasa Inggris, Spanyol, Jerman, dengan suara yang sama.

Kesalahan umum

Ringkasan alih-alih teks asli

Instruksinya adalah menyalin ulang prosa secara persis. Jika model membuat ringkasan, berarti ia membaca PDF hasil pindaian tanpa teks: ubah manuskrip ke PDF berbasis teks, bukan gambar halaman.

Lapisan instrumental yang menutupi suara

Musik diatur pada 0,25 di Montase agar tetap berada di bawah narasi. Lapisan instrumental dengan melodi yang menonjol akan menarik perhatian telinga: minta brief untuk latar tanpa tema, tanpa perkusi.

Sampul yang terpotong

Montase diatur untuk menampilkan gambar secara utuh dengan latar hitam. Dalam mode cover, sampul berformat 3:4 akan kehilangan judul di bagian atas dan bawah: gunakan mode contain untuk cuplikan.

Model yang direkomendasikan

Pertanyaan umum

Bisakah membacakan satu bab utuh?

Bisa, secara bertahap: satu node Voice-off membacakan hingga 3.000 karakter. Minta node Teks untuk bagian berikutnya, duplikasi node Voice-over, dan susun bagian-bagian tersebut secara berurutan di Montase. Harga mengikuti jumlah karakter yang dibacakan.

Berapa biaya untuk cuplikan ini?

Sekitar enam puluh kredit untuk demo ini: narasi 1.400 karakter (sekitar dua belas kredit), lapisan instrumental enam puluh detik (sekitar lima puluh), sampul (dua), dan pembacaan PDF (dua sampai tiga). Harga ditampilkan pada setiap node sebelum Anda mengklik.

Apakah suara memperhatikan tanda baca?

Ya: ElevenLabs v3 menandai koma, titik, dan paragraf yang dipisahkan oleh baris kosong. Untuk jeda yang lebih panjang, gunakan tag [pause]; untuk bisikan, [whispers]. Tag-tag ini tidak dibacakan.

Berapa durasi ideal untuk sebuah cuplikan?

Satu setengah hingga dua menit, yaitu 1.400 hingga 1.800 karakter: cukup untuk membangun suara dan suasana, cukup singkat untuk didengarkan sampai selesai di ponsel.

Bisakah suara diganti setelahnya?

Bisa, pada node Voice-over, tanpa perlu membuat ulang teks: pilih warna suara lain dan jalankan kembali pembacaan, Montase akan otomatis diperbarui.

Apakah sampul diperlukan?

Tidak, klip gambar apa pun sudah cukup untuk Montase: foto penulis, ilustrasi tempat. Namun sampul dengan judul tetap yang paling mudah dibagikan.

Di mana sebaiknya video ini diunggah?

Di halaman buku, di media sosial, sebagai episode nol sebuah podcast: file mp4 dihasilkan dalam format 16:9, 1080p, dengan suara yang sudah dicampur. Montase 9:16 menghasilkan versi vertikalnya.

Membuat cuplikan audio buku dengan AI

Gunakan workflow ini

Akun gratis, tanpa kartu kredit. Workflow terbuka sudah terisi di canvas Anda.