Semua tool

Memberi suara pada video dengan AI

Satu bidikan bisu, satu lapisan ambience dan satu alas musik: ketiganya dihasilkan di sini, penyuntingan menyatukannya. Alur kerja lengkap, tanpa perlu membuat akun.

Demo interaktif

Workflow sungguhan, hasil nyata. Geser dan zoom sesuka Anda.

Gunakan workflow ini

Alur kerja sungguhan: bidikan teras kafe di bawah hujan itu bisu, dan kedua node menghasilkan ambience serta musik yang hilang darinya.

Sekilas info

Apa yang dihasilkan workflow ini
2 jalur audio, total 40 d
Struktur canvas
7 node terhubung oleh 5 sambungan
Model yang terpasang
ElevenLabs Sound Effects, ElevenLabs Music
Biaya satu kali proses lengkap
sekitar 87 kredit, setara US$1,04

Kebanyakan video hasil generasi keluar tanpa suara, dan kesunyian itulah yang paling dulu membongkarnya. Alur kerja ini membuat dua jalur yang hilang: satu lapisan ambience dengan ElevenLabs Sound Effects, satu alas musik dengan ElevenLabs Music.

Node Media tidak tersambung ke apa pun, dan itu bukan kelalaian. Tidak ada model dalam katalog yang menerima video sebagai masukan untuk menurunkan efek suaranya: suara diuraikan lewat teks. Jadi bidikannya tetap ada di depan mata sementara Anda menulis kedua instruksi, dan memang untuk itulah ia ada.

Dua node terpisah alih-alih satu, karena ambience dan musik tidak disetel dengan cara yang sama: yang pertama disesuaikan dengan durasi bidikan, yang kedua dihasilkan lebih panjang lalu dipotong saat penyuntingan. Penyatuannya dilakukan di Montase, perkakas di bilah kanvas, yang mengekspor satu berkas. Satu putaran penuh berbiaya sedikit di atas satu dolar.

Cara melakukannya

  1. 1

    Unggah bidikan bisu Anda

    Video hasil generasi, rekaman ponsel, tangkapan layar: node Media menerimanya apa adanya. Catat durasinya, itulah yang menentukan panjang ambience.

  2. 2

    Uraikan apa yang harus terdengar

    Bukan emosinya, sumbernya. Hujan di atas kanvas, air menetes ke genangan, ban di aspal basah. Efek suara diuraikan seperti daftar inventaris, bukan seperti niat.

  3. 3

    Uraikan musiknya terpisah

    Alat musik, tempo, tanpa drum, tanpa vokal. Sebutkan bahwa ia harus menyisakan ruang untuk efek: musik yang memenuhi seluruh spektrum akan menindas ambience yang baru saja dibuat.

  4. 4

    Satukan di Montase

    Video, ambience dan musik pada tiga jalur, levelnya disetel, lalu satu berkas keluar. Di situlah bidikannya berhenti menjadi bisu.

Variasi dan contoh penggunaan

Canvas yang sama, disetel untuk kebutuhan berbeda: setiap variasi hanya butuh dua atau tiga baris prompt yang diubah.

Memberi suara pada bidikan hasil generasi

Kasus pakai paling langsung: semua video yang keluar dari node Video tanpa audio, dan itu sebagian besarnya. Ambil kembali deskripsi yang dipakai untuk menghasilkan gambarnya, simpan sumbernya dan buang niatnya, maka tiga perempat instruksi ambience sudah ada di tangan.

Ambience berulang untuk situs atau kios

Bidikan yang berputar di kepala halaman lebih baik hanya membawa ambience, tanpa musik. Efeknya disetel pada durasi persis putarannya agar sambungannya tidak terdengar, hal yang tidak pernah bisa dilakukan musik yang dipotong.

Mengganti suara asli yang mengecewakan

Rekaman ponsel membawa angin di mikrofon dan suara tetangga. Membuat ambience yang bersih lalu menukarnya saat penyuntingan lebih murah daripada mengulang pengambilan, dan lebih tak kentara daripada bidikan bisu.

Musik saja untuk sebuah montase

Node Musik bisa dipakai tanpa sisa alur kerjanya: tiga puluh detik alas instrumental untuk montase beberapa bidikan. Hasilkan lebih panjang dari yang diperlukan, pemotongan dilakukan saat penyuntingan dan pudaran lebih baik daripada akhir yang mendadak.

Efek tunggal alih-alih lapisan

Sebuah pintu, gelas yang diletakkan, langkah di atas kerikil. ElevenLabs Sound Effects bisa pendek dan tepat, dan suara-suara tunggal itu ditempatkan tepat pada frame saat penyuntingan. Satu instruksi untuk satu suara, jangan pernah satu daftar.

Ambience untuk salindia atau korsel

Tidak ada keharusan berangkat dari video. Rangkaian gambar diam yang disusun sebagai salindia diberi suara dengan cara yang persis sama, dan sering justru itulah yang membuat korsel terasa seperti rangkaian sungguhan.

Kesalahan umum

Menguraikan emosi alih-alih sumber

Ambience yang melankolis dan berat tidak berarti apa-apa bagi mesin efek suara. Hujan di atas kanvas, air menetes, ban di aspal basah: itu yang bisa dikerjakannya. Emosi adalah hasilnya, bukan instruksinya.

Meminta musik dan efek sekaligus

Kesalahan yang memberi hasil paling mengecewakan. Model mencampur dua wilayah itu dan mengeluarkan benda hibrida di mana hujannya terdengar seperti maracas. Dua node, dua instruksi, dua level yang bisa disetel saat penyuntingan.

Lupa melarang vokal

Model musik yang dibiarkan bebas dengan senang hati menambahkan nyanyian, dan nyanyian di bawah video membuat narasi mustahil sesudahnya. Tulis tanpa vokal dalam instruksinya, bahkan ketika itu terasa jelas.

Menghasilkan ambience sepanjang montase

Ambience disetel pada bidikan, bukan pada filmnya. Dua puluh detik hujan untuk bidikan lima detik memaksa pemotongan sembarangan, sedangkan lapisan yang dihasilkan pada durasi tepat masuk tanpa perlu dipikirkan.

Model yang direkomendasikan

Pertanyaan umum

Kenapa node Media tidak tersambung ke apa pun?

Karena belum ada model yang bisa mendengarkan sebuah gambar. Efek dan musik dihasilkan dari teks, bukan dari videonya. Bidikannya ada di situ untuk dilihat sambil menulis, lalu berangkat ke montase bersama kedua jalur.

Apakah benar-benar perlu dua node?

Perlu, dan itulah bagian paling berguna dari templat ini. Satu instruksi yang meminta hujan sekaligus piano menghasilkan bubur di mana efeknya terdengar seperti alat musik. Terpisah, masing-masing disetel pada durasi dan levelnya sendiri.

Bisakah membuat suara narasi di sini?

Tidak dengan kedua node ini, yang mengurus efek dan musik. Suara punya nodenya sendiri, dan alur kerja video dokumenter menunjukkan cara menyambungkannya ke sebuah teks.

Berapa biaya satu putaran penuh?

Sedikit di atas satu dolar untuk sepuluh detik ambience dan tiga puluh detik musik. Harganya tampil di tiap node sebelum diklik, dan bergantung pada durasi yang diminta.

Apakah montase benar-benar mengekspor satu berkas?

Ya, video dan jalur audio dicampur menjadi satu MP4, dikodekan di dalam peramban. Itulah perkakas Montase di bilah kanvas, yang mengambil hasil-hasil proyek tanpa perlu Anda unduh satu per satu.

Bolehkah musiknya dipakai komersial?

Boleh, hasilnya milik Anda. Kehati-hatian ada pada apa yang Anda minta: instruksi yang menyebut nama seniman atau lagu yang sudah ada sedang mengejar peniruan, dan di situlah tanahnya jadi licin.

Berapa durasi maksimalnya?

Dua puluh dua detik untuk efek suara, beberapa menit untuk musik. Untuk ambience yang lebih panjang, lebih baik membuat lapisan yang bisa diulang lalu mengulanginya saat penyuntingan daripada meminta satu yang sangat panjang.

Apa bedanya dengan suara yang dihasilkan model video?

Sebagian model video memproduksi jalur suaranya sendiri, dan itu praktis kalau kebetulan pas. Di sini Anda memegang kendali: dua jalur terpisah, bisa disetel, bisa diganti, dan bidikannya tetap terpakai meski ambience-nya tidak cocok.

Memberi suara pada video dengan AI

Gunakan workflow ini

Akun gratis, tanpa kartu kredit. Workflow terbuka sudah terisi di canvas Anda.