Diskon 10% untuk langganan bulanan dengan kode NODE10, hingga 31 Agustus

Imaginode
Semua tool

Avatar AI yang berbicara

Presenter sintetis mengucapkan naskah Anda ke kamera, dengan suaranya sendiri. Veo 3.1 menghasilkan gambar dan ucapan sekaligus, jadi gerak bibirnya pas. Alur kerjanya bisa dilihat di sini, tanpa akun.

Demo interaktif

Workflow sungguhan, hasil nyata. Geser dan zoom sesuka Anda.

Gunakan workflow ini

Kartu referensi menjaga wajahnya, node Teks membawa naskahnya, dan node Video merender delapan detik lengkap dengan suara. Tidak ada node Voice-over: ucapannya keluar dari model video. Buka node-nya untuk membaca prompt-nya.

Sekilas info

Apa yang dihasilkan workflow ini
1 gambar dalam 9:16 · 1 video berdurasi 8 detik dalam 720p, format 9:16
Struktur canvas
5 node terhubung oleh 2 sambungan
Model yang terpasang
Seedream 5 Pro, Veo 3.1 Fast
Biaya satu kali proses lengkap
sekitar 149 kredit, setara €1,49

Avatar yang berbicara selalu terbentur masalah yang sama: sinkronisasi bibir. Rantai produksi klasik menghasilkan video bisu, membuat suara secara terpisah, lalu mencoba menempelkan keduanya, dan selalu tersisa selisih sepersepuluh detik yang langsung terasa palsu.

Di sini ucapan dan gambar keluar dari render yang sama. Veo 3.1 Fast menghasilkan dialog bersama videonya: bibir mengikuti suara karena keduanya dihitung bersamaan. Sebagai gantinya, mengganti satu kata berarti merender ulang, jadi naskahnya dikunci sebelum dijalankan, dan karena itulah ia tinggal di node Teks-nya sendiri, bisa diubah tanpa menyentuh karakternya.

Wajahnya sendiri dijaga oleh kartu referensi tiga sudut, mekanisme yang sama dengan menjaga karakter tetap konsisten di beberapa shot. Dengan begitu Anda bisa memproduksi satu seri utuh dengan presenter yang sama, episode demi episode. Seedream 5 Pro menyusun shot awalnya, dan kalkulator publik menunjukkan biaya persis satu pengambilan sebelum mendaftar.

Cara melakukannya

  1. 1

    Buat presenternya

    Kartu referensi membawa tiga tampilan wajah. Kartu inilah yang memungkinkan menemukan kembali orang yang persis sama di episode berikutnya, dengan latar lain dan naskah lain.

  2. 2

    Susun shot-nya

    Node Image membingkai adegannya: meja kerja, cahaya, ruang kosong untuk teks di layar. Framing sebatas dada, sedikit menyamping, menyisakan ruang untuk gerakan tangan.

  3. 3

    Tulis dialognya

    Node Teks berisi arahan adegan dan kalimat yang harus diucapkan, di dalam tanda kutip. Dua kalimat pendek cukup untuk delapan detik, dan nadanya dideskripsikan seperti arahan akting.

  4. 4

    Render pengambilannya

    Delapan detik, format vertikal, audio aktif. Suaranya langsung ada di file video: tidak ada yang perlu disinkronkan setelahnya, dan tidak ada yang perlu diedit kalau pengambilannya bagus.

Variasi dan contoh penggunaan

Canvas yang sama, disetel untuk kebutuhan berbeda: setiap variasi hanya butuh dua atau tiga baris prompt yang diubah.

Avatar presenter untuk pelatihan

Sebuah modul pelatihan dipecah jadi sekuens delapan detik, masing-masing di node Video-nya, semua tersambung ke kartu wajah yang sama. Presenternya tetap identik dari bab ke bab, hal yang tak dijamin rangkaian syuting sungguhan mana pun di harga ini.

Juru bicara brand

Wajah yang sama membuka setiap video perusahaan, tanpa bergantung pada ketersediaan seorang karyawan atau kepergiannya. Deskripsikan busana dan latarnya di node Gambar: kartu memegang wajah, shot memegang konteks.

Avatar yang bicara bahasa lain

Tulis dialognya dalam tanda kutip di bahasa yang diinginkan: Veo 3.1 Fast mengucapkannya, lengkap dengan gerak bibir. Satu video pun bisa diturunkan ke lima pasar, dengan presenter yang sama dan lima dialog.

Video sambutan di halaman situs

Delapan detik, shot sebatas dada, latar kantor yang blur: format yang menaikkan waktu kunjungan di halaman depan. Jaga kalimatnya pendek, satu gagasan per video, dan siapkan subtitle untuk penonton tanpa suara.

Avatar vertikal untuk TikTok dan Reels

Template sudah merender dalam 9:16. Sisakan ruang di atas kepala untuk teks di layar, dan potong setengah detik pertama saat editing: model video sering memulai dengan frame yang agak kaku.

Kesalahan umum

Naskah kepanjangan untuk delapan detik

Dua kalimat pendek muat dalam satu take. Lebih dari itu, model mempercepat tempo atau memotong bagian akhirnya, dan Anda harus membayar ulang render penuh demi mengoreksi satu kata.

Mendeskripsikan suara setelah render dijalankan

Suara keluar dari render yang sama dengan gambarnya: timbre, tempo, dan intonasi dideskripsikan di prompt, sebelum generate. Berganti suara berarti take baru.

Close-up terlalu rapat ke wajah

Shot yang sangat rapat menonjolkan cacat-cacat mikro di sekitar mulut. Shot sebatas dada, agak menyamping, memberi ruang untuk gestur dan membuat take lebih meyakinkan.

Model yang direkomendasikan

Pertanyaan umum

Bisakah memilih suaranya?

Anda mendeskripsikannya di prompt, seperti arahan casting: warna suara, tempo, intensi. Suaranya tidak dipilih dari daftar, dan dua render dari naskah yang sama bisa sedikit berbeda.

Apakah modelnya bisa berbahasa Indonesia?

Bisa. Tulis dialognya dalam bahasa Indonesia di dalam tanda kutip pada prompt, sisanya boleh tetap dalam bahasa Inggris tanpa mengubah bahasa yang diucapkan.

Bagaimana kalau pengambilannya gagal?

Jalankan ulang. Satu pengambilan delapan detik menghabiskan beberapa puluh sen kredit, dan node menyimpan riwayat render sebelumnya: tidak ada yang hilang saat membandingkan dua versi.

Apakah lip sync-nya akurat?

Ya, karena gambar dan ucapan keluar dari render yang sama: tidak ada yang ditempel belakangan. Inilah yang membedakan workflow ini dari rantai klasik, tempat selisih sepersepuluh detik saja sudah membongkar hasil editan.

Bisakah memakai wajah saya sendiri?

Bisa, dengan mengisi kartu Referensi memakai tiga foto Anda. Lakukan hanya dengan wajah orang yang sudah memberi izin: juru bicara yang digenerate dari foto pihak ketiga menimbulkan masalah hak atas citra diri yang serius.

Berapa biaya satu take delapan detik?

Sekitar 144 kredit dengan Veo 3.1 Fast, kira-kira 1,40 euro, sudah termasuk gambar awalnya. Harga pastinya tertera di tombol sebelum render dijalankan.

Bisakah merangkai beberapa dialog?

Bisa, satu node Video per dialog, semua tersambung ke kartu wajah dan shot awal yang sama. Disambung berurutan, hasilnya video satu menit dengan presenter yang konsisten.

Avatar AI yang berbicara

Gunakan workflow ini

Akun gratis, tanpa kartu kredit. Workflow terbuka sudah terisi di canvas Anda.