월간 구독 10% 할인, 코드 NODE10, 8월 31일까지

Imaginode
모든 도구

말하는 AI 아바타

합성 진행자가 카메라를 보며 여러분의 대본을 자기 목소리로 말합니다. Veo 3.1이 이미지와 음성을 동시에 생성하므로 입 모양이 정확히 맞습니다. 워크플로우를 계정 없이 여기서 볼 수 있습니다.

인터랙티브 데모

실제 워크플로, 실제 결과물. 자유롭게 이동하고 확대해 보세요.

이 워크플로 사용하기

레퍼런스 시트가 얼굴을 붙잡고, 텍스트 노드가 대본을 품고, 비디오 노드가 목소리와 함께 8초를 렌더링합니다. 보이스오버 노드는 없습니다. 음성은 비디오 모델에서 나옵니다. 노드를 열어 프롬프트를 읽어 보세요.

한눈에 보기

이 워크플로의 결과물
9:16 이미지 1장 · 720p, 9:16 포맷의 8초 영상 1개
캔버스 구조
노드 5개, 연결선 2개
연결된 모델
Seedream 5 Pro, Veo 3.1 Fast
전체 1회 실행 비용
약 149 크레딧, €1.49 상당

말하는 아바타는 언제나 같은 문제에 부딪힙니다. 립싱크. 기존 파이프라인은 무음 영상을 생성하고, 목소리를 따로 만들고, 둘을 이어 붙이려 하지만, 0.1초의 어긋남이 남아 곧바로 가짜 티가 납니다.

여기서는 음성과 이미지가 같은 렌더링에서 나옵니다. Veo 3.1 Fast가 영상과 함께 대사를 생성합니다. 입술이 목소리를 따라가는 이유는 둘이 함께 계산되었기 때문입니다. 그 대신 단어 하나를 바꾸려면 렌더링을 다시 돌려야 하므로 대본은 실행 전에 확정하고, 그래서 대본은 캐릭터를 건드리지 않고 수정할 수 있는 자기만의 텍스트 노드에 삽니다.

얼굴은 세 각도의 레퍼런스 시트가 붙잡습니다. 여러 장면에서 일관된 캐릭터를 유지하는 것과 같은 원리입니다. 이렇게 하면 같은 진행자로 에피소드를 이어 가며 시리즈 전체를 만들 수 있습니다. Seedream 5 Pro가 시작 장면을 구성하고, 공개 계산기는 가입 전에 한 테이크의 정확한 비용을 알려 줍니다.

이렇게 하세요

  1. 1

    진행자를 만드세요

    레퍼런스 시트에 얼굴의 세 각도를 담습니다. 다음 에피소드에서 다른 배경, 다른 대본으로도 정확히 같은 사람을 다시 불러오게 해 주는 것이 이 시트입니다.

  2. 2

    장면을 구성하세요

    이미지 노드가 장면을 잡습니다. 책상, 조명, 화면 텍스트를 위한 여백. 가슴 높이에서 살짝 비껴 잡은 앵글이면 손짓이 들어갈 자리가 생깁니다.

  3. 3

    대사를 쓰세요

    텍스트 노드에는 연출 지시와 따옴표로 감싼 대사가 들어갑니다. 8초에는 짧은 두 문장이면 충분하고, 톤은 연기 지시문처럼 묘사합니다.

  4. 4

    테이크를 렌더링하세요

    8초, 세로 포맷, 오디오 켜기. 목소리가 비디오 파일 안에 담겨 나옵니다. 뒤에서 맞출 것도 없고, 테이크가 좋으면 편집할 것도 없습니다.

변형과 활용 사례

같은 캔버스를 다른 목적에 맞게 조정한 버전들: 각 변형은 프롬프트 두세 줄만 바꾸면 됩니다.

교육 과정용 진행자 아바타

교육 모듈을 8초 시퀀스로 나누고, 각각 비디오 노드 하나에, 모두 같은 얼굴 시트에 연결합니다. 진행자가 챕터에서 챕터로 동일하게 유지됩니다. 실제 촬영을 여러 번 하는 방식으로는 이 가격에 절대 보장할 수 없는 일입니다.

브랜드 대변인

같은 얼굴이 회사의 모든 영상을 엽니다. 직원의 일정에도, 퇴사에도 좌우되지 않습니다. 복장과 배경은 이미지 노드에 묘사하세요 : 시트가 얼굴을, 숏이 맥락을 담당합니다.

다른 언어로 말하는 아바타

원하는 언어의 대사를 따옴표 안에 쓰세요 : Veo 3.1 Fast가 입 모양까지 맞춰 발음합니다. 같은 영상이 이렇게 5개 시장으로 변주됩니다. 같은 진행자, 다섯 개의 대사.

웹사이트 첫 화면의 환영 영상

8초, 가슴까지 오는 숏, 흐릿한 사무실 배경 : 홈페이지 체류 시간을 늘리는 포맷입니다. 문장은 짧게, 영상당 아이디어 하나만, 그리고 무음 재생을 위한 자막을 준비하세요.

TikTok과 릴스용 세로 아바타

템플릿은 이미 9:16으로 렌더링합니다. 화면 텍스트를 위해 머리 위에 여백을 남기고, 편집에서 첫 0.5초를 잘라 내세요 : 비디오 모델은 종종 살짝 굳은 장면으로 시작합니다.

자주 하는 실수

8초에 비해 너무 긴 스크립트

짧은 두 문장이 한 테이크에 들어갑니다. 그 이상이면 모델이 말을 빨리 하거나 끝을 잘라 버리고, 단어 하나 고치자고 렌더링 전체를 다시 결제해야 합니다.

렌더링을 실행한 뒤에 목소리를 묘사하기

목소리는 이미지와 같은 렌더링에서 나옵니다 : 음색, 속도, 뉘앙스는 생성 전에 프롬프트에 묘사합니다. 목소리를 바꾸는 것은 곧 새 테이크를 뜻합니다.

얼굴에 바짝 붙인 클로즈업

아주 타이트한 숏은 입 주변의 미세한 결함을 도드라지게 합니다. 가슴까지, 살짝 비껴 잡은 숏이 제스처에 자리를 주고 테이크를 더 그럴듯하게 만듭니다.

추천 모델

자주 묻는 질문

목소리를 고를 수 있나요?

캐스팅 지시문처럼 프롬프트에 묘사합니다. 음색, 속도, 의도. 목록에서 선택하는 방식이 아니며, 같은 텍스트라도 두 렌더링이 조금 다를 수 있습니다.

모델이 한국어로 말하나요?

네. 프롬프트에서 대사를 따옴표로 감싸 한국어로 쓰세요. 나머지 묘사는 영어로 두어도 말하는 언어에는 영향을 주지 않습니다.

테이크가 마음에 안 들면요?

다시 돌리면 됩니다. 8초짜리 테이크는 크레딧 몇십 센트이고, 노드가 이전 렌더링 기록을 보관하므로 두 버전을 비교할 때 잃는 것은 없습니다.

립싱크는 정확한가요?

네, 이미지와 말이 같은 렌더링에서 나오기 때문입니다 : 나중에 붙이는 게 아무것도 없습니다. 0.1초의 어긋남만으로도 합성 티가 나는 기존 방식 체인과의 차이가 바로 이것입니다.

제 얼굴로 아바타를 만들 수 있나요?

네, 레퍼런스 시트를 본인 사진 세 장으로 채우면 됩니다. 반드시 동의한 사람의 얼굴로만 하세요 : 제삼자의 사진으로 생성한 대변인은 초상권에서 진짜 문제가 됩니다.

8초 테이크 하나에 비용이 어느 정도인가요?

Veo 3.1 Fast로 약 144크레딧, 즉 약 1.4유로이고 시작 이미지가 포함된 가격입니다. 정확한 가격은 렌더링 실행 전에 버튼에 표시됩니다.

여러 대사를 이어 갈 수 있나요?

네, 대사당 비디오 노드 하나씩, 모두 같은 얼굴 시트와 같은 시작 숏에 연결합니다. 이어 붙이면 진행자가 한결같은 1분짜리 영상이 됩니다.

말하는 AI 아바타

이 워크플로 사용하기

무료 계정, 카드 등록 불필요. 워크플로가 미리 채워진 상태로 캔버스에 열립니다.