모든 도구

AI로 노래에서 보컬 분리하기

30초짜리 노래를 Demucs가 보컬, 드럼, 베이스, 나머지 네 트랙으로 나누고, 옆에서는 같은 노래를 보컬 분리 모델에 통과시킵니다. 계정 없이 전체 워크플로를 그대로 볼 수 있습니다.

인터랙티브 데모

실제 워크플로, 실제 결과물. 자유롭게 이동하고 확대해 보세요.

이 워크플로 사용하기

실제 워크플로: 같은 노래가 두 개의 소리 개선 노드로 들어가고, Demucs는 네 트랙을, 분리 모델은 하나를 돌려줍니다.

한눈에 보기

이 워크플로의 결과물
처리된 오디오 파일 5개
캔버스 구조
노드 3개, 연결선 0개
연결된 모델
Demucs, ElevenLabs Audio Isolation
전체 1회 실행 비용
약 12 크레딧, US$0.14 상당

노래방 버전 만들기, 리믹스용 보컬 뽑기, 연습하려고 곡에서 드럼 빼기. 모두 같은 작업에서 시작합니다. 노래를 트랙으로 나누는 일입니다. 이 워크플로는 Meta의 분리 모델 Demucs로 그 일을 합니다. 노래가 소리 개선 노드에 들어가면 파일 넷이 나옵니다. 보컬, 드럼, 베이스, 그리고 기타와 키보드를 포함한 나머지 전부입니다.

두 번째 노드는 일부러 다른 일을 합니다. ElevenLabs Audio Isolation은 음악이 아니라 말소리를 위해 만들어졌고, 데모는 그래도 노래에 무엇을 하는지 보여 줍니다. 목소리만 돌려줍니다. 2026년 9월 3일 데모 곡에서 측정한 결과, 그 포락선은 Demucs의 보컬 트랙과 0.93의 상관을 보였고 음량은 17 % 컸습니다. 하지만 돌려주는 건 그것뿐입니다. 반주가 없으니 노래방 버전도 없습니다.

데모의 노래는 누구에게도 권리를 묻지 않으려고 생성한 것입니다. 당신의 노래는 각 노드의 가져오기 버튼으로 들어가고, 한 번에 최대 10분, 값은 초 단위입니다. 30초짜리에 두 노드를 돌리면 14센트, 그중 Demucs가 4크레딧입니다.

이렇게 하세요

  1. 1

    노래를 가져오세요

    MP3, WAV, M4A, OGG, 최대 10분. 플레이어가 읽자마자 노드가 길이와 값을 보여 줍니다. 오디오 포트는 캔버스에서 만든 음악도 받습니다.

  2. 2

    Demucs를 실행하세요

    클릭 한 번에 파일 넷: 보컬, 드럼, 베이스, 기타. 트랙마다 플레이어와 내려받기 버튼이 있고, 노드의 출력은 첫 번째인 보컬을 실어 나릅니다.

  3. 3

    분리 모델과 비교하세요

    두 번째 노드는 다른 길로 목소리만 줍니다. 편곡이 두터운 보컬에서는 둘 중 하나가 문장 끝을 더 잘 지킵니다. 편집에 보낼 것을 정하기 전에 둘 다 들어 보세요.

  4. 4

    당신의 버전을 조립하세요

    노래방 버전은 보컬을 뺀 세 트랙입니다. [편집](/docs/canvas-nodes)의 오디오 트랙 셋에 올리고 내보내세요. 리믹스라면 보컬을 남기고 나머지를 바꾸세요.

변형과 활용 사례

같은 캔버스를 다른 목적에 맞게 조정한 버전들: 각 변형은 프롬프트 두세 줄만 바꾸면 됩니다.

노래방 버전

가장 많이 찾는 경우입니다. 목소리 없는 노래. Demucs가 보컬을 따로 떼고, 남은 드럼, 베이스, 기타가 노래방 버전입니다. 편집에 올릴 세 트랙과 그 위에서 부를 노래 한 곡.

리믹스용 아카펠라

그 반대로, 새 편곡 위에 올릴 목소리만. 여기서 두 노드가 경쟁하고, 그것이 데모의 뜻입니다. Demucs와 분리 모델은 조금씩 다른 목소리를 돌려주니 문장 끝이 가장 잘 버티는 쪽을 고르세요.

곡의 드럼에 맞춰 연주하기

곡을 익히려는 드러머는 드럼 트랙만 뽑아 기타 없이 반복해 듣습니다. 베이스도 마찬가지입니다. Demucs가 가장 깨끗하게 나누는 두 트랙입니다.

휴대폰으로 녹음한 커버 다듬기

거실에서 찍은 커버는 목소리와 기타가 섞여 있습니다. 영상에서 오디오를 뽑아 Demucs에 통과시키면 목소리만 따로, 더 크게 다시 믹스한 뒤 영상에 되돌릴 수 있습니다.

악기 하나만 분리하기

Demucs는 네 계열만 압니다. 기타나 피아노를 정확히 뽑으려면 SAM Audio 노드가 「the electric guitar」 같은 글 설명을 받아 인식한 것을 한쪽에, 나머지를 다른 쪽에 돌려줍니다.

노래에 자막 달기, 받아쓰기

분리된 목소리는 믹스보다 훨씬 정확하게 받아쓸 수 있습니다. 가사가 더 이상 스네어와 싸우지 않기 때문입니다. 먼저 분리하고, 그다음 받아쓰고, 의심스러운 단어 확인용으로 보컬 트랙을 남겨 두세요.

자주 하는 실수

보컬 분리 모델에 노래방 버전을 기대하기

그것은 목소리를 돌려주지, 그 반대는 절대 돌려주지 않습니다. 노드 이름이 「분리」이고 정확히 그 일을 합니다. 목소리가 아닌 것은 버려지지, 따로 보관되지 않습니다. 노래방 버전은 Demucs입니다.

이미 심하게 압축된 파일 분리하기

96 kb/s MP3나 스피커에서 녹음한 노래는 Demucs가 악기를 알아보는 데 쓰는 고음을 이미 잃었습니다. 트랙이 흐릿하게 나옵니다. 구할 수 있는 가장 좋은 파일, 가능하면 원본에서 시작하세요.

30초 쓰려고 10분 돌리기

값은 초 단위이고 Demucs는 긴 파일에 느립니다. 먼저 필요한 구간으로 자르고 그다음 분리하세요. 더 싸고, 더 빠르고, 결과는 같습니다.

「기타」 트랙을 기대하기

Demucs는 목소리, 드럼, 베이스가 아닌 전부를 「기타」에 넣습니다. 기타, 키보드, 현악기가 한꺼번에입니다. 특정 악기라면 위에서 말한 SAM Audio 노드이지, 존재하지 않는 다섯 번째 트랙이 아닙니다.

추천 모델

자주 묻는 질문

두 노드 중 어느 것이 노래방 버전을 만드나요?

Demucs, 오직 그것뿐입니다. 노래방 버전은 목소리가 아닌 전부, 즉 드럼, 베이스, 기타 트랙을 합친 것입니다. 보컬 분리 모델은 목소리만 돌려주므로 그 반대는 만들 수 없습니다.

분리된 보컬은 깨끗한가요?

귀에는 깨끗하고, 돋보기로 보면 완벽하지 않습니다. 코러스와 긴 리버브에서 Demucs는 보컬 트랙에 나머지 믹스의 흔적을 조금 남기기도 합니다. 리믹스에서는 새 악기 아래 묻히고, 맨 아카펠라라면 무음 구간을 들어 보세요.

저작권이 있는 곡을 분리해도 되나요?

기술적으로는 됩니다. 모델은 권리를 읽지 않습니다. 결과를 어떻게 쓰느냐는 곡의 라이선스에 달렸습니다. 집에서 부르는 노래방 버전은 문제가 없고, 공개하면 문제가 됩니다. 데모 곡을 생성한 이유가 바로 그것입니다.

분리 한 번에 얼마인가요?

Demucs는 30초에 4크레딧, 1분에 6, 최대 10분에 60 안팎입니다. 보컬 분리 모델은 더 비싸서 분당 14크레딧입니다. 값은 클릭 전에 노드에 표시되며, 파일의 측정된 길이로 계산됩니다.

최대 길이는 얼마인가요?

두 노드 모두 한 번에 10분입니다. 앨범 하나는 곡별로 처리합니다. 어차피 그것이 원하는 형태입니다. 곡마다 트랙 한 세트.

어떤 형식으로 나오나요?

어떤 프로그램에서도 읽히는 오디오 파일이 트랙마다 하나, 노드에서 내려받습니다. 각 트랙은 원곡과 정확히 같은 길이라 어긋남 없이 겹쳐집니다.

휴대폰으로도 할 수 있나요?

있습니다. 캔버스가 모바일에서 돌아가고 파일은 휴대폰의 파일을 포함해 노드에서 고릅니다. 모바일에서 만들기 가이드가 손가락으로 캔버스를 다루는 법을 설명합니다.

제 파일이 모델 학습에 쓰이나요?

아닙니다. 올린 것은 당신의 작업 공간에 남고 어떤 학습에도 넘어가지 않습니다. 만들어진 파일은 원곡의 권리 범위 안에서 당신의 것입니다.

AI로 노래에서 보컬 분리하기

이 워크플로 사용하기

무료 계정, 카드 등록 불필요. 워크플로가 미리 채워진 상태로 캔버스에 열립니다.