← Blog

유튜브에서 노래방 반주 만들기: 어떤 곡이든 MR로

2026-08-04

유튜브에는 '반주 버전' 버튼이 없습니다. 특정 곡을 따라 부르고 싶다면——공식 MR이 나오지 않은 곡, 커버곡, 동네 노래방 기기에 없는 외국어 곡——반주는 직접 만드는 수밖에 없습니다.

다행히 이제는 두 단계면 끝나는 작업입니다. 5분 정도 걸리고 비용은 들지 않습니다. 1단계는 곡을 오디오 파일로 받는 것, 2단계는 그 파일을 AI 모델에 넣어 보컬과 나머지를 분리하는 것입니다.

짧은 답

  1. 원하는 곡의 유튜브 URL을 복사합니다.
  2. OnlyMP3.tools에서 320 kbps MP3로 변환합니다. 여기서 비트레이트 선택은 평소 감상용보다 훨씬 중요합니다(이유는 아래에서 설명).
  3. 그 MP3를 AI 보컬 분리 도구에 업로드합니다. 예를 들어 SongToKaraoke는 곡을 보컬과 반주로 나눠 줍니다.
  4. 반주 스템을 내려받습니다. 이것이 노래방 반주입니다.

전체 흐름은 이게 전부입니다. 아래에서는 각 단계가 왜 그런지, 어떤 곡이 깔끔하게 분리되는지, 결과가 이상할 때 어떻게 하는지를 설명합니다.

'보컬만 줄이면' 되지 않는 이유

예전에 반주를 만들던 방법은 센터 채널 제거였습니다. 리드 보컬은 보통 정중앙에 믹스되어 있습니다. 즉 좌우 채널에 동일한 신호가 들어 있죠. 한 채널에서 다른 채널을 빼면 완벽히 가운데 있는 것은 모두 상쇄됩니다——보컬을 포함해서요.

어느 정도는 작동합니다. AI 이전부터 무료 '보컬 리무버'가 존재했던 이유죠. 하지만 치명적인 문제가 두 가지 있습니다.

  • 가운데 있는 다른 것들도 함께 사라집니다. 킥, 스네어, 베이스도 거의 항상 센터에 있습니다. 가수와 함께 리듬 섹션 전체가 날아갑니다.
  • 리버브는 살아남습니다. 보컬의 리버브 잔향은 센터가 아니라 스테레오라서 상쇄되지 않습니다. 노래는 없는데 노래의 잔향만 유령처럼 남습니다. 꽤 기괴하게 들립니다.

요즘 AI 분리는 원리가 완전히 다릅니다. Demucs 계열 모델은 개별 스템이 확보된 수만 곡으로 학습했기 때문에, 보컬이 스테레오 상 어디에 있는지가 아니라 사람 목소리가 어떻게 들리는지를 배웠습니다. 음향적 특징으로 보컬을 뽑아내므로 드럼, 베이스, 악기는 그대로 남습니다.

실제 차이는 확연합니다. 센터 제거는 드럼이 빠진 얇고 텅 빈 트랙을 주지만, AI 분리는 진짜 MR처럼 들리는 결과를 줍니다.

1단계: 곡을 MP3로 받기

유튜브 URL을 OnlyMP3.tools에 붙여 넣고 비트레이트를 골라 내려받습니다.

320 kbps를 고르세요. 평소 감상용이라면 192와 320의 차이를 대부분 구분하지 못하고, 저희도 보통은 용도에 맞게 고르라고 안내합니다. 하지만 보컬 분리는 예외이며, 이유는 다음과 같습니다.

MP3 압축은 인코더가 "의식적으로 알아채지 못할 것"이라고 판단한 오디오 정보를 버리는 방식으로 동작합니다. 비트레이트가 낮을수록 더 많이 버립니다——특히 고역대, 그리고 더 큰 소리에 가려진 작은 소리 구간에서요. 그런데 그 영역이 바로 분리 모델이 '목소리'와 '기타'를 구분할 때 사용하는 부분입니다. 128 kbps 파일을 준다는 건, 일부러 버려진 데이터에서 보컬을 복원하라고 요구하는 셈입니다.

아티팩트는 반주에서 물속처럼 일렁이는 질감으로 나타나며, 심벌과 리버브 꼬리에서 가장 잘 들립니다. 저화질 JPEG로 다섯 번 저장한 사진을 다시 보정하면 안 되는 것과 같은 이치입니다.

각 비트레이트에서 실제로 무엇을 잃는지는 OnlyMP3 비트레이트 가이드에 정리해 두었습니다.

한 가지 더. 원본 영상의 품질은 끌어올릴 수 없는 천장입니다. 누군가 저품질 음원으로 올린 곡이라면 320 kbps를 요청해도 나쁜 오디오가 담긴 큰 파일이 될 뿐입니다. 공식 아티스트 채널이나 공식 'Artist - Topic' 채널을 우선하세요. 보통 레이블 마스터에서 공급됩니다.

2단계: 보컬 분리하기

MP3를 AI 분리 도구에 업로드합니다. SongToKaraoke는 바로 이 용도로 만들어졌습니다. 곡을 올리면 보컬이 없는 반주를 돌려주고, 바로 내려받아 부를 수 있습니다. 드럼과 베이스까지 개별 파일로 원한다면 범용 스템 분리 도구도 있지만, 노래방용이라면 2분할로 충분합니다.

처리 시간은 곡 길이에 따라 보통 30초에서 몇 분 사이입니다. 모델은 서버에서 돌아가므로 기기 성능이 낮아도 문제없습니다.

돌려받는 것은 반주 스템입니다. 같은 곡, 같은 템포, 같은 키, 같은 편곡에서 리드 보컬만 빠진 상태죠.

어떤 곡이 깔끔하게 분리되나

결과는 장르와 프로덕션 방식에 따라 크게 달라집니다. 만족도를 결정하는 가장 큰 변수입니다.

곡 유형일반적인 결과이유
모던 팝, 힙합, EDM매우 좋음멀티트랙 프로덕션이 깔끔하고 보컬이 독립적이며 학습 데이터도 많음
록, 메탈좋음보컬은 잘 분리됨. 디스토션이 강한 기타가 가끔 모델을 헷갈리게 함
어쿠스틱 싱어송라이터좋음~보통목소리와 통기타의 주파수 대역이 겹쳐 약간의 번짐 발생
관악기가 있는 재즈, 소울보통색소폰과 트럼펫 음역이 사람 목소리와 겹침
합창, 오페라, 아카펠라 위주나쁨'악기'가 곧 목소리라 분리할 대상이 없음
라이브 녹음, 부틀렉나쁨관객 소음과 공간 울림이 모든 스템을 오염시킴
1965년 이전 모노 녹음보통~나쁨모든 소리가 한 채널에 겹쳐 있고 테이프 압축이 강함

원칙은 이렇습니다. 원본 녹음에서 보컬이 독립적일수록 모델이 더 잘 뽑아냅니다. 부스에서 따로 녹음한 스튜디오 팝은 훌륭하게 분리되지만, 마이크 두 대로 녹음한 1958년 라이브 재즈는 그렇지 않습니다.

'좋은 결과'의 실제 수준

깔끔하게 분리되어도 공식 발매 MR과 같지는 않습니다. 다음은 감안하세요.

  • 소리가 두꺼운 구간에서 보컬 잔상이 남을 수 있습니다(특히 긴 음).
  • 심벌이 약간 뭉툭해집니다. 고역대가 보컬과 심벌이 가장 많이 겹치는 지점이라 모델이 과하게 깎을 때가 있습니다.
  • 백보컬은 남을 수도, 사라질 수도 있습니다. 대부분의 모델은 화음과 더블링도 '보컬'로 간주해 리드와 함께 제거합니다. 후렴이 겹겹이 쌓인 화음으로 완성되는 곡이라면 반주가 허전하게 느껴질 수 있습니다.

집에서, 파티에서 부르거나 연습용이라면 어느 것도 문제되지 않습니다. 녹음해서 공개할 계획이라면 먼저 전체를 처음부터 끝까지 주의 깊게 들어 보세요.

주요 활용

  • 홈 노래방: 노래방 서비스가 라이선스하지 않은 곡——외국어 곡, 인디 발매, 앨범 수록곡.
  • 보컬 연습. 피아노 편곡 악보 대신 원래 편곡과 원곡 템포로 연습할 수 있습니다.
  • 오디션과 커버. 원곡에서 추출한 반주는 MIDI 재현보다 훨씬 낫습니다.
  • 음악 교육. 수업에서 반주를 틀면 교실에서 들리는 목소리는 학생 것뿐입니다.
  • 댄스와 안무: 카운트를 셀 때 보컬이 방해가 되는 경우.

문제 해결

반주에 보컬이 희미하게 남아 있습니다. 대개 원본 품질 문제입니다. 구할 수 있는 가장 좋은 업로드에서 320 kbps로 다시 받아 시도하세요. 밀도 높은 라이브 믹스이거나 화음이 많은 곡이라면 그게 한계일 수 있습니다.

반주가 얇고 '물속' 같은 소리가 납니다. 전형적인 저비트레이트 입력 아티팩트입니다. 내려받은 비트레이트를 확인하고 128이나 192였다면 320으로 다시 하세요.

드럼이 보컬과 함께 사라졌습니다. AI 분리가 아니라 센터 채널 제거의 특징입니다. 일부 무료 '보컬 리무버' 사이트는 아직도 옛날 감산 방식을 씁니다. 실제 스템 분리를 하는 도구를 쓰세요.

업로드가 실패하거나 시간 초과됩니다. 아주 긴 파일(DJ 셋, 공연 전체 녹음, 1시간짜리 믹스)은 처리 한도를 넘길 수 있습니다. 원하는 곡만 먼저 잘라내세요.

오디오가 아니라 .html 파일이 받아집니다. 그 변환기가 파일이 아니라 광고 리디렉션을 준 겁니다. 위험 신호입니다——변환기 고르는 법을 참고하세요.

저작권에 관하여

개인 연습이나 홈 노래방을 위해 반주 버전을 만드는 것은 대부분의 법역에서 사적 이용으로 다뤄지는 것이 일반적입니다. 하지만 그 반주를 공개하거나, 판매하거나, 수익화 콘텐츠의 배경음악으로 쓰는 것은 다른 문제입니다. 파일에서 무엇을 제거했든 곡의 저작권과 원반권은 그대로 남아 있습니다.

노래방이 거실에서 끝난다면 괜찮습니다. 수익화 채널에 올라간다면 라이선스를 알아보세요.

자주 묻는 질문

뭔가 설치해야 하나요? 아니요. 두 단계 모두 브라우저에서 끝납니다. MP3 다운로드는 OnlyMP3.tools에서, 분리는 분리 서비스 서버에서 이뤄집니다.

휴대폰에서도 되나요? 됩니다. 둘 다 웹 기반입니다. 번거로운 건 iOS의 파일 처리 정도인데, MP3는 '파일' 앱의 다운로드에 저장되므로 거기서 업로드하면 됩니다.

반주 키는 원곡 그대로인가요? 네. 분리는 음정이나 템포를 바꾸지 않습니다. 조옮김이 필요하면 반주를 얻은 뒤의 별도 작업입니다.

반대로 보컬만 얻을 수 있나요? 가능합니다. 같은 처리에서 두 스템이 함께 나옵니다. 보컬만 있는 트랙(아카펠라)은 같은 분할의 나머지 절반으로, 리믹스나 창법 분석에 유용합니다.

왜 공식 MR보다 못하게 들리나요? 공식 MR은 보컬 트랙을 빼고 믹스한 실제 멀티트랙이기 때문입니다. 분리는 추정에 기반한 재구성입니다. 최근 몇 년 사이 격차가 크게 줄었지만 완전히 사라지지는 않았습니다.

정말 320 kbps가 필요한가요? 이 작업에서는 평소 감상보다 훨씬 중요합니다. 분리 품질의 상한은 압축 후 원본 오디오가 얼마나 남았는지가 직접 결정합니다.

마무리

두 단계입니다. 깨끗한 MP3를 얻고, 거기서 보컬을 빼낸다. 1단계에서 고른 비트레이트가 2단계의 천장을 정한다는 것——이게 전 과정에서 유일하게 직관적이지 않은 부분입니다. 평소라면 낮은 걸로 만족했더라도 이번엔 320 kbps로 받으세요.

먼저 OnlyMP3.tools에서 곡을 받고, SongToKaraoke로 반주를 만드세요.