품질 저하 없이 비디오에서 보컬을 분리하는 방법
품질 손실을 최소화하고, 스템 잔여물을 확인하고, 보컬과 대화 분리 중에서 선택하면서 비디오에서 보컬을 분리하는 방법을 알아보세요.

비디오에서 보컬을 분리하려면 가장 명확하게 승인된 소스로 시작하고, 노래의 경우 보컬/악기 분할을 선택하고, 음성 비디오의 경우 대화/음악/효과 분할을 선택하고, 내보내기 전에 가장 겹치는 부분을 미리 봅니다. "품질 저하 없이"는 손실 없는 결과를 약속하는 것이 아니라 피할 수 있는 손상을 최소화하는 것을 의미해야 합니다. 소스 분리는 이미 믹싱된 사운드트랙의 일부를 추정하므로 큰 반주, 반향, 군중 소음 및 압축으로 인해 잔여물이 남거나 보컬 디테일이 부드러워질 수 있습니다.
주요 시사점
- 음악의 경우 보컬/악기, 대부분의 비디오 편집의 경우 대화/음악/효과 등 콘텐츠에 맞게 분리 모델을 일치시킵니다.
- 가장 빠른 클린 소스를 사용하고 분리 전에 불필요한 재인코딩을 피하세요.
- 자음, 호흡, 지속 음, 잔향 꼬리 및 인공물에 대한 묵음 간격을 검토합니다.
- 단독으로 그리고 의도한 최종 믹스에서 보컬 스템을 판단하십시오.
- 전체 줄기를 과도하게 처리하는 대신 원본 사운드트랙을 유지하고 부분적으로 수리하십시오.
먼저 동영상에서 "보컬"이 무엇을 의미하는지 결정하세요.
이 단어는 두 가지 다른 편집 대상을 설명할 수 있습니다.
연주 영상에서 '보컬'은 주로 악기 연주와 분리된 노래를 의미합니다. 인터뷰, 튜토리얼, 영화 클립 또는 제품 데모에서 목표는 음악 및 음향 효과와 분리된 음성 대화입니다. 잘못된 출력을 선택하면 악기의 유용한 분위기가 묻어나거나 노래와 음성 자료가 일관되지 않게 분류될 수 있습니다.
| 소스 및 목표최고의 시작 분할예상 출력왜? | |||
| 노래 연주 또는 노래방 | 보컬 / 악기 | 줄기 2개 | 음악적 과제와 직접적으로 일치함 |
| 배경음악에 대한 인터뷰 | 대화/음악/효과 | 줄기 3개 | 분위기와 비음악적 효과를 보존합니다. |
| 장면 더빙 | 대화/음악/효과 | 줄기 3개 | 음성을 대체하면서 건전한 침대를 유지합니다. |
| 리믹스를 위한 아카펠라 | 보컬 / 악기 | 줄기 2개 | 보컬 에셋과 백킹 트랙을 제작합니다. |
| 캡션 또는 스크립트 검토를 위한 음성 | 대화/음악/효과 | 줄기 3개 | 이해하기 쉬운 연설에 중점을 둡니다. |
Recapo는 두 경로를 모두 제공합니다. 그 보컬 리무버 보컬/악기 워크플로우를 사용하는 반면 오디오 분리기 영상 중심 작업을 위한 대사, 음악, 효과를 반환할 수 있습니다.

완벽한 격리가 현실적인 약속이 아닌 이유
영상이 믹싱되면 보컬과 배경이 하나의 파형이 됩니다. 소스 분리는 원래 녹음 세션을 다시 열지 않습니다. 어떤 소리가 어떤 줄기에 속하는지 추정합니다.
여러 가지 조건으로 인해 추정이 더 어려워졌습니다.
- 가수와 악기는 비슷한 주파수를 차지합니다.
- 음성이 악보나 효과보다 조용합니다.
- 방의 반사는 시간에 걸쳐 목소리를 퍼뜨립니다.
- 압축이나 제한은 소스를 함께 움직이게 만듭니다.
- 품질이 낮은 사본에는 과도 현상과 고주파 세부 사항이 번져 있습니다.
- 군중의 목소리는 리드 보컬과 비슷합니다.
결과에는 블리드, 금속성 또는 물 같은 질감, 부드러워진 "s" 및 "t" 소리, 숨결 디테일 누락, 반주의 구멍 등이 포함될 수 있습니다. Recapo의 공식 분리기 페이지에서는 분리가 희미한 잔여물을 남길 수 있으며 무손실 혼합이 아니라는 점을 명시적으로 경고합니다. 이러한 제한에 대해 신뢰할 수 있는 작업 흐름을 계획합니다.
단계별 보컬 분리 작업 흐름
1. 최고의 소스로 시작하세요
편집이 허용된 가장 빠른 세대를 사용하세요. 원본 비디오를 사용할 수 있는 경우 소셜 미디어 다운로드에서 추출하지 마십시오. 반복되는 인코딩은 분리가 시작되기 전에 아티팩트를 추가할 수 있습니다.
글로벌 이퀄라이제이션, 과도한 압축 또는 공격적인 노이즈 감소를 자동으로 적용하지 마십시오. 이러한 프로세스는 보컬과 배경을 함께 재구성할 수 있습니다. 소스에 잡음이 있는 경우 분리 전후 정리를 통해 짧은 섹션을 테스트하고 들리는 부작용이 적은 버전을 유지하세요.
2. 어려운 순간을 표시하세요
소스를 듣고 참고하세요:
- 조용한 목소리로 큰 반주;
- 긴 반향이나 지연으로 노래하기;
- 박수, 구호 또는 겹치는 연설자;
- 음절에서 발생하는 날카로운 효과;
- 목소리가 속삭임으로 떨어지는 구절;
- 바람이 불고, 윙윙거리고, 쉿하는 소리가 나는 순간들.
이것이 품질 관리 포인트입니다. 쉬운 첫 문장만으로는 줄기 전체가 깨끗하다는 것을 증명할 수 없습니다.
3. 분리 모드를 선택하세요
보컬이 음악 믹스의 일부이고 아카펠라, 노래방 또는 리믹스 자료를 원할 때 보컬/악기를 사용하십시오. 음악적이지 않은 배경 세부 정보를 별도로 유지하면서 음성이 필요한 경우 대화/음악/효과를 사용하세요.
적절한 Recapo 도구에 소스를 업로드하고 처리하기 전에 현재 페이지 컨트롤을 확인하세요. 제품 인터페이스와 옵션은 변경될 수 있으므로 실제 공식 페이지가 정보의 출처입니다.
4. 분리된 음성 미리보기
편안한 수준으로 헤드폰을 사용하여 들어보세요. 명료도를 먼저 확인한 다음 자연스러움을 확인하세요. 더 큰 줄기가 자동으로 더 나은 줄기는 아닙니다.
주의 사항:
- 자음의 시작과 끝;
- 지속된 모음과 노래된 음표;
- 반주 잔여물이 노출되는 일시 중지;
- 호흡과 조용한 말;
- 각 프레이즈 다음에 리버브가 끝납니다.
- 음성 비디오를 위한 립싱크.
그런 다음 악기, 음악, 효과 출력을 들어보세요. 인식할 수 있는 성대 조각이 남아 있으면 해당 줄기를 재사용할 때 다시 나타날 수 있습니다.
5. 맥락에 따라 비교
격리된 보컬을 의도한 설정에 배치합니다. 리믹스의 경우 새 백킹 트랙을 들어보세요. 캡션이나 텍스트 변환의 경우 모든 단어가 명확한지 확인하세요. 더빙의 경우 원래 대사 없이 음악과 효과를 결합하고 잔여물을 들어보세요.
일부 솔로 아티팩트는 최종 믹스에서 가려집니다. 다른 문제들, 특히 단어가 중복되거나 자음이 누락되는 문제는 더욱 주의를 산만하게 합니다. 솔로 파형만으로는 결정하지 않고 상황에 맞게 결정하십시오.
6. 수리가 필요한 부분만 수리하세요
줄기의 대부분을 사용할 수 있는 경우 전체 녹음에 걸쳐 더 강한 처리를 추진하지 마십시오. 대신:
- 짧은 출혈을 자동화합니다.
- 거친 경계를 희미하게 한다;
- 편집상 적절한 경우 승인된 다른 테이크의 음절을 패치합니다.
- 일시 정지가 부자연스럽게 공허하게 들리지 않도록 통제된 양의 분위기를 유지하십시오.
- 격리된 이벤트에 대해 타겟 스펙트럼 복구를 사용합니다.
- 안정적이고 원치 않는 텍스처에만 조심스럽게 노이즈 감소를 적용하십시오.
공식 Audacity 지침에 따르면 일반적인 소음 감소는 개별 클릭, 팝 또는 불규칙한 배경 활동이 아닌 쉿소리, 윙윙거리는 소리 또는 팬 소음과 같은 지속적인 소리에 적합하다고 나와 있습니다. 갑작스러운 소리는 가능할 때마다 로컬 이벤트로 처리되어야 합니다.
7. 가역 세트 내보내기 및 보존
원본 믹스, 분리된 음성, 보완적인 줄기 또는 줄기 및 편집된 결과를 유지합니다. 모든 파일이 동기화된 상태로 유지되도록 동일한 시작 시간을 유지하세요. 항목을 삭제하기 전에 내보내기를 다시 열고 전체 기간이 올바르게 재생되는지 확인하세요.
스템을 사용하기 전 품질 체크리스트
- 음성은 사진과 동기화됩니다.
- 조용한 단어와 자음의 가장자리는 여전히 이해할 수 있습니다.
- 일시 정지 시 음악이나 효과 잔여물이 허용됩니다.
- 목소리가 공허하거나, 거품이 많거나, 금속성이거나, 페이즈하게 들리지 않습니다.
- 리버브 테일이 갑자기 끊어지지 않습니다.
- 보완 어간에는 방해가 되는 보컬 조각이 포함되어 있지 않습니다.
- 고립된 보컬은 솔로뿐만 아니라 최종 믹스에서도 작동합니다.
- 원본 사운드트랙이 보존됩니다.

일반적인 문제와 더 나은 대응
보컬은 물속에서 들린다
이는 종종 더 강한 분리가 보컬의 디테일도 제거한다는 것을 나타냅니다. 추가 노이즈 제거 또는 필터링에서 물러납니다. 다른 분리 모드를 비교하고 상황에 맞는 분위기를 약간 복원하거나 공격적인 정리보다 더 자연스럽게 들리면 약간의 블리드를 허용합니다.
음악은 목소리 아래에 남아 있습니다.
잔여물이 특정 문구로 제한되어 있는지 확인하세요. 교체용 뮤직베드를 사용하면 실신을 가릴 수 있습니다. 노출된 음성의 경우 영향을 받는 영역만 줄이거나 음악 중심의 보컬 분할로 시작한 경우 대화 분리를 시도하십시오.
시끄러운 효과 중에 음성이 사라집니다.
모델은 음성의 일부를 효과로 분류했을 수 있습니다. 해당 보완 줄기와 원래 혼합물을 검토하십시오. 로컬 패치는 전체 녹음에 걸쳐 처리를 늘리는 것보다 덜 손상될 수 있습니다.
리버브는 스템 사운드를 멀리 있게 만듭니다.
리버브는 직접 음성과 혼합된 반향으로 구성됩니다. Adobe의 공식 문서에서는 반향 제거를 반향 프로파일을 추정하고 조정 가능한 처리량을 적용하는 것으로 설명합니다. 이러한 처리를 보수적으로 사용하십시오. 너무 많이 처리하면 음성이 얇아질 수 있으며 별도로 캡처하지 않은 세부 정보를 어떤 도구도 복구할 수 없습니다.
바람소리나 쉿쉿거리는 소리가 고립된 목소리에 남아있다
이는 소스 분리 문제 이후의 소음 문제입니다. 사용 오디오 소음 감소 음성이나 대화 줄기에서 결과를 미리 보고 음성이 합성된 것처럼 들리기 전에 중지합니다. 지속적인 소음은 일반적으로 일회성 영향보다 억제하기가 더 쉽습니다.
향후 격리를 개선하는 녹음 선택
후반 작업은 캡처부터 시작됩니다. 다음 녹화를 제어할 수 있는 경우:
- 마이크를 화자나 가수에게 더 가깝게 배치합니다.
- 모니터나 스피커가 마이크에 흘러 들어가는 것을 줄입니다.
- 프로덕션에서 허용하는 경우 별도의 마이크나 트랙을 녹음합니다.
- 실외에서 바람 보호 장치를 사용하십시오.
- 반사가 적은 방을 선택하거나 녹음 영역 주변에 부드러운 가구를 추가하십시오.
- 전체 테스트 전에 간단한 테스트를 모니터링합니다.
- 원본 멀티트랙 파일을 보존합니다.
진정한 격리 녹음은 완성된 믹스를 되돌리려는 시도보다 더 많은 제어 기능을 제공합니다. 분리는 해당 원본이 존재하지 않거나 현재 작업 흐름에서 사용할 수 없는 경우 가장 유용합니다.
자주 묻는 질문
오디오를 먼저 추출하지 않고 비디오에서 보컬을 분리할 수 있나요?
예, 구분 기호가 비디오 입력을 직접 허용하는 경우입니다. 전체 사운드트랙의 독립 실행형 복사본을 원하거나 다른 도구에 오디오 전용 입력이 필요한 경우에만 추출이 필요합니다.
보컬 리무버는 다이얼로그 세퍼레이터와 동일합니까?
서로 관련되어 있지만 다양한 출력에 최적화되어 있습니다. 보컬 리무버는 일반적으로 보컬과 악기를 반환합니다. 비디오 중심 분리기는 대화, 음악 및 효과를 독립적으로 유지할 수 있습니다.
분리된 보컬이 완전히 무손실이 될 수 있나요?
완성된 믹스에 대해서는 신뢰할 수 있는 보증이 없습니다. 목표는 의도한 편집에 대해 잔여물과 아티팩트를 충분히 낮게 유지하면서 유용한 보컬 디테일을 유지하는 것입니다.
고립된 음성에 노이즈 감소를 사용해야 합니까?
원치 않는 소음이 남아 있을 때만 사용하세요. 공격적인 노이즈 제거는 음성 및 노래에 손상을 줄 수 있으므로 적절한 패스를 미리 보고 원본과 비교해 보세요.
악기 연주에서 가수의 목소리가 계속 들리는 이유는 무엇입니까?
보컬은 반주와 함께 주파수, 리버브 또는 다이내믹을 공유할 수 있습니다. 이러한 중첩은 보완 줄기에 희미한 보컬 잔여물을 남길 수 있습니다.
작업에 적합한 성대 분리
레이블이 아닌 편집 주위의 출력을 선택하십시오. Recapo를 사용하세요 오디오 분리기 음성 비디오 제어 또는 그 보컬 리무버 두 줄기 음악 작업 흐름을 위해. 어려운 부분을 미리 보고 원본을 유지하며 과도하게 처리된 침묵의 시도보다 자연스러운 사용 가능한 결과를 선호합니다.


