오픈 소스 · 로컬 우선 · Higgs Audio, ElevenLabs 외
내 영상을, 어떤 언어로든, 내 목소리로.
한 언어로 된 영상을 올리고 바꿀 언어를 고르세요. OpenDub은 말소리와 음악을 분리하고, 받아쓰고, 문장마다 그 순간에 맞는 길이로 번역한 뒤, 원래 목소리를 복제해 다시 말합니다. 그리고 새 언어의 자막을 영상에 새겨 넣습니다.
- 오픈 소스. 모든 단계가 읽고, 실행하고, 갈아 끼울 수 있는 코드입니다.
- 음성 모델만 빼면 전부 로컬. 분리, 음성 검출, 타이밍, 믹싱, 렌더링이 내 기기에서 돌아갑니다. 영상은 기기를 벗어나지 않고, 선택한 음성 모델에는 말소리 클립과 텍스트만 전송됩니다.
- 강력합니다. 복제한 내 목소리로 17개 언어를, 문장마다 입 모양에 맞춘 길이로, 놀람이나 열의, 차분함 같은 어조까지 담아 말합니다.
기타 설정 복제 목소리 · 문장별 어조 일치
말하기 속도는 설정이 아닙니다. 문장마다 화자와 함께 시작하고 끝나도록 자동으로 정해집니다.
「목소리 교체」는 음악과 효과음을 남기고 말소리만 바꿉니다. 「보이스오버」는 원음을 아래에 희미하게 남깁니다.
더빙 중
—
진행 중인 작업
완료
—
더빙 블록을 끌어 옮기거나 양 끝을 끌어 길이를 바꾸세요. 두 번 클릭하면 원본 위치로 되돌아갑니다.
문장
번역, 어조, 타이밍을 고친 뒤 그 문장만 적용하세요. 나머지는 그대로 유지됩니다.
내 영상 더빙하기
또는 내 컴퓨터에서 OpenDub을 돌리세요.
위쪽 카드는 5분 이하의 영상을 이 탭에서 바로 더빙합니다. 컴퓨터에 설치하는 앱은 길이 제한이 없고, 목소리를 더 빨리 제거하며, 어떤 문장이든 고치거나 어조를 바꾸거나 끌어 옮긴 뒤 10초쯤이면 다시 더빙합니다.
Higgs STT, 번역, 그리고 어조 태그가 붙은 복제 목소리. 품질이 가장 좋으며, 위의 더빙도 이 방식으로 만들었습니다.
Boson AI 사용량 요금
Whisper, 로컬 언어 모델, OmniVoice. 컴퓨터를 벗어나는 것도, 청구되는 것도 없습니다.
곧 제공
열고 설치를 누르면 됩니다. 터미널도 설정도 필요 없습니다.
한 줄로 설치할 수도 있습니다curl -fsSL https://opendub.app/install.sh | bash
macOS와 Linux. 약 2 GB, 몇 분. 무료 음성을 설치하고 실행하므로 위의 카드가 그 음성으로 더빙할 수 있습니다. 모두 이 컴퓨터 안에서만 이루어집니다.
- 설치 Python 3.12와 ffmpeg을 설치합니다(Homebrew의
ffmpeg이면 충분합니다). - 키 추가 Higgs 경로용으로
BOSON_API_KEY=…를.env파일에 넣습니다. - 실행
./run.sh로 시작한 뒤http://127.0.0.1:8910을 엽니다.
전부 오픈 소스이며 AGPL-3.0입니다: github.com/opendubapp/opendub.
작동 방식
네 개의 모델이, 저마다 가장 잘하는 한 가지를 맡습니다.
- 01
분리
Demucs가 말소리를 음악·효과음에서 떼어 냅니다. 덕분에 사운드트랙은 더빙 뒤에도 그대로 남고, 아래의 모든 모델은 깨끗한 목소리를 듣습니다.
- 02
듣기
Silero VAD가 말소리를 찾아냅니다. Higgs STT가 어떤 언어로 말했든 그대로 받아쓰고, 로컬 Whisper는 단어 단위로 맞춘 타이밍만 제공합니다.
- 03
길이에 맞춰 번역
Higgs 챗 모델이 문장 단위로 번역하되, 화자가 그 말을 하는 데 걸린 시간에 맞춰 길이를 잡습니다. 그래서 새 목소리가 화자의 입과 함께 시작하고 멈춥니다.
- 04
말하고, 확인하기
Higgs TTS가 원본의 깨끗한 문장 하나에서 목소리를 복제하고, 말의 내용과 화자의 성량·속도에서 읽어 낸 어조 그대로 각 문장을 말합니다. 문장마다 다시 받아써서 확인하고, 어긋났으면 다시 만든 뒤, 원본 길이에 맞도록 다시 말하거나 살짝 늘립니다.