Código aberto · Local em primeiro lugar · Higgs Audio, ElevenLabs e mais
Seu vídeo, em qualquer idioma, na sua própria voz.
Envie um vídeo em um idioma e escolha outro. O OpenDub separa a fala da música, transcreve tudo, traduz cada frase para caber no tempo dela e fala de novo com um clone da voz original — depois embute as legendas no novo idioma.
- Código aberto. Cada etapa é código simples, que você pode ler, rodar e trocar.
- Local, menos os modelos de voz. Separação, detecção de fala, sincronia, mixagem e renderização rodam no seu dispositivo. Seu vídeo nunca sai dele — só os trechos de fala e o texto vão para o modelo de voz que você escolher.
- Potente. Sua voz clonada em 17 idiomas, cada fala no tempo dos seus lábios e com o seu tom — surpresa, entusiasmo, calma.
Outras configurações Voz clonada · tom ajustado por fala
A velocidade da fala não é uma configuração: ela é escolhida fala a fala, para cada uma começar e terminar junto com o original.
Substituir a voz mantém a música e os efeitos e troca a fala. Voz sobreposta deixa o original baixinho por baixo.
Dublando
—
O que está acontecendo
Pronto
—
Arraste um bloco dublado para movê-lo, ou as bordas dele para mudar a duração. Dê dois cliques para encaixá-lo de volta no original.
Falas
Mude a tradução, o tom ou o tempo de qualquer fala e aplique só essas — o resto é mantido.
Duble o seu vídeo
Ou rode o OpenDub na sua própria máquina.
O cartão lá em cima dubla vídeos de até cinco minutos nesta aba mesmo. O app no seu computador não tem limite de duração, remove a voz mais rápido e deixa você editar, mudar o tom ou arrastar qualquer fala e redublar em uns dez segundos.
STT da Higgs, tradução e voz clonada com marcações de tom. A melhor qualidade, e foi o que fez a dublagem acima.
Preços de uso da Boson AI
Whisper, um modelo de linguagem local e o OmniVoice. Nada sai do seu computador e nada é cobrado.
Em breve
curl -fsSL https://opendub.app/install.sh | bash
macOS e Linux. Cerca de 2 GB, alguns minutos. Instala a voz gratuita e inicia, para que o cartão no topo possa dublar com ela. Nada sai do seu computador.
- Instale o Python 3.12 e o ffmpeg (o
ffmpegdo Homebrew já tem tudo). - Coloque uma chave para o caminho Higgs: escreva
BOSON_API_KEY=…num arquivo.env. - Inicie com
./run.she abrahttp://127.0.0.1:8910.
Tudo é código aberto, AGPL-3.0: github.com/opendubapp/opendub.
Como funciona
Quatro modelos, cada um fazendo aquilo em que é melhor.
- 01
Separar
O Demucs separa a fala da música e dos efeitos, para a trilha sobreviver à dublagem e todos os modelos seguintes ouvirem uma voz limpa.
- 02
Escutar
O Silero VAD encontra a fala. O Higgs STT escreve as palavras no idioma em que foram ditas; um Whisper local entra só com a sincronia, alinhada palavra por palavra.
- 03
Traduzir na medida
O modelo de chat da Higgs traduz frases inteiras, cada uma no tamanho do tempo que a pessoa levou para dizê-la — assim a nova voz começa e para junto com os lábios dela.
- 04
Falar e conferir
O Higgs TTS clona a voz a partir de uma frase limpa do original e diz cada fala no tom em que ela foi dita, deduzido das palavras e do volume e da velocidade de quem falava. Cada fala é transcrita de volta e refeita se saiu do rumo, depois dita outra vez ou esticada de leve para bater com a duração original.