Código abierto · Primero en local · Higgs Audio, ElevenLabs y más
Tu vídeo, en cualquier idioma, con tu propia voz.
Sube un vídeo en un idioma y elige otro. OpenDub separa la voz de la música, la transcribe, traduce cada frase para que encaje en su momento y la dice con un clon de la voz original; después incrusta los subtítulos en el nuevo idioma.
- Código abierto. Cada paso es código normal que puedes leer, ejecutar y sustituir.
- En local, salvo los modelos de voz. La separación, la detección de voz, la sincronización, la mezcla y el renderizado se hacen en tu dispositivo. Tu vídeo nunca sale de él: al modelo de voz que elijas solo van fragmentos de voz y texto.
- Potente. Tu propia voz clonada en 17 idiomas, con cada frase ajustada a tus labios y con tu tono: sorpresa, entusiasmo, calma.
Otros ajustes Voz clonada · tono ajustado por frase
La velocidad al hablar no es un ajuste: se elige en cada frase para que empiece y termine con el hablante.
Sustituir la voz conserva la música y los efectos y cambia solo el habla. Voz superpuesta deja el original de fondo, muy bajo.
Doblando
—
Qué está haciendo
Listo
—
Arrastra un bloque doblado para moverlo, o sus bordes para cambiar su duración. Haz doble clic para volver a encajarlo con el original.
Frases
Cambia cualquier traducción, tono o tiempo y aplica solo esas frases: el resto se conserva.
Dobla tu propio vídeo
O ejecuta OpenDub en tu propia máquina.
La tarjeta de arriba dobla vídeos de hasta cinco minutos aquí mismo, en esta pestaña. La app para tu ordenador no tiene límite de duración, quita la voz más rápido y te deja editar, cambiar el tono o arrastrar cualquier frase y volver a doblarla en unos diez segundos.
Higgs STT, traducción y voz clonada con etiquetas de tono. La mejor calidad, y con lo que se hizo el doblaje de arriba.
Precios de uso de Boson AI
Whisper, un modelo de lenguaje local y OmniVoice. Nada sale de tu ordenador y no se cobra nada.
Muy pronto
Ábrelo y pulsa Instalar. Sin terminal y sin configurar nada.
O instálalo con una líneacurl -fsSL https://opendub.app/install.sh | bash
macOS y Linux. Unos 2 GB, unos minutos. Instala la voz gratuita y la arranca para que la tarjeta de arriba pueda doblar con ella. Nada sale de tu ordenador.
- Instala Python 3.12 y ffmpeg (el
ffmpegde Homebrew trae todo lo necesario). - Añade una clave para la ruta de Higgs: pon
BOSON_API_KEY=…en un archivo.env. - Arráncalo con
./run.shy abrehttp://127.0.0.1:8910.
Todo es código abierto, AGPL-3.0: github.com/opendubapp/opendub.
Cómo funciona
Cuatro modelos, cada uno haciendo aquello en lo que es mejor.
- 01
Separar
Demucs separa la voz de la música y los efectos, así la banda sonora sobrevive al doblaje y todos los modelos siguientes oyen una voz limpia.
- 02
Escuchar
Silero VAD encuentra la voz. Higgs STT escribe las palabras en el idioma en que se dicen; un Whisper local aporta solo la sincronización, alineada palabra por palabra.
- 03
Traducir a medida
El modelo de chat de Higgs traduce frases enteras, cada una ajustada al tiempo que tardó el hablante en decirla, para que la nueva voz empiece y acabe con sus labios.
- 04
Hablar y comprobar
Higgs TTS clona la voz a partir de una frase limpia del original y dice cada línea con el tono en que se dijo, deducido de las palabras y del volumen y la velocidad del hablante. Cada frase se vuelve a transcribir y se regenera si se desvió, y luego se repite o se estira ligeramente hasta durar lo mismo que la original.