Open Source · Läuft lokal · Higgs Audio, ElevenLabs und mehr
Ihr Video, in jeder Sprache, in Ihrer eigenen Stimme.
Laden Sie ein Video in einer Sprache hoch und wählen Sie eine andere. OpenDub trennt die Sprache von der Musik, schreibt sie mit, übersetzt jeden Satz passend zu seinem Moment und spricht ihn in einem Klon der Originalstimme wieder ein — und brennt anschließend Untertitel in der neuen Sprache ein.
- Open Source. Jeder Schritt ist schlichter Code, den Sie lesen, ausführen und ersetzen können.
- Lokal, bis auf die Stimmmodelle. Trennung, Sprachaktivitätserkennung, Timing, Mischung und Rendering laufen auf Ihrem Gerät. Ihr Video verlässt es nie — nur Sprachausschnitte und Text gehen an das Stimmmodell Ihrer Wahl.
- Leistungsstark. Ihre eigene geklonte Stimme in 17 Sprachen, jede Zeile auf Ihre Lippen getimt und in Ihrem Tonfall — Überraschung, Begeisterung, Ruhe.
Weitere Einstellungen Geklonte Stimme · Tonfall pro Zeile
Das Sprechtempo ist keine Einstellung: Es wird pro Zeile so gewählt, dass jede Zeile zusammen mit der sprechenden Person beginnt und endet.
„Stimme ersetzen“ behält Musik und Effekte und tauscht nur die Sprache. Voice-over lässt das Original leise darunter stehen.
Wird synchronisiert
—
Was gerade passiert
Fertig
—
Ziehen Sie einen synchronisierten Block, um ihn zu verschieben, oder seine Ränder, um seine Länge zu ändern. Ein Doppelklick setzt ihn wieder auf das Original.
Zeilen
Ändern Sie Übersetzung, Tonfall oder Timing und übernehmen Sie nur diese Zeilen — der Rest bleibt erhalten.
Ihr eigenes Video synchronisieren
Oder lassen Sie OpenDub auf Ihrem eigenen Rechner laufen.
Die Karte oben synchronisiert Videos bis zu fünf Minuten direkt in diesem Tab. Die App auf Ihrem Computer hat keine Längenbegrenzung, entfernt die Stimme schneller und lässt Sie jede Zeile bearbeiten, ihren Tonfall ändern oder sie verschieben und in rund zehn Sekunden neu synchronisieren.
Higgs STT, Übersetzung und eine geklonte Stimme mit Tonfall-Tags. Die beste Qualität — und das, woraus die Synchronisation oben entstanden ist.
Nutzungspreise von Boson AI
Whisper, ein lokales Sprachmodell und OmniVoice. Nichts verlässt Ihren Computer, und es entstehen keine Kosten.
Demnächst
Öffnen und auf Installieren drücken. Kein Terminal, nichts einzurichten.
Oder mit einer Zeile installierencurl -fsSL https://opendub.app/install.sh | bash
macOS und Linux. Etwa 2 GB, ein paar Minuten. Installiert die kostenlose Stimme und startet sie, damit die Karte oben damit synchronisieren kann. Nichts verlässt Ihren Computer.
- Installieren Sie Python 3.12 und ffmpeg (Homebrews
ffmpegbringt alles Nötige mit). - Schlüssel hinterlegen für den Higgs-Weg:
BOSON_API_KEY=…in eine.env-Datei schreiben. - Starten mit
./run.sh, dannhttp://127.0.0.1:8910öffnen.
Alles davon ist Open Source, AGPL-3.0: github.com/opendubapp/opendub.
So funktioniert es
Vier Modelle, jedes für genau das, was es am besten kann.
- 01
Trennen
Demucs trennt die Sprache von Musik und Effekten, damit der Ton die Synchronisation übersteht und jedes folgende Modell eine saubere Stimme hört.
- 02
Zuhören
Silero VAD findet die gesprochenen Stellen. Higgs STT schreibt die Worte mit, in welcher Sprache sie auch gesagt werden; ein lokales Whisper liefert allein das Timing, Wort für Wort ausgerichtet.
- 03
Passgenau übersetzen
Das Higgs-Chatmodell übersetzt ganze Sätze, jeden so bemessen, wie lange die sprechende Person dafür gebraucht hat — damit die neue Stimme mit ihren Lippen einsetzt und aufhört.
- 04
Sprechen, dann prüfen
Higgs TTS klont die Stimme aus einem sauberen Satz des Originals und spricht jede Zeile in dem Tonfall, in dem sie gesagt wurde — abgelesen aus den Worten und daraus, wie laut und schnell gesprochen wurde. Jede Zeile wird zurücktranskribiert und neu erzeugt, wenn sie abgewichen ist, dann noch einmal gesprochen oder sanft gedehnt, bis sie zur ursprünglichen Länge passt.