🌍 ElevenLabs Dubbing v2: Die wichtigsten Neuerungen
• Automatisches Dubbing in über 90 Sprachen: Eine deutliche Erweiterung gegenüber den rund 70 Sprachen der v1-Version.
• Erhalt der schauspielerischen Leistung: Nuancen, Emotionen, Intonation und Ausdruck bleiben authentisch erhalten.
• Audio-zu-Audio-Modell: Keine manuelle Transkription mehr erforderlich; das Modell arbeitet direkt mit der Original-Audiospur (Conditioning).
Hallo zusammen, hier ist das Sonetho. ⚡
Am 29. Mai 2026 hat ElevenLabs offiziell die nächste Generation seines Dubbing-Modells veröffentlicht: Dubbing v2. Nach der Ankündigung von Music v2 am 27. Mai ist dies das zweite große Update – und es geht weit über eine bloße Erweiterung des Sprachumfangs hinaus.
Die technologische Basis des Modells wurde grundlegend erneuert.
v1 vs. v2 — Was hat sich geändert?
Ein Vergleich mit unserem v1-Leitfaden von vor zwei Monaten verdeutlicht die Fortschritte.
Feature | Vorgänger (v1) | Neu (v2) |
|---|---|---|
Modell-Ansatz | Transkript-basiert | Direktes Audio-zu-Audio |
Emotionen & Intonation | Teils flach | Originalgetreu |
Video-Sync | Manuelle Nacharbeit nötig | Automatische Sync-Optimierung |
Voice Cloning | Separates PVC-Training nötig | Integriertes Auto-Cloning |
Sprachunterstützung | 70 Sprachen | Über 90 Sprachen |
Wie die Tabelle zeigt, übertrifft v2 den Vorgänger in allen Belangen – Zeit, es selbst zu testen.
Nutzen Sie automatisches Voice Cloning, über 90 Sprachen und emotionale Präzision zum Creator-Preis von nur 11 Euro.
Jetzt Creator-Plan mit 50% Rabatt für 11 Euro sichern →
Die 5 wichtigsten Neuerungen
1. Performance-aware Dubbing — Erhaltung der schauspielerischen Leistung
Offizielles Statement: "Tonlage, Emotionen, Tempo, Ausdruck und Intention des Sprechers werden authentisch in die Zielsprache übertragen."
Während bei v1 die Vertonung oft noch etwas "mechanisch" klingen konnte, sorgt v2 dafür, dass die emotionale Ebene – inklusive Seufzern, Lachen und subtilen Nuancen – vollständig erhalten bleibt.
2. Audio-zu-Audio-Modell — Wegfall der Transkript-Stufe
Offizielles Statement: "Das Modell verlässt sich nicht mehr auf Texttranskripte, sondern nutzt direktes Conditioning auf Basis der Quell-Audiodatei."
Dies ist der technologische Durchbruch von v2. Wir sind besonders darauf gespannt, wie gut die Sprechertrennung bei Hintergrundgeräuschen funktioniert und wie präzise Stimmen bei mehreren Sprechern im selben Clip zugeordnet werden.
3. Sync-aware Translation — Start und Ende der übersetzten Tonspur werden automatisch präzise mit dem Originalvideo synchronisiert. Dies ist entscheidend, um die Lippensynchronität bei Sprachen mit unterschiedlicher Silbenlänge zu gewährleisten.
4. Integriertes automatisches Voice Cloning — Ohne manuelles Setup nutzt das Modell die Stimme des Originals automatisch für die Übersetzung. Wir werden testen, wie sich diese integrierte Lösung im Vergleich zum klassischen PVC (Professional Voice Cloning) schlägt.
5. Unterstützung von über 90 Sprachen — Wir werden prüfen, wie natürlich sich Übersetzungen ins Deutsche anfühlen und ob die Qualität auch bei komplexen Sprachpaaren, wie etwa Deutsch zu Japanisch oder Vietnamesisch, stabil bleibt.
7-Tage-Aktion: 30 Minuten Bonus-Dubbing für Paid-Pläne
Zur Feier des Starts erhalten alle User mit einem kostenpflichtigen Abo 30 Minuten Bonus-Dubbing. Das Guthaben wird automatisch gutgeschrieben – gilt jedoch nur 7 Tage ab Launch.
⏳ Der 7-Tage-Bonus wird automatisch bei Registrierung angewendet – kein Gutscheincode nötig.
Bei einer Neuanmeldung kostet der Creator-Plan derzeit statt 22 Euro nur 11 Euro (50% Rabatt), inklusive 30 Minuten Bonus-Dubbing.
Bonus sichern und Creator-Plan mit 50% Rabatt starten →
💡 Wie man dauerhaft 50% Rabatt auf den Creator-Plan erhält, haben wir hier zusammengefasst: Anleitung: 50% Rabatt auf ElevenLabs Creator-Pläne im Jahr 2026
Plan | Standard | + 7 Tage Bonus | Gesamt |
|---|---|---|---|
Free | 10 Min. | — | 10 Min. |
Starter (5 €) | 30 Min. | + 30 Min. | 60 Min. |
Creator (22 €, 11€) | 2 Std. | + 30 Min. | 2 Std. 30 Min. ← Empfehlung |
Pro (99 €) | 10 Std. | + 30 Min. | 10 Std. 30 Min. |
Ausblick auf den nächsten Artikel
Wir werden die genannten fünf Punkte in der Praxis testen und euch im nächsten Beitrag detaillierte Ergebnisse präsentieren. Wer nicht warten möchte: Auf der offiziellen ElevenLabs-Seite könnt ihr euch die Demo-Samples anhören und euch selbst von der Qualität überzeugen!
🎧 ElevenLabs Dubbing v2 Demo jetzt anhören
📚 Weiterführende Artikel
Der ultimative ElevenLabs Dubbing Guide: Videos in über 90 Sprachen übersetzen
ElevenLabs Tipps · v1 Workflow erklärt
Das Geheimnis hinter 99% Sync-Genauigkeit: Drei Wege zum Voice Cloning im Vergleich
ElevenLabs Tipps · Vergleich mit v2 Auto-Cloning
"Klingt das echt?" Animations-Dubbing aus dem Home-Studio (feat. ElevenLabs)
ElevenLabs Tipps · Dubbing in der Praxis
🚀 Fazit
Wer plant, seine Reichweite international zu skalieren, sollte diese Aktion nutzen. Wo früher bei KI-Stimmen noch eine gewisse Skepsis mitschwang, setzt v2 neue Maßstäbe für Authentizität. Probiert es einfach aus!
🌎 Mit 50% Rabatt bei Dubbing v2 starten
※ Dies ist ein Affiliate-Partner-Link des Sonethos.
❓ Häufig gestellte Fragen (FAQ)
Q1. Was hat sich bei Dubbing v2 geändert?
A. Die Funktionsweise des Modells wurde grundlegend verändert.
Während v1 auf Transkripten basierte, nutzt v2 ein Audio-to-Audio-Verfahren, das direkt auf dem Original-Audio basiert.
Die Anzahl der unterstützten Sprachen wurde von rund 70 auf über 90 erhöht.
Die Videosynchronisation erfolgt nun automatisch statt manuell, und Voice Cloning ist jetzt standardmäßig integriert, anstatt ein separates PVC-Training zu erfordern.
Q2. Was bedeutet es, dass die schauspielerische Leistung des Originals erhalten bleibt?
A. Offiziell bedeutet dies, dass Tonfall, Emotionen, Tempo, Sprechweise und Intention des Sprechers in die neue Sprache übertragen werden.
Bis v1 klangen Synchronisationen von Koreanisch in Englisch häufig eher wie eine maschinelle Vorlesung.
Ob dabei auch nicht-sprachliche Elemente wie Seufzer oder Lachen vollständig erhalten bleiben, muss in der Praxis geprüft werden.
Q3. Was ist Sync-aware Translation?
A. Es handelt sich um eine Funktion, bei der Anfang und Ende der übersetzten Tonspur automatisch an das Originalvideo angepasst werden.
Die entscheidende Frage ist, wie gut die Lippenbewegungen oder Szenenwechsel bei Sprachen mit unterschiedlicher Silbenanzahl, wie etwa bei Koreanisch und Englisch, übereinstimmen.
Q4. Muss ich Voice Cloning separat einrichten?
A. Es wurde angekündigt, dass in v2 die übersetzte Stimme automatisch in der Stimme des Originalsprechers generiert wird, ohne dass zusätzliche Einstellungen erforderlich sind.
Inwieweit sich die Qualität vom bisherigen PVC-Cloning unterscheidet, muss noch im Einzelfall geprüft werden.
Q5. Wie erhalte ich die 30 Minuten kostenlose Synchronisation für 7 Tage?
A. Zur Feier der Veröffentlichung erhalten alle kostenpflichtigen Pläne ein Bonusguthaben von 30 Minuten für Synchronisationen.
Dies wird automatisch angewendet, ohne dass eine separate Anmeldung oder ein Gutscheincode erforderlich ist.
Das Angebot gilt jedoch nur für 7 Tage ab dem Startdatum.
Q6. Wie hoch ist das Synchronisationsguthaben pro Plan?
A. Der Free-Plan beinhaltet 10 Minuten zum Testen ohne Bonus.
Starter ($5) umfasst 30 Minuten Grundguthaben plus 30 Minuten Bonus, also insgesamt 60 Minuten.
Creator ($22, rabattiert $11) bietet 2 Stunden Grundguthaben plus 30 Minuten Bonus, also insgesamt 2 Stunden und 30 Minuten.
Pro ($99) beinhaltet 10 Stunden Grundguthaben plus 30 Minuten Bonus.
Viel Erfolg bei euren Projekten!
Dein Sonetho-Team ⚡