KI-Video-Übersetzer

Kommerzielle Nutzung OK 380+ Modelle Kein Wasserzeichen Keine Anmeldung erforderlich
Modell:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Drag & Drop Ihr Video hier, oder klicken Sie zum Durchsuchen

MP4, MOV, WebM bis 100MB · Clips unter 5 Minuten arbeiten am schnellsten

· ·
~1.500 Token pro Minute Video (Audiopfad) · ~3.000/min mit Lippensync.
Audio aus Video extrahieren...
Übersetzt Video bereit
Show transcript + translation
Ursprünglich (umgeschrieben)

                    
Übersetzt

                    
Herunterladen MP4

Wo sich der Videoübersetzer auszahlt

YouTube global repostieren

Ein englischer Upload → Spanisch, Hindi, Französisch, Portugiesisch, Indonesisch re-uploads mit der Stimme des Sprechers in jeder Sprache. 4× das Publikum für eine Produktion.

Lokalisieren von Kursen

Online-Erzieher dub einen 50-Video-Kurs in 10 Sprachen über Nacht. Die Lip-Sync-Option lässt die sprechenden Köpfe Segmente fühlen sich native, nicht untertitelt.

Anzeigen lokalisieren

Führen Sie das gleiche Produkt Testimonial über 10 landesspezifische Ad-Accounts. Gleicher Schauspieler, gleiche Aufnahme, native Audio pro Markt – ohne erneut zu schießen.

Wie funktioniert der Videoübersetzer?

Schritt 1

Audio extrahieren

Serverseitiges ffmpeg zieht einen sauberen MP3-Track aus dem Upload. Schnell — läuft auf dem API VPS.

Schritt 2

Beschriftung

Whisper verwandelt das Audio in Text mit automatischer Spracherkennung. 99-sprachige Unterstützung aus dem Kasten heraus.

Schritt 3

Translate + re-voice

MadLAD übersetzt in die Zielsprache; Kokoro spricht es zurück in der Stimme, die Sie aus 174 Optionen gewählt haben.

Schritt 4

Mix back + (optional) lip-sync

ffmpeg ersetzt das Original-Audio durch den neuen Track. Wenn Lipsync eingeschaltet ist, Sync Lipsync v2 re-rendert den Mund zu passen.

Tipps für das sauberste übersetzte Video

  • Einzelner nach vorne gerichteter Lautsprecher. Multi-Lautsprecher-Szenen verwirren das Transkript und den Lippensync beides.
  • Klares Audio bei -6 dB. Hintergrundmusik oder Rauschen reduziert die Transkriptionsgenauigkeit.
  • Unter 5-Minuten-Clips rendern in 2-5 Minuten (Audio-Pfad) oder 5-15 Minuten (mit Lippen-Synchron).
  • Spanisch, Französisch, Deutsch, Portugiesisch, Italienisch haben die natürlichsten Kokoro Sprachoptionen. Hindi, Arabisch, Japanisch, Koreanisch, Chinesisch funktionieren auch.
Erweiterte Optionen
Ergebnis
Die Tokens sind knapp. Erhalten Sie mehr Token
Willst du bessere Ergebnisse? Premium-Modelle (GPT-5, Claude, Gemini) liefern eine höhere Qualität. Pläne anzeigen

❤️ Love this tool? Share it!

Sign up um einen Verweis zu erhalten und 25.000 Token pro Freund zu verdienen.

Willst du mehr? Melde dich kostenlos an für 30K Tokens/Tag + 10K Bonus
Kostenlos anmelden

Ihre Anfrage bearbeiten...

Repostieren Sie Ihre YouTube auf Spanisch, Hindi, Französisch — mit der Stimme des Lautsprechers in der Zielsprache. Whisper transkribiert, MadLAD übersetzt, Kokoro re-voices, ffmpeg mischt zurück. Optional Sync Lipsync v2 re-rendert den Mund.

Verwendung KI-Video-Übersetzer

1
Geben Sie Ihre Eingabe ein

Geben Sie Text ein, laden Sie eine Datei hoch oder beschreiben Sie, was Sie wollen.

2
Klicken Sie auf Generieren

Unsere KI verarbeitet Ihre Anfrage in Sekundenschnelle mit den besten Open-Source-Modellen.

3
Herunterladen & Teilen

Downloaden, kopieren oder teilen Sie Ihr Ergebnis. Kostenlos für den persönlichen und kommerziellen Gebrauch.

Verwenden Sie dieses Tool über API

Automatisieren Sie dieses Tool aus Ihrem eigenen Code. OpenAI-kompatible REST-Endpunkt, Bearer-Token-Auth, kein zusätzliches SDK erforderlich. Tokenkosten entsprechen der Web-Schnittstelle.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

KI-Video-Übersetzer — FAQ

Laden Sie jedes Video hoch (ein YouTube-Clip, eine Kursvorlesung, ein Produkttestimonial) und wir übersetzen es in die Zielsprache mit der Stimme des Sprechers, die in dieser Sprache neu synthetisiert wird. Optional wird der Mund durch Lippen-Synchronisation re-renders, so dass er tatsächlich mit dem neuen Audio übereinstimmt.

Fünf Schritte laufen client-side in der Reihenfolge: (1) ffmpeg extrahiert ein sauberes MP3 aus dem Video, (2) Whisper transkribiert es (auto-detects 99 languages), (3) MadLAD übersetzt den Text, (4) Kokoro spricht die Übersetzung in der Stimme, die Sie gewählt haben, (5) ffmpeg mischt das neue Audio zurück in das ursprüngliche Video und ersetzt den ursprünglichen Track. Mit Lippensync auf, ein sechster Schritt führt das Ergebnis durch Sync Lipsync v2, um den Mund erneut zu re-rendern.

Video-Dubbing läuft immer die volle Lip-Sync-Pipeline – es ist die Premium-, Identitäts-erhaltende Option. Video-Übersetzer macht Lip-Sync Opt-In: überspringen Sie es für eine 3× schneller, ~50% billigere Lauf, die perfekt für Voice-over-Stil-Inhalte ist, wo Mund-perfekte Synchronisation ist nicht kritisch (Podcasts, Bildschirmaufnahmen, Kochen Videos, alles, wo der Lautsprecher ist nicht in der Nähe der gesamten Zeit).

Der Audio-Only-Pfad läuft fast ausschließlich auf selbst gehosteten Modellen (ffmpeg + Whisper + MadLAD + Kokoro), so dass er in Ihrem täglichen Token-Zuschuss für kurze Clips passt. Lip-sync verwendet das Premium-Sync Lipsync v2 Modell und erfordert erworbene Token. Schätzung: ~ 1.500 Token pro Minute Video für den Audio-Pfad, ~3.000/min mit Lippen-Sync.

Die Dropdowns entlarven 20 High-Demand-Sprachen (Spanisch, Französisch, Deutsch, Italienisch, Portugiesisch, Niederländisch, Polnisch, Russisch, Türkisch, Arabisch, Hebräisch, Hindi, Chinesisch, Japanisch, Koreanisch, Vietnamesisch, Indonesisch, Thai, Schwedisch, Englisch).

Ja — der Voice Picker zieht alle 174 Kokoro Stimmen über 37 Sprachen. Jede Stimme wird mit einem Sample markiert, damit Sie vor dem Einspielen vorsprechen können. Passen Sie das Stimmgeschlecht mit dem Lautsprecher für das natürlichste Ergebnis an.

Nein — Kokoro wählt aus 174stock Stimmen, nicht ein Klon des ursprünglichen Lautsprechers. Für identitätserhaltende Stimme Klonen, führen Sie unsere /voice/clone/ Werkzeug zuerst, um die Stimme des Lautsprechers zu erfassen, dann verwenden Sie einen benutzerdefinierten Workflow. Voice Klonen + automatische Übersetzung in einer Pipeline ist auf der Roadmap.

Clips bis zu 100MB Prozess gut. Unter 5 Minuten Renders in 2-5 Minuten für den Audio-Pfad, 5-15 Minuten mit Lippen-Synchron. Für längere Videos, aufgeteilt in Szenen, übersetzen, und rekombinieren in /video/editor/.

MP4, MOV, WebM, MKV bis zu 100MB. Ein nach vorn gerichteter Lautsprecher gibt das sauberste Transkript und (wenn Sie es aktivieren) den besten Lippensync. Hintergrundmusik oder mehrere Lautsprecher reduzieren Transkriptionsgenauigkeit.

Nicht durch KI-Video-Übersetzer — es ersetzt das Audio, nicht die Visuals. Um übersetzte Untertitel in das Video zu brennen, führen Sie unser /video/caption/-Tool auf dem Ergebnis aus. Um eine SRT/VTT-Untertiteldatei zu exportieren, verwenden Sie /transcribe/ auf dem Originalvideo.

Nein. Uploads werden innerhalb von Minuten nach dem Render gelöscht. Die Ausgabe sitzt auf unserem CDN für 24 Stunden (7 Tage für bezahlte Benutzer) am Share-Link, dann wird entfernt.

Nicht als einziger Endpunkt — Kette der vorhandenen Live-Rezepte: POST /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, dann optional /v1/video/lip-sync/. Vollständige Curl-Rezepte für jeden bei /api/. Das Frontend orchestriert diese exakte Kette.

Melde dich kostenlos an für 30.000 Token

Kostenloses Konto erstellen

Keine Kreditkarte erforderlich

Wie würden Sie dieses Tool bewerten?

Love this tool? Share it!