Traducteur vidéo IA

Utilisation commerciale OK 380+ modèles Pas de filigrane Pas besoin d'inscription
Modèle:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Faites glisser et déposez votre vidéo ici, ou cliquez pour parcourir

MP4, MOV, WebM jusqu'à 100 Mo · clips de moins de 5 minutes fonctionnent plus rapidement

· ·
~1 500 tokens par minute de vidéo (voie audio) · ~3 000/min avec lip-sync.
Extraire de l'audio de la vidéo...
Vidéo traduite prête
Show transcript + translation
Original (transcrit)

                    
Traduit

                    
Télécharger MP4

Où le traducteur vidéo paie

Repose YouTube à l'échelle mondiale

Un téléchargement en anglais → espagnol, hindi, français, portugais, indonésien recharge avec la voix de l'orateur dans chaque langue. 4× le public pour une production.

Localiser les cours

Les éducateurs en ligne dub un cours de 50-vidéo dans 10 langues du jour au lendemain. L'option lip-sync rend les segments parlants-tête se sentent natifs, pas sous-titrés.

Localiser les annonces

Exécutez le même témoignage de produit sur 10 comptes publicitaires spécifiques au pays. Même acteur, même shot, audio natif par marché — sans un rappel.

Comment fonctionne le traducteur vidéo

Étape 1

Extrait audio

Le côté serveur ffmpeg tire une piste MP3 propre de votre téléchargement. Rapide — fonctionne sur l'API VPS.

Étape 2

Transcription

Whisper transforme l'audio en texte avec détection automatique du langage. 99-langue support hors de la boîte.

Étape 3

Translate + re-voice

MadLAD se traduit dans la langue cible ; Kokoro le reprend dans la voix que vous avez choisie parmi 174 options.

Étape 4

Mix back + (optional) lip-sync

ffmpeg remplace l'audio d'origine par la nouvelle piste. Si lip-sync est activé, Sync Lipsync v2 rerend la bouche pour correspondre.

Conseils pour la vidéo la plus propre traduite

  • Haut-parleur unique orienté vers l'avant. Les scènes multi-parleurs confondent la transcription et le lip-sync passent les deux.
  • Effacer l'audio à -6 dB. La musique de fond ou le bruit réduit la précision de transcription.
  • Sous les clips de 5 minutes rendre en 2-5 minutes (voie audio) ou 5-15 minutes (avec lip-sync).
  • L'espagnol, le français, l'allemand, le portugais, l'italien ont les options vocales les plus naturelles Kokoro. Hindi, arabe, japonais, coréen, chinois travaillent également.
Options avancées
Résultat
Les tokens sont bas. Obtenez plus de tokens
Vous voulez de meilleurs résultats? Modèles premium (GPT-5, Claude, Gemini) offrent une qualité supérieure. Afficher les plans

❤️ Love this tool? Share it!

Inscrivez-vous pour obtenir un lien de référence et gagner 25 000 tokens par ami.

Tu en veux plus? Inscrivez-vous gratuitement pour 30K tokens/jour + 10K bonus
Inscription gratuite

Traitement de votre demande...

Repose ton YouTube en espagnol, hindi, français — avec la voix de l'orateur dans la langue cible. Whisper transcrit, MadLAD traduit, Kokoro re-voix, ffmpeg mixe en arrière. En option Sync Lipsync v2 re-rend la bouche.

Comment utiliser Traducteur vidéo IA

1
Saisissez votre entrée

Tapez du texte, téléchargez un fichier ou décrivez ce que vous voulez. Aucun compte n'est nécessaire.

2
Cliquez sur générer

Notre IA traite votre demande en quelques secondes à l'aide des meilleurs modèles open-source.

3
Télécharger et partager

Téléchargez, copiez ou partagez votre résultat. Gratuit pour un usage personnel et commercial.

Utilisez cet outil via l'API

Automatisez cet outil à partir de votre propre code. Endpoint REST compatible OpenAI, Auth-token auth, pas de SDK supplémentaire requis.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

Traducteur vidéo IA — FAQ

Téléchargez n'importe quelle vidéo (un clip YouTube, une conférence de cours, un témoignage de produit) et nous la traduisons dans la langue cible avec la voix du locuteur re-synthétisée dans cette langue. En option, lip-sync re-rend la bouche pour qu'elle corresponde réellement au nouvel audio.

Cinq étapes s'exécutent côté client en séquence : (1) ffmpeg extrait un MP3 propre de la vidéo, (2) Whisper le transcrit (détecte automatiquement 99 langues), (3) MadLAD traduit le texte, (4) Kokoro parle la traduction dans la voix que vous avez choisie, (5) ffmpeg mélange le nouvel audio dans la vidéo originale, remplaçant la piste originale. Avec lip-sync sur, une sixième étape conduit le résultat à travers Sync Lipsync v2 pour rendre la bouche.

Video Doublage fonctionne toujours sur le pipeline lip-sync complet — c'est l'option premium, identity-serving. Video Translator rend lip-sync opt-in: sautez-le pour un 3× plus rapide, ~50% moins cher qui est parfait pour la voix-over-style contenu où la synchronisation parfaite de la bouche n'est pas critique (podcasts, enregistrements d'écran, vidéos de cuisson, tout ce qui n'est pas en gros plan tout le temps).

Le chemin audio seulement fonctionne presque entièrement sur les modèles auto-hosted (ffmpeg + Whisper + MadLAD + Kokoro), de sorte qu'il s'intègre à l'intérieur de votre token quotidien pour les courts clips. Lip-sync utilise le modèle premium Sync Lipsync v2 et nécessite des tokens achetés. Estimation: ~1 500 tokens par minute de vidéo pour le chemin audio, ~3 000/min avec lip-sync.

Les déclins exposent 20 langues à forte demande (espagnol, français, allemand, italien, portugais, néerlandais, polonais, russe, turc, arabe, hébreu, hindi, chinois, japonais, coréen, vietnamien, indonésien, thaï, suédois, anglais). MadLAD supporte techniquement 450+; ping nous si vous avez besoin d'autres.

Oui — le sélectionneur de voix tire les 174 voix Kokoro dans 37 langues. Chaque voix est marquée avec un échantillon afin que vous puissiez auditionner avant de s'engager.

Non — Kokoro choisit à partir de 174 voix de stock, pas un clone de l'enceinte d'origine. Pour préserver l'identité, lancez notre outil /voice/clone/ d'abord pour capturer la voix de l'enceinte, puis utilisez un flux de travail personnalisé. Le clonage vocal + traduction automatique dans un pipeline est sur la feuille de route.

Moins de 5 minutes rend en 2-5 minutes pour le chemin audio, 5-15 minutes avec lip-sync. Pour les vidéos plus longues, diviser en scènes, traduire chacun, et recombiner dans /video/editor/.

MP4, MOV, WebM, MKV jusqu'à 100 Mo. Un seul haut-parleur orienté vers l'avant donne la transcription la plus propre et (si vous l'activez) la meilleure synchronisation lip-sync. La musique de fond ou plusieurs haut-parleurs réduisent la précision de transcription.

Pour graver les sous-titres traduits dans la vidéo, lancez notre outil /video/caption/ sur le résultat. Pour exporter un fichier de sous-titres SRT/VTT, utilisez /transcribe/ sur la vidéo originale.

Non. Les téléchargements sont supprimés dans les minutes qui suivent le rendu. La sortie se trouve sur notre CDN pendant 24 heures (7 jours pour les utilisateurs payants) sur le lien de partage, puis est supprimée.

Pas comme un seul paramètre — chaînez les éléments en direct existants: POST /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, puis en option /v1/video/lip-sync/. Recettes pleines en boucle pour chaque à /api/. La façade orchestre cette chaîne exacte.

Inscrivez-vous gratuitement pour 30 000 tokens

Créer un compte gratuit

Aucune carte de crédit requise

Comment évalueriez-vous cet outil?

Love this tool? Share it!