Traduttore video IA

Uso commerciale OK 380+ modelli Nessuna filigrana Nessuna registrazione necessaria
Modello:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Trascinare & rilasciare il video qui, o fare clic per navigare

MP4, MOV, WebM fino a 100MB · clip sotto 5 minuti lavorare più velocemente

· ·
~1.500 gettoni al minuto di video (percorso audio) · ~3.000/min con sincronizzazione labbra.
Estrazione audio dal video...
Video tradotto pronto
Show transcript + translation
Originale (trascritto)

                    
Tradotto

                    
Scarica MP4

Dove il Video Translator paga

Reposte YouTube a livello globale

Un Inglese carica → Spagnolo, Hindi, Francese, Portoghese, Indonesiano ricarica con la voce dell'altoparlante in ogni lingua. 4× il pubblico per una produzione.

Localizzazione dei corsi

Gli educatori online doppiano un corso di 50-video in 10 lingue durante la notte. L'opzione labbro-sync fa i segmenti parlanti-testa si sentono nativi, non sottotitolati.

Localizzazione degli annunci

Eseguire lo stesso prodotto testimonial su 10 conti pubblicitari specifici paese. Stesso attore, stesso scatto, audio nativo per mercato senza un reshoot.

Come funziona il traduttore video

Fase 1

Estrai audio

Server-side ffmpeg tira una traccia MP3 pulita dal tuo upload. Fast Funziona sul VPS API.

Fase 2

Trascrizione

Whisper trasforma l'audio in testo con rilevamento automatico del linguaggio. Supporto 99-lingua fuori dalla scatola.

Fase 3

Translate + re-voice

MadLAD si traduce nella lingua di destinazione; Kokoro lo parla nella voce che hai scelto tra 174 opzioni.

Fase 4

Mix back + (optional) lip-sync

ffmpeg sostituisce l'audio originale con la nuova traccia. Se il labbro-sync è acceso, Sync Lipsync v2 re-rende la bocca da abbinare.

Consigli per il video più pulito tradotto

  • Singolo diffusore rivolto in avanti. Scene multi-altoparlanti confondono la trascrizione e il labbro-sincrono passano entrambi.
  • L'audio chiaro a -6 dB. La musica di sottofondo o il rumore riduce l'accuratezza della trascrizione.
  • Sotto le clip di 5 minuti rendono in 2-5 minuti (percorso audio) o 5-15 minuti (con sincronizzazione labbra).
  • Spagnolo, francese, tedesco, portoghese, italiano hanno la voce più naturale Kokoro opzioni. Hindi, arabo, giapponese, coreano, cinese anche lavorare.
Opzioni avanzate
Risultato
I token sono bassi. Ottenere più token
Vuoi risultati migliori? Modelli premium (GPT-5, Claude, Gemini) forniscono una qualità superiore. Visualizza Piani

❤️ Love this tool? Share it!

Registrati per ottenere un link di referral e guadagnare 25.000 gettoni per amico.

Ne vuoi ancora? Iscriviti gratis per 30K gettoni al giorno + 10K bonus
Iscriviti gratis

Elaborare la tua richiesta...

Repost your YouTube in Spagnolo, Hindi, Francese con la voce dell'altoparlante nella lingua di destinazione. Whisper transcribes, MadLAD traduce, Kokoro re-voices, ffmpeg mix indietro. Optional Sync Lipsync v2 re-rende la bocca.

Come usare Traduttore video IA

1
Inserisci il tuo input

Digitare testo, caricare un file, o descrivere ciò che si desidera. Nessun account necessario.

2
Fare clic su genera

Il nostro IA elabora la tua richiesta in pochi secondi utilizzando i migliori modelli open-source.

3
Scarica e condividi

Scaricare, copiare o condividere il risultato. Gratis per uso personale e commerciale.

Utilizzare questo strumento tramite API

Automatizza questo strumento dal tuo codice. Endpoint REST compatibile con OpenAI, auth Bearer-token, nessun SDK aggiuntivo richiesto. I costi Token corrispondono all'interfaccia web.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

Traduttore video IA — FAQ

Caricare qualsiasi video (un clip YouTube, una lezione di corso, una testimonianza di prodotto) e lo traduciamo nella lingua di destinazione con la voce dell'altoparlante ri-sintetizzato in quella lingua. Facoltativamente, il labbro-sync re-rende la bocca in modo che in realtà corrisponde al nuovo audio. Il passo: repost your YouTube in Spagnolo, Hindi, Francese

Cinque passi eseguire client-side in sequenza: (1) ffmpeg estrae un MP3 pulito dal video, (2) Whisper lo trascrive (auto-rileva 99 lingue), (3) MadLAD traduce il testo, (4) Kokoro parla la traduzione nella voce che hai scelto, (5) ffmpeg mixa il nuovo audio nel video originale, sostituendo la traccia originale. Con il labbro-sync acceso, un sesto passo traccia il risultato attraverso Sync Lipsync v2 per ri-render la bocca.

Il video Dubbing esegue sempre la pipeline di lip-sync completa è l'opzione premium, identity-preserving. Video Translator rende il lap-sync opt-in: saltare per un 3× più veloce, ~50% corsa più conveniente che è perfetto per contenuti vocali-over-style in cui bocca-perfetta sincronizzazione non è critica (podcast, registrazioni dello schermo, video di cottura, tutto ciò in cui l'altoparlante non è in primo piano per tutto il tempo).

Il percorso audio-solo gira quasi interamente su modelli auto-ospitati (ffmpeg + Whisper + MadLAD + Kokoro), quindi si inserisce all'interno del vostro token giornaliero per brevi clip. Lip-sync utilizza il modello Premium Sync Lipsync v2 e richiede token acquistati. Preventivo: ~1.500 token al minuto di video per il percorso audio, ~3.000/min con lap-sync.

I menu a discesa espongono 20 lingue ad alta richiesta (spagnolo, francese, tedesco, italiano, portoghese, olandese, polacco, russo, turco, arabo, ebraico, hindi, cinese, giapponese, coreano, vietnamita, indonesiano, tailandese, svedese, inglese). MadLAD supporta tecnicamente 450+; ping noi se ne avete bisogno.

Sì, il picker della voce tira tutte le 174 voci Kokoro in 37 lingue. Ogni voce è contrassegnata con un campione in modo da poter fare un'audizione prima di commettere. Corrispondere il genere della voce all'altoparlante per il risultato più naturale.

Nessuna scelta di Kokoro da 174 voci stock, non un clone dell'altoparlante originale. Per la clonazione vocale di conservazione dell'identità, eseguire il nostro /voice/clone/ strumento prima di catturare la voce dell'altoparlante, quindi utilizzare un flusso di lavoro personalizzato. La clonazione vocale + traduzione automatica in una pipeline è sulla roadmap.

Clip fino a 100MB processo bene. In meno di 5 minuti renderizza in 2-5 minuti per il percorso audio, 5-15 minuti con labbro-sync. Per i video più lunghi, dividere in scene, tradurre ciascuno, e ricombina in /video/editor/.

MP4, MOV, WebM, MKV fino a 100MB. Un singolo altoparlante rivolto in avanti dà la trascrizione più pulita e (se lo si abilita) il migliore labbro-sync. Musica di sottofondo o più altoparlanti riducono l'accuratezza di trascrizione.

Non con Traduttore video IA sostituisce l'audio, non le immagini. Per masterizzare i sottotitoli tradotti nel video, eseguire il nostro /video/didascalia/ strumento sul risultato. Per esportare un file di sottotitoli SRT/VTT, utilizzare /transcribe/ sul video originale.

No. Gli upload vengono eliminati entro pochi minuti dal render. L'output si trova sul nostro CDN per 24 ore (7 giorni per gli utenti a pagamento) al link share, quindi viene rimosso.

Non come un singolo endpoint catena di live quelli esistenti: POST /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, quindi opzionalmente /v1/video/lip-sync/. Ricette arricciatura completa per ogni /api/. Il frontend orchestra questa catena esatta.

Iscriviti gratis per 30.000 gettoni

Crea account libero

Nessuna carta di credito richiesta

Come valuteresti questo strumento?

Love this tool? Share it!