Traductor de vídeo de IA

Uso comercial aceptado Máis de 380 modelos Sen marca de auga Non é preciso rexistrarse
Modelo:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Arrastre e solte o vídeo aquí, ou prema para examinar

MP4, MOV, WebM ata 100MB · os clips de menos de 5 minutos funcionan máis rápido

· ·
~1. 500 tokens por minuto de vídeo (camiño de son) · ~3. 000/ min con sincronización labial.
A extraer o son do vídeo...
Vídeo traducido listo
Show transcript + translation
Orixinal (transcrita)

                    
Traducido

                    
Obter MP4

Onde o Video Translator paga a pena

Repost YouTube globalmente

Un envío en inglés → Español, hindi, francés, portugués, indonesio reenvía coa voz do falante en cada idioma. 4x a audiencia para unha produción.

Localizar os campos

Os educadores en liña dobran un curso de 50 vídeos en 10 linguas durante a noite. A opción de sincronización labial fai que os segmentos de cabeza faladora sexan nativos, sen subtítulos.

Localizar os anuncios

Execute o mesmo testemuño de produto en 10 contas de anuncios específicas de cada país. Mesmo actor, mesma toma, son nativo por mercado — sen repetir a toma.

Como funciona o tradutor de vídeo

Paso 1

Extraer o son

O ffmpeg do lado do servidor obtén unha pista MP3 limpa do envío. Rápido — executa no API VPS.

Paso 2

Transcrición

Whisper converte o son en texto coa detección automática da linguaxe. Soporte para 99 linguas.

Paso 3

Translate + re-voice

MadLAD traduce á lingua de destino; Kokoro fala de volta coa voz que escolla entre 174 opcións.

Paso 4

Mix back + (optional) lip-sync

ffmpeg substituirá o son orixinal pola nova pista. Se a sincronización labial está activada, Sync Lipsync v2 renderizará a boca para que coincida.

Consellos para o vídeo traducido máis limpo

  • Un só falante cara adiante. As escenas con varios falantes confunden a transcrición e a sincronización labial.
  • Son claro a - 6 dB. A música de fondo ou o ruído reducen a precisión da transcrición.
  • Os clips de menos de 5 minutos renderízanse en 2- 5 minutos (camiño de son) ou 5- 15 minutos (con sincronización labial).
  • O español, francés, alemán, portugués e italiano teñen as opcións de voz Kokoro máis naturais. O hindi, árabe, xaponés, coreano e chinés tamén funcionan.
Opcións avanzadas
Resultado
A faltar fichas. Obter máis fichas
Queres mellores resultados? Modelos Premium (GPT-5, Claude, Gemini) ofrecen unha calidade superior. Ver os planos

❤️ Amas Free.ai?

Regístrese para obter unha ligazón de referencia e gañar 25.000 tokens por amigo.

Queres máis? Inscríbete gratis para 30K tokens/día + 10K de bonificación
Inscríbete gratis

A procesar o seu pedido...

Reposte o seu YouTube en español, hindi, francés — coa voz do falante na lingua de destino. Whisper transcribe, MadLAD traduce, Kokoro re- fala, ffmpeg mestura. A opción de sincronización Lipsync v2 re- renderiza a boca.

Como usar Traductor de vídeo de IA

1
Introduza a súa entrada

Escriba texto, envíe un ficheiro ou describa o que queira. Non se precisa conta.

2
Prema para xerar

A nosa IA procesa a túa solicitude en segundos empregando os mellores modelos de código aberto.

3
Obter e compartir

Obteña, copie ou comparta o seu resultado. Gratuito para uso persoal e comercial.

Empregar esta ferramenta mediante API

Automatice esta ferramenta a partir do seu propio código. Punto final REST compatíbel con OpenAI, autenticación por token de portador, non se require SDK adicional. Os custos dos tokens son iguais aos da interface web.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

Traductor de vídeo de IA — FAQ

Envíe calquera vídeo (un clip de YouTube, unha conferencia dun curso, un testemuño dun produto) e traducirémolo á lingua de destino coa voz do falante re- sintetizada nesa lingua. Opcionalmente, a sincronización labial renderiza a boca de novo para que realmente coincida co novo son. O ton: re- publicar o seu YouTube en español, hindi, francés — coa súa cara realmente dicindo as palabras.

Cinco pasos executanse en secuencia no lado do cliente: (1) ffmpeg extrae un MP3 limpo do vídeo, (2) Whisper transcribeno (detecta automaticamente 99 linguas), (3) MadLAD traduce o texto, (4) Kokoro fala a tradución na voz que escolla, (5) ffmpeg mestura o novo son de novo no vídeo orixinal, substituíndo a pista orixinal. Se a sincronización labial está activada, un sexto paso encamiña o resultado a través de Sync Lipsync v2 para renderizar a boca.

A dobraxe de vídeo executa sempre o canal completo de sincronización labial, é a opción premium que preserva a identidade. O Tradutor de vídeo fai que a sincronización labial sexa opcional: salte esta opción para unha execución 3 veces máis rápida e ~50% máis barata, perfecta para contidos de estilo voz sobre texto onde a sincronización perfecta da boca non é crítica (podcasts, gravacións de pantalla, vídeos de cociña, calquera cousa onde o falante non estea preto todo o tempo).

A rota só de son executase case na súa totalidade en modelos auto- hospedados (ffmpeg + Whisper + MadLAD + Kokoro), polo que cabe dentro da súa asignación diaria de tokens para clips curtos. A sincronización labial usa o modelo premium Sync Lipsync v2 e require tokens comprados. Estimación: ~ 1. 500 tokens por minuto de vídeo para a ruta de son, ~ 3. 000/ min con sincronización labial.

As listas despregábeis mostran 20 linguas moi demandadas (español, francés, alemán, italiano, portugués, holandés, polaco, ruso, turco, árabe, hebreo, hindi, chinés, xaponés, coreano, vietnamita, indonesio, tailandés, sueco, inglés). MadLAD admite tecnicamente 450 idiomas +, pídanos que lle enviemos outras se precisa outras.

Si, o selector de voz obtén as 174 voces de Kokoro en 37 linguas. Cada voz está etiquetada cunha mostra para que poida escoitar antes de confirmar. Coincide o xénero da voz co falante para obter o resultado máis natural.

Non, Kokoro escolle entre 174 voces, non un clon do falante orixinal. Para clonar a voz preservando a identidade, execute a nosa ferramenta / voice/ clone/ primeiro para capturar a voz do falante, e logo use un fluxo de traballo personalizado. A clonación de voz + tradución automática nun canal está no mapa.

Os clips de ata 100 MB procesan ben. Menos de 5 minutos renderizaranse en 2- 5 minutos para a ruta de son, 5- 15 minutos con sincronización labial. Para vídeos máis longos, divida en escenas, traduza cada unha e recombine en / vídeo/ editor /.

MP4, MOV, WebM, MKV ata 100MB. Un só altofalante cara adiante dá a transcrición máis limpa e (se o habilita) a mellor sincronización labial. A música de fondo ou varios altofalantes reducen a precisión da transcrición.

Non con Traductor de vídeo de IA, substituirá o son, non as imaxes. Para gravar os subtítulos traducidos no vídeo, execute a ferramenta / video/ caption/ no resultado. Para exportar un ficheiro de subtítulos SRT/ VTT, use / transcribe / no vídeo orixinal.

Non. Os envíos son eliminados nuns minutos da renderización. A saída permanece na nosa CDN durante 24 horas (7 días para usuarios de pago) na ligazón compartida, e logo é eliminada.

Non como un único punto final, encadea os existentes: POST / v1/ vídeo/ a- audio/ → / v1/ stt/ → / v1/ tradución/ → / v1/ tts/ → / v1/ vídeo/ engadir- audio/, e logo opcionalmente / v1/ vídeo/ lip- sync/. As receitas completas de curl para cada un en / api /. A interface orquestra esta cadea exacta.

Inscríbete gratis para obter 30.000 tokens

Crear unha conta libre

Non se require tarxeta de crédito

Como valora esta ferramenta?

Amas Free.ai?