Tradutor de Vídeo de IA

Utilização comercial OK 380+ modelos Sem marca de água Não é necessário inscrever
Modelo:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Arraste e solte o seu vídeo aqui, ou clique para navegar

MP4, MOV, WebM até 100MB · clipes de menos de 5 minutos de trabalho mais rápido

· ·
~1.500 tokens por minuto de vídeo (caminho do audio) · ~3.000/min com lab-sync.
Extraindo áudio do vídeo...
Vídeo traduzido pronto
Show transcript + translation
Original (transcrito)

                    
Tradução

                    
Baixar MP4

Onde o tradutor de vídeo paga

Reenviar o YouTube globalmente

Um upload em inglês → Espanhol, hindi, francês, português, indonésio recarga com a voz do orador em cada língua. 4× o público para uma produção.

Localizar cursos

Os educadores on-line dubam um curso de 50 vídeo em 10 línguas durante a noite. A opção lab-sync faz os segmentos falando-head sentir-se nativo, não subtítulado.

Localizar anúncios

Execute o mesmo testemunho de produto em 10 contas de anúncios nacionais específicos. O mesmo ator, o mesmo tiro, áudio nativo por mercado — sem uma resolução.

Como o tradutor de vídeo funciona

Passo 1

Extrair áudio

O lado do servidor ffmpeg puxa uma pista MP3 limpa do seu upload. Rápido — executa-se no API VPS.

Passo 2

Transcrição

O Whisper transforma o áudio em texto com auto detecção de linguagem. Suporte de 99 idiomas fora da caixa.

Passo 3

Translate + re-voice

MadLAD traduz para a língua-alvo; Kokoro fala de volta na voz que você escolheu de 174 opções.

Passo 4

Mix back + (optional) lip-sync

ffmpeg substitui o áudio original pela nova pista. Se o lab-sync estiver ligado, Sync Lipsync v2 reenvia a boca para que corresponda.

Dicas para o vídeo mais limpo traduzido

  • Confundem a transcrição e o labio-sincronismo ambos.
  • Limpar áudio em -6 dB. Música de fundo ou ruído reduz a precisão da transcrição.
  • Em menos de 5 minutos clipes representam em 2-5 minutos (caminho audio) ou 5-15 minutos (com sincronização de lábios).
  • Espanhol, francês, alemão, português, italiano têm as opções de voz Kokoro mais naturais. Hindi, árabe, japonês, coreano, chinês também trabalho.
Opções avançadas
Resultado
Os tokens estão a ficar baixos. Obter mais tokens
Queres melhores resultados? Modelos premium (GPT-5 Ver Planos

❤️ Love this tool? Share it!

Inscreva-se para obter um link de referência e ganhar 25 mil tokens por amigo.

Queres mais? Inscreva-se gratuitamente para 30K tokens/dia + 10K bônus
Inscreva-se gratuitamente

Processando o seu pedido...

Reenviar seu YouTube em espanhol, hindi, francês — com a voz do orador na língua-alvo. Whisper transcribe, MadLAD traduce, Kokoro re-voces, ffmpeg mistura de volta. Opcional Sincronização Lipsync v2 re-remite a boca.

Como Utilizar Tradutor de Vídeo de IA

1
Insira a sua entrada

Digite texto, carregue um arquivo ou descreva o que você quer. Nenhuma conta necessária.

2
Clique em gerar

Nossa IA processa seu pedido em segundos usando os melhores modelos de código aberto.

3
Baixar & compartilhar

Baixe, copie ou compartilhe seu resultado. Gratuito para uso pessoal e comercial.

Use esta ferramenta através da API

Automate esta ferramenta a partir do seu próprio código. Endpoint REST compatível com o OpenAI, Bearer-token auth, não é necessário SDK extra. Custos de token correspondem à interface web.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

Tradutor de Vídeo de IA — FAQ

Envie qualquer vídeo (um clipe do YouTube, uma palestra do curso, um testemunho do produto) e traduzi-lo para a língua-alvo com a voz do alto-falante re-sintetizado nessa língua. Opcionalmente, o lab-sync re-rende a boca para que ele realmente corresponda ao novo áudio. O latch: reposte seu YouTube em espanhol, hindi, francês — com seu rosto realmente dizendo as palavras.

Cinco passos executam o lado do cliente na sequência: (1) ffmpeg extrai um MP3 limpo do vídeo, (2) Whispeg transcribe-o (auto-detecta 99 idiomas), (3) MadLAD traduz o texto, (4) Kokoro fala a tradução na voz que você escolheu, (5) ffmpeg mistura o novo áudio de volta ao vídeo original, substituindo a faixa original. Com o lap-sync em, um sexto passo rota o resultado através de Sync Lipsync v2 para re-render a boca.

Video Dubbing sempre executa o pipeline completo do lab-sync — é a opção premium, identity-preserving. Video Translator faz opt-in do lab-sync: salte-o para um 3× mais rápido, ~50% mais barato run que é perfeito para o conteúdo do estilo de voz, onde a sincronização perfeita da boca não é crítica (podcasts, gravações de tela, vídeos de cozinha, qualquer coisa onde o alto-falante não esteja em close-up o tempo todo).

O caminho só de áudio funciona quase inteiramente em modelos auto-hostados (ffmpeg + Whisper + MadLAD + Kokoro), por isso cabe dentro do seu subsídio de token diário para clipes curtos. Lip-sync usa o modelo premium de Sync Lipsync v2 e requer tokens compradas. Estimação: ~1.500 tokens por minuto de vídeo para o caminho de áudio, ~3.000/min com lap-sync.

Os deslocamentos expõem 20 línguas de alta demanda (espanhol, francês, alemão, italiano, português, neerlandês, polaco, russo, turco, árabe, hebraico, hindi, chinês, japonês, coreano, vietnamita, indonésio, tailandês, sueco, inglês). MadLAD tecnicamente suporta 450+; ping-nos se você precisar de outros.

Sim — o piquedor de voz puxa todas as 174 vozes de Kokoro em 37 idiomas. Cada voz é etiquetada com uma amostra para que você possa fazer audição antes de cometer. Faça correspondência do gênero de voz ao alto-falante para o resultado mais natural.

Não — Kokoro escolhe de 174 vozes de estoque, não um clone do alto-falante original. Para a clonagem de voz de preservação de identidade, execute nossa ferramenta /voice/clone/ primeiro para capturar a voz do alto-falante, em seguida use um fluxo de trabalho personalizado. Clonagem de voz + tradução automática em um conduto está no roadmap.

Clips até 100MB processo bem. Menos de 5 minutos torna em 2-5 minutos para o caminho de áudio, 5-15 minutos com lab-sync. Por vídeos mais longos, divididos em cenas, traduz cada, e recombinar em /video/editor /.

MP4, MOV, WebM, MKV até 100MB. O único alto-falante direcionado à frente dá a transcrição mais limpa e (se você o habilitar) o melhor lab-sync. Música de fundo ou múltiplos alto-falantes reduz a precisão da transcrição.

Não por Tradutor de Vídeo de IA — ele substitui o áudio, não o visual. Para gravar legendas traduzidas no vídeo, execute nossa ferramenta /video/caption/ no resultado. Para exportar um arquivo de subtítulo SRT/VTT, use /transcribe/ no vídeo original.

Não. Os envios são excluídos dentro de minutos do render. A saída fica no nosso CDN por 24 horas (7 dias para usuários pagos) no link de compartilhamento, então é removido.

Não como um único endpoint — cadeia dos existentes ao vivo: POST /v1/video/to-audio/ → /v1/st/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, em seguida opcionalmente /v1/video/lip-sync/. Receitas de curlo completo para cada api /. O interface orquestra esta cadeia exata.

Inscreva-se gratuitamente para 30.000 tokens

Criar Conta Livre

Não é exigido o cartão de crédito

Como iria avaliar esta ferramenta?

Love this tool? Share it!