AI Videoöversättare

Kommersiell användning OK 380+ modeller Inget vattenmärke Ingen registrering behövs
Förlaga:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Dra och släpp din video här, eller klicka för att bläddra

MP4, MOV, WebM upp till 100MB · klipp under 5 minuter arbete snabbast

· ·
1 500 polletter per minut video (ljudbana) · 3 000/min med läppsynkronisering.
Extraherar ljud från video...
Översatt video klar
Show transcript + translation
Ursprungligt (kränkt)

                    
Översatt

                    
Ladda ner MP4

Där videoöversättaren betalar sig

Reposta YouTube globalt

En engelsk uppladdning → Spanska, Hindi, Franska, Portugisiska, Indonesiska re-uploads med talarens röst på varje språk. 4× publiken för en produktion.

Lokalisera kurser

Online pedagoger dubba en 50-video kurs i 10 språk över en natt. Lip-sync alternativet gör att tal-huvud segment känner sig infödda, inte textade.

Lokalisera annonser

Kör samma produkt vittnesmål över 10 landsspecifika annonskonton. Samma aktör, samma bild, infödda ljud per marknad - utan en omslag.

Hur videoöversättaren fungerar

Steg 1

Extrahera ljud

Server-side ffmpeg drar en ren MP3-spår från din uppladdning. Snabb - körs på API VPS.

Steg 2

Ändra

Whisper förvandlar ljudet till text med automatisk språkdetektering. 99-språksstöd ut ur rutan.

Steg 3

Translate + re-voice

MadLAD översätter till målspråket; Kokoro talar det tillbaka i rösten du valde från 174 alternativ.

Steg 4

Mix back + (optional) lip-sync

ffmpeg ersätter det ursprungliga ljudet med det nya spåret. Om läppsynkroniseringen är på, Sync Lipsync v2 re-renderar munnen för att matcha.

Tips för den renaste översatta videon

  • En enda framåtvänd högtalare. Multi-högtalarscener förvirrar utskriften och läppsynkroniseringen passerar båda.
  • Tydligt ljud på -6 dB. Bakgrundsmusik eller ljud minskar transkriptionsnoggrannheten.
  • Under 5-minuters clips renderas på 2-5 minuter (ljudbana) eller 5-15 minuter (med läppsynkronisering).
  • Spanska, franska, tyska, portugisiska, italienska har de mest naturliga Kokoro röstalternativ. Hindi, arabiska, japanska, koreanska, kinesiska fungerar också.
Avancerade alternativ
Resultat
Tokens börjar ta slut. Hämta fler tokener
Vill du ha bättre resultat? Premiemodeller (GPT-5, Claude, Gemini) levererar högre kvalitet. Visa Planer

❤️ Love this tool? Share it!

< a href="/signup/" style="color:#16A34A">Registrera dig för att få en referenslänk och tjäna 25 000 polletter per vän.

Vill du ha mer? Registrera dig gratis för 30K tokens/dag + 10K bonus
Registrera dig gratis

Bearbetning av din begäran...

Reposta ditt YouTube på spanska, hindi, franska — med talarens röst i målspråket. Whisper transkriberar, MadLAD översätter, Kokoro re-voices, ffmpeg mixar tillbaka. Tillval Sync Lipsync v2 re-renderar munnen.

Hur du använder AI Videoöversättare

1
Ange din inmatning

Skriv text, ladda upp en fil eller beskriv vad du vill. Inget konto behövs.

2
Klicka på generera

Vår AI behandlar din begäran på några sekunder med hjälp av de bästa open-source modellerna.

3
Ladda ner & resurs

Ladda ner, kopiera eller dela ditt resultat. Gratis för personligt och kommersiellt bruk.

Använd det här verktyget via API

Automatisera detta verktyg från din egen kod. OpenAI-kompatibel REST endpoint, Bearer-token auth, ingen extra SDK krävs. Token kostnader matchar webbgränssnittet.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

AI Videoöversättare — FAQ

Ladda upp vilken video som helst (ett YouTube-klipp, en kursföreläsning, en produktberättelse) och vi översätter den till målspråket med talarens röst som synthesized på det språket. Tillval, läppsynkronisering återger munnen så att den faktiskt matchar det nya ljudet. Tonhöjden: posta din YouTube på spanska, hindi, franska — med ditt ansikte faktiskt säger orden.

Fem steg kör klient-sida i följd: (1) ffmpeg extraherar en ren MP3 från videon, (2) Whisper transkriberar det (auto-detekterar 99 språk), (3) MadLAD översätter texten, (4) Kokoro talar översättningen i rösten du valde, (5) ffmpeg blandar det nya ljudet tillbaka till den ursprungliga videon, ersätter den ursprungliga banan. Med läppsynkronisering på, ett sjätte steg leder resultatet genom Sync Lipsync v2 att åter rendera munnen.

Video Dubbing kör alltid full läppsynkronisering pipeline - det är premium, identitetsbevarande alternativ. Videoöversättare gör läppsynkronisering opt-in: hoppa över den för en 3× snabbare, ~50% billigare körning som är perfekt för röst-över stil innehåll där mun-perfekt synkning är inte kritisk (podcasts, skärminspelningar, matlagning videor, något där högtalaren inte är i närbild hela tiden).

Den ljud-endast vägen kör nästan helt på självvärdiga modeller (ffmpeg + Whisper + MadLAD + Kokoro), så det passar inuti din dagliga token tolerans för korta klipp. Lip-sync använder premium Sync Lipsync v2 modellen och kräver köpta tokens. Uppskattning: ~1,500 tokens per minut av video för ljudbanan, ~3,000/min med läppsynkronisering.

De dropdowns exponerar 20 hög efterfrågan språk (spanska, franska, tyska, italienska, portugisiska, nederländska, polska, ryska, turkiska, arabiska, hebreiska, hindi, kinesiska, japanska, koreanska, vietnamesiska, indonesiska, thailändska, svenska, engelska). MadLAD tekniskt stöder 450+; ping oss om du behöver andra.

Ja — röstväljaren drar alla 174 Kokoro röster över 37 språk. Varje röst är taggad med ett prov så att du kan provspela innan du begår. Matcha röst kön till talaren för det mest naturliga resultatet.

Nej — Kokoro väljer från 174 aktieröster, inte en klon av den ursprungliga talaren. För identitetsbevarande röstkloning, kör vår /voice/clone/ verktyg först för att fånga talarens röst, använd sedan ett anpassat arbetsflöde. Röstkloning + automatisk översättning i en pipeline är på färdplanen.

Klipper upp till 100MB processa väl. Under 5 minuter återger i 2-5 minuter för ljudbanan, 5-15 minuter med läppsynkronisering. För längre videor, delas i scener, översätta varje, och reombine i /video/redigerare/.

MP4, MOV, WebM, MKV upp till 100MB. En enda framåtvänd högtalare ger den renaste utskriften och (om du aktiverar det) den bästa läppsynkroniseringen. Bakgrundsmusik eller flera högtalare minskar transkriptionsnoggrannheten.

Inte med AI Videoöversättare — det ersätter ljud, inte bild. För att bränna översatt textning i videon, kör vår /video/ bildtext / verktyg på resultatet. För att exportera en SRT/ VTT textning fil, använd / transcript / på den ursprungliga videon.

Nej. Uppladdningar raderas inom några minuter från renderingen. Utmatningen sitter på vår CDN i 24 timmar (7 dagar för betalda användare) på aktielänken, sedan tas bort.

Inte som en enda endpoint – kedja de befintliga levande: POST /v1/video/to-audio/ → /v1/st/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, sedan valfritt /v1/video/lip-sync/. Fulla lock recept för varje på /api/. Frontend orkestrerar denna exakta kedja.

Registrera dig gratis för 30 000 polletter

Skapa gratis konto

Inget kreditkort krävs

Hur skulle du värdera det här verktyget?

Love this tool? Share it!