AI Videooversetter

Kommersiell bruk OK 380+ modeller Intet vannmerke Ikke nødvendig å logge inn
Modell:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Dra og slipp videoen her, eller trykk for å bla

MP4, MOV, WebM opp til 100 MB · klipp under 5 minutter, arbeid raskest

· ·
~1.500 mynter per minutt video (lydsti) · ~3.000/min med leppe-sync.
Pakker ut lyd fra video...
Oversatt video klar
Show transcript + translation
Opprinnelig (overskrevet)

                    
Oversatt

                    
Last ned MP4

Hvor Videooversetteren betaler ut

Send YouTube på nytt globalt

En engelsk opplasting → Spansk, Hindi, Fransk, Portugisisk, Indonesisk gjenopplasting med høyttalerens stemme på hvert språk. 4× publikum for én produksjon.

Lokaliser kurs

Nettbaserte lærere dubberer et 50- videokurs til 10 språk over natten. Lip- Sync- valget gjør at talehode- segmentene føles innfødte, ikke tekstet.

Lokaliser annonser

Kjør samme produktutsagn på tvers av 10 landsspesifikke ad- kontoer. Samme skuespiller, samme skudd, egen lyd per marked – uten en omsøking.

Hvordan videooversetteren fungerer

Trinn 1

Pakk ut lyd

ffmpeg på tjenersiden trekker et rent MP3- spor fra opplastingen din. Raskt – kjører på API VPS.

Trinn 2

Transcribe

Visper gjør lyden om til tekst med automatisk språkoppdaging. Støtte for 99 språk kommer ut av boksen.

Trinn 3

Translate + re-voice

MadLAD oversetter til målspråket; Kokoro snakker det tilbake i stemmen du valgte fra 174 valgmuligheter.

Trinn 4

Mix back + (optional) lip-sync

ffmpeg erstatter den opprinnelige lyden med det nye sporet. Hvis Lip- Sync er på, så gir Sync Lipsync v2 munnen på nytt for å passe.

Tips for den reneste oversatte videoen

  • Enkelt høyttaler forover. Flere høyttalerscener forvirrer både utskriften og leppesynkroniseringen.
  • Tøm lyd ved - 6 dB. Bakgrunnsmusikk eller støy reduserer utskriftsnøyaktighet.
  • Under 5 minutters klipping vises det på 2-5 minutter (lydvei) eller 5-15 minutter (med leppesynkronisering).
  • Spansk, fransk, tysk, portugisisk, italiensk har de mest naturlige Kokoro stemmevalgene. Hindi, arabisk, japansk, koreansk, kinesisk virker også.
Avanserte valg
Resultat
Tegn som er nesten tomt. Hent flere symboler
Vil du ha bedre resultater? Premiemodeller (GPT-5, Claude, Gemini) leverer høyere kvalitet. Vis planer

❤️ Love this tool? Share it!

Tilmeld deg for å få en henvisningslenke og tjene 25.000 mynter per venn.

Vil du ha mer? Registrer deg gratis for 30K mynter/dag + 10K bonus
Registrer deg gratis

Behandler din forespørsel...

Send din YouTube på spansk, Hindi, fransk – med høyttalerens stemme på målspråket. Visninger, MadLAD oversetter, Kokoro om- stemmer, ffmpeg blander tilbake. Valgfri Sync Lipsync v2 gir opp munnen på nytt.

Bruksmåte AI Videooversetter

1
Skriv inn dine inndata

Skriv inn tekst, last opp en fil eller beskriv hva du vil ha. Ingen konto trengs.

2
Trykk Lag

Vår AI behandler din forespørsel i sekunder med de beste open- source modellene.

3
Last ned & ressurs

Last ned, kopier eller del resultatet ditt. Gratis for personlig og kommersiell bruk.

Bruk dette verktøyet via API

Automatiser dette verktøyet fra din egen kode. OpenAI- kompatible REST endepunkt, Bearer- token auth, ikke nødvendig med ekstra SDK. Tegnkostnader stemmer med nettgrensesnittet.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

AI Videooversetter — FAQ

Last opp alle videoer (et YouTube- klipp, en kursforelesning, et produktutsagn) og vi oversetter det til målspråket med høyttalerens stemme på nytt i det språket. Alternativt vil leppsynk gjenoppta munnen slik at den faktisk passer med den nye lyden. Hindi, fransk: Send YouTube på spansk, hindi, med ansiktet ditt som faktisk sier ordene.

Fem steg å kjøre klientsiden i rekkefølge: (1) ffmpeg trekker ut en ren MP3 fra videoen, (2) Visper transskriberer det (autooppdager 99 språk), (3) MadLAD oversetter teksten, (4) Kokoro snakker om oversettelsen i stemmen du valgte, (5) ffmpeg blander den nye lyden tilbake til den opprinnelige videoen, og erstatter det opprinnelige sporet. Med lip- sync på vil et sjette trinn gi resultatet gjennom Sync Lipsync v2 for å gi munnen igjen.

Video Dubbing kjører alltid hele lep- sync rørledningen – det er det premiumvalget, identitetsbevaringsvalget. Videooversetteren gjør lip-sync tilvalg: hopp over det for en 3× raskere, ~ 50% billigere kjøring som er perfekt for innhold i tale- over- stil der munn- perfekt synkronisering ikke er kritisk (podcasts, skjermopptak, matlaging av videoer, alt der høyttaleren ikke er i nærbilde hele tiden).

Stien med bare lyd kjører nesten helt og holdent på egenverterte modeller (ffmpeg + Whisper + MadLAD + Kokoro), så den passer inne i din daglige token- rate for korte klipp. Lip-sync bruker premium Sync Lipsync v2 modellen og krever kjøpte tokenser. Anslag: ~ 1. 500 tokens per minutt video for lydstien, ~ 3. 000/ min med lip-sync.

Nedtrekkene viser 20 høytrykksspråk (spansk, fransk, tysk, italiensk, portugisisk, nederlandsk, polsk, russisk, tyrkisk, arabisk, hebraisk, hindi, kinesisk, japansk, koreansk, vietnamesisk, indonesisk, thai, svensk, engelsk). MadLAD støtter teknisk 450+; ping oss hvis du trenger andre.

Ja, stemmevelgeren drar alle 174 Kokoro- stemmer over 37 språk. Hver stemme er merket med et utvalg, slik at du kan teste før du gir deg. Tilpass stemme- kjønn til høyttaleren for det mest naturlige resultatet.

Nei, Kokoro velger fra 174 stamstemmer, ikke en klone av den opprinnelige høyttaleren. For å bevare identitet, kjør først vår /voice/ klone/ verktøy for å fange høyttalerens stemme, og bruk så en selvvalgt arbeidsflyt. Stemmekloning + autooversettelse i en rørledning er på veikartet.

Klipper opp til 100 MB- prosessen godt. Under 5 minutter viser 5-15 minutter for lyd- stien, 5-15 minutter med lip-sync. For lengre videoer, delt i scener, oversett hver, og kombiner i / video/ redaktør /.

MP4, MOV, WebM, MKV opptil 100 MB. Enkelt foroverrettet høyttaler gir den reneste utskriften og (hvis du gjør det mulig) den beste leppesynkroniseringen. Bakgrunnsmusikk eller flere høyttalere reduserer transkripteringsnøyaktighet.

Ikke AI Videooversetter – det erstatter lyden, ikke bilde. Bruk / transcribe/ på originalvideoen for å brenne oversatt teksting i videoen.

Ingen. Opplastinger slettes i løpet av minutter etter opptegningen. Utdataene sitter på CDN- en vår i 24 timer (7 dager for betalte brukere) på ressurslenken, så fjernes.

Ikke som ett enkelt endepunkt — kjede de eksisterende levende: POST / v1/ video/ to- audio/ → /v1/ st/ → / v1/ translate/ → / v1/ tts/ → / v1/ video/ add- audio /, deretter eventuelt / v1/ video/ lip- sync /. Fulle krølleoppskrifter for hver ved / api /. Frontend- orkestret er en del av denne kjeden.

Registrer deg gratis for 30 000 mynter

Lag ledig konto

Ikke påkrevd med kredittkort

Hvordan vil du vurdere dette verktøyet?

Love this tool? Share it!