AI vaizdo vertėjas

Naudojimas komerciniais tikslais 380+ modeliai Nėra vandens ženklo Nėra reikalo pasirašyti
Modelis:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Nutempkite ir numeskite vaizdo įrašą čia arba spauskite norėdami naršyti

MP4, MOV, WebM iki 100 MB · klipai po 5 minučių dirba greičiausiai

· ·
~ 1500 žetonų per minutę vaizdo įrašo (audio tako) · ~ 3000/min su lūpų sintezės.
Išrenkamas garsas iš video...
Išverstas video paruoštas
Show transcript + translation
Originalas (pažymėtas)

                    
Išverstas

                    
Atsiųsti MP4

Kur atsiperka vaizdo vertėjas

Repost YouTube visame pasaulyje

Vienas Anglų įkelti → Ispanų, Hindi, Prancūzų, Portugalų, Indoneziečių iš naujo įkelia su garsiakalbio balso kiekviena kalba. 4× auditorija už vieną prodiuseriją.

Lokalizuoti kursus

Online pedagogai dubliuoja 50-video kursą į 10 kalbų per naktį. Lūpų sintezės variantas leidžia kalbėjimo-galvos segmentai jaustis gimtoji, o ne subtitruota.

Lokalizuoti skelbimus

Paleisti tą patį produktą atsiliepimai per 10 konkrečioms šalims skirtų reklamos sąskaitų. Tas pats aktorius, tas pats kadras, gimtoji garso už rinką — be pervadinimo.

Kaip veikia vaizdo vertėjas

1 veiksmas

Išpakuoti garsą

Serverio pusėje ffmpeg traukia švarų MP3 takelį iš jūsų įkėlimo. Greitas – veikia API VPS.

2 veiksmas

Atsekti

Whisper paverčia garsą tekstu automatiškai aptinkant kalbą. 99 kalbų palaikymas iš dėžutės.

3 veiksmas

Translate + re-voice

MadLAD išversta į tikslinę kalbą; Kokoro kalba atgal į balsą, kurį pasirinkote iš 174 variantų.

4 veiksmas

Mix back + (optional) lip-sync

ffmpeg pakeičia originalų garsą nauju takeliu. Jei įjungtas lip-sync, Sync Lipsync v2 iš naujo įtraukia burną, kad atitiktų.

Patarimai švariausiam išverstam vaizdo įrašui

  • Vienas į priekį orientuotas garsiakalbis. Keli garsiakalbių scenos supainioja transkriptą ir lūpų sintezę.
  • Išvalyti garsą esant -6 dB. Fono muzika arba triukšmas sumažina transkripcijos tikslumą.
  • Po 5 minučių klipai perteikiami per 2-5 minutes (audio takas) arba 5-15 minučių (su lūpų sinteze).
  • Ispanų, prancūzų, vokiečių, portugalų, italų turi labiausiai natūralus Kokoro balso galimybes. Hindi, arabų, japonų, korėjiečių, kinų taip pat dirbti.
Sudėtingesnės parinktys
Rezultatas
Maži žetonai. Gaukite daugiau žetonų
Nori geresnių rezultatų? Premium modeliai (GPT-5, Claude, Gemini) užtikrina geresnę kokybę. Peržiūrėti planus

❤️ Love Free.ai? Tell your friends!

Sign up norėdami gauti kreipimosi nuorodą ir uždirbti 25,000 žetonų vienam draugui.

Nori daugiau? Užsiregistruoti nemokamai 30K žetonams per dieną + 10K bonusas
Užsiregistruoti nemokamai

Apdorokite savo užklausą...

Repost your YouTube ispaniškai, Hindi, Prancūzų - su garsiakalbio balso į tikslinę kalbą. Whisper transliuotojai, MadLAD verčia, Kokoro per-balsai,ffmpeg maišo atgal. Neprivalomas Sync Lipsync v2 re-renders burnos.

Kaip vartoti AI vaizdo vertėjas

1
Įveskite įvedinį

Įveskite tekstą, įkelkite failą arba apibūdinkite ką norite. Sąskaitos nereikia.

2
Spustelėkite generavimą

Mūsų AI apdoroja Jūsų užklausą per kelias sekundes, naudodami geriausius atviro kodo modelius.

3
Atsisiųsti ir dalintis

Atsisiųskite, nukopijuokite arba pasidalinkite savo rezultatais. Nemokamas asmeniniam ir komerciniam naudojimui.

Naudoti šį įrankį per API

Automatizuoti šį įrankį iš savo kodo. OpenAI suderinama REST vertinamoji baigtis, Beaker-token auth, papildomų SDK nereikia. Token išlaidos atitinka interneto sąsają.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

AI vaizdo vertėjas — FAQ

Įkelkite bet kokį vaizdo įrašą (YouTube klipas, kursas paskaita, produkto atsiliepimai) ir mes išverskite jį į tikslinę kalbą su garsiakalbio balso iš naujo sintezuoti, kad kalba. Neprivaloma, lūpų sintezės iš naujo įrėminti burną, kad ji iš tikrųjų atitinka naują garso. Pistoletas: repost savo "YouTube" ispanų kalba, Hindi, Prancūzų — su savo veido iš tikrųjų sako žodžius.

Penki žingsniai paleisti kliento pusėje seka: (1) ffmpeg ekstraktai švarus MP3 iš vaizdo, (2) Whisper transratings jį (auto-aptinka 99 kalbas), (3) MadLAD verčia tekstą, (4) Kokoro kalba vertimo į balso pasirinko, (5) ffmpeg maišo naują garso atgal į originalų vaizdo, pakeičiant originalų takelį. Lip-sync ant, šeštas žingsnis maršrutai rezultatas per Sync Lipsync v2 iš naujo-rengti burną.

Video Dubbing visada veikia visą lūpų sinchronizavimo vamzdynas — tai premium, tapatybės išsaugojimo galimybė. Video Translator daro lip-sync pasirinkimas: praleisti jį už 3× greičiau, ~50% pigiau paleisti tai puikiai tinka balso-over-style turinį, kai burnos tobuli sinchronizacija nėra kritinė (podcasts, ekrano įrašus, virimo vaizdo, nieko, kai garsiakalbis nėra arti visą laiką).

Tik garso takelis veikia beveik vien tik savarankiškai įmontuotais modeliais (ffmpeg + Whisper + MadLAD + Kokoro), todėl jis tinka jūsų kasdieniam garso takelių žetonų apmokėjimui. Lip-sync naudoja premium Sync Lipsync v2 modelį ir turi įsigyti žetonų. Įvertinkite: ~ 1500 žetonų per minutę garso takui, ~ 3000/min su lip-sync.

Nukritimai atskleisti 20 didelės paklausos kalbos (ispanų, prancūzų, vokiečių, italų, portugalų, olandų, lenkų, rusų, turkų, arabų, hebrajų, hindi, kinų, japonų, korėjiečių, Vietnamo, Indonezijos, tajų, švedų, anglų). MadLAD techniškai palaiko 450+; Ping mums, jei jums reikia kitų.

Taip — balso parinkėjas ištraukia visus 174 Kokoro balsus 37 kalbomis. Kiekvienas balsas pažymėtas mėginiu, kad prieš įvykdydami galėtumėte patikrinti balsą. Sulyginkite balso lytį su garsiakalbiu dėl natūraliausio rezultato.

Ne — Kokoro renkasi iš 174 akcijų balsus, o ne originalaus garsiakalbio kloną. Dėl tapatybei išsaugoti skirto balso klonavimo, pirmiausia paleiskite mūsų / balso / klaviatūros/ priemonės garsiakalbio balsui užfiksuoti, tada naudokite pasirinktinį darbinį srautą. Balso klonavimas + automatinis vertimas į vieną dujotiekį yra ant plano.

Iškirpti iki 100MB proceso gerai. Per 5 minutes garso takui atsidaro per 2-5 minutes, 5-15 minučių su lip-sync. Ilgesniems vaizdo įrašams padalyti į scenas, išversti kiekvieną ir perjungti /video/editor/.

MP4, MOV, WebM, MKV iki 100MB. Vienas į priekį orientuotas garsiakalbis suteikia švariausią transkripciją ir (jei įjungsite) geriausią lūpų sintezę. Fono muzika arba keli garsiakalbiai sumažina transkripcijos tikslumą.

Ne iš šio įrankio – jis pakeičia garsą, o ne vaizdus. Norėdami įrašyti išverstus subtitrus į vaizdo įrašą, paleiskite mūsų /video/kaption/ įrankį ant rezultato. Norėdami eksportuoti SRT/ VTT subtitrų failą, naudokite / perrašykite/ ant originalaus vaizdo.

Ne. Išsiuntimai ištrinami per kelias minutes nuo atvaizdavimo. Rezultatas sėdi mūsų CDN 24 valandas (7 dienas mokamiems vartotojams) prie akcijų nuorodos, tada pašalinamas.

Ne kaip viena vertinamoji baigtis – grandinė esamiems gyviesiems: Point /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, tada pasirinktinai /v1/video/lip- sync/. Pilna garbanos receptai kiekvienam at /api/. Priekinė orkestra tiksliai šią grandinę.

Užsiregistruoti nemokamai 30,000 žetonų

Sukurti nemokamą paskyrą

Kredito kortelės nereikia

Kaip vertinate šį įrankį?

Like this tool? Share it!