Przekładnik wideo SI

Wykorzystanie handlowe OK 380+ modeli Brak znaku wodnego Nie ma potrzeby rejestracji
Wzór:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Przeciągnij i upuść tutaj swoje wideo lub kliknij aby przeglądać

MP4, MOV, WebM do 100MB · klipy poniżej 5 minut pracy najszybciej

· ·
~1,500 tokenów na minutę wideo (ścieżka audio) · ~3,000/min z lip-sync.
Wydobywanie audio z wideo...
Przetłumaczone wideo gotowe
Show transcript + translation
Oryginalny (zapisane)

                    
Przetłumaczone

                    
Pobierz MP4

Gdzie tłumacz wideo się opłaci

Repost YouTube na całym świecie

Jeden angielski upload → hiszpański, hinduski, francuski, portugalski, indonezyjski ponowne obciążenia głośnika w każdym języku. 4× publiczność dla jednej produkcji.

Klasyfikacja kursów lokalizacyjnych

Online edukatory dub 50-video kurs na 10 języków przez noc. Opcja sync lip-sync sprawia, że segmenty rozmowy-głowy czują się native, a nie subtitled.

Lokalizuj reklamy

Uruchom ten sam produkt zeznania na 10 kont reklamowych dla poszczególnych krajów. Ten sam aktor, ten sam shot, native audio na rynku – bez ponownego shoot.

Jak działa tłumacz wideo

Krok 1

Rozpakuj dźwięk

Na stronie serwera ffmpeg wyciąga czysty MP3 ścieżkę z Twojego wysłania. Szybko — uruchamia na API VPS.

Krok 2

Transcribe

Szeptanie przekształca dźwięk w tekst z wykrywaniem języka automatycznego. 99-językowe wsparcie z pudełka.

Krok 3

Translate + re-voice

MadLAD przekłada się na język docelowy; Kokoro mówi to z powrotem w głosie wybranym z 174 opcji.

Krok 4

Mix back + (optional) lip-sync

ffmpeg zastępuje oryginalny dźwięk nowym utworem. Jeśli jest włączony lip-sync, Sync Lipsync v2 oddaje usta do pasowania.

Wskazówki na najczystsze przetłumaczone wideo

  • Scenografia wielogłośnika myli transkrypcję i synchroryzację ust.
  • Wyczyszczenie dźwięku przy -6 dB. Muzyka tła lub hałas zmniejsza dokładność transkrypcji.
  • Poniżej 5-minutowych klipów wyświetla się w ciągu 2-5 minut (ścieżka audio) lub 5-15 minut (z syncem lip).
  • Hiszpański, francuski, niemiecki, portugalski, włoski mają najbardziej naturalne opcje głosowe Kokoro. Hindi, arabski, japoński, koreański, chiński również pracuje.
Zaawansowane opcje
Wynik
Tokiny się skończyły. Zdobądź więcej tokenów
Chcesz lepsze wyniki? Modele premium (GPT-5, Claude, Gemini) dostarcza wyższej jakości. Widok planów

❤️ Love this tool? Share it!

Zaloguj się aby uzyskać link referencyjny i zarobić 25 000 tokenów na przyjaciela.

Chcesz więcej? Zarejestruj się za darmo za 30K tokeny/dzień + 10K bonus
Zarejestruj się za darmo

Przetwarzam twoją prośbę...

Repost your YouTube in hiszpański, hindi, francuski — z głosem głośnika w języku docelowym. Whisper transcribes, MadLAD tłumaczy, Kokoro re-voices, ffmpeg miesza z powrotem. Opcjonalna Sync Lipsync v2 oddaje usta.

Jak stosować lek Przekładnik wideo SI

1
Wprowadź swoje wpisy

Wpisz tekst, wyślij plik lub opisz, czego chcesz. Nie jest potrzebne konto.

2
Kliknij wygenerować

Nasz SI przetwarza Twoją prośbę w sekundach przy użyciu najlepszych modeli open-source.

3
Pobierz & dzielenie

Pobierz, kopiuj lub podziel się swoim wynikiem. Darmowe do użytku osobistego i komercyjnego.

Użyj tego narzędzia przez API

Automatyzuj to narzędzie z własnego kodu. Kompatybilny z OpenAI REST punkt końcowy, Authentic-Bearer-token, nie jest wymagany dodatkowy SDK. Koszty token pasują do interfejsu internetowego.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

Przekładnik wideo SI — FAQ

Wyślij dowolne wideo (wykład z YouTube, wykład z kursu, świadectwo produktu) i przetłumaczymy go na język docelowy z przesyntezowaniem głosu głośnika w tym języku. Opcjonalnie, lip-synch re-daje usta tak, aby rzeczywiście pasował do nowego dźwięku. Wystawa: repost your YouTube w języku hiszpańskim, hinduskim, francuskim – z twarzą rzeczywiście mówiąc słowa.

Pięć kroków uruchomić klient-bok w sekwencji: (1) ffmpeg wyciąga czysty MP3 z wideo, (2) Whisper transkripuje go (automatycznie wykrywa 99 języków), (3) MadLAD tłumaczy tekst, (4) Kokoro mówi tłumaczenie w wybranym głosie, (5) ffmpeg miesza nowy dźwięk z powrotem do oryginalnego wideo, zastępując oryginalny tor. Lip-sync on, szósty krok wynik przez Sync Lipsync v2 aby oddać usta.

Wideo Dubbing zawsze obsługuje pełny rurociąg synchronizujący lipy – jest to premium, tożsamość-zachowanie. Video Translator robi lip-sync opt-in: pominąć go na 3× szybciej, ~50% tańsza run to idealne dla zawartości głos-nad-styl, gdzie usta-doskonała synchronizacja nie jest krytyczne (podkasta, nagrania ekranowe, filmy gotowania, wszystko, gdzie głośnik nie jest w bliskim czasie).

Ścieżka audio tylko działa niemal w całości na modelach samodzielnych (ffmpeg + Whisper + MadLAD + Kokoro), więc pasuje do codziennego tokenu dla krótkich klipów. Lip-sync używa premium Sync Lipsync v2 i wymaga zakupionych tokenów. Szacunek: ~1,500 tokenów na minutę wideo dla ścieżki audio, ~3,000/min z lip-sync.

Spadki ujawniają 20 języków wysokich wymagań (szpański, francuski, niemiecki, portugalski, holenderski, polski, rosyjski, rosyjski, arabski, hebrajski, hinduski, chiński, japoński, koreański, wietnamski, indonezyjski, tajski, szwedzki, angielski). MadLAD technicznie wspiera 450+; ping nas, jeśli potrzebujesz innych.

Tak — wybieracz głosu pociąga wszystkie 174 głosy Kokoro w 37 językach. Każdy głos jest oznaczony próbką, więc można przesłuchać przed popełnieniem zobowiązania. Dopasuj płeć głosu do głośnika dla najbardziej naturalnych rezultatów.

Nie — Kokoro wybiera z 174 głośników akcji, a nie klonu oryginalnego głośnika. Dla klonowania głosu tożsamości, uruchomić /woice/klon/narzędzie najpierw, aby uchwycić głos głośnika, następnie użyć niestandardowego przepływu roboczego. Głos klonowanie + tłumaczenie automatyczne w jednym rurociągu jest na planie działania.

Clips do 100MB proces dobrze. Mniej 5 minut wyświetla w 2-5 minut dla ścieżki audio, 5-15 minut z lip-sync. Dla dłuższych filmów wideo, podzielić na sceny, przetłumaczyć każdy, i rekombinować w /video/editor /.

MP4, MOV, WebM, MKV do 100MB. Pojedynczy głośnik do przodu daje najczystszy transkrypt i (jeśli to włączysz) najlepszą synchronizację ust. Muzyka tła lub wiele głośników zmniejsza dokładność transkrypcji.

Nie przez Przekładnik wideo SI – zastępuje audio, nie wizualne. Aby spalić przetłumaczone napisy do wideo, uruchomić nasz /video/caption/ narzędzie na wynik. Aby eksportować plik napisów SRT/VTT, użyj /transcribe/ na oryginalnym filmie.

Nie. Wysyłki są usuwane w ciągu kilku minut od wyświetlania. Wyjście znajduje się na naszym CDN przez 24 godziny (7 dni dla płatnych użytkowników) na łączu akcjonariuszy, następnie zostaje usunięte.

Nie jako jeden punkt końcowy – łańcuch istniejących żywych: POST /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, następnie opcjonalnie /v1/video/lip-sync /. Pełne skrzyżowanie receptur dla każdego w /api /.

Zarejestruj się bezpłatnie na 30 000 tokenów

Utwórz bezpłatne konto

Karta kredytowa nie jest wymagana

Jak mógłbyś ocenić to narzędzie?

Love this tool? Share it!