AI 비디오 번역기

상업적 사용 OK 380+ 모델 워터마크 없음 가입이 필요하지 않습니다
모델:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

여기에 비디오를 드래그 앤 드롭하거나 클릭하여 찾아보십시오.

MP4, MOV, WebM 최대 100MB · 5분 이하의 클립이 가장 빠르게 작동

· ·
~1,500 토큰/분의 비디오(오디오 경로) · ~3,000/분의 입술 동기화.
비디오에서 오디오 추출 중...
번역된 비디오 준비
Show transcript + translation
원본 (전사)

                    
번역됨

                    
다운로드 MP4

비디오 번역기가 효과를 발휘하는 곳

전 세계적으로 YouTube 리포스팅

영어 업로드 1개 → 스페인어, 힌디어, 프랑스어, 포르투갈어, 인도네시아어 각 언어로 된 스피커의 음성으로 재업로드.

코스 현지화

온라인 교육자들은 50개의 비디오 강의를 하루에 10개 언어로 번역합니다. 입술 동기화 옵션은 자막이 아닌 토크헤드 세그먼트를 본인의 언어로 느끼게 합니다.

광고를 현지화

10개 국가별 광고 계정에서 동일한 제품 리뷰를 실행합니다. 동일한 배우, 동일한 촬영, 시장별 네이티브 오디오 — 재촬영 없이.

비디오 번역기 작동 방법

1단계

오디오 추출

서버 측 ffmpeg는 업로드에서 깨끗한 MP3 트랙을 끌어옵니다. 빠르다 — API VPS에서 실행됩니다.

2단계

번역

Whisper는 자동 언어 감지 기능을 통해 오디오를 텍스트로 변환합니다. 99개 언어 지원

3단계

Translate + re-voice

MadLAD는 대상 언어로 번역; Kokoro는 174 옵션에서 선택한 목소리로 다시 말합니다.

4단계

Mix back + (optional) lip-sync

ffmpeg 는 원본 오디오를 새 트랙으로 대체합니다. 입 동기화가 켜져 있으면, Sync Lipsync v2 는 입을 일치시키기 위해 다시 렌더링합니다.

가장 깨끗한 번역 비디오를위한 팁

  • 멀티 스피커 장면은 녹음과 입술 동기화 패스를 모두 혼동시킵니다.
  • -6 dB에서 명확한 오디오. 배경 음악 또는 소음은 녹음 정확도를 낮추게 됩니다.
  • 5분 미만의 클립은 2-5분(오디오 경로) 또는 5-15분(립 동기화)으로 렌더링됩니다.
  • 스페인어, 프랑스어, 독일어, 포르투갈어, 이탈리아어는 가장 자연스러운 Kokoro 음성 옵션을 가지고 있습니다. 힌디어, 아랍어, 일본어, 한국어, 중국어도 작동합니다.
고급 옵션
결과
토큰이 부족해요 더 많은 토큰을 얻으십시오
더 나은 결과를 원하십니까? 프리미엄 모델 (GPT-5, Claude, Gemini) 보다 높은 품질을 제공합니다. 계획 보기

❤️ Love this tool? Share it!

가입 추천 링크를 얻을 수 있으며 친구 당 25,000 토큰을 적립합니다.

더 먹고 싶어? 하루 30K 토큰 + 10K 보너스를 무료로 가입하세요
무료로 가입하세요

귀하의 요청을 처리 중...

스페인어, 힌디어, 프랑스어로 YouTube를 리포스트하세요. 대상 언어로 된 스피커의 음성을 들려주세요. Whisper가 녹음하고 MadLAD가 번역하고 Kokoro가 음성을 재생하고 ffmpeg이 믹스합니다.

사용 방법 AI 비디오 번역기

1
입력을 입력하십시오

텍스트를 입력하거나 파일을 업로드하거나 원하는 내용을 설명하세요. 계정이 필요하지 않습니다.

2
생성하기를 클릭하십시오

당사의 AI는 최고의 오픈 소스 모델을 사용하여 몇 초 만에 요청을 처리합니다.

3
다운로드 및 공유

다운로드, 복사 또는 결과를 공유. 개인 및 상업용 무료.

API를 통해 이 도구를 사용

이 도구를 자신의 코드로 자동화하세요. OpenAI 호환 REST 엔드포인트, 베어러 토큰 인증, 추가 SDK 필요 없음. 토큰 비용은 웹 인터페이스와 일치합니다.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

AI 비디오 번역기 — FAQ

어떤 동영상(YouTube 클립, 강의, 제품 리뷰)을 업로드하더라도 해당 언어로 재합성된 연사의 음성과 함께 대상 언어로 번역됩니다. 옵션으로 입술 동기화를 통해 입을 재렌더링하여 새로운 오디오와 실제로 일치하도록 합니다. 피치: 스페인어, 힌디어, 프랑스어로 YouTube를 재포스트하십시오.

클라이언트 측에서 순서대로 다섯 단계가 실행됩니다. (1) ffmpeg이 비디오에서 깨끗한 MP3를 추출합니다. (2) Whisper가 비디오를 번역합니다. (99개 언어를 자동으로 감지합니다.) (3) MadLAD가 텍스트를 번역합니다. (4) Kokoro가 번역된 텍스트를 선택한 음성으로 말합니다. (5) ffmpeg이 새로운 오디오를 원래 비디오로 복사하여 원래 트랙을 대체합니다.

Video Translator는 입술 동기화를 선택할 수 있게 해줍니다. 입술 동기화가 중요하지 않은 음성-오버 스타일 콘텐츠(팟캐스트, 스크린 녹화, 요리 동영상, 스피커가 항상 클로즈업 상태에 있지 않은 모든 것)에 완벽한 3배 빠른 ~50% 저렴한 실행을 위해 이를 건너 뛰십시오.

오디오 전용 경로는 거의 전적으로 자체 호스팅 모델(ffmpeg + Whisper + MadLAD + Kokoro)에서 실행되므로 짧은 클립을 위한 일일 토큰 허용량 내에 들어갑니다. 립 동기화는 프리미엄 Sync Lipsync v2 모델을 사용하고 구입 토큰이 필요합니다. 예상: 오디오 경로의 경우 분당 비디오 1,500 토큰, 립 동기화의 경우 분당 3,000 토큰.

드롭다운 메뉴는 20개의 수요가 많은 언어를 보여줍니다(스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 네덜란드어, 폴란드어, 러시아어, 터키어, 아랍어, 히브리어, 힌디어, 중국어, 일본어, 한국어, 베트남어, 인도네시아어, 태국어, 스웨덴어, 영어). MadLAD는 기술적으로 450개 이상의 언어를 지원합니다.

음성 선택기는 37개 언어의 174개의 Kokoro 음성을 모두 뽑아냅니다. 각 음성은 샘플 태그가 붙어 있어 커밋하기 전에 오디션을 볼 수 있습니다. 가장 자연스러운 결과를 위해 음성 성별을 스피커와 일치시키세요.

아니요 — Kokoro는 174개의 스톡 음성 중에서 선택하며, 원본 스피커의 복제본이 아닙니다. 신원을 보존하는 음성 복제를 위해서는 먼저 /voice/clone/ 도구를 실행하여 스피커의 음성을 캡처한 다음 사용자 정의 워크플로를 사용합니다.

5분 미만의 클립은 오디오 경로를 위해 2-5분, 입 동기화를 위해 5-15분이 걸립니다. 더 긴 비디오의 경우 장면으로 나누고 각각을 번역하고 /video/editor/에 다시 결합하십시오.

MP4, MOV, WebM, MKV 최대 100MB. 단일 전방향 스피커는 가장 깨끗한 녹음을 제공하고 (활성화하면) 최고의 입술 동기화를 제공합니다. 배경 음악 또는 여러 스피커는 녹음 정확도를 줄입니다.

AI 비디오 번역기는 오디오를 대체하며 시각적 요소는 대체하지 않습니다. 번역된 자막을 비디오에 레코딩하려면 결과물에서 /video/caption/ 도구를 실행하십시오. SRT/VTT 자막 파일을 내보내려면 원본 비디오에서 /transcribe/를 사용합니다.

아니요. 업로드는 렌더링 후 몇 분 내에 삭제됩니다. 출력은 공유 링크에서 24시간 동안(유료 사용자의 경우 7일) 저희 CDN에 저장되고, 그 후 삭제됩니다.

단일 엔드포인트로서가 아니라 — 기존의 라이브 엔드포인트를 연결하세요: POST /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, 그리고 선택적으로 /v1/video/lip-sync/. 각각에 대한 전체 컬 레시피는 /api/에 있습니다. 프론트엔드는 이 정확한 연결을 조율합니다.

30,000 토큰을 무료로 등록하세요

무료 계정 만들기

신용카드 필요 없음

이 도구를 어떻게 평가하시겠습니까?

Love this tool? Share it!