Trình dịch video AIName

Dùng thương mại được. 380+ mô hình Không dấu nước Không cần đăng ký
Mô hình:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

Kéo và thả video của bạn vào đây, hoặc nhấn để duyệt

MP4, MOV, WebM lên đến 100MB · các đoạn phim dưới 5 phút hoạt động nhanh nhất

· ·
~1,500 token mỗi phút video (đường âm thanh) · ~3,000/min với lip-sync.
Đang trích âm thanh từ video...
Video đã dịch sẵn sàng.
Show transcript + translation
Nguyên bản (transcripted)

                    
Dịch

                    
Tải về MP4

Đó là nơi mà dịch thuật viên video có thể trả tiền.

Repost YouTube toàn cầu

Một bản tải lên tiếng Anh → Tiếng Tây Ban Nha, Hindi, Pháp, Bồ Đào Nha, Indonesia tải lại với giọng nói của người nói trong mỗi ngôn ngữ.

Tìm đường

Các giáo viên trực tuyến lồng tiếng cho 50 video trong 10 ngôn ngữ trong đêm.

Tìm địa chỉ

Cùng một diễn viên, cùng một cảnh quay, âm thanh bản địa cho mỗi thị trường - không cần quay lại.

Cách hoạt động của trình dịch video

Bước 1

Nhúng âm thanh

ffmpeg bên máy phục vụ lấy một đoạn MP3 sạch từ tải lên của bạn. Nhanh — chạy trên API VPS.

Bước 2

Bản dịch

Whisper chuyển âm thanh thành văn bản với khả năng tự động phát hiện ngôn ngữ. Hỗ trợ 99 ngôn ngữ ngay từ khi ra mắt.

Bước 3

Translate + re-voice

MadLAD dịch sang ngôn ngữ mục tiêu; Kokoro nói lại bằng giọng nói bạn chọn từ 174 lựa chọn.

Bước 4

Mix back + (optional) lip-sync

ffmpeg thay thế âm thanh gốc bằng ca khúc mới. Nếu đồng bộ môi được bật, đồng bộ môi v2 sẽ vẽ lại miệng để phù hợp.

Thông tin về video được dịch sạch nhất

  • Cảnh có nhiều loa làm nhầm bản ghi âm và đồng bộ môi.
  • Âm thanh rõ ràng ở -6 dB. Âm nhạc nền hoặc tiếng ồn làm giảm độ chính xác của bản dịch.
  • Các đoạn phim dưới 5 phút được tạo ra trong 2-5 phút (đường âm thanh) hoặc 5-15 phút (với đồng bộ môi).
  • Tiếng Tây Ban Nha, Pháp, Đức, Bồ Đào Nha, Ý có các tùy chọn giọng nói Kokoro tự nhiên nhất. Hindi, Ả Rập, Nhật Bản, Hàn Quốc, Trung Quốc cũng hoạt động.
Tùy chọn cao cấp
Kết quả
Tiền hết rồi. Lấy thêm biểu tượng
Muốn kết quả tốt hơn? Các mẫu cao cấp (GPT-5, Claude, Gemini) cung cấp chất lượng cao hơn. Xem kế hoạch

❤️ Love this tool? Share it!

Đăng ký để nhận được một liên kết giới thiệu và kiếm được 25.000 token cho mỗi người bạn.

Muốn thêm nữa không? Đăng ký miễn phí 30K token/ngày + 10K thưởng
Đăng ký miễn phí

Đang xử lý yêu cầu của bạn...

Đăng lại YouTube bằng tiếng Tây Ban Nha, Hindi, Pháp — với giọng nói của người nói bằng ngôn ngữ mục tiêu. Whisper phiên âm, MadLAD dịch, Kokoro tái phát âm, ffmpeg trộn lại. Tùy chọn đồng bộ hóa Lipsync v2 tái tạo lại miệng.

Cách sử dụng Trình dịch video AIName

1
Nhập thông tin

Nhập văn bản, tải lên tập tin, hoặc mô tả điều bạn muốn. Không cần tài khoản.

2
Nhấn để tạo

AI của chúng tôi xử lý yêu cầu của bạn trong vài giây sử dụng các mô hình nguồn mở tốt nhất.

3
Tải về và chia sẻ

Tải xuống, sao chép, hoặc chia sẻ kết quả của bạn. Miễn phí cho sử dụng cá nhân và thương mại.

Dùng công cụ này qua API

Tự động hóa công cụ này từ mã của bạn. Điểm kết thúc REST tương thích với OpenAI, xác thực bằng token của người mang, không cần SDK bổ sung. Chi phí token tương ứng với giao diện web.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

Trình dịch video AIName — FAQ

Tải lên bất kỳ video nào (một đoạn YouTube, một bài giảng, một bài kiểm tra sản phẩm) và chúng tôi sẽ dịch nó sang ngôn ngữ mục tiêu với giọng nói của người nói được tổng hợp lại bằng ngôn ngữ đó. Tùy chọn, đồng bộ môi sẽ tái tạo lại miệng để nó thực sự phù hợp với âm thanh mới. Độ cao: đăng lại YouTube của bạn bằng tiếng Tây Ban Nha, Hindi, Pháp — với khuôn mặt của bạn thực sự nói những từ.

Năm bước chạy theo thứ tự bên máy khách: (1) ffmpeg trích ra một MP3 sạch từ video, (2) Whisper phiên âm nó (tự động phát hiện 99 ngôn ngữ), (3) MadLAD dịch văn bản, (4) Kokoro nói lời dịch bằng giọng bạn chọn, (5) ffmpeg trộn âm thanh mới vào video gốc, thay thế cho đoạn gốc. Với tính năng đồng bộ môi, bước thứ sáu dẫn kết quả qua Sync Lipsync v2 để vẽ lại miệng.

Video Translator làm cho lip-sync opt-in: bỏ qua nó cho một chạy nhanh hơn 3 lần, ~ 50% rẻ hơn hoàn hảo cho nội dung kiểu giọng nói trên nơi đồng bộ hoàn hảo miệng không quan trọng (podcast, ghi hình màn hình, video nấu ăn, bất kỳ thứ gì mà người nói không ở gần suốt thời gian).

Đường chỉ âm thanh chạy hầu như hoàn toàn trên các mô hình tự lưu (ffmpeg + Whisper + MadLAD + Kokoro), vì vậy nó phù hợp với số token hàng ngày cho các đoạn phim ngắn. Đồng bộ môi dùng mô hình đồng bộ môi v2 cao cấp và cần mua token. Ước tính: ~1. 500 token mỗi phút video cho đường âm thanh, ~3. 000/ phút với đồng bộ môi.

Các danh sách thả xuống cho thấy 20 ngôn ngữ có nhu cầu cao (Tây Ban Nha, Pháp, Đức, Ý, Bồ Đào Nha, Hà Lan, Ba Lan, Nga, Thổ Nhĩ Kỳ, Ả Rập, Hebrew, Hindi, Trung Quốc, Nhật Bản, Hàn Quốc, Việt Nam, Indonesia, Thái Lan, Thụy Điển, Anh). MadLAD hỗ trợ 450+ ngôn ngữ về mặt kỹ thuật, hãy nhắn tin cho chúng tôi nếu bạn cần những ngôn ngữ khác.

Có — trình chọn giọng nói lấy tất cả 174 giọng nói Kokoro từ 37 ngôn ngữ. Mỗi giọng nói được gắn thẻ với một mẫu để bạn có thể thử giọng trước khi thực hiện. Chọn giọng nói phù hợp với người nói để có kết quả tự nhiên nhất.

Không — Kokoro chọn từ 174 giọng nói, không phải bản sao của người nói gốc. Để sao chép giọng nói bảo tồn danh tính, chạy công cụ /voice/clone/ của chúng tôi trước để thu giọng nói của người nói, sau đó sử dụng một luồng công việc tùy chỉnh. Sao chép giọng nói + dịch tự động trong một đường ống là trên bản đồ.

Các đoạn phim lên đến 100MB được xử lý tốt. Dưới 5 phút sẽ được hiển thị trong 2-5 phút cho đường dẫn âm thanh, 5-15 phút với đồng bộ môi. Đối với các đoạn phim dài hơn, chia thành các cảnh, dịch mỗi cảnh, và kết hợp lại trong /video/editor/.

MP4, MOV, WebM, MKV lên đến 100MB. Một loa hướng về phía trước cho bản ghi rõ ràng nhất và (nếu bạn bật nó) đồng bộ môi tốt nhất. Âm nhạc nền hoặc nhiều loa làm giảm độ chính xác của bản ghi.

Không phải bởi Trình dịch video AIName — nó thay thế âm thanh, không phải hình ảnh. Để ghi phụ đề dịch sang video, chạy công cụ /video/caption/ trên kết quả. Để xuất một tập tin phụ đề SRT/VTT, sử dụng /transcribe/ trên video gốc.

Không. Những tập tin tải lên sẽ bị xóa trong vòng vài phút sau khi được hiển thị. Dữ liệu xuất sẽ nằm trên CDN của chúng tôi trong 24 giờ (7 ngày đối với người dùng trả phí) tại liên kết chia sẻ, sau đó sẽ bị gỡ bỏ.

Không phải là một điểm cuối duy nhất — liên kết các điểm hiện có: POST /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, sau đó tùy chọn /v1/video/lip-sync/.

Đăng ký miễn phí 30,000 token

Tạo tài khoản miễn phí

Không cần thẻ tín dụng

Anh đánh giá công cụ này thế nào?

Love this tool? Share it!