AI Lip Sync

Dùng thương mại được rồi. 581 models Không dấu nước Không cần đăng ký
Mô hình:
+ GPT-5, Claude, Gemini
Tải lên một đoạn phim đầu nói và hoặc một đoạn âm thanh hoặc một kịch bản - chúng tôi sẽ vẽ lại miệng từng khung để phù hợp với âm thanh mới. Chạy trên mô hình đồng bộ môi cao cấp, giá theo giây của video với token mua. Tốt nhất cho việc giảm tốc, ADR, thay thế lồng tiếng, hoặc tạo một đoạn phim nói im lặng.

Kéo video tới đây hoặc nhấn

MP4 / MOV / WebM · tối đa 100MB

- · - · -

Kéo tập tin âm thanh tới đây hoặc nhấn

MP3 / WAV / M4A · tối đa 50MB

- · -
0 / 1500
Thời gian không khớp
Ước tính token cho đoạn phim của bạn
-
Tải lên một video + âm thanh (hoặc gõ một văn bản) để xem chi phí chính xác.
Tải về

♪ Where AI lip-sync earns its keep ♪

ADR / redub

Đoạn phim được ghi lại trong buồng quay, thả vào, miệng được tái tạo lại để phù hợp, không còn bắn lại vì một từ bị phát âm sai nữa.

Đổi giọng nói

Bắn với bất kỳ diễn viên nào, lồng tiếng với nghệ sĩ lồng tiếng ưa thích của bạn (hoặc giọng nói TTS) - môi theo, không dẫn đầu.

Tên người nói

Cho một chân dung im lặng hay nhân vật AI tạo ra một giọng nói. Đường dây với / image-to-video / để hoạt hình một chân dung tĩnh trước, sau đó làm cho nó nói.

Cách làm việc của AI lip sync

Bước 1

Tải lên video

Mặt trước rõ ràng là tốt nhất. Nhiều loa, nhìn sơ đồ, hay đầu quay nhanh làm giảm chất lượng.

Bước 2

Cho âm thanh

Tải lên MP3 / WAV / M4A OR gõ một văn bản và chúng tôi sẽ TTS nó với Kokoro (174 giọng nói trên 37 ngôn ngữ).

Bước 3

Kiểm tra độ dài

Chúng tôi cảnh báo nếu video và âm thanh khác nhau hơn 0,5 giây. Tự động cắt đến độ dài ngắn hơn được chọn theo mặc định.

Bước 4

Đồ họa

Mô hình đồng bộ môi cao cấp tái tạo lại mỗi khung miệng để phù hợp với âm thanh mới. Đoạn phim 30 giây điển hình: ~1-2 phút.

Gợi ý cho kết quả đồng bộ môi tốt nhất

  • Một loa hướng về phía trước, nhiều loa bắn vào nhau làm lộn xộn máy dò diện.
  • Mặt được chiếu sáng tốt, bóng tối dày trên một nửa khuôn mặt làm khó khăn việc theo dõi miệng.
  • Âm thanh ở mức cao nhất -6 dB đến -3 dB. Đồng bộ âm thanh bị cắt hoặc âm thanh tĩnh tệ hơn.
  • 30-second chunks render fastest. For 10+ minute videos, split into scenes.
Tùy chọn cao cấp
Kết quả
Tiền đang cạn. Lấy thêm token
Muốn kết quả tốt hơn? Mô hình cao cấp (GPT-5, Claude, Gemini) cung cấp chất lượng cao hơn. Xem kế hoạch

❤️ Cậu yêu Free.ai?

Đăng ký để nhận liên kết giới thiệu và kiếm được 30.000 token cho mỗi người bạn.

Muốn thêm nữa không? Đăng ký miễn phí: 30,000 token/ngày
Đăng ký miễn phí

Đang xử lý yêu cầu của bạn...

Tạo video đồng bộ môi với AI. Đặt âm thanh với bất kỳ khuôn mặt nào.

Cách sử dụng AI Lip Sync

1
Nhập thông tin nhập vào

Nhập văn bản, tải lên tập tin, hay mô tả điều bạn muốn. Không cần tài khoản.

2
Nhấn để tạo

AI của chúng tôi xử lý yêu cầu của bạn trong vài giây sử dụng các mô hình nguồn mở tốt nhất.

3
Tải về và chia sẻ

Tải xuống, sao chép, hoặc chia sẻ kết quả của bạn. Miễn phí cho sử dụng cá nhân và thương mại.

Dùng công cụ này qua API

Tự động hóa công cụ này từ mã của bạn. Điểm cuối REST tương thích OpenAI, xác thực token Bearer, không cần SDK bổ sung. Chi phí token tương ứng với giao diện web.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

AI Lip Sync - FAQ

Tải lên một video đầu nói và một đoạn âm thanh (hoặc gõ một văn lệnh cho TTS) và AI sẽ tái tạo miệng từng khung để phù hợp với âm thanh mới. Tốt nhất cho ADR, thay thế giọng nói, giảm thiểu, hoặc cho một chân dung im lặng một giọng nói.

Một mô hình vẽ miệng cao cấp làm việc này. Nó phân tích mỗi âm trong âm thanh, phát hiện khuôn mặt trong mỗi khung, và tái tạo vùng môi để phù hợp. Phần còn lại của khuôn mặt, nền và cơ thể không bị ảnh hưởng.

Không. Lip- sync chạy trên một mô hình cao cấp được tính theo giây của video, vì vậy nó chỉ sử dụng token mua: phần thưởng đăng ký và token hàng ngày không bao gồm nó. Giá sẽ tăng dần theo độ dài của đoạn phim và được hiển thị trước khi bạn gửi.

MP4, MOV, WebM lên đến 100MB. Các đoạn phim dưới 30 giây hoạt động nhanh nhất. Một loa hướng trước cho kết hợp môi- miệng sạch nhất; nhiều loa hoặc chuyển đầu nhanh làm giảm chất lượng.

MP3, WAV, M4A lên đến 50MB. Hoặc, gõ một văn bản và chọn từ 174 giọng nói của Kokoro trên 37 ngôn ngữ - chúng tôi sẽ TTS nó và sử dụng nó như là âm thanh lái xe.

We warn you when durations differ by more than 0.5 seconds. The "auto-trim to shorter" toggle (on by default) cuts the longer of the two; otherwise the output covers only the overlapping window.

Kết quả tốt nhất: một khuôn mặt rõ ràng nhìn về phía trước, ánh sáng tốt, camera hầu như ổn định. Kết quả tồi: hình dạng, khuôn mặt bị che (kính, mặt nạ), nhiều khuôn mặt cạnh tranh, gần cực với miệng một phần trong khung.

Lồng tiếng (/ video/ dubbing/) là một ống dẫn đầy đủ: STT → dịch → TTS → đồng bộ môi. Đồng bộ môi chỉ là bước cuối cùng - bạn tự cung cấp âm thanh. Dùng đồng bộ môi khi bạn đã có đoạn lồng tiếng sẵn sàng; dùng lồng tiếng khi bạn muốn dịch và lồng lại từ đầu.

Đặc biệt: đoạn phim 30 giây được hiển thị trong 1- 2 phút. Cờ hiển thị thời gian đợi ước tính khi bạn gửi, và kết quả xuất hiện trên bảng điều khiển của bạn - bạn có thể đóng thẻ.

Không phải trong một lần - mô hình đóng vào một mặt. Đối với các cảnh có nhiều loa, cắt thành các đoạn phim có loa duy nhất, đồng bộ môi mỗi đoạn, sau đó ghép lại với nhau trong một trình biên tập video.

Không. Tập tin đầu vào sẽ bị xóa trong vài phút sau khi vẽ. Tập tin kết quả sẽ được giữ trên CDN của chúng tôi trong 24h (7d cho người dùng trả tiền) tại liên kết chia sẻ.

Có - POST một video đa phần + audio_file (hoặc video + văn bản + giọng nói) vào /v1/video/lip-sync/. Xem /api/ cho tài liệu.

Đăng ký miễn phí: 30,000 token/ngày

Tạo tài khoản

Không cần thẻ tín dụng

Anh đánh giá công cụ này thế nào?

Cậu yêu Free.ai?