همگام‌سازی لب‌های هوش مصنوعی

استفاده تجاری مدل هاي 581 بدون نشان آبی نیازی به ثبت نام نیست
مدل:
+ GPT-5, Claude, Gemini
یک ویدئو از سر صحبت‌کننده و یا یک آهنگ صوتی یا یک دست‌نوشت را بارگذاری کنید - ما فریم به فریم دهان را برای مطابقت با صدای جدید دوباره ترسیم می‌کنیم. روی یک مدل همگام‌سازی لب برتر اجرا می‌شود، قیمت بر ثانیه ویدئو با توکن‌های خریداری شده. ایده‌آل برای کاهش، ADR، جایگزینی صدای بالا، یا ساختن یک کلیپ صامت صحبت.

ویدئوی را به اینجا بکشید یا کلیک کنید

MP4 / MOV / WebM · حداکثر ۱۰۰ مگابایت

- · - · -

پروندۀ صوتی را به اینجا بکشید یا کلیک کنید

MP3 / WAV / M4A · حداکثر ۵۰ مگابایت

- · -
0 / 1500
مدت‌ها تطابق ندارند
تخمین نشانه برای ویدئو
-
یک ویدئو + صدا را بارگذاری کنید (یا یک اسکریپت را تایپ کنید) تا هزینه دقیق را ببینید.
بارگیری

جایی که هوش مصنوعی لب هماهنگ کردنش رو بدست میاره

ADR / redub

يه خط رو تو اتاقک دوباره ضبط کن، بذار توي اون، دهن دوباره يه جور ديگه بازي کنه ديگه ديگه براي يه کلمه اشتباه تلفظ شده بازي نميکنه

جابجایی صدا

با هر بازیگری فیلمبرداری کنید، با صدای مورد علاقه خود (یا صدای TTS) - لب‌ها دنبال می‌کنند، نه رهبری می‌کنند.

آواتارهای حرفه‌ای

به یک پرتره ساکت یا شخصیت تولید شده توسط هوش مصنوعی صدا بدهید. با /image-to-video/ زنجیره کنید تا ابتدا یک پرتره ثابت را پویانمایی کنید، سپس آن را به صحبت وادار کنید.

چگونه هوش مصنوعی لب هماهنگ کار می کند

گام ۱

بارگذاری ویدئو

چهره روشن و رو به جلو بهترین کار را می‌کند. چند بلندگو، نمای پروفایل یا چرخش سریع سر کیفیت را کاهش می‌دهد.

Step 2

ارائه صدا

MP3 / WAV / M4A را بارگذاری کنید یا یک اسکریپت را تایپ کنید و ما آن را با Kokoro (۱۷۴ صدا در ۳۷ زبان) ترجمه می‌کنیم.

گام ۳

بررسی طول

We warn if video and audio differ by more than 0.5 s. Auto-trim to the shorter length is checked by default.

Step 4

نمایش

مدل lip-sync premium هر فریم دهان را برای مطابقت با صدای جدید بازسازی می‌کند. کلیپ ۳۰ ثانیه‌ای معمول: ~۱-۲ دقیقه.

راهنمایی برای بهترین خروجی همگام‌سازی لب

  • يه بلندگوي جلويي. شليک هاي چند بلندگويي شناسايي چهره رو گمراه ميکنه
  • چهره خوب روشن شده سايه هاي سنگين روي نصف صورت باعث ميشه رديابي دهان مشکل باشه
  • صدا در ۶ dB- تا ۳ dB- اوج. همگام‌سازی صدای بریده یا ساکت و آهسته بدتر است.
  • تکه های ۳۰ ثانیه ای سریعترین رندر را دارند. برای ویدئوی ۱۰+ دقیقه ای ، به صحنه ها تقسیم کنید.
گزینه‌های پیشرفته
نتیجه
. يه کم کم ميشه گرفتن نشانه‌های بیشتر
نتيجه بهتري ميخواي؟ مدلهای پریمیوم (GPT-5, Claude, Gemini) کیفیت بالاتری را ارائه می‌دهند. نمایش نقشه

❤️ دوست Free.ai رو به دوستانت بگو

ثبت نام کنید تا لینک پیشنهادی دریافت کنید و 30 توکن برای هر دوست بدست آورید.

بيشتر ميخواي؟ ثبت نام رایگان: 30,000 tokens/day
ثبت نام

در حال پردازش درخواست شما...

ساخت ویدئوی همگام‌سازی لب با هوش مصنوعی. صدا را با هر چهره ای تطبیق دهید.

چطور استفاده شود همگام‌سازی لب‌های هوش مصنوعی

1
وارد کردن ورودی

متن را تایپ کنید ، پرونده‌ای را بارگذاری کنید ، یا آنچه را می‌خواهید توصیف کنید. حساب نیازی نیست.

2
ایجاد را کلیک کنید

هوش مصنوعی ما درخواست شما را در چند ثانیه با استفاده از بهترین مدل‌های منبع باز پردازش می‌کند.

3
بارگیری و اشتراک

دانلود، کپی یا اشتراک‌گذاری نتایج خود. برای استفاده شخصی و تجاری رایگان است.

استفاده از این ابزار از طریق API

این ابزار را از کد خودتان خودکار کنید. نقطه پایانی REST سازگار با OpenAI، گواهی‌نامه توکن حامل، نیازی به SDK اضافی نیست. هزینه توکن با رابط وب مطابقت دارد.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

همگام‌سازی لب‌های هوش مصنوعی - FAQ

یک ویدئو از سر صحبت‌کننده را همراه با یک آهنگ صوتی بارگذاری کنید (یا یک اسکریپت برای TTS تایپ کنید) و هوش مصنوعی فریم به فریم دهان را برای مطابقت صوتی با صدای جدید بازسازی می‌کند. ایده‌آل برای ADR، جایگزینی صدای فوق، بازسازی، یا دادن صدا به یک پرتره ساکت.

یک مدل رندر دهان عالی کار را انجام می‌دهد. هر صدایی در صدا را تجزیه و تحلیل می‌کند ، چهره را در هر فریم شناسایی می‌کند ، و ناحیه لب را برای تطابق بازسازی می‌کند. بقیه چهره ، پس زمینه و بدن دستکاری نمی‌شوند.

نه. Lip-sync روی مدل پرمیوم اجرا می‌شود که به ازای هر ثانیه ویدئوی پرداخت می‌شود، بنابراین فقط از توکن‌های خریداری شده استفاده می‌کند: پاداش ثبت نام و توکن‌های روزانه آن را پوشش نمی‌دهند. قیمت با طول کلیپ مقیاس می‌شود و قبل از ارسال نمایش داده می‌شود.

MP4, MOV, WebM تا ۱۰۰ مگابایت. کلیپ‌های کمتر از ۳۰ ثانیه سریع‌ترین کارها را انجام می‌دهند. یک بلندگو با جهت جلوی واحد، همگام‌سازی لب‌های تمیز را فراهم می‌کند؛ بلندگوهای چندگانه یا چرخش سریع سر کیفیت را کاهش می‌دهد.

MP3, WAV, M4A تا 50MB. به جای آن، یک اسکریپت را تایپ کنید و از 174 صدای Kokoro در 37 زبان انتخاب کنید - ما آن را به TTS تبدیل می کنیم و از آن به عنوان صدای رانندگی استفاده می کنیم.

We warn you when durations differ by more than 0.5 seconds. The "auto-trim to shorter" toggle (on by default) cuts the longer of the two; otherwise the output covers only the overlapping window.

بهترین نتایج: یک چهره روشن رو به جلو، روشنایی خوب، دوربین بیشتر ثابت. نتایج ضعیف: نمای پروفایل، چهره پوشیده (عینک آفتابی، ماسک)، چهره‌های چندگانه رقابتی، نزدیک‌نمایی‌های شدید با دهان جزئی در قاب.

دوبلاژ (/video/dubbing/) یک خط لوله کامل است: STT → ترجمه → TTS → lip-sync. lip-sync تنها آخرین گام است - شما خودتان صدا را فراهم می‌کنید. از lip-sync زمانی استفاده کنید که از قبل آهنگ صدابردار آماده دارید؛ از دوبلاژ زمانی استفاده کنید که می‌خواهید از ابتدا ترجمه و صدا را دوباره تولید کنید.

معمول: کلیپ ۳۰ ثانیه‌ای در ۱- ۲ دقیقه ترسیم می‌شود. بنر یک تخمین انتظار را هنگام ارسال نشان می‌دهد ، و نتیجه در دسکتاپ شما قرار می‌گیرد - می‌توانید تب را ببندید.

نه در یک گذر - مدل روی یک چهره قفل می‌شود. برای صحنه‌های چند بلندگو، به کلیپ‌های تک بلندگو برش دهید، هر کدام را با لب هماهنگ کنید، سپس در ویرایشگر ویدئویی دوباره به هم بچسبانید.

نه. پرونده‌های ورودی در عرض چند دقیقه از رندر حذف می‌شوند. خروجی در شبکه CDN ما برای ۲۴ ساعت (۷ روز برای کاربران پرداخت‌کننده) در پیوند اشتراک نگه داشته می‌شود.

آره - POST یک فایل چندبخشی ویدئویی + صوتی (یا ویدئویی + متن + صدا) به /v1/video/lip-sync/. برای مستندات /api/ را ببینید.

ثبت نام رایگان: 30,000 tokens/day

ایجاد حساب

کارت اعتباري لازم نيست

اين ابزار رو چطور رتبه بندي ميکني؟

دوست Free.ai رو به دوستانت بگو