مترجم ویدئویی هوش مصنوعی

استفاده تجاری ص ۳۸۰. بدون نشان آبی نیازی به ثبت نام نیست
مدل:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

ویدئو را به اینجا بکشید و بگذارید ، یا برای مرور کلیک کنید

MP4, MOV, WebM تا 100MB · کلیپ‌های کمتر از 5 دقیقه سریع‌ترین کارها

· ·
1500 تاکن در دقیقه ویدئو (راه صوتی) ~3000/min با lip-sync.
در حال استخراج صدا از ویدئو...
. ويدئو ترجمه شده آماده است
Show transcript + translation
(ترجمه)

                    
ترجمه شده

                    
بارگیری MP4

جایی که مترجم ویدئویی سود میده

بازنشر جهانی یوتیوب

یک بار آپلود انگلیسی → اسپانیایی، هندی، فرانسوی، پرتغالی، اندونزیایی با صدای سخنران در هر زبان. ۴× تماشاچی برای یک تولید.

محلی کردن میدان

آموزش دهندگان آنلاین یک دوره ۵۰ ویدئویی را در عرض یک شب به ۱۰ زبان ترجمه می‌کنند.

محلی کردن آگهیها

همان بازیگر، همان صحنه، همان صدای بومی در هر بازار - بدون نیاز به بازسازی.

چگونه ترجمه ویدئویی کار می‌کند

گام ۱

استخراج صدا

ffmpeg سمت کارساز یک شیار MP3 تمیز را از بارگذاری شما استخراج می‌کند. سریع — روی API VPS اجرا می‌شود.

گام دوم

رونوشت

زبان فارسی در این کتاب به صورت مفصل مورد بررسی قرار گرفته و به ۳۹ زبان فارسی ترجمه شده‌است.

گام ۳

Translate + re-voice

MadLAD به زبان هدف ترجمه می‌کند؛ Kokoro آن را با صدایی که از ۱۷۴ گزینه انتخاب کرده‌اید، بازگو می‌کند.

گام چهارم

Mix back + (optional) lip-sync

ffmpeg صدای اصلی را با شیار جدید جایگزین می‌کند. اگر همگام‌سازی لب فعال باشد، همگام‌سازی همگام‌سازی لب نسخه ۲ دهان را برای تطابق دوباره نمایش می‌دهد.

راهنمایی برای ویدئوهای ترجمه شده

  • يه بلندگوي جلو رو به جلو صحنه هاي چند بلندگويي رونوشت و هماهنگ کردن لب ها رو بهم مي زنه
  • صدای واضح در -6 dB. موسیقی پس زمینه یا نویز دقت رونویسی را کاهش می‌دهد.
  • در زیر ۵ دقیقه کلیپ‌ها در ۲-۵ دقیقه (راه صوتی) یا ۵-۱۵ دقیقه (با همگام‌سازی لب) نمایش داده می‌شوند.
  • اسپانیایی، فرانسوی، آلمانی، پرتغالی، ایتالیایی طبیعی‌ترین گزینه‌های صدای کوکورو هستند. هندی، عربی، ژاپنی، کره‌ای، چینی نیز کار می‌کنند.
گزینه‌های پیشرفته
نتیجه
. رمزها کم ميشه گرفتن نشانه‌های بیشتر
نتيجه بهتري ميخواي؟ مدلهای پریمیوم (GPT-5, Claude, Gemini) کیفیت بالاتری را ارائه می‌دهند. نمایش نقشه

❤️ دوست Free.ai رو به دوستانت بگو

ثبت نام کنید تا لینک پیشنهادی دریافت کنید و 30 توکن برای هر دوست بدست آورید.

بيشتر ميخواي؟ ثبت نام مجاني براي 30K توکن/روز + 10K بونوس
ثبت نام

در حال پردازش درخواست شما...

یوتیوب خود را به اسپانیایی، هندی، فرانسوی دوباره بنویسید — با صدای سخنران در زبان هدف. Whisper رونویسی می‌کند، MadLAD ترجمه می‌کند، Kokoro دوباره صدا می‌دهد، ffmpeg دوباره میکس می‌کند. گزینه‌ای همگام سازی Lipsync v2 دهان را دوباره نمایش می‌دهد.

چطور استفاده کنم مترجم ویدئویی هوش مصنوعی

1
وارد کردن ورودی

متن را تایپ کنید ، یک پرونده را بارگذاری کنید ، یا آنچه را که می‌خواهید توصیف کنید. حساب نیازی نیست.

2
ایجاد را بزنید

هوش مصنوعی ما درخواست شما را در چند ثانیه با استفاده از بهترین مدل‌های منبع باز پردازش می‌کند.

3
بارگیری و اشتراک

دانلود، کپی یا اشتراک‌گذاری نتایج خود. برای استفاده شخصی و تجاری رایگان است.

استفاده از این ابزار از طریق API

این ابزار را از کد خودتان خودکار کنید. نقطه پایانی REST سازگار با OpenAI، گواهی‌نامه حامل گواهی‌نامه، نیازی به SDK اضافی نیست. هزینه گواهی‌نامه با رابط وب مطابقت دارد.

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

مترجم ویدئویی هوش مصنوعی — FAQ

هر ویدئو (یک کلیپ یوتیوب، یک سخنرانی در کلاس، یک گواهینامه محصول) را آپلود کنید و ما آن را به زبان هدف ترجمه می‌کنیم و صدای سخنران را به آن زبان دوباره ترکیب می‌کنیم. به صورت اختیاری، lip-sync دهان را دوباره نمایش می‌دهد تا در واقع با صدای جدید مطابقت داشته باشد.

پنج گام در سمت کارگزار به ترتیب اجرا می‌شوند: (۱) ffmpeg یک MP3 تمیز از ویدئو استخراج می‌کند، (۲) Whisper آن را رونویسی می‌کند (۹۹ زبان را به صورت خودکار تشخیص می‌دهد)، (۳) MadLAD متن را ترجمه می‌کند، (۴) Kokoro ترجمه را با صدایی که انتخاب کرده‌اید می‌گوید، (۵) ffmpeg صدای جدید را دوباره به ویدئو اصلی می‌آمیزد و آهنگ اصلی را جایگزین می‌کند. با فعال کردن همگام‌سازی لب، گام ششم نتیجه را از طریق همگام‌سازی همگام‌سازی لب نسخه ۲ برای بازسازی دهان هدایت می‌کند.

ترجمه ویدئویی همگام‌سازی لب را انتخاب می‌کند: برای یک اجرای ۳ برابر سریع‌تر، ~۵۰٪ ارزان‌تر که برای محتوای صدا-بر-زبان که همگام‌سازی کامل دهان حیاتی نیست (پادکاست‌ها، ضبط‌های صفحه، ویدئوهای آشپزی، هر چیزی که در آن سخنران در تمام زمان در نزدیکی نیست) عالی است، آن را رها کنید.

مسیر تنها صدا تقریباً به‌طور کامل بر روی مدل‌های خود میزبانی شده (ffmpeg + Whisper + MadLAD + Kokoro) اجرا می‌شود، بنابراین در داخل مجوز توکن روزانه شما برای کلیپ‌های کوتاه قرار می‌گیرد. Lip-sync از مدل Premium Sync Lipsync v2 استفاده می‌کند و به توکن‌های خریداری شده نیاز دارد. تخمین: ~1,500 توکن در دقیقه ویدئو برای مسیر صدا، ~3,000/min با lip-sync.

این فهرست ۲۰ زبان مورد نیاز را نشان می‌دهد (اسپانیایی، فرانسوی، آلمانی، ایتالیایی، پرتغالی، هلندی، لهستانی، روسی، ترکی، عربی، عبری، هندی، چینی، ژاپنی، کره‌ای، ویتنامی، اندونزیایی، تایلندی، سوئدی، انگلیسی).

بله — انتخاب‌کننده صدا همۀ ۱۷۴ صدای Kokoro را در ۳۷ زبان استخراج می‌کند. هر صدا با یک نمونه برچسب‌گذاری می‌شود ، بنابراین می‌توانید قبل از انجام آزمایش ، آن را تست کنید. برای طبیعی‌ترین نتیجه ، جنسیت صدا را با گوینده تطبیق دهید.

نه — کوکورو از ۱۷۴ صدای موجود استفاده می‌کند، نه یک کلون از سخنران اصلی. برای شبیه‌سازی صدای محافظت‌شده، ابزار /voice/clone/ را اجرا کنید تا صدای سخنران را ضبط کنید، سپس از یک جریان کار سفارشی استفاده کنید. شبیه‌سازی صدا + ترجمه خودکار در یک خط لوله در نقشه راه است.

کلیپ‌های تا ۱۰۰ مگابایت به خوبی پردازش می‌شوند. کمتر از ۵ دقیقه در ۲-۵ دقیقه برای مسیر صوتی، ۵-۱۵ دقیقه با همگام‌سازی لب رندر می‌شود. برای ویدئوهای طولانی‌تر، به صحنه‌ها تقسیم کنید، هر کدام را ترجمه کنید و دوباره در /video/editor/ ترکیب کنید.

MP4, MOV, WebM, MKV تا ۱۰۰ مگابایت. یک بلندگو با جهت جلوی تکی، پاک‌ترین رونوشت را می‌دهد و (اگر آن را فعال کنید) بهترین همگام‌سازی لب را. موسیقی پس‌زمینه یا بلندگوهای چندگانه دقت رونوشت را کاهش می‌دهد.

نه با مترجم ویدئویی هوش مصنوعی — مترجم ویدئویی هوش مصنوعی صدا را جایگزین می‌کند، نه تصویر. برای سوزاندن زیرنویس‌های ترجمه شده در ویدئو، ابزار /video/caption/ را روی نتیجه اجرا کنید. برای صادرات یک پرونده زیرنویس SRT/VTT، از /transcribe/ روی ویدئو اصلی استفاده کنید.

نه. بارگذاری‌ها در عرض چند دقیقه از رندر حذف می‌شوند. خروجی برای ۲۴ ساعت (۷ روز برای کاربران پرداختی) در شبکهٔ پخش محتوای ما در پیوند اشتراک قرار می‌گیرد ، سپس حذف می‌شود.

نه به عنوان یک نقطه پایانی واحد — زنجیره از آن‌هایی که زنده هستند: POST /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/، سپس به صورت اختیاری /v1/video/lip-sync/.

براي 30000 تا توکن مجاني ثبت نام کن

ایجاد حساب

کارت اعتباري لازم نيست

اين ابزار رو چطور رتبه بندي ميکني؟

دوست Free.ai رو به دوستانت بگو