এআই ভিডিও অনুবাদক

বাণিজ্যিক ব্যবহার ঠিক আছে ৩৮০+ মডেল কোন ওয়াটারমার্ক নেই কোন সাইন-আপ প্রয়োজন নেই
মডেল:
+ GPT-5, Claude, Gemini
Repost your YouTube in Spanish, Hindi, French — with your face actually saying the words. Upload a video, pick a target language + voice, and we transcribe, translate, re-voice, and mix the new audio back into the original clip. Toggle lip-sync to also re-render the mouth.

আপনার ভিডিও এখানে টেনে নিয়ে যান অথবা ব্রাউজ করতে ক্লিক করুন

এমপি৪, এমওভি, ওয়েবএম ১০০ মেগাবাইট পর্যন্ত · ৫ মিনিটের কম সময়ের ক্লিপ দ্রুততম কাজ করে

· ·
~1,500 টোকেন প্রতি মিনিট ভিডিও (অডিও পাথ) · ~3,000/min লিপ-সিনক সহ।
ভিডিও থেকে অডিও এক্সট্র্যাক্ট করা হচ্ছে...
অনুবাদকৃত ভিডিও প্রস্তুত
Show transcript + translation
মূল (অনুবাদিত)

                    
অনুবাদ করা হয়েছে

                    
ডাউনলোড MP4

যেখানে ভিডিও অনুবাদক মূল্য পরিশোধ করে

ইউটিউব সারা বিশ্বে পুনরায় পোস্ট করেছে

একটি ইংরেজি আপলোড → স্প্যানিশ, হিন্দি, ফরাসি, পর্তুগিজ, ইন্দোনেশিয়ান ভাষায় প্রতিটি ভাষায় কথা বলা ব্যক্তির কণ্ঠস্বর সহ পুনরায় আপলোড করা।

স্থানীয় কোর্স

অনলাইন শিক্ষাবিদরা এক রাতে ৫০ টি ভিডিও কোর্স ১০ টি ভাষায় অনুবাদ করে। লিপ-সিনক অপশনটি কথা বলা মাথার অংশগুলোকে উপশীর্ষক না করে স্থানীয় মনে করে।

বিজ্ঞাপন স্থানীয়করণ

একই প্রডাক্টের সাক্ষ্যপ্রমাণ ১০টি দেশভিত্তিক বিজ্ঞাপন অ্যাকাউন্টে প্রচার করা হচ্ছে। একই অভিনেতা, একই শ্যুটিং, প্রতিটি বাজারে একই ভাষার অডিও - পুনরায় শ্যুটিং না করে।

ভিডিও অনুবাদক কিভাবে কাজ করে

১ম ধাপ

অডিও এক্সট্র্যাক্ট করুন

সার্ভার-সাইড ffmpeg আপলোড করা ফাইল থেকে একটি পরিষ্কার MP3 ট্র্যাক বের করে। দ্রুত — API VPS-এ চলবে।

২য় ধাপ

অনুলিপি

Whisper স্বয়ংক্রিয় ভাষা সনাক্তকরণ সহযোগে অডিওকে টেক্সটে রূপান্তর করে। ৯৯টি ভাষার সমর্থন বাক্স থেকে বের করে।

৩য় ধাপ

Translate + re-voice

মাডলাড লক্ষ্য ভাষায় অনুবাদ করে; কোকোরো ১৭৪টি ভাষার মধ্যে থেকে আপনার পছন্দের ভাষায় তা বলবে।

৪র্থ ধাপ

Mix back + (optional) lip-sync

ffmpeg মূল অডিওটি নতুন ট্র্যাক দ্বারা প্রতিস্থাপন করে। লিপ-সিনক সক্রিয় হলে, Sync Lipsync v2 মুখের মিল অনুসারে পুনরায় রেন্ডার করে।

পরিষ্কার অনুবাদ ভিডিও তৈরির জন্য কিছু টিপস

  • একক সামনের দিকে মুখ করে স্পিকার. বহু স্পিকার দৃশ্য ট্রান্সক্রিপ্ট এবং লিপ-সিনক উভয়ই ভুলে যায়।
  • -6 dB-এ অডিও পরিষ্কার করুন। পটভূমির সঙ্গীত বা শব্দের কারণে অনুবাদ সঠিকতা কমে যায়।
  • ৫ মিনিটের কম সময়ের ক্লিপ ২-৫ মিনিটে (অডিও পাথ) অথবা ৫-১৫ মিনিটে (লিপ-সিনক সহ) প্রদর্শন করা হবে।
  • স্প্যানিশ, ফরাসি, জার্মান, পর্তুগিজ, ইতালিয়ান সবচেয়ে স্বাভাবিক কোকোরো শব্দের অপশন আছে। হিন্দি, আরবি, জাপানি, কোরীয়, চীনাও কাজ করে।
অগ্রসর অপশন
ফলাফল
টোকেন কমে যাচ্ছে। আরো ট্যাব পাওয়া যাচ্ছে না
ভাল ফলাফল চান? প্রাইম মডেল (GPT-5, Claude, Gemini) উচ্চমানের প্রদান করে। পরিকল্পনা প্রদর্শন করো

❤️ Free.ai ভালোবাসো?

সাবস্ক্রাইব করুন একটি রিফারেন্স লিংক পেতে এবং প্রতি বন্ধুর জন্য ২৫,০০০ টোকেন অর্জন করতে।

আরো চাও? ৩০K টোকেন/দিন + ১০K বোনাস এর জন্য বিনামূল্যে নিবন্ধন করুন
নিবন্ধন করুন

আপনার অনুরোধ প্রসেস করা হচ্ছে...

আপনার ইউটিউব স্প্যানিশ, হিন্দি, ফরাসি ভাষায় পুনরায় পোস্ট করুন - লক্ষ্য ভাষায় বক্তার কন্ঠ সহ। হুইস্পার অনুবাদ করে, মাডলাড অনুবাদ করে, কোকোরো পুনরায় কণ্ঠ দেয়, এফএমপিইজি মিক্স করে। বৈকল্পিক সিঙ্ক লিপসিঙ্ক v2 মুখের পুনরায় রেন্ডার করে।

ব্যবহারের নিয়ম এআই ভিডিও অনুবাদক

1
আপনার ইনপুট লিখুন

টেক্সট টাইপ করুন, একটি ফাইল আপলোড করুন, অথবা আপনি যা চান তা বর্ণনা করুন। কোন অ্যাকাউন্টের প্রয়োজন নেই।

2
ক্লিক করে তৈরি করুন

আমাদের এআই সেকেন্ডের মধ্যেই আপনার আবেদনের প্রক্রিয়া সম্পন্ন করে, সে জন্য সেরা উন্মুক্ত উৎস মডেল ব্যবহার করে।

3
ডাউনলোড এবং শেয়ার

আপনার ফলাফল ডাউনলোড, অনুলিপি অথবা শেয়ার করুন। ব্যক্তিগত এবং বাণিজ্যিক ব্যবহারের জন্য বিনামূল্যে।

API-র মাধ্যমে এই টুলটি ব্যবহার করুন

আপনার নিজের কোড থেকে এই টুলটি স্বয়ংক্রিয় করুন। OpenAI-সমর্থিত REST এন্ডপয়েন্ট, Bearer-token auth, কোন অতিরিক্ত SDK প্রয়োজন নেই। টোকেন খরচ ওয়েব ইন্টারফেসের সাথে মিলবে।

curl -X POST https://api.free.ai/v1/video/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"prompt": "A cat playing piano", "duration": 4}'

এআই ভিডিও অনুবাদক — FAQ

যে কোন ভিডিও আপলোড করুন (ইউটিউব ভিডিও, একটি কোর্স লেকচার, একটি পণ্যের সাক্ষ্য) এবং আমরা তা লক্ষ্য ভাষায় অনুবাদ করব, যে ভাষায় বক্তার কন্ঠ পুনরায় সংশ্লেষিত হবে। ইচ্ছা করলে লিপ-সিনক মুখের পুনরায় রূপান্তর করবে যাতে তা নতুন শব্দের সাথে মিলবে।

পাঁচটি ধাপ ক্লায়েন্ট-পাশে ক্রমানুসারে চলবে: (১) ffmpeg ভিডিও থেকে একটি পরিষ্কার MP3 এক্সট্র্যাক্ট করবে, (২) Whisper এটি অনুবাদ করবে (৯৯টি ভাষা স্বয়ংক্রিয়ভাবে সনাক্ত করবে), (৩) MadLAD টেক্সট অনুবাদ করবে, (৪) Kokoro আপনার নির্বাচিত কন্ঠে অনুবাদটি বলবে, (৫) ffmpeg নতুন অডিওটিকে মূল ভিডিওতে মিশিয়ে দেবে, মূল ট্র্যাকটি প্রতিস্থাপন করবে। লিপ-সিনক সক্রিয় থাকলে, ষষ্ঠ ধাপটি ফলাফলটি Sync Lipsync v2 এর মাধ্যমে মুখটি পুনরায় রেন্ডার করতে পাঠায়।

ভিডিও ডাবিং সবসময় পুরো লিপ-সিনক পাইপলাইন চালায় - এটাই প্রাইম, পরিচয় সংরক্ষণের অপশন। ভিডিও অনুবাদক লিপ-সিনককে অটো-ইন করে: ৩ গুণ দ্রুত, ~৫০% সস্তা চালনার জন্য এটি ছেড়ে দিন যা ভয়েস-অভার-স্টাইলের বিষয়বস্তুতে চমৎকার যেখানে মুখের সাথে পূর্ণ সমন্বয় গুরুত্বপূর্ণ নয় (পডকাস্ট, পর্দা রেকর্ডিং, রান্নার ভিডিও, যে কোন কিছু যেখানে বক্তা সব সময় কাছে থেকে দেখা হয় না)।

শুধুমাত্র অডিও পাথ প্রায় সম্পূর্ণরূপে স্ব-হোস্টকৃত মডেল (ffmpeg + Whisper + MadLAD + Kokoro)-এ চলছে, তাই এটি আপনার ছোট ক্লিপগুলির জন্য দৈনিক টোকেন অনুমোদনের মধ্যে পড়ে। লিপ-সিনক প্রাইম সিঙ্ক লিপসিনক v2 মডেল ব্যবহার করে এবং ক্রয়কৃত টোকেন প্রয়োজন। অনুমান: অডিও পাথের জন্য প্রতি মিনিটে ভিডিওতে ~১,৫০০ টোকেন, লিপ-সিনকের সাথে ~৩,০০০/মিনিট।

ড্রপডাউন ২০টি উচ্চ চাহিদার ভাষা (স্পেনীয়, ফরাসি, জার্মান, ইতালীয়, পর্তুগিজ, ডাচ, পোলিশ, রুশ, তুর্কি, আরবি, হিব্রু, হিন্দি, চীনা, জাপানি, কোরিয়ান, ভিয়েতনামি, ইন্দোনেশিয়ান, থাই, সুইডিশ, ইংরেজি) প্রকাশ করে।

হ্যাঁ — শব্দ নির্বাচনকারী ৩৭টি ভাষার ১৭৪টি কোকোরো শব্দ তুলে নেয়। প্রতিটি শব্দের সাথে একটি নমুনা ট্যাগ করা হয় যাতে আপনি কমিশন করার আগে সেগুলোর অডিশন করতে পারেন। সবচেয়ে স্বাভাবিক ফলাফল পেতে শব্দের লিঙ্গের সাথে কথা বলা ব্যক্তির লিঙ্গের মিল রাখুন।

না - কোকোরো ১৭৪ টি স্টক কন্ঠ থেকে বেছে নেয়, মূল স্পিকারের ক্লোন নয়। পরিচয় সংরক্ষণের জন্যে প্রথমে স্পিকারের কন্ঠ ধারণ করার জন্য আমাদের /voice/clone/ টুল চালিয়ে নিন, তারপর একটি স্বনির্ধারিত ওয়ার্কফ্লো ব্যবহার করুন। একটি পাইপলাইনে কন্ঠ ক্লোন + স্বয়ংক্রিয় অনুবাদ হচ্ছে রোডম্যাপ।

১০০ মেগাবাইট পর্যন্ত ক্লিপ ভালভাবে প্রসেস করা হয়। অডিও পাথের জন্য ৫ মিনিটের নিচে রেন্ডার করা হলে ২-৫ মিনিটে, লিপ-সিনক ব্যবহার করলে ৫-১৫ মিনিটে প্রসেস করা হয়। দীর্ঘ ভিডিও হলে, দৃশ্যে বিভক্ত করে, প্রত্যেকটিকে অনুবাদ করে, এবং /video/editor/ এ পুনরায় সংযুক্ত করুন।

MP4, MOV, WebM, MKV ১০০ মেগাবাইট পর্যন্ত। একক সামনের দিকে মুখ করা স্পিকার সবচেয়ে পরিষ্কার অনুবাদ এবং (যদি আপনি এটি সক্রিয় করেন) সবচেয়ে ভাল লিপ-সিনক প্রদান করে। পটভূমির সঙ্গীত বা একাধিক স্পিকার অনুবাদ সঠিকতা কমায়।

এআই ভিডিও অনুবাদক দ্বারা নয় — এটি অডিও প্রতিস্থাপন করে, দৃশ্যমান নয়। ভিডিওতে অনুবাদ সাবটাইটেল বার্ন করতে, ফলাফলটিতে আমাদের /video/caption/ টুল চালানো হবে। একটি SRT/VTT সাবটাইটেল ফাইল রপ্তানি করতে, মূল ভিডিওতে /transcribe/ ব্যবহার করুন।

না। আপলোড করা ফাইলগুলো রেন্ডার করার কয়েক মিনিটের মধ্যে মুছে ফেলা হয়। আউটপুটটি আমাদের সিডিএন-এ ২৪ ঘণ্টার জন্য (পেইড ব্যবহারকারীদের জন্য ৭ দিন) শেয়ার লিঙ্কে থাকে, তারপর তা মুছে ফেলা হয়।

একক শেষ বিন্দু হিসেবে নয় — বর্তমানে বিদ্যমান লাইভগুলোকে চেইন করুন: POST /v1/video/to-audio/ → /v1/stt/ → /v1/translate/ → /v1/tts/ → /v1/video/add-audio/, তারপর ইচ্ছাকৃতভাবে /v1/video/lip-sync/। প্রতিটি জন্য পূর্ণ কার্ল রেসিপি /api/ এ। ফরোয়ার্ড এই সঠিক চেইনটি পরিচালনা করে।

১০,০০০ টোকেন এর জন্য বিনামূল্যে নিবন্ধন করুন

ফ্রি অ্যাকাউন্ট তৈরি করুন

কোন ক্রেডিট কার্ডের প্রয়োজন নেই

আপনি কিভাবে এই টুলটি রেটিং করবেন?

Free.ai ভালোবাসো?