মুক্ত তাগালগ অনুবাদ

AI এর সাহায্যে তাগালগ অডিও এবং ভিডিও টেক্সট হিসেবে অনুবাদ করুন। দ্রুত, সঠিক এবং বিনামূল্যে।

কিভাবে কাজ করে

  1. এই ফোল্ডারে যাও Free.ai ট্রান্সক্রিপ্টার
  2. আপনার তাগালগ অডিও অথবা ভিডিও ফাইল আপলোড করুন
  3. আমাদের AI স্বয়ংক্রিয়ভাবে তাগালগ সনাক্ত করে এবং এটি অনুলিপি
  4. টেক্সট বা SRT সাবটাইটেল হিসাবে আপনার ট্রান্সক্রিপশন ডাউনলোড করুন

তাগালগ অনুবাদ বৈশিষ্ট্য

  • ✓faster-whisper দ্বারা চালিত (MIT লাইসেন্সপ্রাপ্ত)
  • ✓স্বয়ংক্রিয় তাগালগ ভাষা সনাক্তকরণ
  • ✓MP3, WAV, MP4, M4A, FLAC এবং আরও সমর্থন করে
  • ✓সময়সূচক এবং সাব- টিভি রপ্তানি (SRT)
  • ✓পে-পার্সন প্লান-এ ফাইল মাপের সীমা নেই
  • ✓ব্যক্তিগত এবং নিরাপদ -- ফাইল প্রক্রিয়াকরণের পরে মুছে ফেলা হয়

ভাষার বিবরণ

ভাষাতাগালগ
আইএসও কোডtl
AI মডেলfaster-whisper
মূল্যমুক্ত

আরো ভাষা

সব ভাষা দেখাও

ফ্যাক্টর

তাগালগ একটি মধ্য- রিসোর্স ভাষা Whisper জন্য - বড়- v3- টারবাইন ভূমি ১৫-২৫% শব্দ ভুল হার ব্যান্ডে। ট্রান্সক্রিপ্ট এর গতি বিশ্বাসযোগ্য; আশা করা হচ্ছে নাম- entity ভুল, মাঝে মাঝে কোড- পরিবর্তন গ্লিচ, এবং short- utterance misfires। প্রকাশনা- গুণমান আউটপুট জন্য একটি মানব পাস পরিকল্পনা করুন।(বিশেষ স্তর C, 15-25% word error rate বেঞ্চমার্ক সেট- আমরা বিজ্ঞাপন দাবী ছাড়াই সৎ ওয়ার স্তর প্রকাশ করি।)

হ্যাঁ - তাগালগ অনুবাদ প্রথমে আপনার দৈনিক বিনামূল্যে টোকেন পুল থেকে নেয়। অডিও প্রতি মিনিটে ৫০ টোকেন খরচ করে, তাই বেনামী দৈনিক পুল প্রতিদিন কয়েক ঘণ্টা অডিও পরিবেষ্টিত করে। লগ-ইন অ্যাকাউন্টের জন্য একটি বড় ৩০,০০০-টোকেন দৈনিক পুল পাওয়া যায়। এরপর, অনুবাদ করা হয়, $১ থেকে টোকেন টপ-আপ দিয়ে।

তাগালগ ট্রান্সক্রিপশন ভাষার স্বাভাবিক বানান সহ আদর্শ UTF-8-এ ফিরিয়ে আনা হয়।

MP3, WAV, M4A, FLAC, OGG, OPUS এবং WEBM সরাসরি গ্রহণ করা হয়। ভিডিও (MP4, MOV, MKV) এর জন্য আমরা Whisper-এ পাঠানোর আগে সার্ভারের দিকে অডিও ট্র্যাক এক্সট্র্যাক্ট করি - আপনার নিজের কোন কিছু রূপান্তর করার প্রয়োজন নেই। উৎস ভাষার উপর নির্ভর না করে একই পাইপলাইন, তাগালগ সহ।

বেনামী আপলোডের সীমা প্রতি ফাইলে প্রায় ৫০০ মেগাবাইট। লগ-ইন অ্যাকাউন্ট ২ জিবি পর্যন্ত যেতে পারে। সময়সীমা কঠিন সীমা নয় - দীর্ঘ ফাইল স্বয়ংক্রিয়ভাবে চূর্ণ করা হয় (৩০ সেকেন্ডের উইন্ডো ওভারলেপ) এবং একটি একক ট্রান্সক্রিপ্ট স্থায়ী সময় স্ট্যাম্পের সাথে পুনরায় স্টাইল করা হয়। বহু ঘণ্টার তাগালগ রেকর্ডিং (পডকাস্ট, পূর্ণ লেকচার, সভা) ভাল কাজ করে।

হ্যাঁ - প্রত্যেক তাগালগ ট্রান্সক্রিপ্ট- এর জন্য ডিফল্টভাবে স্পিকারের ডায়রিজম সক্রিয় করা হয় । আউটপুটটি স্পিকার ১ / স্পিকার ২ / স্পিকার ৩ হিসাবে সময়ের স্ট্যাম্পের সাথে বিভক্ত করা হয়, তাই সাক্ষাৎকার, প্যানেল আলোচনা এবং বহুপক্ষীয় সভা লেবেলযুক্তভাবে ফিরে আসে । ডায়রিজম একটি আলাদা মডেলে চলতে থাকে এবং আমরা সমর্থন করা সব ভাষার ক্ষেত্রে একইভাবে কাজ করে ।

হ্যাঁ - ইউআরএল /transcribe/youtube/ এ পেস্ট করুন ইউটিউব এর জন্য অথবা /transcribe/podcast/ এ পডকাস্ট ফিডের জন্য (আপেল, স্পটিফাই, আরএসএস)। আমরা অডিও ডাউনলোড করি, Whisper এর মাধ্যমে language=tl এর মাধ্যমে চালিয়ে আনি, এবং সময় স্ট্যাম্প এবং স্পিকার লেবেল সহকারে ট্রান্সক্রিপ্ট ফিরিয়ে আনি। সাধারণ তাগালগ বিষয়বস্তু: হোয়াটসঅ্যাপ ভয়েস নোট, ইউটিউব ভলোগ এবং সংক্ষিপ্ত ভিডিও সবচেয়ে সাধারণ তাগালগ কাজের চাপ - ইউআরএল /transcribe/youtube/ এ পেস্ট করুন অথবা সরাসরি অডিও আপলোড করুন।

Whisper এর প্রতি মিনিটে অডিও রেকর্ড করার জন্য ৫০ টোকেন খরচ হয়, তাই এক ঘণ্টার রেকর্ডিং এর জন্য খরচ হয় ~৩,০০০ টোকেন। বেশিরভাগ ব্যবহারকারী কিছুই খরচ করেন না - ৩০,০০০ টোকেনের বিনামূল্যের দৈনিক পুল ছোট ক্লিপ, ভয়েস নোট এবং একবার পডকাস্টের জন্য ব্যবহৃত হয়। এর বাইরে, ট্রান্সক্রিপশনের জন্য আপনি যে পরিমাণ অর্থ খরচ করেন, তার উপর ভিত্তি করেই টোকেন টপআপ করা হয়, যার মূল্য ১ ডলার থেকে শুরু হয়।

হ্যাঁ — সেগমেন্ট-স্তর (প্রতি ~১০-৩০ সেকেন্ডে) এবং শব্দ-স্তর উভয় পর্যায়ের সময়সূচক উপস্থিত রয়েছে। VTT/SRT সাবটাইটেল রপ্তানির ক্ষেত্রে শব্দ-স্তর ডিফল্ট, ফলে উপশীর্ষক লাইন-বিশেষে সুসংগত হবে। অনুরোধের মূল অংশে API-তে timestamps="word" নির্ধারণ করুন। তাগালগ ট্রান্সক্রিপশন ভাষার স্বাভাবিক বানান সহ আদর্শ UTF-8-এ ফিরিয়ে আনা হয়।

হ্যাঁ। /v1/transcribe/-এ language=tl সহযোগে অডিও (multipart/form-data, field name "file") POST করুন - অথবা Whisper স্বয়ংক্রিয়ভাবে সনাক্ত করার জন্য ভাষা প্যারামিটারটি অগ্রাহ্য করুন। ট্রান্সক্রিপ্ট, সেগমেন্ট, টাইমসটাম্প এবং স্পিকার লেবেল সহ JSON ফিরিয়ে দেয়। /api/-তে সম্পূর্ণ রেফারেন্স এবং SDK স্নিপেট রয়েছে।

হ্যাঁ - অনুবাদ শেষ হলে, অনুবাদ বা /translate/ এ লেখাটি পেস্ট করুন। তাগালগ আমাদের সমর্থিত অন্যান্য ভাষার সাথে জুটি বেঁধে কাজ করে (২০০+)। সভায় অংশগ্রহণের জন্য অনুবাদ /summarize/ এর মাধ্যমে পাঠানো উচিত; অনুবাদ করার জন্য এটি /voice/tts/ এ পাঠানো উচিত যাতে লক্ষ্য ভাষায় অডিও প্রদর্শন করা যায়।

Whisper এর ঝামেলা নির্ভরতা এখনও তাগালগ এর উপর প্রযোজ্য, কিন্তু এই সঠিকতা স্তরে যেকোন অতিরিক্ত ঝামেলা বেসলাইন ত্রুটি হারকে গঠন করে। পরিষ্কার হেডসেট অডিও ফোন বা ল্যাপটপ-মাইক রেকর্ডিং এর চেয়ে উল্লেখযোগ্যভাবে ভাল ফলাফল প্রদান করে।যদি কোন ট্রান্সক্রিপ্ট ব্যবহারযোগ্য না হয়, তাহলে ফাইলটি নিয়ে contact@free.ai এ ইমেইল করুন - আমরা টোকেন ফিরিয়ে দেব এবং দেখব কোন ভিন্ন ইঞ্জিন আপনার অডিওকে ভালোভাবে পরিচালনা করতে পারে কিনা।

Free.ai ভালোবাসো?

এই পাতাটি রেটিং দিন