মুক্ত বসনীয় অনুবাদ
AI এর সাহায্যে বসনীয় অডিও এবং ভিডিও টেক্সট হিসেবে অনুবাদ করুন। দ্রুত, সঠিক এবং বিনামূল্যে।
কিভাবে কাজ করে
- এই ফোল্ডারে যাও Free.ai ট্রান্সক্রিপ্টার
- আপনার বসনীয় অডিও অথবা ভিডিও ফাইল আপলোড করুন
- আমাদের AI স্বয়ংক্রিয়ভাবে বসনীয় সনাক্ত করে এবং এটি অনুলিপি
- টেক্সট বা SRT সাবটাইটেল হিসাবে আপনার ট্রান্সক্রিপশন ডাউনলোড করুন
বসনীয় অনুবাদ বৈশিষ্ট্য
- ✓faster-whisper দ্বারা চালিত (MIT লাইসেন্সপ্রাপ্ত)
- ✓স্বয়ংক্রিয় বসনীয় ভাষা সনাক্তকরণ
- ✓MP3, WAV, MP4, M4A, FLAC এবং আরও সমর্থন করে
- ✓সময়সূচক এবং সাব- টিভি রপ্তানি (SRT)
- ✓পে-পার্সন প্লান-এ ফাইল মাপের সীমা নেই
- ✓ব্যক্তিগত এবং নিরাপদ -- ফাইল প্রক্রিয়াকরণের পরে মুছে ফেলা হয়
ভাষার বিবরণ
| ভাষা | বসনীয় |
| আইএসও কোড | bs |
| AI মডেল | faster-whisper |
| মূল্য | মুক্ত |
আরো ভাষা
সব ভাষা দেখাওফ্যাক্টর
বসনীয় একটি কম- রিসোর্স ভাষা Whisper জন্য - large- v3- turbo ২৫% শব্দ ভুল হারের উপরে বসেন, মাঝে মাঝে অনেক উপরে। ট্রান্সক্রিপ্ট অনুসন্ধান এবং gist জন্য ব্যবহারযোগ্য কিন্তু প্রকাশনা- প্রস্তুত হিসাবে বিবেচনা করা উচিত নয়। যদি একটি উচ্চতর- সঠিকতা ইঞ্জিন বসনীয় জন্য উপলব্ধ হয় আমরা স্বয়ংক্রিয়ভাবে এটিতে ওয়াইড্রো।(বিশেষ স্তর D, over 25% word error rate বেঞ্চমার্ক সেট- আমরা বিজ্ঞাপন দাবী ছাড়াই সৎ ওয়ার স্তর প্রকাশ করি।)
হ্যাঁ - বসনীয় অনুবাদ প্রথমে আপনার দৈনিক বিনামূল্যে টোকেন পুল থেকে নেয়। অডিও প্রতি মিনিটে ৫০ টোকেন খরচ করে, তাই বেনামী দৈনিক পুল প্রতিদিন কয়েক ঘণ্টা অডিও পরিবেষ্টিত করে। লগ-ইন অ্যাকাউন্টের জন্য একটি বড় ৩০,০০০-টোকেন দৈনিক পুল পাওয়া যায়। এরপর, অনুবাদ করা হয়, $১ থেকে টোকেন টপ-আপ দিয়ে।
বসনীয় ট্রান্সক্রিপশন ভাষার স্বাভাবিক বানান সহ আদর্শ UTF-8-এ ফিরিয়ে আনা হয়।
MP3, WAV, M4A, FLAC, OGG, OPUS এবং WEBM সরাসরি গ্রহণ করা হয়। ভিডিও (MP4, MOV, MKV) এর জন্য আমরা Whisper-এ পাঠানোর আগে সার্ভারের দিকে অডিও ট্র্যাক এক্সট্র্যাক্ট করি - আপনার নিজের কোন কিছু রূপান্তর করার প্রয়োজন নেই। উৎস ভাষার উপর নির্ভর না করে একই পাইপলাইন, বসনীয় সহ।
বেনামী আপলোডের সীমা প্রতি ফাইলে প্রায় ৫০০ মেগাবাইট। লগ-ইন অ্যাকাউন্ট ২ জিবি পর্যন্ত যেতে পারে। সময়সীমা কঠিন সীমা নয় - দীর্ঘ ফাইল স্বয়ংক্রিয়ভাবে চূর্ণ করা হয় (৩০ সেকেন্ডের উইন্ডো ওভারলেপ) এবং একটি একক ট্রান্সক্রিপ্ট স্থায়ী সময় স্ট্যাম্পের সাথে পুনরায় স্টাইল করা হয়। বহু ঘণ্টার বসনীয় রেকর্ডিং (পডকাস্ট, পূর্ণ লেকচার, সভা) ভাল কাজ করে।
হ্যাঁ - প্রত্যেক বসনীয় ট্রান্সক্রিপ্ট- এর জন্য ডিফল্টভাবে স্পিকারের ডায়রিজম সক্রিয় করা হয় । আউটপুটটি স্পিকার ১ / স্পিকার ২ / স্পিকার ৩ হিসাবে সময়ের স্ট্যাম্পের সাথে বিভক্ত করা হয়, তাই সাক্ষাৎকার, প্যানেল আলোচনা এবং বহুপক্ষীয় সভা লেবেলযুক্তভাবে ফিরে আসে । ডায়রিজম একটি আলাদা মডেলে চলতে থাকে এবং আমরা সমর্থন করা সব ভাষার ক্ষেত্রে একইভাবে কাজ করে ।
হ্যাঁ - ইউআরএল /transcribe/youtube/ এ পেস্ট করুন ইউটিউব এর জন্য অথবা /transcribe/podcast/ এ পডকাস্ট ফিডের জন্য (আপেল, স্পটিফাই, আরএসএস)। আমরা অডিও ডাউনলোড করি, Whisper এর মাধ্যমে language=bs এর মাধ্যমে চালিয়ে আনি, এবং সময় স্ট্যাম্প এবং স্পিকার লেবেল সহকারে ট্রান্সক্রিপ্ট ফিরিয়ে আনি। সাধারণ বসনীয় বিষয়বস্তু: লেকচার, সাক্ষাৎকার, ভয়েস নোট এবং ইউটিউব কনটেন্ট বসনীয়-এ সব কাজ করে - ইউআরএল /transcribe/youtube/-এ পেস্ট করুন অথবা সরাসরি ফাইল আপলোড করুন।
Whisper এর প্রতি মিনিটে অডিও রেকর্ড করার জন্য ৫০ টোকেন খরচ হয়, তাই এক ঘণ্টার রেকর্ডিং এর জন্য খরচ হয় ~৩,০০০ টোকেন। বেশিরভাগ ব্যবহারকারী কিছুই খরচ করেন না - ৩০,০০০ টোকেনের বিনামূল্যের দৈনিক পুল ছোট ক্লিপ, ভয়েস নোট এবং একবার পডকাস্টের জন্য ব্যবহৃত হয়। এর বাইরে, ট্রান্সক্রিপশনের জন্য আপনি যে পরিমাণ অর্থ খরচ করেন, তার উপর ভিত্তি করেই টোকেন টপআপ করা হয়, যার মূল্য ১ ডলার থেকে শুরু হয়।
হ্যাঁ — সেগমেন্ট-স্তর (প্রতি ~১০-৩০ সেকেন্ডে) এবং শব্দ-স্তর উভয় পর্যায়ের সময়সূচক উপস্থিত রয়েছে। VTT/SRT সাবটাইটেল রপ্তানির ক্ষেত্রে শব্দ-স্তর ডিফল্ট, ফলে উপশীর্ষক লাইন-বিশেষে সুসংগত হবে। অনুরোধের মূল অংশে API-তে timestamps="word" নির্ধারণ করুন। বসনীয় ট্রান্সক্রিপশন ভাষার স্বাভাবিক বানান সহ আদর্শ UTF-8-এ ফিরিয়ে আনা হয়।
হ্যাঁ। /v1/transcribe/-এ language=bs সহযোগে অডিও (multipart/form-data, field name "file") POST করুন - অথবা Whisper স্বয়ংক্রিয়ভাবে সনাক্ত করার জন্য ভাষা প্যারামিটারটি অগ্রাহ্য করুন। ট্রান্সক্রিপ্ট, সেগমেন্ট, টাইমসটাম্প এবং স্পিকার লেবেল সহ JSON ফিরিয়ে দেয়। /api/-তে সম্পূর্ণ রেফারেন্স এবং SDK স্নিপেট রয়েছে।
হ্যাঁ - অনুবাদ শেষ হলে, অনুবাদ বা /translate/ এ লেখাটি পেস্ট করুন। বসনীয় আমাদের সমর্থিত অন্যান্য ভাষার সাথে জুটি বেঁধে কাজ করে (২০০+)। সভায় অংশগ্রহণের জন্য অনুবাদ /summarize/ এর মাধ্যমে পাঠানো উচিত; অনুবাদ করার জন্য এটি /voice/tts/ এ পাঠানো উচিত যাতে লক্ষ্য ভাষায় অডিও প্রদর্শন করা যায়।
Whisper- এর ঝগড়া প্রশিক্ষণ এই স্তরে কম সাহায্য করে - বোতলনেক হচ্ছে বসনীয় অডিও Whisper প্রশিক্ষণের সময় দেখেছে, ঝগড়া নয় । পরিষ্কার স্টুডিও অডিও এখনও ঝগড়া অডিওকে জিতেছে, কিন্তু কোনটিও সঠিকতা আপনি একটি উচ্চ- রিসোর্স ভাষায় পেতে যে পেতে হবে পৌঁছবে না ।যদি কোন ট্রান্সক্রিপ্ট ব্যবহারযোগ্য না হয়, তাহলে ফাইলটি নিয়ে contact@free.ai এ ইমেইল করুন - আমরা টোকেন ফিরিয়ে দেব এবং দেখব কোন ভিন্ন ইঞ্জিন আপনার অডিওকে ভালোভাবে পরিচালনা করতে পারে কিনা।