মুক্ত হাউসা অনুবাদ
AI এর সাহায্যে হাউসা অডিও এবং ভিডিও টেক্সট হিসেবে অনুবাদ করুন। দ্রুত, সঠিক এবং বিনামূল্যে।
কিভাবে কাজ করে
- এই ফোল্ডারে যাও Free.ai ট্রান্সক্রিপ্টার
- আপনার হাউসা অডিও অথবা ভিডিও ফাইল আপলোড করুন
- আমাদের AI স্বয়ংক্রিয়ভাবে হাউসা সনাক্ত করে এবং এটি অনুলিপি
- টেক্সট বা SRT সাবটাইটেল হিসাবে আপনার ট্রান্সক্রিপশন ডাউনলোড করুন
হাউসা অনুবাদ বৈশিষ্ট্য
- ✓faster-whisper দ্বারা চালিত (MIT লাইসেন্সপ্রাপ্ত)
- ✓স্বয়ংক্রিয় হাউসা ভাষা সনাক্তকরণ
- ✓MP3, WAV, MP4, M4A, FLAC এবং আরও সমর্থন করে
- ✓সময়সূচক এবং সাব- টিভি রপ্তানি (SRT)
- ✓পে-পার্সন প্লান-এ ফাইল মাপের সীমা নেই
- ✓ব্যক্তিগত এবং নিরাপদ -- ফাইল প্রক্রিয়াকরণের পরে মুছে ফেলা হয়
ভাষার বিবরণ
| ভাষা | হাউসা |
| আইএসও কোড | ha |
| AI মডেল | faster-whisper |
| মূল্য | মুক্ত |
আরো ভাষা
সব ভাষা দেখাওফ্যাক্টর
হাউসা একটি কম- রিসোর্স ভাষা Whisper জন্য - large- v3- turbo ২৫% শব্দ ভুল হারের উপরে বসেন, মাঝে মাঝে অনেক উপরে। ট্রান্সক্রিপ্ট অনুসন্ধান এবং gist জন্য ব্যবহারযোগ্য কিন্তু প্রকাশনা- প্রস্তুত হিসাবে বিবেচনা করা উচিত নয়। যদি একটি উচ্চতর- সঠিকতা ইঞ্জিন হাউসা জন্য উপলব্ধ হয় আমরা স্বয়ংক্রিয়ভাবে এটিতে ওয়াইড্রো।(বিশেষ স্তর D, over 25% word error rate বেঞ্চমার্ক সেট- আমরা বিজ্ঞাপন দাবী ছাড়াই সৎ ওয়ার স্তর প্রকাশ করি।)
হ্যাঁ - হাউসা অনুবাদ প্রথমে আপনার দৈনিক বিনামূল্যে টোকেন পুল থেকে নেয়। অডিও প্রতি মিনিটে ৫০ টোকেন খরচ করে, তাই বেনামী দৈনিক পুল প্রতিদিন কয়েক ঘণ্টা অডিও পরিবেষ্টিত করে। লগ-ইন অ্যাকাউন্টের জন্য একটি বড় ৩০,০০০-টোকেন দৈনিক পুল পাওয়া যায়। এরপর, অনুবাদ করা হয়, $১ থেকে টোকেন টপ-আপ দিয়ে।
হাউসা ট্রান্সক্রিপশন ভাষার স্বাভাবিক বানান সহ আদর্শ UTF-8-এ ফিরিয়ে আনা হয়।
MP3, WAV, M4A, FLAC, OGG, OPUS এবং WEBM সরাসরি গ্রহণ করা হয়। ভিডিও (MP4, MOV, MKV) এর জন্য আমরা Whisper-এ পাঠানোর আগে সার্ভারের দিকে অডিও ট্র্যাক এক্সট্র্যাক্ট করি - আপনার নিজের কোন কিছু রূপান্তর করার প্রয়োজন নেই। উৎস ভাষার উপর নির্ভর না করে একই পাইপলাইন, হাউসা সহ।
বেনামী আপলোডের সীমা প্রতি ফাইলে প্রায় ৫০০ মেগাবাইট। লগ-ইন অ্যাকাউন্ট ২ জিবি পর্যন্ত যেতে পারে। সময়সীমা কঠিন সীমা নয় - দীর্ঘ ফাইল স্বয়ংক্রিয়ভাবে চূর্ণ করা হয় (৩০ সেকেন্ডের উইন্ডো ওভারলেপ) এবং একটি একক ট্রান্সক্রিপ্ট স্থায়ী সময় স্ট্যাম্পের সাথে পুনরায় স্টাইল করা হয়। বহু ঘণ্টার হাউসা রেকর্ডিং (পডকাস্ট, পূর্ণ লেকচার, সভা) ভাল কাজ করে।
হ্যাঁ - প্রত্যেক হাউসা ট্রান্সক্রিপ্ট- এর জন্য ডিফল্টভাবে স্পিকারের ডায়রিজম সক্রিয় করা হয় । আউটপুটটি স্পিকার ১ / স্পিকার ২ / স্পিকার ৩ হিসাবে সময়ের স্ট্যাম্পের সাথে বিভক্ত করা হয়, তাই সাক্ষাৎকার, প্যানেল আলোচনা এবং বহুপক্ষীয় সভা লেবেলযুক্তভাবে ফিরে আসে । ডায়রিজম একটি আলাদা মডেলে চলতে থাকে এবং আমরা সমর্থন করা সব ভাষার ক্ষেত্রে একইভাবে কাজ করে ।
হ্যাঁ - ইউআরএল /transcribe/youtube/ এ পেস্ট করুন ইউটিউব এর জন্য অথবা /transcribe/podcast/ এ পডকাস্ট ফিডের জন্য (আপেল, স্পটিফাই, আরএসএস)। আমরা অডিও ডাউনলোড করি, Whisper এর মাধ্যমে language=ha এর মাধ্যমে চালিয়ে আনি, এবং সময় স্ট্যাম্প এবং স্পিকার লেবেল সহকারে ট্রান্সক্রিপ্ট ফিরিয়ে আনি। সাধারণ হাউসা বিষয়বস্তু: লেকচার, সাক্ষাৎকার, ভয়েস নোট এবং ইউটিউব কনটেন্ট হাউসা-এ সব কাজ করে - ইউআরএল /transcribe/youtube/-এ পেস্ট করুন অথবা সরাসরি ফাইল আপলোড করুন।
Whisper এর প্রতি মিনিটে অডিও রেকর্ড করার জন্য ৫০ টোকেন খরচ হয়, তাই এক ঘণ্টার রেকর্ডিং এর জন্য খরচ হয় ~৩,০০০ টোকেন। বেশিরভাগ ব্যবহারকারী কিছুই খরচ করেন না - ৩০,০০০ টোকেনের বিনামূল্যের দৈনিক পুল ছোট ক্লিপ, ভয়েস নোট এবং একবার পডকাস্টের জন্য ব্যবহৃত হয়। এর বাইরে, ট্রান্সক্রিপশনের জন্য আপনি যে পরিমাণ অর্থ খরচ করেন, তার উপর ভিত্তি করেই টোকেন টপআপ করা হয়, যার মূল্য ১ ডলার থেকে শুরু হয়।
হ্যাঁ — সেগমেন্ট-স্তর (প্রতি ~১০-৩০ সেকেন্ডে) এবং শব্দ-স্তর উভয় পর্যায়ের সময়সূচক উপস্থিত রয়েছে। VTT/SRT সাবটাইটেল রপ্তানির ক্ষেত্রে শব্দ-স্তর ডিফল্ট, ফলে উপশীর্ষক লাইন-বিশেষে সুসংগত হবে। অনুরোধের মূল অংশে API-তে timestamps="word" নির্ধারণ করুন। হাউসা ট্রান্সক্রিপশন ভাষার স্বাভাবিক বানান সহ আদর্শ UTF-8-এ ফিরিয়ে আনা হয়।
হ্যাঁ। /v1/transcribe/-এ language=ha সহযোগে অডিও (multipart/form-data, field name "file") POST করুন - অথবা Whisper স্বয়ংক্রিয়ভাবে সনাক্ত করার জন্য ভাষা প্যারামিটারটি অগ্রাহ্য করুন। ট্রান্সক্রিপ্ট, সেগমেন্ট, টাইমসটাম্প এবং স্পিকার লেবেল সহ JSON ফিরিয়ে দেয়। /api/-তে সম্পূর্ণ রেফারেন্স এবং SDK স্নিপেট রয়েছে।
হ্যাঁ - অনুবাদ শেষ হলে, অনুবাদ বা /translate/ এ লেখাটি পেস্ট করুন। হাউসা আমাদের সমর্থিত অন্যান্য ভাষার সাথে জুটি বেঁধে কাজ করে (২০০+)। সভায় অংশগ্রহণের জন্য অনুবাদ /summarize/ এর মাধ্যমে পাঠানো উচিত; অনুবাদ করার জন্য এটি /voice/tts/ এ পাঠানো উচিত যাতে লক্ষ্য ভাষায় অডিও প্রদর্শন করা যায়।
Whisper- এর ঝগড়া প্রশিক্ষণ এই স্তরে কম সাহায্য করে - বোতলনেক হচ্ছে হাউসা অডিও Whisper প্রশিক্ষণের সময় দেখেছে, ঝগড়া নয় । পরিষ্কার স্টুডিও অডিও এখনও ঝগড়া অডিওকে জিতেছে, কিন্তু কোনটিও সঠিকতা আপনি একটি উচ্চ- রিসোর্স ভাষায় পেতে যে পেতে হবে পৌঁছবে না ।যদি কোন ট্রান্সক্রিপ্ট ব্যবহারযোগ্য না হয়, তাহলে ফাইলটি নিয়ে contact@free.ai এ ইমেইল করুন - আমরা টোকেন ফিরিয়ে দেব এবং দেখব কোন ভিন্ন ইঞ্জিন আপনার অডিওকে ভালোভাবে পরিচালনা করতে পারে কিনা।