আরবি বিনামূল্যে অনুবাদ

AI ব্যবহার করে আরবি অডিও এবং ভিডিওকে টেক্সটে রূপান্তর করুন। দ্রুত, সঠিক এবং বিনামূল্যে।

কিভাবে কাজ করে

  1. এই ফোল্ডারে যাও Free.ai ট্রান্সক্রিপ্টার
  2. আপনার আরবি অডিও অথবা ভিডিও ফাইল আপলোড করুন
  3. আমাদের AI স্বয়ংক্রিয়ভাবে আরবি সনাক্ত করে এবং এটি অনুলিপি করে
  4. টেক্সট বা SRT সাবটাইটেল হিসাবে আপনার ট্রান্সক্রিপশন ডাউনলোড করুন

আরবি অনুবাদ বৈশিষ্ট্য

  • faster-whisper দ্বারা চালিত (MIT লাইসেন্সপ্রাপ্ত)
  • আরবি ভাষা স্বয়ংক্রিয়ভাবে সনাক্ত করা হবে
  • MP3, WAV, MP4, M4A, FLAC এবং আরও সমর্থন করে
  • সময়সূচক এবং সাব- টিভি রপ্তানি (SRT)
  • পে-পার্সন প্লান-এ ফাইল মাপের সীমা নেই
  • ব্যক্তিগত এবং নিরাপদ -- ফাইল প্রক্রিয়াকরণের পরে মুছে ফেলা হয়

ভাষার বিবরণ

ভাষাআরবি
আইএসও কোডar
AI মডেলfaster-whisper
মূল্যমুক্ত

আরো ভাষা

সব ভাষা দেখাও

ফ্যাক্টর

Whisper large-v3-turbo আরবি সঠিকভাবে পরিচালনা করে — বেঞ্চমার্ক অডিওতে ৭-১৫% শব্দের ভুল হার। নামকরণকৃত বস্তু, সংখ্যা এবং ঘন প্রযুক্তিগত শব্দভাণ্ডারের ক্ষেত্রে মাঝে মাঝে প্রতিস্থাপনের আশা রাখুন; ট্রান্সক্রিপ্টটির বেশিরভাগ অংশ সঠিক হবে।(বিশেষ স্তর B, 7-15% word error rate বেঞ্চমার্ক সেট- আমরা বিজ্ঞাপন দাবী ছাড়াই সৎ ওয়ার স্তর প্রকাশ করি।)

হ্যাঁ — আরবি অনুবাদ প্রথমে আপনার দৈনিক বিনামূল্যে টোকেন পুল থেকে নেওয়া হবে। অডিও প্রতি মিনিটে প্রায় ৫০ টোকেন খরচ করে, তাই বেনামী দৈনিক পুল প্রতিদিন কয়েক ঘন্টা অডিও প্রদান করে। লগ-ইন অ্যাকাউন্টের জন্য একটি বড় ৩০,০০০ টোকেন দৈনিক পুল পাওয়া যায়। এরপর, অনুবাদ $১ থেকে টোকেন টপ-আপ সহযোগে ব্যবহারের সময় অর্থ প্রদান করা হয়।

আরবি ডিফল্টভাবে আধুনিক মানক আরবি (MSA) স্তরে পরিচালিত হয়। মিশরীয়, লেভান্টিন, গালফ এবং মাগরেবি কথোপকথন স্বীকৃত কিন্তু MSA বানান পদ্ধতিতে অনুবাদ করা হয় - উইস্পার রোমানাইজ করে না বা উপভাষা-বিশেষ বানান সংরক্ষণ করে না। পরিষ্কার MSA সংবাদ/লেকচার অডিও জন্য স্তর-বি সঠিকতা আশা করুন; ভারী মাগরেবি বা মিশরীয় কথোপকথন তা নিচে ঠেলে দেয়।

MP3, WAV, M4A, FLAC, OGG, OPUS, এবং WEBM সরাসরি গ্রহণ করা হয়। ভিডিও (MP4, MOV, MKV) এর জন্য আমরা সার্ভার-সাইড অডিও ট্র্যাক এক্সট্র্যাক্ট করি তা উইস্পারে পাঠানোর আগে - আপনার নিজের কোন কিছু রূপান্তর করার প্রয়োজন নেই। উৎস ভাষার উপর নির্ভর না করে একই পাইপলাইন, আরবি সহ।

বেনামী আপলোডের সীমা প্রতি ফাইলে প্রায় ৫০০ মেগাবাইট। লগ-ইন করা অ্যাকাউন্ট ২ জিবি পর্যন্ত যেতে পারে। সময়সীমা কঠিন সীমা নয় - দীর্ঘ ফাইলগুলি স্বয়ংক্রিয়ভাবে চ্যাঙ্ক করা হয় (৩০ সেকেন্ডের উইন্ডোগুলির সাথে ওভারলেপ) এবং একটি একক ট্রান্সক্রিপ্ট হিসাবে পুনরায় স্টাইল করা হয় যা অবিরাম টাইমস্ট্যাম্প সহ। বহু ঘণ্টার আরবি রেকর্ডিং (পডকাস্ট, পূর্ণ লেকচার, সভা) ভালভাবে কাজ করে।

হ্যাঁ — প্রত্যেক আরবি ট্রান্সক্রিপ্ট-এর জন্য ডিফল্টভাবে স্পিকারের ডায়ারিজম সক্রিয় করা হয়। আউটপুটটি স্পিকার ১ / স্পিকার ২ / স্পিকার ৩ হিসাবে ভাগ করা হয় এবং সময়সূচীর সাথে, তাই সাক্ষাৎকার, প্যানেল আলোচনা এবং বহু-পক্ষীয় সভাগুলি লেবেলযুক্তভাবে ফিরে আসে। ডায়ারিজম একটি পৃথক মডেলে চলতে থাকে এবং আমরা সমর্থন করা সমস্ত ভাষার জন্য একইভাবে কাজ করে।

হ্যাঁ - ইউটিউব এর জন্য /transcribe/youtube/ এ ইউআরএল পেস্ট করুন অথবা পডকাস্ট ফিডের জন্য /transcribe/podcast/ এ পেস্ট করুন (অ্যাপল, স্পটিফাই, আরএসএস)। আমরা অডিও ডাউনলোড করি, এটি উইস্পারের মাধ্যমে language=ar এর মাধ্যমে চালানো হয়, এবং টাইমসটাম্প এবং স্পিকার লেবেল সহকারে ট্রান্সক্রিপ্ট ফিরিয়ে দেওয়া হয়। সাধারণ আরবি উপাদান: আরবি-এ সংবাদ ক্লিপ, উপদেশ, বক্তৃতা এবং রাজনৈতিক সাক্ষাৎকার সবচেয়ে সাধারণ কাজের চাপ; ইউটিউব ইউআরএল /transcribe/youtube/-এ পেস্ট করুন অথবা ফাইলটি আপলোড করুন।।

Whisper এর প্রতি মিনিটে অডিও রেকর্ড করার জন্য ৫০ টোকেন খরচ হয়, তাই এক ঘণ্টার রেকর্ডিং এর জন্য খরচ হয় ~৩,০০০ টোকেন। বেশিরভাগ ব্যবহারকারী কিছুই খরচ করেন না - ৩০,০০০ টোকেনের বিনামূল্যের দৈনিক পুল ছোট ক্লিপ, ভয়েস নোট এবং একক পডকাস্টের জন্য ব্যবহৃত হয়। এর বাইরে, অনুবাদ করা হয় ব্যবহারের উপর ভিত্তি করে, $১ থেকে টোকেন টপ-আপ করা যায়।

হ্যাঁ — সেগমেন্ট-স্তর (প্রতি ~১০-৩০ সেকেন্ডে) এবং শব্দ-স্তর উভয় পর্যায়ের সময়সূচক উপস্থিত রয়েছে। VTT/SRT সাবটাইটেল রপ্তানির ক্ষেত্রে শব্দ-স্তর ডিফল্ট, ফলে উপশীর্ষক লাইন-বিশেষে সুসংগত হবে। অনুরোধের মূল অংশে API-তে timestamps="word" নির্ধারণ করুন। আরবি ট্রান্সক্রিপ্ট তাদের স্থানীয় ডান থেকে বামে স্ক্রিপ্ট ফিরে আসে এবং যেকোনো RTL-সচেতন প্রদর্শক (ব্রাউজার, ওয়ার্ড, গুগল ডক্স) সঠিকভাবে প্রদর্শন করে।

হ্যাঁ। /v1/transcribe/-এ language=ar সহযোগে অডিও (মাল্টিপার্শ্ব/ফর্ম-ডাটা, ক্ষেত্র নাম "ফাইল") POST করুন — অথবা Whisper-কে স্বয়ংক্রিয়ভাবে সনাক্ত করতে ভাষা পরামিতিটি অগ্রাহ্য করুন। ট্রান্সক্রিপ্ট, সেগমেন্ট, টাইমসটাম্প এবং স্পিকার লেবেল সহ JSON ফিরিয়ে দেয়। /api/-এ সম্পূর্ণ রেফারেন্স এবং SDK স্নিপেট রয়েছে।

হ্যাঁ — অনুবাদ শেষ হলে, অনুবাদ বাটন ক্লিক করুন অথবা টেক্সটটি /translate/ এ পেস্ট করুন। আরবি আমাদের সমর্থিত অন্যান্য সকল ভাষার সাথে জুটি বেঁধে কাজ করে (২০০+)। সভায় অংশগ্রহণের জন্য অনুবাদ /summarize/ এর মাধ্যমে পাঠানো উচিত; অনুবাদ করার জন্য এটি /voice/tts/ এ পাঠানো উচিত যাতে লক্ষ্য ভাষায় অডিও প্রদর্শন করা যায়।

হুইসপারকে শত হাজার ঘণ্টার বাস্তব অডিও থেকে প্রশিক্ষণ দেয়া হয়েছে, তাই এটি পটভূমির শব্দ এবং আরবি-এ ফোন-গুণমানের রেকর্ডিং সহ্য করে। সর্বোত্তম ফলাফল পেতে পরিষ্কার অডিও (হেডসেট মাইক, কোন সঙ্গীত রুম) প্রদান করুন - এই স্তরে শব্দ বেসলাইন ত্রুটি হারকে বৃদ্ধি করে।যদি কোন ট্রান্সক্রিপ্ট ব্যবহারযোগ্য না হয়, তাহলে ফাইলটি নিয়ে contact@free.ai এ ই-মেইল করুন। আমরা টোকেন ফিরিয়ে দেব এবং দেখব কোন ভিন্ন ইঞ্জিন আপনার অডিওকে ভালোভাবে পরিচালনা করতে পারে কিনা।

Free.ai ভালোবাসো?

এই পাতাটি রেটিং দিন