চীনা বিনামূল্যে অনুবাদ
AI ব্যবহার করে চীনা অডিও এবং ভিডিওকে টেক্সটে রূপান্তর করুন। দ্রুত, সঠিক এবং বিনামূল্যে।
কিভাবে কাজ করে
- এই ফোল্ডারে যাও Free.ai ট্রান্সক্রিপ্টার
- আপনার চীনা অডিও অথবা ভিডিও ফাইল আপলোড করুন
- আমাদের AI স্বয়ংক্রিয়ভাবে চীনা সনাক্ত করে এবং এটি অনুলিপি করে
- টেক্সট বা SRT সাবটাইটেল হিসাবে আপনার ট্রান্সক্রিপশন ডাউনলোড করুন
চীনা অনুবাদ বৈশিষ্ট্য
- ✓faster-whisper দ্বারা চালিত (MIT লাইসেন্সপ্রাপ্ত)
- ✓চীনা ভাষা স্বয়ংক্রিয়ভাবে সনাক্ত করা হবে
- ✓MP3, WAV, MP4, M4A, FLAC এবং আরও সমর্থন করে
- ✓সময়সূচক এবং সাব- টিভি রপ্তানি (SRT)
- ✓পে-পার্সন প্লান-এ ফাইল মাপের সীমা নেই
- ✓ব্যক্তিগত এবং নিরাপদ -- ফাইল প্রক্রিয়াকরণের পরে মুছে ফেলা হয়
ভাষার বিবরণ
| ভাষা | চীনা |
| আইএসও কোড | zh |
| AI মডেল | faster-whisper |
| মূল্য | মুক্ত |
আরো ভাষা
সব ভাষা দেখাওফ্যাক্টর
উইস্পার লম্বা-v3-টর্বো তার সর্বোচ্চ সঠিকতা স্তরে চীনা এ পৌঁছেছে - প্রমিত বেঞ্চমার্কে ৭% শব্দের ভুল হারের নিচে। বাস্তবে এর অর্থ হল পরিষ্কার স্টুডিও অডিও প্রায়-পরিপূর্ণভাবে ফিরে আসে, এবং কথোপকথন অডিও ব্যবহারযোগ্য নগণ্য পরিষ্কারের সাথে।(বিশেষ স্তর A, under 7% word error rate বেঞ্চমার্ক সেট- আমরা বিজ্ঞাপন দাবী ছাড়াই সৎ ওয়ার স্তর প্রকাশ করি।)
হ্যাঁ — চীনা অনুবাদ প্রথমে আপনার দৈনিক বিনামূল্যে টোকেন পুল থেকে নেওয়া হবে। অডিও প্রতি মিনিটে প্রায় ৫০ টোকেন খরচ করে, তাই বেনামী দৈনিক পুল প্রতিদিন কয়েক ঘন্টা অডিও প্রদান করে। লগ-ইন অ্যাকাউন্টের জন্য একটি বড় ৩০,০০০ টোকেন দৈনিক পুল পাওয়া যায়। এরপর, অনুবাদ $১ থেকে টোকেন টপ-আপ সহযোগে ব্যবহারের সময় অর্থ প্রদান করা হয়।
মান্ডারিনের জন্য language=zh প্রদান করুন (ডিফল্ট — উৎসের উপর নির্ভর করে সরল অথবা ঐতিহ্যবাহী আউটপুট)। কান্টোনিজ ভাষার জন্য language=yue ব্যবহার করুন যদি আপনার অডিও হংকং / গুয়াংজু ভাষার হয়; কান্টোনিজ ভাষাকে zh হিসাবে অনুবাদ করলে মান্ডারিন-অক্ষরবিন্যাসের অনুমান পাওয়া যাবে যা টোন এবং বানান হারিয়ে ফেলবে।
MP3, WAV, M4A, FLAC, OGG, OPUS, এবং WEBM সরাসরি গ্রহণ করা হয়। ভিডিও (MP4, MOV, MKV) এর জন্য আমরা সার্ভার-সাইড অডিও ট্র্যাক এক্সট্র্যাক্ট করি তা উইস্পারে পাঠানোর আগে - আপনার নিজের কোন কিছু রূপান্তর করার প্রয়োজন নেই। উৎস ভাষার উপর নির্ভর না করে একই পাইপলাইন, চীনা সহ।
বেনামী আপলোডের সীমা প্রতি ফাইলে প্রায় ৫০০ মেগাবাইট। লগ-ইন করা অ্যাকাউন্ট ২ জিবি পর্যন্ত যেতে পারে। সময়সীমা কঠিন সীমা নয় - দীর্ঘ ফাইলগুলি স্বয়ংক্রিয়ভাবে চ্যাঙ্ক করা হয় (৩০ সেকেন্ডের উইন্ডোগুলির সাথে ওভারলেপ) এবং একটি একক ট্রান্সক্রিপ্ট হিসাবে পুনরায় স্টাইল করা হয় যা অবিরাম টাইমস্ট্যাম্প সহ। বহু ঘণ্টার চীনা রেকর্ডিং (পডকাস্ট, পূর্ণ লেকচার, সভা) ভালভাবে কাজ করে।
হ্যাঁ — প্রত্যেক চীনা ট্রান্সক্রিপ্ট-এর জন্য ডিফল্টভাবে স্পিকারের ডায়ারিজম সক্রিয় করা হয়। আউটপুটটি স্পিকার ১ / স্পিকার ২ / স্পিকার ৩ হিসাবে ভাগ করা হয় এবং সময়সূচীর সাথে, তাই সাক্ষাৎকার, প্যানেল আলোচনা এবং বহু-পক্ষীয় সভাগুলি লেবেলযুক্তভাবে ফিরে আসে। ডায়ারিজম একটি পৃথক মডেলে চলতে থাকে এবং আমরা সমর্থন করা সমস্ত ভাষার জন্য একইভাবে কাজ করে।
হ্যাঁ - ইউটিউব এর জন্য /transcribe/youtube/ এ ইউআরএল পেস্ট করুন অথবা পডকাস্ট ফিডের জন্য /transcribe/podcast/ এ পেস্ট করুন (অ্যাপল, স্পটিফাই, আরএসএস)। আমরা অডিও ডাউনলোড করি, এটি উইস্পারের মাধ্যমে language=zh এর মাধ্যমে চালানো হয়, এবং টাইমসটাম্প এবং স্পিকার লেবেল সহকারে ট্রান্সক্রিপ্ট ফিরিয়ে দেওয়া হয়। সাধারণ চীনা উপাদান: পডকাস্ট, বক্তৃতা, সাক্ষাৎকার এবং দীর্ঘ ইউটিউব কনটেন্ট চীনা-এ আমরা সবচেয়ে বেশি দেখতে পাই।।
Whisper এর প্রতি মিনিটে অডিও রেকর্ড করার জন্য ৫০ টোকেন খরচ হয়, তাই এক ঘণ্টার রেকর্ডিং এর জন্য খরচ হয় ~৩,০০০ টোকেন। বেশিরভাগ ব্যবহারকারী কিছুই খরচ করেন না - ৩০,০০০ টোকেনের বিনামূল্যের দৈনিক পুল ছোট ক্লিপ, ভয়েস নোট এবং একক পডকাস্টের জন্য ব্যবহৃত হয়। এর বাইরে, অনুবাদ করা হয় ব্যবহারের উপর ভিত্তি করে, $১ থেকে টোকেন টপ-আপ করা যায়।
হ্যাঁ — সেগমেন্ট-স্তর (প্রতি ~১০-৩০ সেকেন্ডে) এবং শব্দ-স্তর উভয় পর্যায়ের সময়সূচক উপস্থিত রয়েছে। VTT/SRT সাবটাইটেল রপ্তানির ক্ষেত্রে শব্দ-স্তর ডিফল্ট, ফলে উপশীর্ষক লাইন-বিশেষে সুসংগত হবে। অনুরোধের মূল অংশে API-তে timestamps="word" নির্ধারণ করুন। চীনা ট্রান্সক্রিপশনগুলি স্থানীয় Han অক্ষর (UTF-8) দ্বারা ফিরিয়ে দেওয়া হবে - সরল অথবা ঐতিহ্যগত, উৎস অডিও এবং ISO কোডের উপর নির্ভর করে।
হ্যাঁ। /v1/transcribe/-এ language=zh সহযোগে অডিও (মাল্টিপার্শ্ব/ফর্ম-ডাটা, ক্ষেত্র নাম "ফাইল") POST করুন — অথবা Whisper-কে স্বয়ংক্রিয়ভাবে সনাক্ত করতে ভাষা পরামিতিটি অগ্রাহ্য করুন। ট্রান্সক্রিপ্ট, সেগমেন্ট, টাইমসটাম্প এবং স্পিকার লেবেল সহ JSON ফিরিয়ে দেয়। /api/-এ সম্পূর্ণ রেফারেন্স এবং SDK স্নিপেট রয়েছে।
হ্যাঁ — অনুবাদ শেষ হলে, অনুবাদ বাটন ক্লিক করুন অথবা টেক্সটটি /translate/ এ পেস্ট করুন। চীনা আমাদের সমর্থিত অন্যান্য সকল ভাষার সাথে জুটি বেঁধে কাজ করে (২০০+)। সভায় অংশগ্রহণের জন্য অনুবাদ /summarize/ এর মাধ্যমে পাঠানো উচিত; অনুবাদ করার জন্য এটি /voice/tts/ এ পাঠানো উচিত যাতে লক্ষ্য ভাষায় অডিও প্রদর্শন করা যায়।
Whisper-কে ৬৮০K ঘণ্টার বাস্তব বিশ্বের শব্দের উপর প্রশিক্ষণ দেয়া হয়েছে, তাই চীনা অনুবাদ পটভূমির শব্দ, সঙ্গীতের বেড এবং ফোনের গুণগত রেকর্ডের জন্য মজবুত। গুরুতর ক্লিপিং বা একাধিক ওভারল্যাপিং স্পিকার সঠিকতাকে ক্ষতিগ্রস্ত করবে।যদি কোন ট্রান্সক্রিপ্ট ব্যবহারযোগ্য না হয়, তাহলে ফাইলটি নিয়ে contact@free.ai এ ই-মেইল করুন। আমরা টোকেন ফিরিয়ে দেব এবং দেখব কোন ভিন্ন ইঞ্জিন আপনার অডিওকে ভালোভাবে পরিচালনা করতে পারে কিনা।