رونوشت مراتی آزاد
رونوشت مراتی صدا و ویدئوی به متن با هوش مصنوعی. سریع، دقیق و رایگان.
چطور کار میکنه
- برو به Free.ai رونوشتکننده
- پروندهی صوتی یا ویدئویی مراتی خود را بارگذاری کنید
- هوش مصنوعی ما مراتی را به طور خودکار تشخیص میدهد و آن را رونوشت میکند
- دانلود رونوشت شما به عنوان متن یا زیرنویس SRT
مراتی ویژگیهای رونوشت
- ✓با faster-whisper (مجوز MIT)
- ✓تشخیص خودکار زبان مراتی
- ✓پشتیبانی از MP3، WAV، MP4، M4A، FLAC و بیشتر
- ✓صادرات نشانزمان و زیرنویس) SRT (
- ✓محدودیت اندازه پرونده در برنامههای پرداختی وجود ندارد
- ✓خصوصی و امن -- پروندهها پس از پردازش حذف میشوند
جزئیات زبان
| زبان | مراتی |
| کد ISO | mr |
| مدل | faster-whisper |
| قیمت | آزاد |
زبانهای بیشتر
نمایش همۀ زبانهاپرسش و پاسخ
مراتی یک زبان منابع متوسط برای Whisper است — بزرگ-v3-تربو در محدوده نرخ خطای کلمه ۱۵-۲۵٪ قرار دارد. ماهیت رونوشت قابل اعتماد است؛ انتظار خطاهای موجودیت نامگذاری شده، اختلالات گاه و بیگاه تغییر کد، و خطاهای کوتاهگویی را داشته باشید. برای خروجی با کیفیت انتشار، یک گذر انسانی را برنامهریزی کنید.(Tier C, 15-25% word error rate on benchmark sets — ما سطوح صادق WER را به جای ادعاهای بازاریابی منتشر میکنیم.)
بله — رونوشت مراتی ابتدا از مجموعه توکنهای رایگان روزانه شما استفاده میکند. صدا در هر دقیقه حدود ۵۰ توکن هزینه دارد، بنابراین مجموعه روزانه ناشناس چند ساعت صدا را در روز پوشش میدهد. حسابهای وارد شده یک مجموعه روزانه بزرگتر از ۳۰۰۰۰ توکن دریافت میکنند. پس از آن، رونوشت به صورت پرداخت در هنگام استفاده است، با توکنهای اضافهشده از ۱ دلار.
مراتی رونوشتها در اسکریپت Devanagari (UTF-8) بازگردانده میشوند.
MP3, WAV, M4A, FLAC, OGG, OPUS, و WEBM مستقیماً پذیرفته میشوند. برای ویدئو (MP4, MOV, MKV) ما شیار صوتی را قبل از ارسال آن به Whisper در سمت کارساز استخراج میکنیم — نیازی نیست که خودتان چیزی را تبدیل کنید. خط لوله یکسان بدون توجه به زبان منبع، از جمله مراتی.
حد بارگذاری ناشناس در حدود ۵۰۰ مگابایت برای هر پرونده است. حسابهای ثبت شده تا ۲ گیگابایت میروند. طول مدت محدودیت سختی نیست — پروندههای طولانی به صورت خودکار به قطعات تقسیم میشوند (پنجره ۳۰ ثانیهای با همپوشانی) و به یک رونوشت واحد با مهرههای زمانی پیوسته دوخت میشوند. ضبطهای چند ساعته مراتی (پادکاستها، سخنرانیهای کامل، جلسات) خوب کار میکنند.
بله — به صورت پیشفرض ، نگارش روزنامه سخنران برای هر رونوشت مراتی فعال است. خروجی به عنوان سخنران ۱ / سخنران ۲ / سخنران ۳ با مهرهای زمانی تقسیم میشود ، بنابراین مصاحبهها ، بحثهای گروهی و جلسات چند نفره برچسبدار برمیگردند. نگارش روزنامه بر روی یک مدل جداگانه اجرا میشود و در تمام زبانهایی که پشتیبانی میکنیم ، یکسان کار میکند.
بله — آدرس را در /transcribe/youtube/ برای یوتیوب یا /transcribe/podcast/ برای پادکستهای (Apple، Spotify، RSS) کپی کنید. ما صدا را دانلود میکنیم، آن را از طریق Whisper با language=mr اجرا میکنیم، و رونوشت را با مهر زمان و برچسبهای سخنران برمیگردانیم. محتوای معمول مراتی: یادداشتهای صوتی واتساپ، ویدیوهای یوتیوب و ویدئوی کوتاه رایجترین بار کاری مراتی هستند — یک آدرس را به /transcribe/youtube/ بچسبانید یا صدا را مستقیماً آپلود کنید..
Whisper حدود ۵۰ توکن در دقیقه صدا هزینه دارد، بنابراین یک ضبط یک ساعته ~۳۰۰۰ توکن است. اکثر کاربران هیچ وقت چیزی خرج نمیکنند — مجموعه روزانه رایگان ۳۰ توکن کلیپهای کوتاه، یادداشتهای صوتی و پادکستهای یکبار مصرف را پوشش میدهد. فراتر از آن، رونویسی به صورت پرداخت در هنگام استفاده است، با توکنهای اضافه از ۱ دلار.
بله — هر دو مهر زمان سطح بخش (هر ~۱۰-۳۰ ثانیه) و سطح کلمه در دسترس هستند. سطح کلمه پیشفرض برای صادرات زیرنویس VTT/SRT است، بنابراین زیرنویسها خط به خط همگامسازی میشوند. در API، timestamps="word" را در بدنه درخواست تنظیم کنید. مراتی رونوشتها در اسکریپت Devanagari (UTF-8) بازگردانده میشوند.
بله. ارسال صدا (مختلف/دادههای فرم، نام حوزه "پرونده") به /v1/transcribe/ با language=mr — یا پارامتر زبان را حذف کنید تا Whisper خودکار تشخیص دهد. JSON را با رونوشت، بخشها، مهرهای زمانی و برچسبهای بلندگو برمیگرداند. مرجع کامل و قطعههای SDK در /api/.
بله — هنگامی که رونوشت تمام شد، بر روی ترجمه کلیک کنید یا متن را در /translate/ بچسبانید. مراتی با هر زبان دیگری که پشتیبانی میکنیم (۲۰۰+) جفت میشود. برای جلسات جلسات رونوشت را از طریق /summarize/ لوله کنید؛ برای دوبلاژ آن را به /voice/tts/ بفرستید تا صدا را در زبان هدف بازسازی کنید.
پایداری نویز Whisper هنوز در مراتی اعمال میشود، اما در این سطح دقت هر نویز اضافی میزان خطای خط پایه را ترکیب میکند. صدای هدست تمیز نتایج بهتری نسبت به ضبطهای تلفن یا میکروفون لپتاپ میدهد.اگر یک رونوشت غیرقابل استفاده برگردد، با فایل به contact@free.ai ایمیل بزنید — ما توکنها را بازگردانده و بررسی میکنیم که آیا موتور دیگری صدای شما را بهتر مدیریت میکند.