رونوشت فارسی آزاد

رونوشت فارسی صدا و ویدئوی به متن با هوش مصنوعی. سریع، دقیق و رایگان.

چطور کار میکنه

  1. برو به Free.ai رونوشت‌کننده
  2. پرونده‌ی صوتی یا ویدئویی فارسی خود را بارگذاری کنید
  3. هوش مصنوعی ما فارسی را به طور خودکار تشخیص می‌دهد و آن را رونوشت می‌کند
  4. دانلود رونوشت شما به عنوان متن یا زیرنویس SRT

فارسی ویژگی‌های رونوشت

  • با faster-whisper (مجوز MIT)
  • تشخیص خودکار زبان فارسی
  • پشتیبانی از MP3، WAV، MP4، M4A، FLAC و بیشتر
  • صادرات نشان‌زمان و زیرنویس) SRT (
  • محدودیت اندازه پرونده در برنامه‌های پرداختی وجود ندارد
  • خصوصی و امن -- پرونده‌ها پس از پردازش حذف می‌شوند

جزئیات زبان

زبانفارسی
کد ISOfa
مدلfaster-whisper
قیمتآزاد

زبانهای بیشتر

نمایش همۀ زبانها

پرسش و پاسخ

فارسی یک زبان منابع متوسط برای Whisper است — بزرگ-v3-تربو در محدوده نرخ خطای کلمه ۱۵-۲۵٪ قرار دارد. ماهیت رونوشت قابل اعتماد است؛ انتظار خطاهای موجودیت نام‌گذاری شده، اختلالات گاه و بیگاه تغییر کد، و خطاهای کوتاه‌گویی را داشته باشید. برای خروجی با کیفیت انتشار، یک گذر انسانی را برنامه‌ریزی کنید.(Tier C, 15-25% word error rate on benchmark sets — ما سطوح صادق WER را به جای ادعاهای بازاریابی منتشر می‌کنیم.)

بله — رونوشت فارسی ابتدا از مجموعه توکن‌های رایگان روزانه شما استفاده می‌کند. صدا در هر دقیقه حدود ۵۰ توکن هزینه دارد، بنابراین مجموعه روزانه ناشناس چند ساعت صدا را در روز پوشش می‌دهد. حساب‌های وارد شده یک مجموعه روزانه بزرگتر از ۳۰۰۰۰ توکن دریافت می‌کنند. پس از آن، رونوشت به صورت پرداخت در هنگام استفاده است، با توکن‌های اضافه‌شده از ۱ دلار.

فارسی رونوشت‌ها در اسکریپت‌های اصلی خود از راست به چپ بازگردانده می‌شوند و به درستی در هر مرورگر RTL-aware (مرورگرها، وورد، گوگل دکس) نمایش داده می‌شوند.

MP3, WAV, M4A, FLAC, OGG, OPUS, و WEBM مستقیماً پذیرفته می‌شوند. برای ویدئو (MP4, MOV, MKV) ما شیار صوتی را قبل از ارسال آن به Whisper در سمت کارساز استخراج می‌کنیم — نیازی نیست که خودتان چیزی را تبدیل کنید. خط لوله یکسان بدون توجه به زبان منبع، از جمله فارسی.

حد بارگذاری ناشناس در حدود ۵۰۰ مگابایت برای هر پرونده است. حساب‌های ثبت شده تا ۲ گیگابایت می‌روند. طول مدت محدودیت سختی نیست — پرونده‌های طولانی به صورت خودکار به قطعات تقسیم می‌شوند (پنجره ۳۰ ثانیه‌ای با همپوشانی) و به یک رونوشت واحد با مهره‌های زمانی پیوسته دوخت می‌شوند. ضبط‌های چند ساعته فارسی (پادکاست‌ها، سخنرانی‌های کامل، جلسات) خوب کار می‌کنند.

بله — به صورت پیش‌فرض ، نگارش روزنامه سخنران برای هر رونوشت فارسی فعال است. خروجی به عنوان سخنران ۱ / سخنران ۲ / سخنران ۳ با مهرهای زمانی تقسیم می‌شود ، بنابراین مصاحبه‌ها ، بحثهای گروهی و جلسات چند نفره برچسب‌دار برمی‌گردند. نگارش روزنامه بر روی یک مدل جداگانه اجرا می‌شود و در تمام زبان‌هایی که پشتیبانی می‌کنیم ، یکسان کار می‌کند.

بله — آدرس را در /transcribe/youtube/ برای یوتیوب یا /transcribe/podcast/ برای پادکست‌های (Apple، Spotify، RSS) کپی کنید. ما صدا را دانلود می‌کنیم، آن را از طریق Whisper با language=fa اجرا می‌کنیم، و رونوشت را با مهر زمان و برچسب‌های سخنران برمی‌گردانیم. محتوای معمول فارسی: کلیپ‌های خبری، موعظه، سخنرانی و مصاحبه‌های سیاسی در فارسی رایج‌ترین کارها هستند؛ آدرس یوتیوب را در /transcribe/youtube/ کپی کنید یا پرونده را آپلود کنید.

Whisper حدود ۵۰ توکن در دقیقه صدا هزینه دارد، بنابراین یک ضبط یک ساعته ~۳۰۰۰ توکن است. اکثر کاربران هیچ وقت چیزی خرج نمی‌کنند — مجموعه روزانه رایگان ۳۰ توکن کلیپ‌های کوتاه، یادداشت‌های صوتی و پادکست‌های یک‌بار مصرف را پوشش می‌دهد. فراتر از آن، رونویسی به صورت پرداخت در هنگام استفاده است، با توکن‌های اضافه از ۱ دلار.

بله — هر دو مهر زمان سطح بخش (هر ~۱۰-۳۰ ثانیه) و سطح کلمه در دسترس هستند. سطح کلمه پیش‌فرض برای صادرات زیرنویس VTT/SRT است، بنابراین زیرنویس‌ها خط به خط همگام‌سازی می‌شوند. در API، timestamps="word" را در بدنه درخواست تنظیم کنید. فارسی رونوشت‌ها در اسکریپت‌های اصلی خود از راست به چپ بازگردانده می‌شوند و به درستی در هر مرورگر RTL-aware (مرورگرها، وورد، گوگل دکس) نمایش داده می‌شوند.

بله. ارسال صدا (مختلف/داده‌های فرم، نام حوزه "پرونده") به /v1/transcribe/ با language=fa — یا پارامتر زبان را حذف کنید تا Whisper خودکار تشخیص دهد. JSON را با رونوشت، بخش‌ها، مهرهای زمانی و برچسب‌های بلندگو برمی‌گرداند. مرجع کامل و قطعه‌های SDK در /api/.

بله — هنگامی که رونوشت تمام شد، بر روی ترجمه کلیک کنید یا متن را در /translate/ بچسبانید. فارسی با هر زبان دیگری که پشتیبانی می‌کنیم (۲۰۰+) جفت می‌شود. برای جلسات جلسات رونوشت را از طریق /summarize/ لوله کنید؛ برای دوبلاژ آن را به /voice/tts/ بفرستید تا صدا را در زبان هدف بازسازی کنید.

پایداری نویز Whisper هنوز در فارسی اعمال می‌شود، اما در این سطح دقت هر نویز اضافی میزان خطای خط پایه را ترکیب می‌کند. صدای هدست تمیز نتایج بهتری نسبت به ضبط‌های تلفن یا میکروفون لپ‌تاپ می‌دهد.اگر یک رونوشت غیرقابل استفاده برگردد، با فایل به contact@free.ai ایمیل بزنید — ما توکن‌ها را بازگردانده و بررسی می‌کنیم که آیا موتور دیگری صدای شما را بهتر مدیریت می‌کند.

دوست Free.ai رو به دوستانت بگو

رتبه بندی این صفحه