. رونوشت آزاد سوندایی
رونوشت از صدا و ویدئو سوندایی به متن با AI. سریع، دقیق و رایگان.
چطور کار میکنه
- برو به رونوشتگر Free.ai
- پروندۀ صوتی یا ویدئویی سوندایی خود را بارگذاری کنید
- هوش مصنوعی ما به طور خودکار سوندایی را تشخیص می دهد و آن را رونوشت می کند
- دانلود رونوشت شما به عنوان متن یا زیرنویس SRT
سوندایی ویژگیهای رونوشت
- ✓با faster-whisper (مجوز MIT)
- ✓تشخیص خودکار زبان سوندایی
- ✓پشتیبانی از MP3، WAV، MP4، M4A، FLAC و بیشتر
- ✓صادرات نشانزمان و زیرنویس) SRT (
- ✓محدودیت اندازه پرونده در برنامههای پرداختی وجود ندارد
- ✓خصوصی و امن -- پروندهها پس از پردازش حذف میشوند
جزئیات زبان
| زبان | سوندایی |
| کد ISO | su |
| مدل | faster-whisper |
| قیمت | آزاد |
زبانهای بیشتر
نمایش همۀ زبانهاپرسش و پاسخ
سوندایی زبانی کم منابع برای Whisper است - بزرگ- v3- توربو در بالای ۲۵٪ نرخ خطای کلمه قرار دارد ، گاهی اوقات بسیار بالاتر. رونوشت برای جستجو و gist مفید است ، اما نباید به عنوان آماده انتشار در نظر گرفته شود. اگر موتور دقیق تر برای سوندایی در دسترس باشد ، به طور خودکار آن را وصل می کنیم.(Tier D, over 25% word error rate on benchmark sets - ما سطوح صادق WER را به جای ادعاهای بازاریابی منتشر میکنیم.)
بله - رونوشت سوندایی ابتدا از توکن روزانه رایگان شما استفاده میکند. صدا در حدود ۵۰ توکن در دقیقه هزینه دارد ، بنابراین توکن روزانه ناشناس چند ساعت صدا را در روز پوشش میدهد. حسابهای ثبت شده یک توکن روزانه بزرگتر از ۳۰۰۰۰ را دریافت میکنند. پس از آن ، رونوشت به صورت پرداخت در هنگام استفاده است ، با توکنهای اضافه از ۱ دلار.
رونوشتهای سوندایی در استاندارد UTF-8 با هجای عادی زبان بازگردانده میشوند.
MP3 ، WAV ، M4A ، FLAC ، OGG ، OPUS ، و WEBM مستقیماً پذیرفته میشوند. برای ویدئو (MP4 ، MOV ، MKV) ، ما شیار صوتی را قبل از ارسال آن به Whisper در سمت کارساز استخراج میکنیم - نیازی نیست خودتان چیزی را تبدیل کنید. خط لوله یکسان بدون توجه به زبان منبع ، از جمله سوندایی.
حد بارگذاری ناشناس در حدود ۵۰۰ مگابایت برای هر پرونده است. حسابهای وارد شده تا ۲ گیگابایت میروند. طول مدت محدودیت سختی نیست - پروندههای طولانی به طور خودکار به تکههای کوچک تقسیم میشوند ( پنجرههای ۳۰ ثانیهای با همپوشانی) و به یک رونوشت واحد با مهرهای زمان پیوسته دوخت میشوند. ضبطهای چند ساعته سوندایی (پادکاستها، سخنرانیهای کامل، جلسات) خوب کار میکنند.
بله - به صورت پیشفرض ، برای هر رونوشت سوندایی ، دیاریزاسیون سخنران فعال است. خروجی به عنوان سخنران ۱ / سخنران ۲ / سخنران ۳ با مهرهای زمانی تقسیم میشود ، بنابراین مصاحبهها ، بحثهای گروهی ، و جلسات چندجانبه برچسبدار برمیگردند. دیاریزاسیون بر روی یک مدل جدا اجرا میشود و در تمام زبانهایی که پشتیبانی میکنیم ، یکسان کار میکند.
بله - URL را به /transcribe/youtube/ برای یوتیوب یا /transcribe/podcast/ برای پادکست (Apple، Spotify، RSS) کپی میکنیم. ما صدا را بارگیری میکنیم، آن را از طریق Whisper با language=su اجرا میکنیم، و رونوشت را با مهر زمان و برچسبهای سخنران برمیگردانیم. محتوای سوندایی معمول: سخنرانیها، مصاحبهها، یادداشتهای صوتی و محتوای یوتیوب در سوندایی همه کار میکنند - یک نشانی وب را به /transcribe/youtube/ بچسبانید یا مستقیماً پرونده را بارگذاری کنید.
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
بله - هر دو مهر زمان سطح قطعه (هر ~۱۰-۳۰ ثانیه) و سطح کلمه در دسترس هستند. سطح کلمه پیشفرض برای صادرات زیرنویس VTT/SRT است ، بنابراین زیرنویسها خط به خط همگامسازی میشوند. در API ، در بدنه درخواست ، timestamps="word" را تنظیم کنید. رونوشتهای سوندایی در استاندارد UTF-8 با هجای عادی زبان بازگردانده میشوند.
بله. صدای POST (multipart/form-data، نام حوزه "file") را به /v1/transcribe / با language=su - یا پارامتر زبان را حذف کنید تا Whisper خودکار تشخیص دهد. JSON را با رونوشت، بخشها، مهرهای زمانی و برچسبهای بلندگو بازگرداند. مرجع کامل و قطعههای SDK در /api/.
بله - وقتی رونوشت تمام شد ، ترجمه را فشار دهید یا متن را به /translate/ بچسبانید. سوندایی با هر زبان دیگری که پشتیبانی میکنیم (۲۰۰+) جفت میشود. برای جلسات جلسه رونوشت را از طریق /summarize/ لوله کنید؛ برای دوبلاژ آن را به /voice/tts/ بفرستید تا صدا را در زبان هدف بازسازی کنید.
آموزش نویز Whisper در این سطح کمک کمتری میکند - تنگنا مقدار صدای سوندایی است که Whisper در طول آموزش دید ، نه نویز. صدای استودیوی تمیز هنوز صدای پر سر و صدا را شکست میدهد ، اما هر دو به دقت نخواهند رسید که در یک زبان منابع بالا بدست میآید.اگر یک رونوشت غیرقابل استفاده باشد، با فایل به contact@free.ai ایمیل بزنید - ما توکنها را بازگردانده و بررسی میکنیم که آیا موتور دیگری صدای شما را بهتر مدیریت میکند.