. رونوشت آزاد کانارا

رونوشت از صدا و ویدئو کانارا به متن با AI. سریع، دقیق و رایگان.

چطور کار میکنه

  1. برو به رونوشتگر Free.ai
  2. پروندۀ صوتی یا ویدئویی کانارا خود را بارگذاری کنید
  3. هوش مصنوعی ما به طور خودکار کانارا را تشخیص می دهد و آن را رونوشت می کند
  4. دانلود رونوشت شما به عنوان متن یا زیرنویس SRT

کانارا ویژگی‌های رونوشت

  • ✓با faster-whisper (مجوز MIT)
  • ✓تشخیص خودکار زبان کانارا
  • ✓پشتیبانی از MP3، WAV، MP4، M4A، FLAC و بیشتر
  • ✓صادرات نشان‌زمان و زیرنویس) SRT (
  • ✓محدودیت اندازه پرونده در برنامه‌های پرداختی وجود ندارد
  • ✓خصوصی و امن -- پرونده‌ها پس از پردازش حذف می‌شوند

جزئیات زبان

زبانکانارا
کد ISOkn
مدلfaster-whisper
قیمتآزاد

زبانهای بیشتر

نمایش همۀ زبانها

پرسش و پاسخ

کانارا زبانی کم منابع برای Whisper است - بزرگ- v3- توربو در بالای ۲۵٪ نرخ خطای کلمه قرار دارد ، گاهی اوقات بسیار بالاتر. رونوشت برای جستجو و gist مفید است ، اما نباید به عنوان آماده انتشار در نظر گرفته شود. اگر موتور دقیق تر برای کانارا در دسترس باشد ، به طور خودکار آن را وصل می کنیم.(Tier D, over 25% word error rate on benchmark sets - ما سطوح صادق WER را به جای ادعاهای بازاریابی منتشر می‌کنیم.)

بله - رونوشت کانارا ابتدا از توکن روزانه رایگان شما استفاده می‌کند. صدا در حدود ۵۰ توکن در دقیقه هزینه دارد ، بنابراین توکن روزانه ناشناس چند ساعت صدا را در روز پوشش می‌دهد. حساب‌های ثبت شده یک توکن روزانه بزرگتر از ۳۰۰۰۰ را دریافت می‌کنند. پس از آن ، رونوشت به صورت پرداخت در هنگام استفاده است ، با توکن‌های اضافه از ۱ دلار.

رونوشت‌های کانارا در استاندارد UTF-8 با هجای عادی زبان بازگردانده می‌شوند.

MP3 ، WAV ، M4A ، FLAC ، OGG ، OPUS ، و WEBM مستقیماً پذیرفته می‌شوند. برای ویدئو (MP4 ، MOV ، MKV) ، ما شیار صوتی را قبل از ارسال آن به Whisper در سمت کارساز استخراج می‌کنیم - نیازی نیست خودتان چیزی را تبدیل کنید. خط لوله یکسان بدون توجه به زبان منبع ، از جمله کانارا.

حد بارگذاری ناشناس در حدود ۵۰۰ مگابایت برای هر پرونده است. حسابهای وارد شده تا ۲ گیگابایت می‌روند. طول مدت محدودیت سختی نیست - پرونده‌های طولانی به طور خودکار به تکه‌های کوچک تقسیم می‌شوند ( پنجره‌های ۳۰ ثانیه‌ای با همپوشانی) و به یک رونوشت واحد با مهرهای زمان پیوسته دوخت می‌شوند. ضبط‌های چند ساعته کانارا (پادکاست‌ها، سخنرانی‌های کامل، جلسات) خوب کار می‌کنند.

بله - به صورت پیش‌فرض ، برای هر رونوشت کانارا ، دیاریزاسیون سخنران فعال است. خروجی به عنوان سخنران ۱ / سخنران ۲ / سخنران ۳ با مهرهای زمانی تقسیم می‌شود ، بنابراین مصاحبه‌ها ، بحثهای گروهی ، و جلسات چندجانبه برچسب‌دار برمی‌گردند. دیاریزاسیون بر روی یک مدل جدا اجرا می‌شود و در تمام زبانهایی که پشتیبانی می‌کنیم ، یکسان کار می‌کند.

بله - URL را به /transcribe/youtube/ برای یوتیوب یا /transcribe/podcast/ برای پادکست (Apple، Spotify، RSS) کپی می‌کنیم. ما صدا را بارگیری می‌کنیم، آن را از طریق Whisper با language=kn اجرا می‌کنیم، و رونوشت را با مهر زمان و برچسب‌های سخنران برمی‌گردانیم. محتوای کانارا معمول: سخنرانی‌ها، مصاحبه‌ها، یادداشت‌های صوتی و محتوای یوتیوب در کانارا همه کار می‌کنند - یک نشانی وب را به /transcribe/youtube/ بچسبانید یا مستقیماً پرونده را بارگذاری کنید.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

بله - هر دو مهر زمان سطح قطعه (هر ~۱۰-۳۰ ثانیه) و سطح کلمه در دسترس هستند. سطح کلمه پیش‌فرض برای صادرات زیرنویس VTT/SRT است ، بنابراین زیرنویس‌ها خط به خط همگام‌سازی می‌شوند. در API ، در بدنه درخواست ، timestamps="word" را تنظیم کنید. رونوشت‌های کانارا در استاندارد UTF-8 با هجای عادی زبان بازگردانده می‌شوند.

بله. صدای POST (multipart/form-data، نام حوزه "file") را به /v1/transcribe / با language=kn - یا پارامتر زبان را حذف کنید تا Whisper خودکار تشخیص دهد. JSON را با رونوشت، بخش‌ها، مهرهای زمانی و برچسب‌های بلندگو بازگرداند. مرجع کامل و قطعه‌های SDK در /api/.

بله - وقتی رونوشت تمام شد ، ترجمه را فشار دهید یا متن را به /translate/ بچسبانید. کانارا با هر زبان دیگری که پشتیبانی می‌کنیم (۲۰۰+) جفت می‌شود. برای جلسات جلسه رونوشت را از طریق /summarize/ لوله کنید؛ برای دوبلاژ آن را به /voice/tts/ بفرستید تا صدا را در زبان هدف بازسازی کنید.

آموزش نویز Whisper در این سطح کمک کمتری می‌کند - تنگنا مقدار صدای کانارا است که Whisper در طول آموزش دید ، نه نویز. صدای استودیوی تمیز هنوز صدای پر سر و صدا را شکست می‌دهد ، اما هر دو به دقت نخواهند رسید که در یک زبان منابع بالا بدست می‌آید.اگر یک رونوشت غیرقابل استفاده باشد، با فایل به contact@free.ai ایمیل بزنید - ما توکن‌ها را بازگردانده و بررسی می‌کنیم که آیا موتور دیگری صدای شما را بهتر مدیریت می‌کند.

دوست Free.ai رو به دوستانت بگو

رتبه این صفحه