. رونوشت آزاد چکی

رونوشت از صدا و ویدئو چکی به متن با AI. سریع، دقیق و رایگان.

چطور کار میکنه

  1. برو به رونوشتگر Free.ai
  2. پروندۀ صوتی یا ویدئویی چکی خود را بارگذاری کنید
  3. هوش مصنوعی ما به طور خودکار چکی را تشخیص می دهد و آن را رونوشت می کند
  4. دانلود رونوشت شما به عنوان متن یا زیرنویس SRT

چکی ویژگی‌های رونوشت

  • ✓با faster-whisper (مجوز MIT)
  • ✓تشخیص خودکار زبان چکی
  • ✓پشتیبانی از MP3، WAV، MP4، M4A، FLAC و بیشتر
  • ✓صادرات نشان‌زمان و زیرنویس) SRT (
  • ✓محدودیت اندازه پرونده در برنامه‌های پرداختی وجود ندارد
  • ✓خصوصی و امن -- پرونده‌ها پس از پردازش حذف می‌شوند

جزئیات زبان

زبانچکی
کد ISOcs
مدلfaster-whisper
قیمتآزاد

زبانهای بیشتر

نمایش همۀ زبانها

پرسش و پاسخ

Whisper large-v3-turbo چکی را به خوبی مدیریت می‌کند — ۷-۱۵٪ نرخ خطای کلمه در صدای معیار. انتظار جایگزینی‌های گاه و بیگاه در موجودات نام‌گذاری شده، اعداد و واژگان فنی متراکم را داشته باشید؛ بیشتر رونوشت درست خواهد بود.(Tier B, 7-15% word error rate on benchmark sets - ما سطوح صادق WER را به جای ادعاهای بازاریابی منتشر می‌کنیم.)

بله - رونوشت چکی ابتدا از توکن روزانه رایگان شما استفاده می‌کند. صدا در حدود ۵۰ توکن در دقیقه هزینه دارد ، بنابراین توکن روزانه ناشناس چند ساعت صدا را در روز پوشش می‌دهد. حساب‌های ثبت شده یک توکن روزانه بزرگتر از ۳۰۰۰۰ را دریافت می‌کنند. پس از آن ، رونوشت به صورت پرداخت در هنگام استفاده است ، با توکن‌های اضافه از ۱ دلار.

رونوشت‌های چکی در استاندارد UTF-8 با هجای عادی زبان بازگردانده می‌شوند.

MP3 ، WAV ، M4A ، FLAC ، OGG ، OPUS ، و WEBM مستقیماً پذیرفته می‌شوند. برای ویدئو (MP4 ، MOV ، MKV) ، ما شیار صوتی را قبل از ارسال آن به Whisper در سمت کارساز استخراج می‌کنیم - نیازی نیست خودتان چیزی را تبدیل کنید. خط لوله یکسان بدون توجه به زبان منبع ، از جمله چکی.

حد بارگذاری ناشناس در حدود ۵۰۰ مگابایت برای هر پرونده است. حسابهای وارد شده تا ۲ گیگابایت می‌روند. طول مدت محدودیت سختی نیست - پرونده‌های طولانی به طور خودکار به تکه‌های کوچک تقسیم می‌شوند ( پنجره‌های ۳۰ ثانیه‌ای با همپوشانی) و به یک رونوشت واحد با مهرهای زمان پیوسته دوخت می‌شوند. ضبط‌های چند ساعته چکی (پادکاست‌ها، سخنرانی‌های کامل، جلسات) خوب کار می‌کنند.

بله - به صورت پیش‌فرض ، برای هر رونوشت چکی ، دیاریزاسیون سخنران فعال است. خروجی به عنوان سخنران ۱ / سخنران ۲ / سخنران ۳ با مهرهای زمانی تقسیم می‌شود ، بنابراین مصاحبه‌ها ، بحثهای گروهی ، و جلسات چندجانبه برچسب‌دار برمی‌گردند. دیاریزاسیون بر روی یک مدل جدا اجرا می‌شود و در تمام زبانهایی که پشتیبانی می‌کنیم ، یکسان کار می‌کند.

بله - URL را به /transcribe/youtube/ برای یوتیوب یا /transcribe/podcast/ برای پادکست (Apple، Spotify، RSS) کپی می‌کنیم. ما صدا را بارگیری می‌کنیم، آن را از طریق Whisper با language=cs اجرا می‌کنیم، و رونوشت را با مهر زمان و برچسب‌های سخنران برمی‌گردانیم. محتوای چکی معمول: سخنرانی‌ها، مصاحبه‌ها، یادداشت‌های صوتی و محتوای یوتیوب در چکی همه کار می‌کنند - یک نشانی وب را به /transcribe/youtube/ بچسبانید یا مستقیماً پرونده را بارگذاری کنید.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

بله - هر دو مهر زمان سطح قطعه (هر ~۱۰-۳۰ ثانیه) و سطح کلمه در دسترس هستند. سطح کلمه پیش‌فرض برای صادرات زیرنویس VTT/SRT است ، بنابراین زیرنویس‌ها خط به خط همگام‌سازی می‌شوند. در API ، در بدنه درخواست ، timestamps="word" را تنظیم کنید. رونوشت‌های چکی در استاندارد UTF-8 با هجای عادی زبان بازگردانده می‌شوند.

بله. صدای POST (multipart/form-data، نام حوزه "file") را به /v1/transcribe / با language=cs - یا پارامتر زبان را حذف کنید تا Whisper خودکار تشخیص دهد. JSON را با رونوشت، بخش‌ها، مهرهای زمانی و برچسب‌های بلندگو بازگرداند. مرجع کامل و قطعه‌های SDK در /api/.

بله - وقتی رونوشت تمام شد ، ترجمه را فشار دهید یا متن را به /translate/ بچسبانید. چکی با هر زبان دیگری که پشتیبانی می‌کنیم (۲۰۰+) جفت می‌شود. برای جلسات جلسه رونوشت را از طریق /summarize/ لوله کنید؛ برای دوبلاژ آن را به /voice/tts/ بفرستید تا صدا را در زبان هدف بازسازی کنید.

Whisper بر روی صدها هزار ساعت صدای واقعی آموزش داده می‌شود ، بنابراین صدای پس زمینه و ضبط‌های با کیفیت تلفن را در چکی تحمل می‌کند. برای بهترین نتایج ، صدای تمیز (می‌کاپ هدست ، بدون تخت موسیقی) را تأمین کنید - در این سطح نویز نرخ خطای خط پایه را ترکیب می‌کند.اگر یک رونوشت غیرقابل استفاده باشد، با فایل به contact@free.ai ایمیل بزنید - ما توکن‌ها را بازگردانده و بررسی می‌کنیم که آیا موتور دیگری صدای شما را بهتر مدیریت می‌کند.

دوست Free.ai رو به دوستانت بگو

رتبه این صفحه