. رونوشت آزاد ولزی

رونوشت از صدا و ویدئو ولزی به متن با AI. سریع، دقیق و رایگان.

چطور کار میکنه

  1. برو به رونوشتگر Free.ai
  2. پروندۀ صوتی یا ویدئویی ولزی خود را بارگذاری کنید
  3. هوش مصنوعی ما به طور خودکار ولزی را تشخیص می دهد و آن را رونوشت می کند
  4. دانلود رونوشت شما به عنوان متن یا زیرنویس SRT

ولزی ویژگی‌های رونوشت

  • ✓با faster-whisper (مجوز MIT)
  • ✓تشخیص خودکار زبان ولزی
  • ✓پشتیبانی از MP3، WAV، MP4، M4A، FLAC و بیشتر
  • ✓صادرات نشان‌زمان و زیرنویس) SRT (
  • ✓محدودیت اندازه پرونده در برنامه‌های پرداختی وجود ندارد
  • ✓خصوصی و امن -- پرونده‌ها پس از پردازش حذف می‌شوند

جزئیات زبان

زبانولزی
کد ISOcy
مدلfaster-whisper
قیمتآزاد

زبانهای بیشتر

نمایش همۀ زبانها

پرسش و پاسخ

ولزی یک زبان منابع میانی برای Whisper است - بزرگ- v3- توربو در محدوده خطای خطای کلمه ۱۵- ۲۵٪ فرود می‌آید. خلاصه رونوشت قابل اعتماد است؛ انتظار خطاهای موجودات نام‌گذاری شده، اختلالات گاه و بیگاه تغییر کد، و خطاهای کوتاه سخنرانی را داشته باشید. برای خروجی با کیفیت انتشار یک گذر انسانی را برنامه‌ریزی کنید.(Tier C, 15-25% word error rate on benchmark sets - ما سطوح صادق WER را به جای ادعاهای بازاریابی منتشر می‌کنیم.)

بله - رونوشت ولزی ابتدا از توکن روزانه رایگان شما استفاده می‌کند. صدا در حدود ۵۰ توکن در دقیقه هزینه دارد ، بنابراین توکن روزانه ناشناس چند ساعت صدا را در روز پوشش می‌دهد. حساب‌های ثبت شده یک توکن روزانه بزرگتر از ۳۰۰۰۰ را دریافت می‌کنند. پس از آن ، رونوشت به صورت پرداخت در هنگام استفاده است ، با توکن‌های اضافه از ۱ دلار.

رونوشت‌های ولزی در استاندارد UTF-8 با هجای عادی زبان بازگردانده می‌شوند.

MP3 ، WAV ، M4A ، FLAC ، OGG ، OPUS ، و WEBM مستقیماً پذیرفته می‌شوند. برای ویدئو (MP4 ، MOV ، MKV) ، ما شیار صوتی را قبل از ارسال آن به Whisper در سمت کارساز استخراج می‌کنیم - نیازی نیست خودتان چیزی را تبدیل کنید. خط لوله یکسان بدون توجه به زبان منبع ، از جمله ولزی.

حد بارگذاری ناشناس در حدود ۵۰۰ مگابایت برای هر پرونده است. حسابهای وارد شده تا ۲ گیگابایت می‌روند. طول مدت محدودیت سختی نیست - پرونده‌های طولانی به طور خودکار به تکه‌های کوچک تقسیم می‌شوند ( پنجره‌های ۳۰ ثانیه‌ای با همپوشانی) و به یک رونوشت واحد با مهرهای زمان پیوسته دوخت می‌شوند. ضبط‌های چند ساعته ولزی (پادکاست‌ها، سخنرانی‌های کامل، جلسات) خوب کار می‌کنند.

بله - به صورت پیش‌فرض ، برای هر رونوشت ولزی ، دیاریزاسیون سخنران فعال است. خروجی به عنوان سخنران ۱ / سخنران ۲ / سخنران ۳ با مهرهای زمانی تقسیم می‌شود ، بنابراین مصاحبه‌ها ، بحثهای گروهی ، و جلسات چندجانبه برچسب‌دار برمی‌گردند. دیاریزاسیون بر روی یک مدل جدا اجرا می‌شود و در تمام زبانهایی که پشتیبانی می‌کنیم ، یکسان کار می‌کند.

بله - URL را به /transcribe/youtube/ برای یوتیوب یا /transcribe/podcast/ برای پادکست (Apple، Spotify، RSS) کپی می‌کنیم. ما صدا را بارگیری می‌کنیم، آن را از طریق Whisper با language=cy اجرا می‌کنیم، و رونوشت را با مهر زمان و برچسب‌های سخنران برمی‌گردانیم. محتوای ولزی معمول: سخنرانی‌ها، مصاحبه‌ها، یادداشت‌های صوتی و محتوای یوتیوب در ولزی همه کار می‌کنند - یک نشانی وب را به /transcribe/youtube/ بچسبانید یا مستقیماً پرونده را بارگذاری کنید.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

بله - هر دو مهر زمان سطح قطعه (هر ~۱۰-۳۰ ثانیه) و سطح کلمه در دسترس هستند. سطح کلمه پیش‌فرض برای صادرات زیرنویس VTT/SRT است ، بنابراین زیرنویس‌ها خط به خط همگام‌سازی می‌شوند. در API ، در بدنه درخواست ، timestamps="word" را تنظیم کنید. رونوشت‌های ولزی در استاندارد UTF-8 با هجای عادی زبان بازگردانده می‌شوند.

بله. صدای POST (multipart/form-data، نام حوزه "file") را به /v1/transcribe / با language=cy - یا پارامتر زبان را حذف کنید تا Whisper خودکار تشخیص دهد. JSON را با رونوشت، بخش‌ها، مهرهای زمانی و برچسب‌های بلندگو بازگرداند. مرجع کامل و قطعه‌های SDK در /api/.

بله - وقتی رونوشت تمام شد ، ترجمه را فشار دهید یا متن را به /translate/ بچسبانید. ولزی با هر زبان دیگری که پشتیبانی می‌کنیم (۲۰۰+) جفت می‌شود. برای جلسات جلسه رونوشت را از طریق /summarize/ لوله کنید؛ برای دوبلاژ آن را به /voice/tts/ بفرستید تا صدا را در زبان هدف بازسازی کنید.

ثبات نویز Whisper هنوز در ولزی اعمال می‌شود، اما در این سطح دقت هر نویز اضافی نرخ خطای خط پایه را ترکیب می‌کند. صدای هدست تمیز نتایج بهتری نسبت به ضبط تلفن یا میکروفون لپ‌تاپ می‌دهد.اگر یک رونوشت غیرقابل استفاده باشد، با فایل به contact@free.ai ایمیل بزنید - ما توکن‌ها را بازگردانده و بررسی می‌کنیم که آیا موتور دیگری صدای شما را بهتر مدیریت می‌کند.

دوست Free.ai رو به دوستانت بگو

رتبه این صفحه