. رونوشت آزاد تلوگویی
رونوشت از صدا و ویدئو تلوگویی به متن با AI. سریع، دقیق و رایگان.
چطور کار میکنه
- برو به رونوشتگر Free.ai
- پروندۀ صوتی یا ویدئویی تلوگویی خود را بارگذاری کنید
- هوش مصنوعی ما به طور خودکار تلوگویی را تشخیص می دهد و آن را رونوشت می کند
- دانلود رونوشت شما به عنوان متن یا زیرنویس SRT
تلوگویی ویژگیهای رونوشت
- ✓با faster-whisper (مجوز MIT)
- ✓تشخیص خودکار زبان تلوگویی
- ✓پشتیبانی از MP3، WAV، MP4، M4A، FLAC و بیشتر
- ✓صادرات نشانزمان و زیرنویس) SRT (
- ✓محدودیت اندازه پرونده در برنامههای پرداختی وجود ندارد
- ✓خصوصی و امن -- پروندهها پس از پردازش حذف میشوند
جزئیات زبان
| زبان | تلوگویی |
| کد ISO | te |
| مدل | faster-whisper |
| قیمت | آزاد |
زبانهای بیشتر
نمایش همۀ زبانهاپرسش و پاسخ
تلوگویی یک زبان منابع میانی برای Whisper است - بزرگ- v3- توربو در محدوده خطای خطای کلمه ۱۵- ۲۵٪ فرود میآید. خلاصه رونوشت قابل اعتماد است؛ انتظار خطاهای موجودات نامگذاری شده، اختلالات گاه و بیگاه تغییر کد، و خطاهای کوتاه سخنرانی را داشته باشید. برای خروجی با کیفیت انتشار یک گذر انسانی را برنامهریزی کنید.(Tier C, 15-25% word error rate on benchmark sets - ما سطوح صادق WER را به جای ادعاهای بازاریابی منتشر میکنیم.)
بله - رونوشت تلوگویی ابتدا از توکن روزانه رایگان شما استفاده میکند. صدا در حدود ۵۰ توکن در دقیقه هزینه دارد ، بنابراین توکن روزانه ناشناس چند ساعت صدا را در روز پوشش میدهد. حسابهای ثبت شده یک توکن روزانه بزرگتر از ۳۰۰۰۰ را دریافت میکنند. پس از آن ، رونوشت به صورت پرداخت در هنگام استفاده است ، با توکنهای اضافه از ۱ دلار.
رونوشتهای تلوگویی در استاندارد UTF-8 با هجای عادی زبان بازگردانده میشوند.
MP3 ، WAV ، M4A ، FLAC ، OGG ، OPUS ، و WEBM مستقیماً پذیرفته میشوند. برای ویدئو (MP4 ، MOV ، MKV) ، ما شیار صوتی را قبل از ارسال آن به Whisper در سمت کارساز استخراج میکنیم - نیازی نیست خودتان چیزی را تبدیل کنید. خط لوله یکسان بدون توجه به زبان منبع ، از جمله تلوگویی.
حد بارگذاری ناشناس در حدود ۵۰۰ مگابایت برای هر پرونده است. حسابهای وارد شده تا ۲ گیگابایت میروند. طول مدت محدودیت سختی نیست - پروندههای طولانی به طور خودکار به تکههای کوچک تقسیم میشوند ( پنجرههای ۳۰ ثانیهای با همپوشانی) و به یک رونوشت واحد با مهرهای زمان پیوسته دوخت میشوند. ضبطهای چند ساعته تلوگویی (پادکاستها، سخنرانیهای کامل، جلسات) خوب کار میکنند.
بله - به صورت پیشفرض ، برای هر رونوشت تلوگویی ، دیاریزاسیون سخنران فعال است. خروجی به عنوان سخنران ۱ / سخنران ۲ / سخنران ۳ با مهرهای زمانی تقسیم میشود ، بنابراین مصاحبهها ، بحثهای گروهی ، و جلسات چندجانبه برچسبدار برمیگردند. دیاریزاسیون بر روی یک مدل جدا اجرا میشود و در تمام زبانهایی که پشتیبانی میکنیم ، یکسان کار میکند.
بله - URL را به /transcribe/youtube/ برای یوتیوب یا /transcribe/podcast/ برای پادکست (Apple، Spotify، RSS) کپی میکنیم. ما صدا را بارگیری میکنیم، آن را از طریق Whisper با language=te اجرا میکنیم، و رونوشت را با مهر زمان و برچسبهای سخنران برمیگردانیم. محتوای تلوگویی معمول: یادداشتهای صوتی واتساپ، ویدیوهای یوتیوب و ویدئوی کوتاه رایجترین بار کاری تلوگویی هستند — یک آدرس را به /transcribe/youtube/ بچسبانید یا صدا را مستقیماً آپلود کنید..
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
بله - هر دو مهر زمان سطح قطعه (هر ~۱۰-۳۰ ثانیه) و سطح کلمه در دسترس هستند. سطح کلمه پیشفرض برای صادرات زیرنویس VTT/SRT است ، بنابراین زیرنویسها خط به خط همگامسازی میشوند. در API ، در بدنه درخواست ، timestamps="word" را تنظیم کنید. رونوشتهای تلوگویی در استاندارد UTF-8 با هجای عادی زبان بازگردانده میشوند.
بله. صدای POST (multipart/form-data، نام حوزه "file") را به /v1/transcribe / با language=te - یا پارامتر زبان را حذف کنید تا Whisper خودکار تشخیص دهد. JSON را با رونوشت، بخشها، مهرهای زمانی و برچسبهای بلندگو بازگرداند. مرجع کامل و قطعههای SDK در /api/.
بله - وقتی رونوشت تمام شد ، ترجمه را فشار دهید یا متن را به /translate/ بچسبانید. تلوگویی با هر زبان دیگری که پشتیبانی میکنیم (۲۰۰+) جفت میشود. برای جلسات جلسه رونوشت را از طریق /summarize/ لوله کنید؛ برای دوبلاژ آن را به /voice/tts/ بفرستید تا صدا را در زبان هدف بازسازی کنید.
ثبات نویز Whisper هنوز در تلوگویی اعمال میشود، اما در این سطح دقت هر نویز اضافی نرخ خطای خط پایه را ترکیب میکند. صدای هدست تمیز نتایج بهتری نسبت به ضبط تلفن یا میکروفون لپتاپ میدهد.اگر یک رونوشت غیرقابل استفاده باشد، با فایل به contact@free.ai ایمیل بزنید - ما توکنها را بازگردانده و بررسی میکنیم که آیا موتور دیگری صدای شما را بهتر مدیریت میکند.