آزاد ڪوريائي ترڪيب

AI سان ڪوريائي آڊيو ۽ وڊيو کي متن ۾ تبديل ڪريو. جلدي، درست ۽ مفت.

ڪيئن ڪم ڪري ٿو

  1. ھتي وڃو Free.ai ترانسڪريٽر
  2. پنھنجي ڪوريائي آڊيو يا وڊيو فائل اپ لوڊ ڪريو
  3. اسان جو AI پاڻمرادو ڪوريائي ڳولي ٿو ۽ ان کي نقل ڪري ٿو
  4. پنھنجي ترانسڪريٽ کي متن يا SRT عنوانن طور ڊائون لوڊ ڪريو

ڪوريائي لکڻ جي خاصيتون

  • ✓faster-whisper طرفان هلايو ويو (MIT لائسنس ٿيل)
  • ✓ڪوريائي ٻوليءَ جو پاڻمرادو ڳولا
  • ✓MP3، WAV، MP4، M4A، FLAC ۽ وڌيڪ کي سپورٽ ڪري ٿو
  • ✓وقت جي نشان ۽ سبٽيٽل برآمد (SRT)
  • ✓ڪابه فائل سائز جي حد
  • ✓پرائيويٽ ۽ محفوظ -- فائل پروسيس ڪرڻ کانپوءِ حذف ڪيو ويندو

ٻولي جون تفصيلون

ٻوليڪوريائي
ISO ڪوڊko
AI ماڊلfaster-whisper
قيمتمفت

وڌيڪ ٻوليون

سڀ ٻوليون ڏسو

پڇاڙي

Whisper large-v3-turbo ڪوريائي تي پنهنجي مٿئين دقت واري طبقي ۾ اچي ٿو - معياري بينچ مارڪ تي 7% لفظ جي غلطي جي شرح هيٺ. عمل ۾ ان جو مطلب صاف اسٽوڊيو آڊيو واپس اچي ٿو-تمام-تمام، ۽ گفتگو آڊيو گهٽ ۾ گهٽ صاف ڪرڻ سان استعمال ڪري سگهجي ٿو.(Tier A, under 7% word error rate on benchmark sets - اسان مارڪيٽنگ دعوائن جي بدران سچي WER ٽائر شايع ڪندا آهيون.)

ھائو - ڪوريائي transcription your daily free token pool from drawn first. Audio costs about 50 tokens per minute, so the anonymous daily pool covers several hours of audio per day. Signed-in accounts get a larger 30,000-token daily pool. That past, transcription is pay-as-you-go, with token top-ups from $1.

ڪوريائي جي ترانسڪريپشن کي اصلي اسڪرپٽ (UTF-8) ۾ موٽايو ويندو آھي. ڪوريائي جي متن ۾ لفظن جي وچ ۾ خالي جاءِ نه آھي، ڊائريزيشن ٽائمسٽامپ ڳالهائيندڙ جي موڙ تي طبعي وقفا شامل ڪندا آھن.

MP3, WAV, M4A, FLAC, OGG, OPUS, ۽ WEBM سڌو سنئون قبول ڪيا ويندا آھن. وڊيو (MP4, MOV, MKV) لاءِ اسان ان کي Whisper ڏانهن موڪلڻ کان اڳ آڊيو ٽريڪ کي سرور پاسي مان ڪڍي ڇڏيو آھي - توھان کي پاڻ کي ڪابه شيء تبديل ڪرڻ جي ضرورت نه آھي. ھڪ ئي پائپ لائن جڏھن به مرڪزي ٻولي، ڪوريائي سميت.

نامعلوم اپ لوڊ جي حد تقريبن 500 MB في فائل آهي. داخل ٿيل اڪائونٽ 2 GB تائين وڃن ٿا. ڊگھائي سخت حد نه آهي - ڊگھيون فائلون پاڻمرادو ٽڪرا ٿي وينديون آهن (30 سيڪنڊن جون ونڊوز گڏيل) ۽ مسلسل وقت جي نشانين سان هڪڙي ترانسڪريٽ ۾ گڏجي وينديون آهن. ڪيترن ڪلاڪن جي ڪوريائي رڪارڊنگ (پوڊڪاست، مڪمل محاضرا، گڏجاڻيون) سٺي ڪم ڪنديون آهن.

ائين آھي - هر ڪوريائي ترانسڪريٽ لاءِ ٻُڌندڙ جي ڊيٽابيس جي ترتيب ڏنل ترتيب ڏنل آھي. خروجي کي وقت جي نشانين سان ٻُڌندڙ 1 / ٻُڌندڙ 2 / ٻُڌندڙ 3 طور حصن ۾ ورهايو ويو آھي، تنھنڪري مداخلت، پينل بحث ۽ ملٽي پارٽي ڪانفرنسون ليڪچر سان واپس اچن ٿيون. ڊائياريزيشن جدا ماڊل تي هلندو آھي ۽ اسان جي سڀني ٻولين ۾ ساڳيو ڪم ڪندو آھي.

هوء - URL کي /transcribe/youtube/ ۾ يوٽيوب لاءِ يا /transcribe/podcast/ ۾ پوڊ ڪاسٽ فيڊ (Apple، Spotify، RSS) لاءِ پيسٽ ڪريو. اسان آڊيو ڊائون لوڊ ڪيو، ان کي Whisper ذريعي run ڪريون ٿا language=ko سان، ۽ وقت جي نشانين ۽ ڳالهائيندڙ جي نشانين سان transcript کي واپس ڪريون ٿا. عام ڪوريائي مواد: پوڊ ڪاسٽ، ڪلاس، مقابلا، ۽ ڊگهي-فارم يوٽيوب مواد ۾ ڪوريائي سڀ کان عام ڪم لوڊ اسان ڏسندا آهن.

Whisper جي قيمت تقريبن 50 ٽوڪنز جي آهي، تنهنڪري هڪ ڪلاڪ جي رڪارڊنگ ~3,000 ٽوڪنز آهي. اڪثر صارفين ڪڏهن به ڪجهه خرچ نه ڪندا آهن - 30,000 ٽوڪنز جي مفت روزاني پول ۾ مختصر ڪلپ، آواز جون نوٽس ۽ هڪ دفعي پوڊ ڪاسٽ شامل آهن. ان کانسواءِ، ترنسڪريشن ادا ڪرڻ جي برابر آهي، ٽوڪنز جي ٽاپ اپ $1 کان.

ھائو - ٻنهي حصي جي سطح (هر ~10-30 سيڪنڊ) ۽ لفظ جي سطح تي وقت جو نشان موجود آھي. لفظ جي سطح VTT/SRT جي سبٽيٽل جي برآمد لاءِ اڻلڀ آھي تنھنڪري عنوان لائين-ب-لائين سان سنئين لائين ۾ آهن. API تي timestamps="word" درخواست جي جسم ۾ مقرر ڪريو. ڪوريائي جي ترانسڪريپشن کي اصلي اسڪرپٽ (UTF-8) ۾ موٽايو ويندو آھي. ڪوريائي جي متن ۾ لفظن جي وچ ۾ خالي جاءِ نه آھي، ڊائريزيشن ٽائمسٽامپ ڳالهائيندڙ جي موڙ تي طبعي وقفا شامل ڪندا آھن.

ھائو. /v1/transcribe/ ڏانهن POST آڊيو (multipart/form-data، field name "file") سان language=ko - يا لغة پاراميٽر کي ڇڏي ڏيو ته Whisper پاڻمرادو ڳولي. JSON سان transcript، segments، timestamps، ۽ speaker labels واپس ڪري. مڪمل حوالو ۽ SDK snippets at /api/.

ائين آھي - جڏھن ترڪيب پوري ٿئي، ترجمو ڪرڻ تي ڪلڪ ڪريو يا متن کي /translate/ ۾ لکو. ڪوريائي اسان جي مدد ڪيل سڀني ٻولين سان گڏجي گڏجي ٿو (200+). گڏجاڻي جي ميٽنگن لاءِ ترڪيب کي /summarize/ ذريعي پيپ ڪريو؛ ڊبلنگ لاءِ ان کي /voice/tts/ ڏانهن موڪليو ته مقصد جي ٻولي ۾ آڊيو رڪارڊ ڪيو وڃي.

Whisper کي 680K ڪلاڪن جي آواز جي حقيقي دنيا ۾ تربيت ڏني وئي آهي، تنھنڪري ڪوريائي ترميم پس منظر جي آواز، موسيقي جي بستر ۽ فون جي معيار جي رڪارڊنگ لاءِ مضبوط آھي. سخت ڪلپنگ يا ڪيترائي مٿاهين اسپيڪر اڃا تائين دقت کي نقصان پهچائيندا.جيڪڏهن ڪو به نقل استعمال نه ٿي سگهيو ته contact@free.ai کي فائيل سان اي ميل ڪريو - اسان ٽوڪنز واپس ڪنداسين ۽ ڏسنداسين ته ڇا ٻيو انجنيئر توهان جي آڊيو کي بهتر سنڀاليندو.

Free.ai پيار؟ پنھنجي دوستن کي چئو!

ھن صفحي کي تصنيف ڪريو