آزاد الباني ترڪيب

AI سان الباني آڊيو ۽ وڊيو کي متن ۾ تبديل ڪريو. جلدي، درست ۽ مفت.

ڪيئن ڪم ڪري ٿو

  1. ھتي وڃو Free.ai ترانسڪريٽر
  2. پنھنجي الباني آڊيو يا وڊيو فائل اپ لوڊ ڪريو
  3. اسان جو AI پاڻمرادو الباني ڳولي ٿو ۽ ان کي نقل ڪري ٿو
  4. پنھنجي ترانسڪريٽ کي متن يا SRT عنوانن طور ڊائون لوڊ ڪريو

الباني لکڻ جي خاصيتون

  • ✓faster-whisper طرفان هلايو ويو (MIT لائسنس ٿيل)
  • ✓الباني ٻوليءَ جو پاڻمرادو ڳولا
  • ✓MP3، WAV، MP4، M4A، FLAC ۽ وڌيڪ کي سپورٽ ڪري ٿو
  • ✓وقت جي نشان ۽ سبٽيٽل برآمد (SRT)
  • ✓ڪابه فائل سائز جي حد
  • ✓پرائيويٽ ۽ محفوظ -- فائل پروسيس ڪرڻ کانپوءِ حذف ڪيو ويندو

ٻولي جون تفصيلون

ٻوليالباني
ISO ڪوڊsq
AI ماڊلfaster-whisper
قيمتمفت

وڌيڪ ٻوليون

سڀ ٻوليون ڏسو

پڇاڙي

الباني Whisper لاءِ گهٽ ذخيرو ٻولي آهي - large-v3-turbo 25% لفظ غلطي جي شرح کان مٿي آهي، ڪڏهن ڪڏهن وڏا وڏا. ترنسڪريٽ ڳولا ۽ gist لاءِ فائديمند آهي پر شايع ڪرڻ لاءِ تيار طور نه سمجهيو وڃي. جيڪڏھن الباني لاءِ وڌيڪ درست انجن موجود ٿئي ٿو ته اسين ان کي پاڻمرادو ڳنڍيون ٿا.(Tier D, over 25% word error rate on benchmark sets - اسان مارڪيٽنگ دعوائن جي بدران سچي WER ٽائر شايع ڪندا آهيون.)

ھائو - الباني transcription your daily free token pool from drawn first. Audio costs about 50 tokens per minute, so the anonymous daily pool covers several hours of audio per day. Signed-in accounts get a larger 30,000-token daily pool. That past, transcription is pay-as-you-go, with token top-ups from $1.

الباني transcripts معياري UTF-8 ۾ واپس ڪيا ويا آھن ٻوليءَ جي عام اچار سان.

MP3, WAV, M4A, FLAC, OGG, OPUS, ۽ WEBM سڌو سنئون قبول ڪيا ويندا آھن. وڊيو (MP4, MOV, MKV) لاءِ اسان ان کي Whisper ڏانهن موڪلڻ کان اڳ آڊيو ٽريڪ کي سرور پاسي مان ڪڍي ڇڏيو آھي - توھان کي پاڻ کي ڪابه شيء تبديل ڪرڻ جي ضرورت نه آھي. ھڪ ئي پائپ لائن جڏھن به مرڪزي ٻولي، الباني سميت.

نامعلوم اپ لوڊ جي حد تقريبن 500 MB في فائل آهي. داخل ٿيل اڪائونٽ 2 GB تائين وڃن ٿا. ڊگھائي سخت حد نه آهي - ڊگھيون فائلون پاڻمرادو ٽڪرا ٿي وينديون آهن (30 سيڪنڊن جون ونڊوز گڏيل) ۽ مسلسل وقت جي نشانين سان هڪڙي ترانسڪريٽ ۾ گڏجي وينديون آهن. ڪيترن ڪلاڪن جي الباني رڪارڊنگ (پوڊڪاست، مڪمل محاضرا، گڏجاڻيون) سٺي ڪم ڪنديون آهن.

ائين آھي - هر الباني ترانسڪريٽ لاءِ ٻُڌندڙ جي ڊيٽابيس جي ترتيب ڏنل ترتيب ڏنل آھي. خروجي کي وقت جي نشانين سان ٻُڌندڙ 1 / ٻُڌندڙ 2 / ٻُڌندڙ 3 طور حصن ۾ ورهايو ويو آھي، تنھنڪري مداخلت، پينل بحث ۽ ملٽي پارٽي ڪانفرنسون ليڪچر سان واپس اچن ٿيون. ڊائياريزيشن جدا ماڊل تي هلندو آھي ۽ اسان جي سڀني ٻولين ۾ ساڳيو ڪم ڪندو آھي.

هوء - URL کي /transcribe/youtube/ ۾ يوٽيوب لاءِ يا /transcribe/podcast/ ۾ پوڊ ڪاسٽ فيڊ (Apple، Spotify، RSS) لاءِ پيسٽ ڪريو. اسان آڊيو ڊائون لوڊ ڪيو، ان کي Whisper ذريعي run ڪريون ٿا language=sq سان، ۽ وقت جي نشانين ۽ ڳالهائيندڙ جي نشانين سان transcript کي واپس ڪريون ٿا. عام الباني مواد: ليڪچر، مقابلا، آواز نوٽس، ۽ يوٽيوب مواد الباني ۾ سڀ ڪم - /transcribe/youtube/ ۾ URL کي چٽيو يا فائل کي سڌو سنئون اپ لوڊ.

Whisper جي قيمت تقريبن 50 ٽوڪنز جي آهي، تنهنڪري هڪ ڪلاڪ جي رڪارڊنگ ~3,000 ٽوڪنز آهي. اڪثر صارفين ڪڏهن به ڪجهه خرچ نه ڪندا آهن - 30,000 ٽوڪنز جي مفت روزاني پول ۾ مختصر ڪلپ، آواز جون نوٽس ۽ هڪ دفعي پوڊ ڪاسٽ شامل آهن. ان کانسواءِ، ترنسڪريشن ادا ڪرڻ جي برابر آهي، ٽوڪنز جي ٽاپ اپ $1 کان.

ھائو - ٻنهي حصي جي سطح (هر ~10-30 سيڪنڊ) ۽ لفظ جي سطح تي وقت جو نشان موجود آھي. لفظ جي سطح VTT/SRT جي سبٽيٽل جي برآمد لاءِ اڻلڀ آھي تنھنڪري عنوان لائين-ب-لائين سان سنئين لائين ۾ آهن. API تي timestamps="word" درخواست جي جسم ۾ مقرر ڪريو. الباني transcripts معياري UTF-8 ۾ واپس ڪيا ويا آھن ٻوليءَ جي عام اچار سان.

ھائو. /v1/transcribe/ ڏانهن POST آڊيو (multipart/form-data، field name "file") سان language=sq - يا لغة پاراميٽر کي ڇڏي ڏيو ته Whisper پاڻمرادو ڳولي. JSON سان transcript، segments، timestamps، ۽ speaker labels واپس ڪري. مڪمل حوالو ۽ SDK snippets at /api/.

ائين آھي - جڏھن ترڪيب پوري ٿئي، ترجمو ڪرڻ تي ڪلڪ ڪريو يا متن کي /translate/ ۾ لکو. الباني اسان جي مدد ڪيل سڀني ٻولين سان گڏجي گڏجي ٿو (200+). گڏجاڻي جي ميٽنگن لاءِ ترڪيب کي /summarize/ ذريعي پيپ ڪريو؛ ڊبلنگ لاءِ ان کي /voice/tts/ ڏانهن موڪليو ته مقصد جي ٻولي ۾ آڊيو رڪارڊ ڪيو وڃي.

Whisper جو شور تربيت هن درجي تي ٿورو مددگار آھي - bottleneck الباني آڊيو Whisper جي مقدار آھي جيڪا تربيت دوران ڏٺو ويو آھي، نه ته شور. صاف اسٽوڊيو آڊيو اڃا تائين شور آڊيو کي ڀڃي ٿو، پر نه ئي اھڙي دقت کي پھچندو جنھن کي توھان اعليٰ وسيلو ٻولي تي حاصل ڪندا.جيڪڏهن ڪو به نقل استعمال نه ٿي سگهيو ته contact@free.ai کي فائيل سان اي ميل ڪريو - اسان ٽوڪنز واپس ڪنداسين ۽ ڏسنداسين ته ڇا ٻيو انجنيئر توهان جي آڊيو کي بهتر سنڀاليندو.

Free.ai پيار؟ پنھنجي دوستن کي چئو!

ھن صفحي کي تصنيف ڪريو