Parler-TTS Large

Free.ai (self-hosted) · tts · ~500 ٽوڪنز clip · 4.6 کان 5 ھن صنف جا صارفين
~500 ٽوڪنز clip

Parler-TTS Large a متن- کان- ڳالھائڻ واري آواز HuggingFace طرفان ٺاھيو ويو آھي. Controllable speech ("spoken quickly with a British accent"), research. تي تمام مضبوط. Free.ai GPUs تي پاڻمرادو ميزبان - توهان جي روزاني ٽوڪين پول (500 ٽوڪين ڪلپ) جي خلاف مفت هلندو آهي. Apache 2.0 تحت جاري ڪيو ويو - تجارتي استعمال Free.ai تي اجازت ڏني وئي.

گھڻا پڇيل سوال

Parler-TTS Large ڪيترين ٻولين کي سپورٽ ڪري ٿو. صحيح فہرست انجن تي منحصر آھي؛ هي صفحو ڪوبه متن قبول ڪري ٿو ۽ انجن ان جي مدد ڪيل ٻولين ۾ رنڊڪ ڏيندو. جيڪڏهن توھان کي ڪا خاص ٻولي گھرجي ته مڪمل ملٽي انجن چونڊيندڙ لاءِ /voice/ ڏسو.

گھڻا انجن اڻ سڌريل طور تي غير جانبدار آمريڪي انگريزي ۽ غير انگريزي ٻولين لاءِ علائقائي مناسب ڌماڪو ڏيکاريندا آھن. پرائمري انجن ڌاڪو جي مختلف قسمن کي ظاھر ڪري سگھن ٿا - مثال کي ملائڻ لاءِ مقابلو ڪريو.

SSML جو مددگار انجنيئر جي لحاظ کان مختلف آھي. وقفو، پروسيڊي، ۽ زور ڏيڻ ٽيگ اڪثر پرائمري انجنيئرن ۽ ڪين ڪي پاڻ ميزبان انجنيئرن تي احترام ڪيا ويندا آھن. عام متن هميشه ڪم ڪندو آھي - ڪو به مارڪ اپ نه گھرجي.

TTS جي اسٽريمنگ پرائمري انجنيئرن تي /v1/tts/API endpoint سان stream=true ذريعي دستياب آهي. ھن صفحي تي ويب UI مڪمل ڪلپ واپس ڪري ٿو جڏھن رندرنگ ختم ٿئي ٿو.

Parler-TTS Large اسان جي پنهنجي GPUs تي هلندو آهي. نسل پهرين توهان جي روزاني مفت پول مان نڪتل آهي. هڪ ڀيرو ختم ٿي، ادا ڪيل ٽوڪنز $5 → 200,000 ٽوڪنز تي شروع ٿيندا آهن. تقريبن ~5 ٽوڪنز هر ڪردار، گهٽ ۾ گهٽ 100 هر ڪلپ.

ويب UI تي هر درخواست تي 5,000 تائين حروف. ڊگهن حصن (آڊيو ڪتاب، مڪمل باب) لاءِ ، /voice/audiobook/ استعمال ڪريو جيڪو خودڪار طور تي ٽڪرا ۽ سٽون ڪري ٿو ، يا API کي لوپ ۾ سڏيو.

ھائو - /v1/tts/batch/ ڏانهن لفظن جو سٽون پوسٽ ڪريو، يا ڪم جي جاءِ UI کي /workspace/ تي استعمال ڪريو TTS کي ڊگهي پائپ لائن ۾ ڳنڍڻ لاءِ (مثال، ترجمو ڪريو → ڳالهائو → سٽ).

ھائو - POST متن /v1/tts/ ڏانهن model="Parler-TTS Large" سان (يا slug ھن صفحي تي). WAV يا MP3 موٽائي ٿو. مڪمل حوالن + SDK snippets لاءِ ڏسو /api/.

هي صفحو متن کان ڳالھائڻ وارو آهي، آواز جو کلون نه - آواز انجن جي ڊيفالٽ آهي. آواز جي کلوننگ (اڃا به حوالو آڊيو) لاءِ ڏسو /voice/clone/، جنهن لاءِ توھان کي آواز جا حق هجڻ يا واضح لکيل منظوري جي ضرورت آھي.

خود-موجوده انجن Free.ai-owned GPUs تي هلن ٿا؛ اسان جي سرورز تي ڪابه شيءِ نه ڇڏي. پرائمري انجن اسان جي DPA تحت مٿين ماڊل مهيا ڪندڙن کي متن موڪليندا آهن. اسان توهان جي داخلا تي تربيت نه ڪندا آهيون ۽ ڊيٽا نه وڪرو ڪندا آهيون.

ھائو - Free.ai پيدا ڪيل آڊيو جو تجارتي استعمال ڏئي ٿو. انجنيئر جو لاڳاپيل لائسنس (Apache 2.0، MIT، يا واپاري شرط) مٿي ۽ ماڊل حوالو صفحي تي ڏيکاريل آهي؛ عملي طور ان جو مطلب آواز، اشتهار، پوڊ ڪاسٽ ۽ ايپليڪيشنون سڀئي حد ۾ آهن.

ھائو - ناڪام ڪم پاڻمرادو ذريعن (ڏينهن جو پول يا ادا ڪيل ٽوڪنز) ڏانهن موٽايا ويندا. جيڪڏھن موٽائي اتي ئي ڏينھن نه ڏيکاريو وڃي ته contact@free.ai کي اي ميل ڪريو.

Free.ai پيار؟ پنھنجي دوستن کي چئو!

ھن صفحي کي تصنيف ڪريو