Parler-TTS Large

Free.ai (self-hosted) · tts · ~500 token/s clip · 4.6 from 5 kategoria honetako erabiltzaileak
~500 token/s clip

Parler-TTS Large a testu-hizketa ahotsa da, HuggingFace-ek eraikia. Strongest at Controllable speech ("spoken quickly with a British accent"), research.. Free.ai GPUtan auto-ostatua — zure eguneroko token pool-aren aurka doan exekutatzen da (500 tokens klip bakoitzeko). Apache 2.0 lizentziapean argitaratua - erabilera komertziala Free.ai lizentziapean baimenduta.

Maiz egiten diren galderak

Parler-TTS Large-ek hizkuntza-sorta zabala onartzen du. Zerrenda zehatza motorearen araberakoa da; orrialde honetako formularioak edozein testu onartzen du eta motorrak onartutako hizkuntzak errendatuko ditu. Ikusi /voice/ motor anitzeko hautatzaile osoa hizkuntza jakin bat behar baduzu.

Motor gehienek ingeles amerikar neutroa errendatzen dute lehenespenez, eta eskualde-azentua ingelesez ez diren hizkuntzetan. Premium motorrek azentu-aldaketak erakutsi ditzakete - itsatsi lagin bat konparatzeko.

SSML euskarria motorearen arabera aldatzen da. Pause, prosody eta emphasis etiketak premium motor gehienetan eta autohostatutako motor batzuetan onartzen dira. Testu arruntak beti funtzionatzen du - ez da markaketarik behar.

TTS streaming-a premium motorretan erabil daiteke /v1/tts/ API amaierako puntuaren bidez stream=true-rekin. Orri honetako web UI-ak klip osoa itzuliko du errendatzea amaitzen denean.

Parler-TTS Large gure GPU propioetan exekutatzen da. Sorkuntzak zure eguneroko biltegi libretik ateratzen du lehenik. Utzi ondoren, ordaindutako tokenak $5 → 200.000 tokenetan hasten dira. Gutxi gorabehera ~5 token karaktere bakoitzeko, gutxienez 100 klip bakoitzeko.

Web UI-ko eskaera bakoitzeko 5.000 karaktere arte. Zati luzeagoetarako (audio-liburuak, kapitulu osoak), erabili /voice/audiobook/, automatikoki zatitu eta elkartu egiten dena, edo API-ari begizta batean deitu.

Bai - POST kate zerrenda bat /v1/tts/batch/-ra, edo erabili /workspace/-ko laneko arearen UIa TTS kanalizazio luzeago batean kateatzeko (adibidez, itzuli → hitz egin → lotu).

Bai - POST testua /v1/tts/-ra model="Parler-TTS Large"-rekin (edo orri honetan dagoen slug-arekin). WAV edo MP3 itzultzen du. Ikusi /api/ erreferentzia osoa + SDK zatiak ikusteko.

Orri hau testua hizketarako da, ez ahotsa klonatzekoa - ahotsa motorearen lehenespenekoa da. Ahotsa klonatzeko (erreferentziazko audioa igotzeko), ikus /voice/clone/, eta horretarako ahotsaren eskubideak eduki behar dituzu edo idatzizko baimen esplizitua.

Auto-ostatutako motorrak Free.ai-en GPUetan exekutatzen dira; ezer ez da gure zerbitzarietatik irteten. Premium motorrek testua gure DPAren arabera goi-mailako modelo-hornitzaileei pasatzen diete. Ez dugu zure sarrerak entrenatzen eta ez ditugu datuak saltzen.

Bai - Free.ai-ek sortutako audioa erabiltzeko baimena ematen du. Motorren oinarrizko lizentzia (Apache 2.0, MIT edo saltzailearen baldintzak) goian eta ereduaren erreferentzia-orrian agertzen da; praktikan, honek esan nahi du ahots-argazkiak, iragarkiak, podcastak eta aplikazioak denak barne hartzen direla.

Bai - huts egin duten lanak automatikoki itzuli iturburura (eguneroko pool-a edo ordaindutako tokenak). Egun berean itzulirik agertzen ez bada, bidali mezu elektroniko bat contact@free.ai helbidera.

Maite duzu Free.ai? Esan lagunei!

Balioetsi orrialde hau