StyleTTS 2

Free.ai (self-hosted) · tts · ~500 žetonov na clip · 4.6 od 5 uporabniki te kategorije
~500 žetonov na clip

StyleTTS 2 je a glas besedila v jezik, ki ga zgradi Yinghao Aaron Li. Najmočnejši v Voice cloning without training data; expressive multilingual speech.. Samostojni gostitelj na Free.ai GPU – teče brezplačno proti vašemu dnevnemu žeton bazenu (500 žetonov na posnetek). Izpuščeno pod MIT - komercialna uporaba dovoljena na Free.ai.

Pogosta vprašanja

StyleTTS 2 podpira široko paleto jezikov. Natančen seznam je odvisen od motorja; oblika na tej strani sprejme katero koli besedilo in motor bo prikazal v svojih podprtih jezikih. Glejte /voice / za celoten večmotorski izbirnik, če potrebujete določen jezik.

Večina motorjev je nevtralno-ameriški angleški privzeto in regijsko primeren naglas za ne-angleške jezike. Premium motorji lahko razložijo naglasne različice - prilepite vzorec za primerjavo.

Podpora SSML se razlikuje po motorju. Pavza, prozodija in označbe za poudarek so počaščeni na večini premium motorjev in na nekaj samostojnih. Običajno besedilo vedno deluje - ni treba označevati.

Streaming TTS je na voljo na premium motorjih prek dogodka /v1/tts/ API s stream=true. Spletni uporabniški interfejs na tej strani vrne celoten posnetek, ko se opravi izdelava.

StyleTTS 2 teče na lastne GPU. Generacija izvleče iz svojega dnevnega brezplačnega bazena najprej. Ko je izčrpano, plačane žetona začnejo z 5 $ → 200.000 žetonov. Grubo ~5 žetonov na znak, najmanj 100 na posnetek.

Do 5000 znakov na zahtevo na spletnem vmesniku. Za daljše kose (audiobooks, polna poglavja), uporabite /voice/audiobook /, ki kose in šive samodejno, ali pokličite API v zanke.

Da - POST seznam nizov na /v1/tts/batch /, ali uporabite delovno mesto v /workspace / verigo TTS v daljši cevovod (npr., prevesti → govori → šiv).

Da - besedilo POST na /v1/tts / z modelom=" StyleTTS 2" (ali s kroglo na tej strani). Vrne WAV ali MP3. Za celoten referenčni prikaz + SDK.

Ta stran je besedilno-na-špik, ne kloniranje glasu - glas je privzeto za motor. Za kloniranje glasu (nalaganje referenčnega zvoka), glej /voice/klon /, ki zahteva bodisi last glasovnih pravic ali imajo izrecno pisno soglasje.

Samostojni motorji, ki tečejo na GPU v lasti Free.ai, nič ne zapusti naših strežnikov. Pogoni premium prenosa besedila ponudnikom modelov v gornjem toku v okviru našega DPA. Ne treniramo na vaših vhodih in ne prodajamo podatkov.

Da - Free.ai dodeljuje komercialno uporabo generiranega zvoka. Osnovna licenca motorja (Apache 2.0, MIT ali pogoji prodajalca) je prikazana zgoraj in na referenčni strani modela; v praksi to pomeni glasovne preglede, oglase, podcast in aplikacije so vse v okviru.

Da – neuspela delovna mesta samodejno povrnitev vira (dnevno združevanje ali plačane žetone). Če se nadomestilo ne pojavi istega dne, e-poštni naslov contact@free.ai.

Ljubezen Free.ai, povej prijateljem!

Oceni to stran