StyleTTS 2

Free.ai (self-hosted) · tts · ~500 žetony na žetony clip · 4.6 od 5 uživatelé této kategorie
~500 žetony na žetony clip

StyleTTS 2 je a hlas text-to-speech postavený Yinghao Aaron Li. Nejsilnější na Voice cloning without training data; expressive multilingual speech.. Self-hosted on Free.ai GPUs - zdarma běží proti vašemu každodennímu token bazénu (500 tokens na klip). Vydáno pod MIT - komerční použití povoleno na Free.ai.

Často kladené otázky

StyleTTS 2 podporuje širokou škálu jazyků. Přesný seznam závisí na motoru; formulář na této stránce přijímá jakýkoliv text a motor bude vykreslovat ve svých podporovaných jazycích. Podívejte se /voice/ pro plný multi-motorový sběrač, pokud potřebujete konkrétní jazyk.

Většina motorů definitivně neutrální-americké angličtiny a region-vhodné akcent pro non-anglické jazyky. Premium motory mohou odhalit varianty akcentu - vložit vzorek k porovnání.

Podpora SSML se liší podle motoru. Pauza, prosody, a důraz značky jsou vyznamenány na většině prémiových motorů a na několika samo-hostovaných. Jednoduchý text vždy funguje - žádný markup vyžaduje.

Streamování TTS je k dispozici na prémiových motorech přes /v1/tts/ API koncového parametru stream=true. Web UI na této stránce vrací celý klip, jakmile renderování skončí.

StyleTTS 2 běží na našich vlastních GPU. Generace čerpá z vašeho každodenního volného bazénu jako první. Jakmile vyčerpán, placené žetony začínají na 5 dolarů → 200 000 žetonů. Zhruba ~5 žetony na znak, minimálně 100 za klip.

Až 5000 znaků na vyžádání na webovém UI. Pro delší kusy (audiobooky, celé kapitoly), použijte /voice/audiobook/ které automaticky roztrhá a stehy, nebo zavolejte API do smyčky.

Ano - POST seznam řetězců na /v1/tts/batch/, nebo použijte pracovní prostor UI v /workspace/ řetěz TTS do delšího potrubí (např., přeložit → mluvit → oko).

Ano - POST text na /v1/tts/ s modelem="StyleTTS 2" (nebo slimák na této stránce). Vrací WAV nebo MP3. Viz /api/ pro plné odkazy + SDK úryvky.

Tato stránka je text-to-speech, ne hlasový klonování - hlas je výchozím motorem. Pro klonování hlasu (nahrávání referenčního zvuku), viz /voice/clone/, což vyžaduje buď vlastnit hlasová práva nebo mít výslovný písemný souhlas.

Samohostované motory běží na GPU vlastněných Free.ai, nic neopouští naše servery. Premium motory přecházejí text na poskytovatele předchůdců modelů pod naší DPA. Netrénujeme na vašich vstupech a neprodáváme data.

Ano - Free.ai uděluje komerční využití generovaného zvuku. Základní licence motoru (Apache 2.0, MIT nebo podmínky prodeje) je uvedena výše a na modelové referenční stránce; v praxi to znamená hlasové, reklamy, podcasty a aplikace jsou všechny in-scope.

Ano - neúspěšné práce auto-refundace ke zdroji (denní bazén nebo placené žetony). Pokud se náhrada neukáže ve stejný den, e-mail contact@free.ai.

Love Free.ai? Tell your friends!

Ohodnotit tuto stránku