StyleTTS 2

Free.ai (self-hosted) · tts · ~500 Prometium clip · 4.6 van 5 gebruikers van hierdie kategorie
~500 Prometium clip

StyleTTS 2 is a teks- tot- sech stem gebou deur Yinghao Aaron Li. Sterkste by Voice cloning without training data; expressive multilingual speech.. Self-geëneer op Free.ai GPUs - hardloop vry teen jou daaglikse vormbad (500 Proformations per clip). Vrygestel onder MIT - kommersiële gebruik wat op Free.ai toegelaat is.

Vrae wat dikwels gevra word

StyleTTS 2 ondersteun 'n wye verskeidenheid tale. Die presiese lys hang af van die enjin; die vorm op hierdie bladsy aanvaar enige teks en die enjin sal in sy ondersteunde tale vertaal. Sien / faktuur/ vir die volledige multi-enjins kieser as jy 'n spesifieke taal nodig het.

Die meeste enjins gee neutrale Amerikaanse Engels met verstek en 'n streek-verrykings aksent vir nie-Engelse tale. Premium enjins kan aksentvorms blootlê - plak 'n monster om te vergelyk.

SSML-ondersteuning wissel deur enjin. Pouseer, prosody en klemetikette word geëer op uiters premies enjins en op 'n paar self-geëneerdes. Eenvoudige teks werk altyd - geen merk op wat nodig is nie.

Stroom TTS is beskikbaar op premies enjins via die /v1/ts/ 'nPI-punt met stroom=waar. Die web UI op hierdie bladsy gee terug Die volledige clip wanneer dit begin eindig.

StyleTTS 2 runs on our own GPUs. Generation draws from your daily free pool first. Once depleted, paid tokens start at $5 → 200,000 tokens. Roughly ~5 tokens per character, minimum 100 per clip.

Tot 5 000 karakters per versoek op die web UI. Vir langer stukke (audioboeke, volledige hoofstukke), gebruik / fakture/audiobook/ wat dele en steke outomaties, of noem die API in 'n lus.

Ja - POS 'n lys stringe na /v1/ts/bath /, of gebruik die werkruimte UI by /workspace/ om TTS te ketting in 'n langer pyp (bv., vertaal → praat → stice).

Ja - POST-teks na /v1/ts/ met model="StyleTTS 2" (of die slug op hierdie bladsy). Terugs WAV of MP3. Sien /api/ vir volledige verwysing + SDK-flenters.

Hierdie bladsy is teks-na-sech, nie stem kloning nie - die stem is die enjin se verstek. Vir stem kloning (laai van 'n verwysing oudio), sien / fact/cloone/, wat vereis dat jy die stemregte besit of eksplisiete geskrewe toestemming het.

Self-gegasheerde enjins loop op Free.ai-geëneer GPUs; niks laat ons bedieners los nie. Premium enjins stuur teks na stroomop model verskaffers onder ons DPA. Ons oefen nie op u invoers nie en verkoop nie data nie.

Ja - Free.ai gee kommersiële gebruik van opgewekte oudio. Die enjin se onderliggende lisensie (Apache 2.0, MIT, of verkoper terme) word bo en op die model verwysing bladsy gewys; in die praktyk beteken dit stemoor, advertensies, poste en apps alles in-scope.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Like this tool? Share it!

Tempo hierdie bladsy