StyleTTS 2

Free.ai (self-hosted) · tts · ~500 kuponki clip · 4.6 mistä 5 Tämän ryhmän käyttäjät
~500 kuponki clip

StyleTTS 2 on a tekstistä puheen ääneen, jonka on rakentanut Yinghao Aaron Li. Vahvin Voice cloning without training data; expressive multilingual speech.:ssä. Itsekeskeinen Free.ai GPU:lla – kulkee vapaasti päivittäistä pokaalia vastaan ({tpm_tokeno},per lippaan). Vapautettu MIT:n alla - kaupallinen käyttö sallittu Free.ai:n kohdalla.

Usein kysyttyjä

StyleTTS 2 tukee monenlaisia kieliä. Tarkka luettelo riippuu moottorista; tämän sivun lomake hyväksyy minkä tahansa tekstin ja moottori tekee sen tuetuilla kielillä. Katso /ääni/koko monimoottorinen poimija, jos tarvitset tietyn kielen.

Useimmat moottorit tekevät neutraalista amerikkalaisesta englannista oletuksena ja alueellisesti sopivan korostuksen ei-englanninkielisille. Huippumoottorit saattavat paljastaa aksenttivariantteja - liittää niistä vertailtavan näytteen.

SSML-tuki vaihtelee moottorien mukaan. Tauko, prosody ja painotusmerkit ovat suurimmalle osalle huippuluokan moottoreista ja muutamalle omatoimiselle. Pelkkä teksti toimii aina - ei markkia tarvita.

Virtaus TTS on saatavilla premium-moottoreilla stream=truen / v1/tts/ API-päätteen kautta. Tämän sivun verkko-OSA palauttaa koko klipin, kun renderointi on valmis.

StyleTTS 2 toimii omilla GPU-laitteillamme. Generation draws from your daily free biljardin first. Kun maksulliset rahakkeet ovat loppuneet, ne alkavat 5 dollarista → 200 000 kuponkia. Noin ~5 kuponkia per merkki, vähintään 100 per klippi.

Verkko-UI:n kautta voi pyytää jopa 5 000 merkkiä. Pidemmissä kappaleissa (audiokirjat, täydet luvut) käytetään /voice/audiobookia, joka pilkkoo ja tikittää automaattisesti, tai soitetaan API-liittymään silmukassa.

Kyllä - POST luettelo naruista kohteeseen /v1/tts/lähetä/ tai käytä työtilaa UI at/workspace/ ketjuttaaksesi TTS:n pidemmäksi putkeksi (esim. kääntääksesi → puhu → ompele).

Kyllä - POST-teksti kohtaan /v1/tts/ malli="StyleTTS 2" (tai tällä sivulla oleva luoti). Palauttaa WAV:n tai MP3:n. Katso /api/-koko referenssi + SDK-piipit.

Tämä sivu on tekstistä ääneen, ei äänikloonaus - ääni on moottorin oletus. Äänikloonauksen (viiteäänen lataaminen) osalta katso /ääni/klooni/, joka edellyttää, että joko omistat äänioikeudet tai saat selkeän kirjallisen suostumuksen.

Itseohjautuvat moottorit toimivat Free.ai-omisteilla GPU-laitteilla; mikään ei jätä palvelimiamme. Premium-moottorit välittävät tekstiä DPA-malliemme alkupään mallitoimittajille. Emme harjoittele syötöistäsi emmekä myy dataa.

Kyllä - Free.ai myöntää generoidun äänen kaupallisen käytön. Moottorin lisenssi (Apache 2.0, MIT tai myyjän termit) näkyy yllä ja mallisivulla. Käytännössä tämä tarkoittaa äänityksiä, mainoksia, podcastia ja sovelluksia on kaikki skannattu.

Kyllä – epäonnistuneet työt palautuvat automaattisesti lähteeseen (päivittäin pooliin tai maksullisiin rahakkeisiin). Jos palautus ei näy samana päivänä, lähetä sähköpostia osoitteeseen contact@free.ai.

Love Free.ai? Tell your friends!

Arvostele tätä sivua