StyleTTS 2

Free.ai (self-hosted) · tts · ~500 För varje clip · 4.6 från 5 användare i denna kategori
~500 För varje clip

StyleTTS 2 är a Text-till-tal-röst byggd av Yinghao Aaron Li. Starkast i Voice cloning without training data; expressive multilingual speech.. Självvärdig på Free.ai GPUs – körs gratis mot din dagliga tokenpool (500 tokens per klipp). Släppt under MIT - tillåten kommersiell användning på Free.ai.

Vanliga frågor

StyleTTS 2 stöder ett brett spektrum av språk. Den exakta listan beror på motorn. Formuläret på den här sidan accepterar alla texter och motorn återger på de språk som stöds. Se /voice/ för den fullständiga multimotorväljaren om du behöver ett specifikt språk.

De flesta motorer ger neutral-amerikanska engelska som standard och en region-lämplig accent för icke-engelska språk. Premium motorer kan exponera accent varianter - klistra in ett prov för att jämföra.

SSML-stöd varierar beroende på motor. Paus, prosody och betoningstaggar är hedrade på de flesta premiummotorer och på några självvärdiga. Enkel text fungerar alltid - ingen markering krävs.

Strömma TTS finns på premium motorer via /v1/tts/ API-slutpunkten med stream=true. Webben UI på denna sida returnerar hela klippet när rendering avslutas.

StyleTTS 2 körs på våra egna GPU. Generation drar från din dagliga fri pool först. När utarmat, betalas polletter börjar på $ 5 → 200.000 tokens. Grovt ~5 tokens per karaktär, minst 100 per klipp.

Upp till 5000 tecken per begäran på webben UI. För längre stycken (audioböcker, fullständiga kapitel), använd /voice/audiobook/ som delar och stygn automatiskt, eller ring API i en loop.

Ja - POST en lista med strängar till /v1/tts/batch/, eller använd arbetsytan UI på /workspace/ för att kedja TTS till en längre pipeline (t.ex., översätta → tala → stygn).

Ja - POST text till /v1/ tts/ med modell="StyleTTS 2" (eller snigel på denna sida). Returnerar WAV eller MP3. Se /api/ för fullständig referens + SDK snippets.

Den här sidan är text-till-tal, inte röstkloning - rösten är motorns standard. För röstkloning (uppladdning av ett referensljud), se /voice/clone/, vilket kräver att du antingen äger rösträttigheterna eller har ett uttryckligt skriftligt samtycke.

Självvärdiga motorer körs på Free.ai-ägda GPU:er; ingenting lämnar våra servrar. Premiummotorer skickar text till uppströms modeller under vår DPA. Vi tränar inte på dina ingångar och säljer inte data.

Ja - Free.ai beviljar kommersiell användning av genererat ljud. Motorns underliggande licens (Apache 2.0, MIT, eller leverantörsvillkor) visas ovan och på modellens referenssida; i praktiken betyder det röstövergångar, annonser, podcasts och appar är alla i-scope.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Love Free.ai? Tell your friends!

Betygsätt denna sida