StyleTTS 2

Free.ai (self-hosted) · tts · ~500 tokens per clip · 4.6 fra 5 brugere af denne kategori
~500 tokens per clip

StyleTTS 2 er a tekst- til- tale stemme bygget af Yinghao Aaron Li. Stærkeste på Voice cloning without training data; expressive multilingual speech.. Self-hostet på Free.ai GPU'er kører gratis mod din daglige token pool (500 tokens pr. klip). Udgivelse under MIT - kommerciel brug tilladt på Free.ai.

Ofte stillede spørgsmål

StyleTTS 2 understøtter en lang række sprog. Den nøjagtige liste afhænger af motoren; formularen på denne side accepterer enhver tekst og motoren vil gengive i dens understøttede sprog. Se / stemme / for den fulde multi- motorvælger hvis du har brug for et bestemt sprog.

De fleste motorer gør neutral-amerikansk engelsk som standard og en region-passende accent for ikke-engelske sprog. Premium motorer kan udsætte accent varianter - indsætte en prøve til sammenligning.

SSML-support varierer af motor. Pause, prosody, og vægt tags er hædret på de fleste premium motorer og på et par selv-hostet dem. Plain tekst altid virker - ingen markup kræves.

Streaming TTS er tilgængelig på premium motorer via /v1/tts/ API endpoint med stream=true. Web UI på denne side returnerer det fulde klip, når rendering finish.

StyleTTS 2 kører på vores egne GPU'er. Generation trækker fra din daglige gratis pool først. Når udtømmet, betalte tokens starter på $ 5 → 200.000 tokens. Robust ~ 5 tokens per tegn, minimum 100 per klip.

Op til 5.000 tegn pr anmodning på web-UI. For længere stykker (lydbøger, fulde kapitler), brug /voice/audiobook / som bidder og sting automatisk, eller ring til API i en løkke.

Ja - POST en liste over strenge til /v1/tts/batch/, eller bruge arbejdsområde UI på /workspace / at kæde TTS i en længere rørledning (f.eks, oversætte → tale → sting).

Ja - POST tekst til /v1/tts/ med model="StyleTTS 2" (eller kuglen på denne side). Returnerer WAV eller MP3. Se / api/ for fuld reference + SDK stumper.

Denne side er tekst- til- tale, ikke stemmekloning - stemmen er motorens standard. For stemmekloning (oploade en reference lyd), se /voice/clone/, som kræver, at du enten ejer stemmen rettigheder eller har eksplicit skriftligt samtykke.

Selvhostede motorer kører på Free.ai-ejede GPU'er; intet forlader vores servere. Premium motorer sender tekst til opstrømsmodeludbydere under vores DPA. Vi træner ikke på dine input og sælger ikke data.

Ja - Free.ai giver kommerciel brug af genereret lyd. Motorens underliggende licens (Apache 2.0, MIT, eller sælger vilkår) vises ovenfor og på modellen referenceside; i praksis betyder det voiceovers, annoncer, podcasts og apps er alle i-scope.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Love Free.ai? Tell your friends!

Bedøm denne side