StyleTTS 2

Free.ai (self-hosted) · tts · ~500 mynter pr. clip · 4.6 fra 5 brukere i denne kategorien
~500 mynter pr. clip

StyleTTS 2 er a tekst- til- tale stemme bygget av Yinghao Aaron Li. Sterkeste ved Voice cloning without training data; expressive multilingual speech.. Selv vert på Free.ai GPUer – går fritt mot din daglige token pool (500 tokens per klipp). Frigitt under MIT - kommersiell bruk tillatt på Free.ai.

Ofte stilte spørsmål

StyleTTS 2 støtter et bredt utvalg av språk. Den eksakte lista avhenger av motoren. Skjemaet på denne siden godtar all tekst, og motoren vil gjengi på de språkene som er støttet. Se /voice/ for full flermotorsvelger hvis du trenger et bestemt språk.

De fleste motorer gjør om nøytral- amerikansk engelsk som standard og bruker en region- passende aksenter for ikke- engelsk. Premium- motorer kan utsette aksentvarianter - lim inn et utvalg for å sammenligne.

SSML- støtte varierer etter motor. Pause, prosodi og vekttagger æres på de fleste premium- motorer og på noen få selv- verts for dem. Enkel tekst virker alltid - ingen oppmerking trengs.

TTS- strømmen finnes på premiummotorer via sluttpunktet / v1/ ts/ API med strøm = sann. Nettgrensesnittet på denne siden returnerer det fullstendige klippet når opptegningen er ferdig.

StyleTTS 2 kjører på våre egne GPU- er. Generasjon henter fra din daglige frie basseng først. Når de er gått ut, starter betalte mynter på $5 → 200.000 tokener per tegn. Omtrent ~5 mynter per tomme, minimum 100 per klipp.

Up to 5,000 characters per request on the web UI. For longer pieces (audiobooks, full chapters), use /voice/audiobook/ which chunks and stitches automatically, or call the API in a loop.

Ja - POST en liste over strenger til /v1/tt/batch/, eller bruk arbeidsområdets grensesnitt på /workspace / for å kjede TTS til en lengre rørledning (f.eks. oversett → tale → stygg).

Ja - POST tekst til / v1/ tts/ med modell=" StyleTTS 2" (eller sneglen på denne siden). Returnerer WAV eller MP3. Se / api/ for full referanse + SDK- snutter.

Denne siden er tekst- til- tale, ikke stemmekloning - stemmen er standardvalget for motoren. For stemmekloning (laster opp en referanselyd), se /voice/ klone /, som krever at du enten eier stemmen eller har uttrykkelig skriftlig samtykke.

Selvt vertsmaskinene kjører på GPU- er som eies av Free.ai, og det er ikke noe som lar tjenerene våre stå. Premium- motorer gir tekst til oppstrøms modellleverandører i henhold til vår DPA. Vi trener ikke på dine inndata og selger ikke data.

Ja - Free.ai gir kommersiell bruk av generert lyd. Motorens underliggende lisens (Apache 2.0, MIT eller leverandørtermer) vises over og på modellreferansesiden. I praksis betyr det at alle taleover, annonser, podkaster og apper er i bruk.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Elsk Free.ai? Fortell vennene dine!

Bedøm denne siden