StyleTTS 2

Free.ai (self-hosted) · tts · ~500 tocynnau y eiliad clip · 4.6 o 5 defnyddwyr y categori yma
~500 tocynnau y eiliad clip

Mae StyleTTS 2 yn a testun-i-lafaru a adeiladwyd gan Yinghao Aaron Li. Mwyaf gryf wrth Voice cloning without training data; expressive multilingual speech.. Hunan-gartrefedig ar Free.ai GPUs — rhedeg yn rhad ac am ddim yn erbyn eich pool tocynnau bob dydd (500 tokens am bob clip). Rhyddhawyd o dan MIT - caniateir defnydd masnachol o dan Free.ai.

Cwestiynau a ofynnir yn aml

Cynhelir nifer o ieithoedd gan StyleTTS 2. Mae'r rhestr gywir yn dibynnu ar y peiriant; mae'r ffurflen ar y dudalen hon yn derbyn unrhyw destun a bydd y peiriant yn arlunio mewn ieithoedd a gynhelir. Gweler /voice/ am y dewisydd aml-beiriant llawn os oes angen iaith benodol arnoch.

Mae' r rhan fwyaf o beiriant yn dangos Saesneg Americanaidd niwtral yn rhagosodedig a gwraidd yn addas i' r ardal ar gyfer ieithoedd nad ydynt yn Saesneg. Gall beiriant premiwm arddangos newidiadau gwraidd - gludwch enghraifft i' w gymharu.

Mae cynhaliaeth SSML yn amrywio yn ôl peiriant. Mae tagiau seibio, prosody, ac amlygu yn cael eu cydnabod ar y mwyafrif o beirianyddion premiwm ac ar rai hunan- westeiedig. Mae testun plaen yn gweithio o hyd - nid oes angen marcio.

Mae TTS llif ar gael ar beirianyddion premiwm drwy'r /v1/tts/ API endpoint gyda stream=true. Mae'r UI gwe ar y dudalen hon yn dychwelyd y clip llawn pan mae'r llunio wedi gorffen.

Mae StyleTTS 2 yn rhedeg ar ein GPUs ein hunain. Mae'r genhedlaeth yn tynnu o'ch cronfa rhad ac am ddim bob dydd yn gyntaf. Pan fydd wedi ei ddiflannu, mae tocynnau a brynwyd yn dechrau ar $5 → 200,000 o tocynnau. Yn llai na ~5 tocyn am bob nod, o leiaf 100 am bob clip.

Hyd at 5,000 o nodau ar gyfer pob cais ar y rhyngwyneb gwe. Ar gyfer darnau hirach (llyfrau sain, pennod gyfan), defnyddiwch /voice/audiobook/ sy'n torri a sticio'n awtomatig, neu ffoniwch yr API mewn cylch.

Ie - POST rhestr o linynnau i /v1/tts/batch/, neu defnyddiwch y rhyngwyneb defnyddiwr gweithfan yn /workspace/ i gysgodi TTS i mewn i pibellau hirach (e.e., cyfieithu → siarad → stitch).

Ie - POST testun i /v1/tts/ gyda model="StyleTTS 2" (neu'r slug ar y dudalen hon). Dychwelyd WAV neu MP3. Gweler /api/ am gyfeiriad llawn + darnau SDK.

Testun-i-leferydd yw'r dudalen hon, nid clonio llais - rhagosodiadau'r peiriant yw'r llais. Am glonio llais (lwytho sain cyfeirio i fyny), gweler /voice/clone/, sy'n gofyn i chi fod yn berchen ar hawliau'r llais neu fod gennych ganiatâd ysgrifenedig clir.

Rheda peiriannau hunan-gartrefedig ar GPUs Free.ai-ei hun; ni ddaw dim o'n gweinyddion. Mae peiriannau premiwm yn pasio testun i ddarparwyr modelau uwch-lawr dan ein DPA. Ni ddysgwn ar eich mewnbwn, ac ni werthir data.

Ie - mae Free.ai yn rhoi caniatâd i ddefnyddio sain a gynhyrchir yn fasnachol. Mae trwydded sylfaenol y peiriant (Apache 2.0, MIT, neu delerau'r gwerthwr) yn cael ei dangos uwchben a ar y dudalen cyfeirio model; yn ymarferol mae hyn yn golygu bod y geiriau, hysbysebion, newyddion, a rhaglenni i gyd yn rhan o'r amrediad.

Ie - ad-dalu swyddi methu'n awtomatig i'r ffynhonnell (cyfanswm diwrnod neu tocynnau talu). Os nad yw ad-daliad yn ymddangos yr un diwrnod, e-bostiwch contact@free.ai.

Hoff Free.ai? Meddwl eich ffrindiau!

Graddio'r dudalen hon