VibeVoice

Free.ai (self-hosted) · tts · ~500 Prometium clip · 4.5 van 4 gebruikers van hierdie kategorie
~500 Prometium clip

VibeVoice is a teks- na- sech stem gebou deur Microsoft. Sterkste by Long-form audiobooks and multi-speaker podcasts with up to four distinct voices.. Self-geëneer op Free.ai GPUs - hardloop vry teen jou daaglikse vormbad (500 Proformations per clip). Vrygestel onder MIT - kommersiële gebruik wat op Free.ai toegelaat is.

Gebruik via API

OpenAI- versoenbaar met REST API. Genereer 'n sleutel en noem hierdie model in sekondes.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"vibevoice","text":"hello world"}'
API Dokumentasie Kry 'n Pi-sleutel

Vrae wat dikwels gevra word

VibeVoice ondersteun 'n wye verskeidenheid tale. Die presiese lys hang van die enjin af; die vorm op hierdie bladsy aanvaar enige teks en die enjin sal in sy ondersteunde tale vertaal. Sien / fak/ vir die volle multi-enjinsplukker as jy 'n spesifieke taal nodig het.

Most engines render neutral-American English by default and a region-appropriate accent for non-English languages. Premium engines may expose accent variants - paste a sample to compare.

SSML-ondersteuning wissel deur 'n enjin. Pouseer, prosody en klemetikette word geëer op uiters premiese enjins en op 'n paar self-geëntenes. Eenvoudige teks werk altyd ☞ geen merk op wat nodig is nie.

Stroom TTS is beskikbaar op premies enjins via die /v1/ts/ 'nPI-punt met stroom=waar. Die web UI op hierdie bladsy gee terug die volledige clip wanneer dit begin eindig.

VibeVoice loop op ons eie GPUs. 'n Geslag trek eerste van jou daaglikse vry poel af. As jy eers uitgeput is, begin jy met $5 → 200 (R5 000) per karakter, minimum 100 per clip.

Tot 5 000 karakters per versoek op die web UI. Vir langer stukke (audioboeke, volledige hoofstukke), gebruik / fakture/audiobook/ wat dele en steke outomaties, of noem die API in 'n lus.

Ja ← POST'n lys stringe na /v1/ts/bat /, of gebruik die werkruimte UI by /workspace/ om TTS in'n langer pyp (bv., vertaal → praat → stice).

Ja ▫ POT-teks na /v1/ts/ met model="VibeVoice" (of die slug op hierdie bladsy). Rets WAV of MP3. Sien /api/ vir volledige verwysing + SDK-flenters.

Hierdie bladsy is teks- to-sech, nie stem kloning Nilsson die stem is die enjin se verstek. Vir stem kloning (laai van 'n verwysing oudio), sien / facuration/cone /, wat vereis dat jy die stem regte besit of eksplisiete geskrewe toestemming het.

Self-gegasheerde enjins loop op Free.ai-gesneier GPUs; niks laat ons bedieners oor nie. Premium enjins stuur teks na stroomop model verskaffers onder ons DPA. Ons oefen nie op u invoers nie en verkoop nie data nie.

Ja - Free.ai gee kommersiële gebruik van opgewekte oudio. Die enjin se onderliggende lisensie (Apache 2.0, MIT, of verkopersterme) word bo en op die modelverwysingblad vertoon; in werklikheid beteken dit stemoorde, advertensies, poste en apps alles in-scope.

Ja Ł het gefaal werke outo-refaund na die bron (huidlik pool of betaalde bewysbriewe). As 'n refund nie vertoon dieselfde dag, e-pos kontak@free.ai.

Like this tool? Share it!

Tempo hierdie bladsy