CosyVoice 2

Free.ai (self-hosted) · tts · ~500 fitxes per clip · 4.5 des de 4 Usuaris d' aquesta categoria
~500 fitxes per clip

CosyVoice 2 és a veu de text a veu construït per Alibaba FunAudioLLM. Més fort a{best} per__. Auto- màquina en les GPUs Free.ai - executades en contra de la vostra piscina diària (500 fitxes per clip). Publicat sota Apache 2.0 - L' ús comercial permès en el Free.ai.

Ús mitjançant l' API

L' API OpenAI compatible amb l' OpenAI. Genera una clau i l' anomenen en segons.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"cosyvoice2","text":"hello world"}'
Documentació de l' API Obtén la clau de l' API

Preguntes més freqüents

La llista exacta dependrà del motor; la forma d' aquesta pàgina accepta qualsevol text i el motor mostrarà en les seves llengües acceptades. Mireu /voice/ per a l' especificació complet de multienginyeria si necessiteu un idioma específic.

La majoria de motors representen l' anglès neutral-americà per omissió i un accent de regió a les llengües no en anglès. Els motors Premium poden exposar variants de l' accent show enganxar una mostra a comparar.

La implementació del SSM variada pel motor. Pausa, prosodi i les etiquetes èmfasi són un honor per als motors més primes i en alguns auto- màquina. El text pla sempre funciona 255, no es requereix marques.

El flux TTS està disponible en motors de gràcia mitjançant el punt d' acabament / v1/ tts/ API amb flux=true. La interfície web d' aquesta pàgina retorna el clip complet una vegada que finalitzi la representació.

FEMEAI_ PH_ name_ s' executa a les nostres GPUs. La generació dibuixa des de la vostra piscina diària primer. Una vegada despleada, les fitxes pagades comencen a 50.000 fitxes. Dialment ~5 fitxes per caràcter, mínim 100 per clip.

Fins a 5000 caràcters per petició a la IU web. Per a peces més llargues (audibooks, capítols sencers), useu /voice/audibook/ que s' aboca automàticament, o cridar a l' API en un bucle.

Sí YAN POST Una llista de cadenes a / v1/ tts/ batch /, o useu l' IU de l' espai de treball a / workspace/ to tail TTS en una canonada més llarga (p. ex., traduïu ascii talk RT cosit).

Si ×PE text POST a / v1/ tts / amb model="CosyVoice 2 ___ " (o la bala d' aquesta pàgina). Retorna WAV o MP3. Mireu / api/ per a una referència completa + SDK retalls.

Aquesta pàgina és de text a veu, no clonar la veu és la per omissió del motor. Per a la clonació de veu (recarregar un so de referència), mireu /vovoice/clone /, el qual requereix que tingueu els drets de veu o tingueu el consentiment explícit.

Els motors auto- hosted s' executen a les GPU de Free.ai- Rurat; res deixa els nostres servidors. Els motors Premi Premium passen text per als proveïdors de model de sortida sota el nostre DPA. No entren a les vostres dades i no venen dades.

Sí - Free.ai concedeix l' ús comercial de l' àudio generat. La llicència subjacent del motor (Apache 2.0, MIT, o termes del proveïdor) es mostra més amunt i en la pàgina de referència del model; en la pràctica això significa "overses," anuncis, podcasts i aplicacions estan totes en el cas de la seva protecció.

Si l' KDEDIRS ha fallat els treballs automàtics a la font (valenty pool o fitxes pagades). Si una reembació no apareix el mateix dia, el contacte de correu electrònic@ free.ai.

Like this tool? Share it!

Valora aquesta pàgina