MeloTTS

Free.ai (self-hosted) · tts · ~500 gettoni per clip · 4.6 da 5 utilizzatori di questa categoria
~500 gettoni per clip

MeloTTS è a voce da testo a parola costruito da MyShell. Il piu' forte di Multilingual TTS. Self-hosted on Free.ai GPU Il token è libero contro il tuo token pool giornaliero (500 tokens per clip). Rilasciato sotto MIT - uso commerciale consentito su Free.ai.

Utilizzare tramite API

API OpenAI-compatibile REST. Generare una chiave e chiamare questo modello in pochi secondi.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"melotts","text":"hello world"}'
Documentazione API Ottieni la chiave API

Domande frequenti

MeloTTS supporta un'ampia gamma di lingue. L'elenco esatto dipende dal motore; il modulo su questa pagina accetta qualsiasi testo e il motore verrà visualizzato nelle lingue supportate. Vedere /voice/ per il picker multimotore completo se avete bisogno di una lingua specifica.

La maggior parte dei motori rende l'inglese neutro-americano per impostazione predefinita e un accento adatto alla regione per le lingue non inglesi. I motori premium possono esporre le varianti di accento - incolla un campione da confrontare.

Il supporto SSML varia a seconda del motore. Pausa, prosodia e tag enfasi sono onorati sulla maggior parte dei motori premium e su alcuni auto-ospitato. Testo semplice funziona sempre - nessun markup richiesto.

Streaming TTS è disponibile su motori premium tramite l'endpoint /v1/tts/ API con stream=true. L'interfaccia utente web di questa pagina restituisce il clip completo una volta che il rendering termina.

MeloTTS funziona con le nostre GPU. La generazione attinge dal tuo primo piscina gratuita quotidiana. Una volta esaurito, i gettoni pagati iniziano a $5 → 200.000 gettoni. Circa ~5 gettoni per personaggio, minimo 100 per clip.

Fino a 5.000 caratteri per richiesta sulla UI web. Per pezzi più lunghi (audiolibri, capitoli completi), utilizzare /voice/audiobook/ che si cuce automaticamente, o chiamare l'API in un ciclo.

Sì - POST una lista di stringhe in /v1/tts/batch/, oppure utilizzare l'interfaccia utente dello spazio di lavoro in /workspace/ per incatenare TTS in una pipeline più lunga (ad esempio, tradurre → parlare → punto).

Sì - Testo POST a /v1/tts/ con model="MeloTTS" (o il proiettile di questa pagina). Restituisce WAV o MP3. Vedere /api/ per riferimento completo + snippet SDK.

Questa pagina è testo a voce, non clonazione vocale - la voce è il valore predefinito del motore. Per la clonazione vocale (caricando un audio di riferimento), vedere /voice/clone/, che richiede di possedere i diritti di voce o avere esplicito consenso scritto.

I motori auto-ospitati funzionano su GPU di proprietà di Free.ai; nulla lascia i nostri server. I motori Premium passano testo ai fornitori di modelli a monte sotto il nostro DPA. Non ci alleniamo sui vostri input e non vendono dati.

Sì - Free.ai garantisce l'uso commerciale dell'audio generato. La licenza di base del motore (Apache 2.0, MIT, o termini del fornitore) è visualizzata sopra e sulla pagina di riferimento del modello; in pratica questo significa che voiceover, annunci, podcast e applicazioni sono tutti in-scope.

Sì - i lavori non sono riusciti a rimborsare automaticamente la fonte (piscina giornaliera o gettoni pagati). Se un rimborso non si presenta lo stesso giorno, email contact@free.ai.

Love Free.ai? Dillo ai tuoi amici!

Valuta questa pagina