StyleTTS 2

Free.ai (self-hosted) · tts · ~500 gettoni per clip · 4.6 da 5 utilizzatori di questa categoria
~500 gettoni per clip

StyleTTS 2 è a voce da testo a parola costruito da Yinghao Aaron Li. Il piu' forte di Voice cloning without training data; expressive multilingual speech.. Self-hosted on Free.ai GPU Il token è libero contro il tuo token pool giornaliero (500 tokens per clip). Rilasciato sotto MIT - uso commerciale consentito su Free.ai.

Domande frequenti

StyleTTS 2 supporta un'ampia gamma di lingue. L'elenco esatto dipende dal motore; il modulo su questa pagina accetta qualsiasi testo e il motore verrà visualizzato nelle lingue supportate. Vedere /voice/ per il picker multimotore completo se avete bisogno di una lingua specifica.

La maggior parte dei motori rende l'inglese neutro-americano per impostazione predefinita e un accento adatto alla regione per le lingue non inglesi. I motori premium possono esporre le varianti di accento - incolla un campione da confrontare.

Il supporto SSML varia a seconda del motore. Pausa, prosodia e tag enfasi sono onorati sulla maggior parte dei motori premium e su alcuni auto-ospitato. Testo semplice funziona sempre - nessun markup richiesto.

Streaming TTS è disponibile su motori premium tramite l'endpoint /v1/tts/ API con stream=true. L'interfaccia utente web di questa pagina restituisce il clip completo una volta che il rendering termina.

StyleTTS 2 funziona con le nostre GPU. La generazione attinge dal tuo primo piscina gratuita quotidiana. Una volta esaurito, i gettoni pagati iniziano a $5 → 200.000 gettoni. Circa ~5 gettoni per personaggio, minimo 100 per clip.

Fino a 5.000 caratteri per richiesta sulla UI web. Per pezzi più lunghi (audiolibri, capitoli completi), utilizzare /voice/audiobook/ che si cuce automaticamente, o chiamare l'API in un ciclo.

Sì - POST una lista di stringhe in /v1/tts/batch/, oppure utilizzare l'interfaccia utente dello spazio di lavoro in /workspace/ per incatenare TTS in una pipeline più lunga (ad esempio, tradurre → parlare → punto).

Sì - Testo POST a /v1/tts/ con model="StyleTTS 2" (o il proiettile di questa pagina). Restituisce WAV o MP3. Vedere /api/ per riferimento completo + snippet SDK.

Questa pagina è testo a voce, non clonazione vocale - la voce è il valore predefinito del motore. Per la clonazione vocale (caricando un audio di riferimento), vedere /voice/clone/, che richiede di possedere i diritti di voce o avere esplicito consenso scritto.

I motori auto-ospitati funzionano su GPU di proprietà di Free.ai; nulla lascia i nostri server. I motori Premium passano testo ai fornitori di modelli a monte sotto il nostro DPA. Non ci alleniamo sui vostri input e non vendono dati.

Sì - Free.ai garantisce l'uso commerciale dell'audio generato. La licenza di base del motore (Apache 2.0, MIT, o termini del fornitore) è visualizzata sopra e sulla pagina di riferimento del modello; in pratica questo significa che voiceover, annunci, podcast e applicazioni sono tutti in-scope.

Sì - i lavori non sono riusciti a rimborsare automaticamente la fonte (piscina giornaliera o gettoni pagati). Se un rimborso non si presenta lo stesso giorno, email contact@free.ai.

Love Free.ai? Dillo ai tuoi amici!

Valuta questa pagina