StyleTTS 2

Free.ai (self-hosted) · tts · ~500 tokens per clip · 4.6 saka 5 Users of this category
~500 tokens per clip

StyleTTS 2 iku a teks-ka-waca kang dibangun déning Yinghao Aaron Li. Strongest at Voice cloning without training data; expressive multilingual speech.. Free.ai GPUs — dioperasikeun gratis ngalawan pool token anjeun saben dinten (500 tokens per clip). Dirilis ing MIT - panggunaan komersial diijini ing Free.ai.

Takon-takon sing asring diajukake

StyleTTS 2 ngadukung loba basa. Daftar anu bener gumantung kana mesin; formulir dina halaman ieu nampi teks naon waé sarta mesin bakal ngahasilkeun dina basa anu didukung. Lihat /voice/ pikeun milih multi-engine lengkep lamun peryogi basa husus.

Kabéh mesin ngahasilkeun basa Inggris Amerika netral sacara piawai sarta aksen anu cocog pikeun wewengkon pikeun basa non-Inggris. Mesin Premium bisa ngajelaskeun variasi aksen - lebetkeun conto pikeun ngabandingkeun.

Dukungan SSML béda-béda gumantung kana mesin. Tag pause, prosody, jeung emphasis dihormat dina kabéh mesin premium sarta dina sababaraha mesin self-hosted. Teks biasa salawasna mampuh - teu merta merta.

Streaming TTS aya dina mesin premium ngaliwatan /v1/tts/ API endpoint kalawan stream=true. Web UI dina halaman ieu balikkeun klip pinuh sanggeus rendering réngsé.

StyleTTS 2 dijalankeun dina GPUs urang sorangan. Generasi drawing ti pool bébas anjeun sapopoé kahiji. Sanggeus dileungitkeun, tokens dibayar dimimitian dina $5 → 200,000 tokens. Kacepetan ~5 tokens per karakter, minimum 100 per clip.

Dina 5000 karakter per pancén dina UI web. Pikeun bagian anu langkung lami (buku audio, bab lengkep), nganggo /voice/audiobook/ anu otomatis ngagulung sareng ngagiling, atanapi ngahubungi API dina loop.

Ya - POST daftar string ka /v1/tts/batch/, atawa nganggo UI ruang kerja di /workspace/ pikeun ngahijikeun TTS kana pipa anu langkung panjang (contona, translate → speak → stitch).

Ya - POST teks ka /v1/tts/ kalawan model="StyleTTS 2" (atawa slug dina kaca ieu). Ngulang WAV atawa MP3. Lihat /api/ kanggo referensi lengkap + snippet SDK.

Halaman ieu nyaéta teks-ka-wacana, lain kloning sora - sora nyaéta piawai mesin. Pikeun kloning sora (ngunggah audio referensi), tingali /voice/clone/, anu meryogikeun anjeun gaduh hak sora atanapi ngadaptarkeun idin anu dituliskeun.

Mesin self-hosted dijalankeun dina GPU Free.ai-dipikawanoh; teu aya anu ninggalkeun server urang. Mesin premium ngaliwatan teks ka upstream model panyadia di handapeun DPA urang. Kami teu latihan dina input anjeun sarta teu ngajual data.

Ya - Free.ai ngawenangkeun pamakéan komersial tina audio anu dihasilkeun. Lisénsi mesin anu di handapeun (Apache 2.0, MIT, atawa istilah vendor) digambarkeun di luhur sarta dina halaman referensi model; dina praktekna ieu hartosna voiceover, iklan, podcast, sarta aplikasi sadayana aya dina scope.

Ya - tugas gagal dipulangkeun sacara otomatis ka sumber (pool saben dinten atanapi token dibayar). Upami dipulangkeun henteu muncul dina dinten anu sami, kirimkeun surel ka contact@free.ai.

Love Free.ai? Nyathet kanca-kancamu!

Nilai kaca iki