StyleTTS 2

Free.ai (self-hosted) · tts · ~500 token per clip · 4.6 dari 5 pengguna kategori ini
~500 token per clip

StyleTTS 2 adalah a suara teks-to-peech built by Yinghao Aaron Li. Terkuat di Voice cloning without training data; expressive multilingual speech.. Self-hosted on Free.ai GPUs - runs free against your daily token pool (500 token per klip). Dibebaskan dengan MIT - penggunaan komersial diijinkan pada Free.ai.

Pertanyaan yang Sering Diajukan

StyleTTS 2 mendukung berbagai bahasa. Daftar yang tepat tergantung pada mesin; bentuk pada halaman ini menerima teks apapun dan mesin akan memberikan dalam bahasa yang didukung. Lihat /voice/ untuk pemetik multi-mesin penuh jika Anda membutuhkan bahasa spesifik.

Kebanyakan mesin membuat bahasa Inggris netral Amerika secara baku dan aksen yang sesuai dengan daerah untuk bahasa non-Inggris. mesin premium dapat mengekspos varian aksen - paste sampel untuk dibandingkan.

Dukungan SSML bervariasi dengan mesin. Jeda, prosody, dan penanda penekanan dijunjung pada mesin premium dan pada beberapa teks sederhana selalu bekerja - tidak perlu markup.

Streaming TTS tersedia pada mesin premium melalui titik/v1/ API dengan stream=true. web UI di halaman ini mengembalikan klip penuh setelah render selesai.

StyleTTS 2 berjalan pada GPUs kita sendiri. Generasi menarik dari kolam Gratis harian Anda terlebih dahulu. sekali habis, token dibayar mulai dari $ 5 → 200.000 token. kasar ~5 token per karakter, minimum 100 per klip.

Hingga 5.000 karakter per permintaan di web UI. Untuk potongan yang lebih panjang (buku-buku terbuka, bab lengkap), gunakan /voice/audiobook/yang potongan dan jahitan secara otomatis, atau panggilan API dalam satu putaran.

Ya - POST daftar string ke /v1/tts/batch/, atau gunakan ruang kerja UI di /workspace/ untuk merantai TTS ke dalam pipa yang lebih panjang (mis, terjemahkan → berbicara → Stitch).

Ya - POST teks ke /v1/tts/ dengan model="StyleTTS 2" (atau siput di halaman ini). Mengembalikan WAV atau MP3. Lihat /api/ untuk referensi lengkap + snippet SDK.

Halaman ini adalah teks-ke-peech, bukan suara kloning - suara adalah default mesin. Untuk kloning suara (memloadingkat audio referensi), lihat /voice/cloke/clone/, yang mengharuskan Anda untuk memiliki hak suara atau memiliki persetujuan tertulis eksplisit.

Mesin berhosted sendiri berjalan pada Free.ai-process; tidak ada yang meninggalkan server kami. Mesin Premium mengirim teks ke penyedia model arus atas kami. Kami tidak melatih pada masukan Anda dan tidak menjual data.

Ya - Free.ai hibah penggunaan komersial dari audio yang dihasilkan. Lisensi yang ada di mesin (Apache 2.0, MIT, atau vendor) ditampilkan di atas dan di halaman referensi model; dalam praktek ini berarti voiceover, iklan, podcast, dan aplikasi semua dalam lingkup.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Cinta Free.ai?

Tingkatkan halaman ini