VibeVoice

Free.ai (self-hosted) · tts · ~500 token per clip · 4.5 dari 4 pengguna kategori ini
~500 token per clip

VibeVoice adalah a suara teks-to-peech dibangun oleh Microsoft. Strongest at Long-form audiobooks and multi-speaker podcasts with up to four distinct voices.. Self-hosted on Free.ai GPUs - runs free against your daily token pool (500 token per klip). Dilepaskan di bawah MIT - penggunaan komersial diijinkan di Free.ai.

Gunakan melalui API

API REST yang kompatibel dengan OpenAI. Hasilkan kunci dan panggil model ini dalam hitungan detik.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"vibevoice","text":"hello world"}'
Dokumentasi API Dapatkan Kunci API

Pertanyaan yang Sering Diajukan

VibeVoice supports a wide range of languages. The exact list depends on the engine; the form on this page accepts any text and the engine will render in its supported languages. See /voice/ for the full multi-engine picker if you need a specific language.

Kebanyakan mesin membuat Bahasa Inggris Amerika netral secara baku dan aksen daerah yang tidak cocok untuk bahasa Inggris.

Dukungan SSML bervariasi dengan mesin. Jeda, prosody, dan tag penekanan dihormati pada kebanyakan mesin premium dan pada beberapa teks sederhana selalu bekerja tidak perlu markup.

Streaming TTS tersedia pada mesin premium melalui ujung /v1/tts/ API dengan stream=true. UI web pada halaman ini mengembalikan klip penuh setelah render selesai.

VibeVoice berjalan pada GPU kita sendiri. Generasi menarik dari kolam bebas harian Anda terlebih dahulu. Setelah habis, token dibayar mulai dari $ 5 → 200.000 token. Kira-kira ~5 token per karakter, minimum 100 per klip.

Hingga 5.000 karakter per permintaan di web UI. Untuk potongan yang lebih panjang (odiobooks, bab penuh), gunakan /voice/audiobook/yang potongan dan jahitan secara otomatis, atau panggilan API dalam sebuah loop.

Ya, POST daftar string ke /v1/tts/batch/, atau gunakan ruang kerja UI di /workspace/ untuk merantai TTS ke dalam pipa yang lebih panjang (mis, terjemahkan → berbicara → Stitch).

Ya teks POST ke /v1/tts/ dengan model=VibeVoice" (atau siput di halaman ini). Mengembalikan WAV atau MP3. Lihat /api/ untuk referensi lengkap + snippet SDK.

Halaman ini adalah teks-ke-peech, bukan suara kloning å suara adalah default mesin. Untuk kloning suara (naikan audio referensi), lihat /voice/cloke/clone/, yang mengharuskan Anda untuk memiliki hak suara atau memiliki persetujuan tertulis eksplisit.

Mesin berhospotan sendiri dijalankan pada GPU milik Free.ai; tidak ada yang meninggalkan server kami. Mesin Premium lulus teks ke provider model hulu di bawah DPA kami. Kami tidak melatih input Anda dan tidak menjual data.

Ya - Free.ai memberikan penggunaan komersial audio yang dihasilkan. Lisensi mesin (Apache 2.0, MIT, atau vendor) ditampilkan di atas dan di halaman referensi model; dalam prakteknya ini berarti voiceover, iklan, podcast, dan aplikasi semua dalam lingkup.

Jika pengembalian dana gagal pada hari yang sama, hubungi surel@free.ai.

Love this tool? Share it!

Laju halaman ini