StyleTTS 2

Free.ai (self-hosted) · tts · ~500 tokens per clip · 4.6 _İşlə 5 bu kateqoriyadakı istifadəçilər
~500 tokens per clip

StyleTTS 2 a mətn-sözə səs tərəfindən Yinghao Aaron Li tərəfindən inşa edilmişdir. Strongest at Voice cloning without training data; expressive multilingual speech.. Free.ai GPU-larda öz-özünə host edilmişdir — gündəlik token pulunuza qarşı pulsuz işləyir (500 tokens klip başına). MIT - ticarət istifadəsi Free.ai ilə icazə verilir.

Tez-tez Sorulan Sual

StyleTTS 2 çoxlu dilləri dəstəkləyir. Tam siyahı mühərrikdən asılıdır; bu səhifədəki forma hər hansı bir mətni qəbul edir və mühərrik dəstəklənən dillərdə render edəcək. Əgər xüsusi bir dil lazımsa, tam çoxlu mühərrik seçicisini /voice/-dən tapa bilərsiniz.

Çoxlu motorlar əvvəlcədən neutral Amerika İngilis dilini və İngilis dili olmayan dillər üçün bölgə uyğun aksent göstərər. Premium motorlar aksent variantlarını göstərə bilər - müqayisə etmək üçün nümunəni yapışdır.

SSML dəstəkləməsi motora görə dəyişir. Pause, prosody və emphasis təqvimləri bir çox premium motorlarda və bir neçə öz-özünə host edilmişlərdə hörmət edilir. Sadə mətn hər zaman işləyir - məzmun qeydi tələb olunmur.

İşıqlandırılmış TTS premium motorlarda stream=true ilə /v1/tts/ API son nöqtəsi vasitəsilə mövcuddur. Bu səhifədəki veb UI renderləmə bitdikdən sonra tam klipi geri qaytarır.

StyleTTS 2 öz GPU-larımızda işləyir. Yaratma əvvəlcə günlük pulsuz ehtiyatınızdan gəlir. Bu ehtiyat tükəndikdə, ödənişli tokenlər $5 → 200,000 tokenlərlə başlayır. Hər xarakter üçün təxminən ~5 token, klip üçün minimum 100.

Veb interfeysində istənilən hər bir xarakter üçün 5000-ə qədər xarakter. Uzun parçalar üçün (audio kitablar, tam fəsillər) /voice/audiobook/ istifadə edin ki, bu da avtomatik olaraq parçalanır və birləşir, ya da API-ni döngə ilə çağırın.

Bəli - /v1/tts/batch/-ə string siyahısını POST et, ya da /workspace/-də iş sahəsi UI-ni istifadə et ki, TTS-i daha uzun boru kəmərinə bağlayasan (məsələn, translate → speak → stitch).

Bəli - /v1/tts/-ə model="StyleTTS 2" ilə (və ya bu səhifədə slug) POST mətni göndər. WAV və ya MP3 qaytarır. Tam istinad + SDK parçaları üçün /api/-ni bax.

Bu səhifə səs klonlama deyil, mətndən-sözə çevirmədir - səs motorun ön qurğusudur. Səs klonlama (referans audio yükləmə) üçün /voice/clone/-ə baxın, bu səs hüquqlarının sizin olması və ya açıq yazılı razılığınızı tələb edir.

Öz-özünə host edilmiş motorlar Free.ai-ə məxsus GPU-larda işləyir; heç nə bizim serverlərimizdən çıxmır. Premium motorlar mətni DPA-mızın altında olan model təminatçılarına verir. Biz sizin daxil olmalarınızı öyrənmirik və məlumat satmırıq.

Bəli - Free.ai yaradılan səsin kommersiya istifadəsini icazə verir. Motorun əsas lisenziyası (Apache 2.0, MIT, ya da satıcı şərtləri) yuxarıda və model istinad səhifəsində göstərilir; praktiki olaraq bu səsləndirmələr, reklamlar, podcastlar və tətbiqlərin hamısının əhatə etdiyini bildirir.

Bəli - bacarılmayan işlərə avtomatik qaynaqdan geri qaytarma (günlük pul ya da ödənilmiş tokenlər). Əgər geri qaytarma eyni gündə görünməsə, contact@free.ai ünvanına e-poçt göndərin.

Free.ai sevmirəm? Dostlarına deyin!

Bu səhifəni qiymətləndir