StyleTTS 2

Free.ai (self-hosted) · tts · ~500 tags на clip · 4.6 від 5 користувачі цієї категорії
~500 tags на clip

StyleTTS 2 - це a Текст- до- мовлення голос, побудований Yinghao Aaron Li. Найсильніший зекVoice cloning without training data; expressive multilingual speech.. Self- host on Free.ai GPUs } безкоштовно йде проти вашого щоденного набору (500 _ на кліп _). Випущено з MIT - комерційне використання на Free.ai.

Часті запитання

StyleTTS 2 підтримує широкий спектр мов. Список залежить від рушія; форма на цій сторінці приймає будь- який текст, а рушій покаже його мовами, які підтримуються. Щоб дізнатися більше, перегляньте розділ / voice /, якщо вам потрібна певна мова.

У більшості рушіїв типово є нейтральною американською англійською, а акцент з території для неанглійських мов. Премій може показувати варіанти акценту - вставте зразок для порівняння.

Підтримка SSML різниться за допомогою рушія. Для більшості внесків і декількох власних рушіїв можна використовувати режим паузи, просодії та теґи наголосу. Звичайний текст завжди працює, - не потрібно розмітки.

TTS, що поточно транслюються, можна скористатися на внесках, за допомогою точки кінця / v1/ tts/ API з поточною точкою=true. Веб- інтерфейс користувача на цій сторінці повертає повний кліп після завершення показу.

StyleTTS 2 працює у наших власних GPU. Покоління спочатку малюється з вашого щоденного вільного басейну. Після вичерпання, платні жести починаються з 5 → 200 000 маркерів. Приблизно ~5 маркерів на символ, мінімально 100 на один кліп.

На запит до 5000 символів на кожен з них у мережі. Для довших частин (книжки звукових даних, повних розділів), використовуйте / voice/ audiobook /, які автоматично складаються з шматків і швів, або зателефонуйте API у циклі.

Так - ПРОВОДЬ список рядків до / v1/ tts/ batch /, або скористайтеся робочим простором UI у / workspace/ to chain TTS у довшу трубу (наприклад, перекладе → say → Shell).

Так - POST текст до / v1/ tts / з моделлю=" StyleTTS 2 " (або слайд на цій сторінці). Повертає WAV або MP3. Повний опис рядків / api / можна знайти у розділі щодо SDK.

Ця сторінка - це текстове мовлення, а не клонування голосів - типово для рушія. Для клонування голосів (завантаження звукового сигналу) див. / $voice/clone /, це вимагає від вас або мати право голосу, або чітко написаної згоди.

Самовладні рушії, які працюють на зFree.ai- вузлі GPU; нічого не залишає наших серверів. Прем' ємнійні рушії передають текст постачальникам моделей, які провайдери можуть рухатися вгору за допомогою DPA. Ми не тренуємося на ваших вводах і не продаємо даних.

Так - Free.ai надає комерційне використання створеного звуку. Основна ліцензія рушія (Apache 2.0, MIT або постачальника) показана вище і на моделі довідковій сторінці. На практиці це означає голосомір, рекламні оголошення, трансляції і програми є невизначеними.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Люблю заккFree.ai?

Оцінити цю сторінку