Parler-TTS Large

Free.ai (self-hosted) · tts · ~500 символы в расчете на clip · 4.6 от 5 пользователей этой категории
~500 символы в расчете на clip

Parler-TTS Large - a Голос в текст, построенный HuggingFace. Самый сильный в Controllable speech ("spoken quickly with a British accent"), research.. Самоорганизуется на Free.ai GPU — бесплатно против вашего ежедневного символического пула ( 500 токенов на клип). Выпущен под Apache 2.0 - коммерческое использование разрешено на Free.ai.

Часто задаваемые вопросы

Parler-TTS Large поддерживает широкий круг языков. Точный список зависит от двигателя; форма на этой странице принимает любой текст, и двигатель будет передаваться на его поддерживаемых языках. См./ zook/ для полного многодвигательного сборщика, если вам нужен конкретный язык.

Большинство двигателей делают нейтральный американский английский по умолчанию и делают региональный акцент для неанглийских языков.

Поддержка SSML варьируется в зависимости от двигателя. Пользование, прозодиоз и метки акцентов почитаются на большинстве двигателей и на нескольких самозаводных двигателях. Постоянный текст всегда работает - не требуется разметки.

На премиальных двигателях TTS можно получить доступ через /v1/ts/ API конечная точка с потоком = ==Веб-сайт UI на этой странице возвращает полный клип после завершения.

Parler-TTS Large работает на наших собственных GPU. Поколение сначала получается из вашего ежедневного бесплатного бассейна. После истощения, оплачиваемые жетоны начинаются с 5 · 200 000 символов. Примерно ~5 символов на персонажа, минимум 100 за клип.

До 5000 знаков на запрос в Интернете UI. Для более длинных частей (аудиокниги, полные главы) используйте/скаки/аудиобук, которые автоматически накладывают и швы, или назовите API в петле.

Да - POST список струн /v1/tts/batch/, или использование рабочего пространства UI на /рабочем пространстве/ для цепочки TTS в более длинный трубопровод (например, перевод β говорящий β stech).

Да - текст POST в /v1/tts/ с моделью = "Parler-TTS Large" (или пуля на этой странице). Возвращает WAV или MP3. См. /api/ для полного использования + SDK snippets.

Эта страница - это текст-пик, а не клонирование голоса - голос - это по умолчанию двигатель. Для клонирования голоса (загрузка справочной аудиосвязи) см. / voard/clone/, что требует, чтобы вы либо владеете правами голоса, либо имели явное письменное согласие.

Самоходные двигатели работают на ГПС, принадлежащих Free.ai; ничего не оставляет наших серверов. Премиум двигателя передает текст поставщикам моделей вверх по течению в рамках нашего ДПВ. Мы не тренируемся на ваших входных данных и не продаем данные.

Да - Free.ai предоставляет коммерческое использование генерированного аудио. Основные права двигателя (Apache 2.0, MIT, или условия поставщика) показаны выше и на типовой справочной странице; на практике это означает голосовые очки, рекламы, подкасты и приложения все в пределах охвата.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Love Free.ai? Tell your friends!

Строка