StyleTTS 2

Free.ai (self-hosted) · tts · ~500 Torneiras por clip · 4.6 a partir de 5 utilizadores desta categoria
~500 Torneiras por clip

StyleTTS 2 é a Voz de texto a voz construído por Yinghao Aaron Li. A mais forte em Voice cloning without training data; expressive multilingual speech.. Self-hosted on Free.ai GPUs — corre livre contra a sua piscina cotidiana de tokens (500 tokens por clipe). Lançado sob MIT - uso comercial permitido em Free.ai.

Perguntas Frequentes

StyleTTS 2 suporta uma ampla gama de idiomas. A lista exata depende do motor; o formulário nesta página aceita qualquer texto e o motor irá renderizar em suas línguas suportadas. Veja /voice / para o picker multi-motor completo se você precisar de uma língua específica.

A maioria dos motores rendem o inglês neutra-americano por padrão e um acento regional adequado para idiomas não-inglês. Os motores premium podem expor variantes de accento - colar uma amostra para comparar.

O suporte SSML varia por motor. Pausa, prosódia e ênfase as etiquetas são honradas na maioria dos motores premium e em alguns auto-hosted. Texto simples sempre funciona - nenhuma marca necessária.

A TTS de streaming está disponível em motores premium através do /v1/tts/ API endpoint com stream=true. A UI web nesta página devolve o clip completo uma vez que termina a renderização.

StyleTTS 2 funciona em nosso próprio GPUs. Geração tira de sua piscina gratuita diária primeiro. Uma vez esgotado, fichas pagas começam com $5 → 200.000 fichas. Aproximadamente ~5 fichas por personagem, mínimo 100 por clipe.

Até 5.000 caracteres por pedido na UI web. Para peças mais longas (audiobooks, capítulos completos), use /voice/audiobook/ que pedaços e pontos automaticamente, ou chame a API em um loop.

Sim - POST uma lista de cordas para /v1/tts/batch /, ou usar a interface de trabalho em /workspace/ para encadenar TTS em um pipeline mais longo (por exemplo, traduzir → falar → ponto).

Sim - Texto POST para /v1/tts/ com model="StyleTTS 2" (ou o engoma nesta página). Devolve WAV ou MP3. Veja /api/ para referência completa + SDK snippets.

Esta página é texto-a- voz, não clonagem de voz - a voz é o padrão do motor. Para clonagem de voz (uploading a reference audio), consulte /voice/clone/, que requer que você seja proprietário dos direitos de voz ou tenha consentimento escrito explícito.

Motores auto-hostados executam-se em GPU pertencentes ao Free.ai; nada deixa nossos servidores. Os motores premium passam texto para fornecedores de modelos a montante sob nosso DPA. Nós não treinamos em seus insumos e não vendemos dados.

Sim - Free.ai concede uso comercial do áudio gerado. A licença subjacente do motor (Apache 2.0, MIT ou termos do fornecedor) é mostrada acima e na página de referência do modelo; na prática isso significa que os anúncios, podcasts e aplicativos são todos in-scop.

Sim - trabalhos falhados reembolsar automaticamente para a fonte (pool diário ou fichas pagas). Se um reembolso não aparecer no mesmo dia, e-mail contact@free.ai.

Adoro Free.ai? Diga aos seus amigos!

Avaliar esta página