StyleTTS 2

Free.ai (self-hosted) · tts · ~500 tokens por clip · 4.6 desde 5 usuarios desta categoría
~500 tokens por clip

StyleTTS 2 é a voz de síntese de texto construído por Yinghao Aaron Li. Máis forte en Voice cloning without training data; expressive multilingual speech.. Auto-aloxado en Free.ai GPUs — executa libremente contra o seu conxunto de tokens diarios (500 tokens por clip). Publicado baixo MIT - uso comercial permitido baixo Free.ai.

Preguntas frecuentes

StyleTTS 2 soporta unha ampla variedade de linguas. A lista exacta depende do motor; o formulario desta páxina acepta calquera texto e o motor renderizará nas linguas soportadas. Consulte / voice / para o selector completo de múltiples motores se precisa unha lingua específica.

A maioría dos motores renderizan o inglés americano neutro por omisión e un acento apropiado para a rexión para as linguas que non sexan inglesas. Os motores Premium poden expor variantes de acentos - apegue unha mostra para comparar.

O soporte de SSML varía segundo o motor. As etiquetas de pausa, prosodi e énfase son respectadas na maioría dos motores premium e en algúns auto- hospedados. O texto simple sempre funciona - non se precisan marcas.

A transmisión de TTS está dispoñíbel nos motores premium mediante o punto final da API / v1/ tts/ con stream=true. A interface web desta páxina devolve o clip completo cando remata a representación.

StyleTTS 2 runs on our own GPUs. Generation draws from your daily free pool first. Once depleted, paid tokens start at $5 → 200,000 tokens. Roughly ~5 tokens per character, minimum 100 per clip.

Ata 5000 caracteres por petición na interface web. Para pezas máis longas (audiolibros, capítulos completos), use /voice/audiobook/ que se fragmenta e se une automaticamente, ou chame á API nun bucle.

Si - POST unha lista de cadeas a / v1/ tts/ batch /, ou empregar a interface do espazo de traballo en / workspace / para encadear TTS nun canal máis longo (por ex., traducir → falar → sutura).

Si - POST texto a / v1/ tts / con model=" StyleTTS 2 "(ou o slug nesta páxina). Devolve WAV ou MP3. Consulte / api / para referencia completa + fragmentos do SDK.

Esta páxina é de texto- a- fala, non de clonación de voz - a voz é a predeterminada do motor. Para clonar a voz (enviar un son de referencia), consulte / voice/ clone /, que require que sexa o propietario dos dereitos da voz ou que teña un consentimento explícito por escrito.

Os motores auto- hospedados executan en GPUs de Free.ai; nada sae dos nosos servidores. Os motores Premium pasan o texto a provedores de modelos ascendentes baixo o noso DPA. Non adestramos coas súas entradas e non vendemos datos.

Si - Free.ai concede o uso comercial do son xerado. A licenza subxacente do motor (Apache 2.0, MIT ou termos do vendedor) móstrase enriba e na páxina de referencia do modelo; na práctica isto significa que as voces, anuncios, podcasts e programas están todos incluídos.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Amas a Free.ai?

Cualificar esta páxina