Parler-TTS Large

Free.ai (self-hosted) · tts · ~500 tokens por clip · 4.6 desde 5 usuarios desta categoría
~500 tokens por clip

Parler-TTS Large é a voz de síntese de texto construído por HuggingFace. Máis forte en Controllable speech ("spoken quickly with a British accent"), research.. Auto- hospedado en GPUs Free.ai - executa libremente contra o seu conxunto diario de tokens (500 tokens por clip). Publicado baixo Apache 2.0 - uso comercial permitido baixo Free.ai.

Preguntas frecuentes

Parler-TTS Large admite unha ampla gama de idiomas. A lista exacta depende do motor; o formulario desta páxina acepta calquera texto e o motor renderizará nos idiomas que admita. Consulta /voice/ para o selector completo de varios motores se precisas un idioma concreto.

A maioría dos motores renderizan inglés neutro americano por defecto e un acento propio da rexión para os idiomas que non son inglés. Os motores premium poden ofrecer variantes de acento: pega unha mostra para comparar.

A compatibilidade con SSML varía segundo o motor. As etiquetas de pausa, prosodia e énfase respéctanse na maioría dos motores premium e nalgúns autoaloxados. O texto simple sempre funciona: non fai falta marcado.

O TTS en streaming está dispoñible nos motores premium mediante o endpoint da API /v1/tts/ con stream=true. A interface web desta páxina devolve o clip completo cando remata a renderización.

Parler-TTS Large funciona nas nosas propias GPU. A xeración sae primeiro da túa reserva diaria gratuíta. Cando se esgota, os tokens de pago comezan en $5 → 200,000 tokens. Aproximadamente ~5 tokens por carácter, cun mínimo de 100 por clip.

Ata 5,000 caracteres por solicitude na interface web. Para pezas máis longas (audiolibros, capítulos completos), usa /voice/audiobook/, que divide e xunta automaticamente, ou chama á API nun bucle.

Si - envía por POST unha lista de cadeas a /v1/tts/batch/, ou usa a interface do espazo de traballo en /workspace/ para encadear o TTS nunha canle máis longa (p. ex., traducir → falar → xuntar).

Si - envía o texto por POST a /v1/tts/ con model="Parler-TTS Large" (ou o slug desta páxina). Devolve WAV ou MP3. Consulta /api/ para a referencia completa e fragmentos de SDK.

Esta páxina é de texto a voz, non de clonación de voz: a voz é a predeterminada do motor. Para clonar unha voz (subindo un audio de referencia), consulta /voice/clone/, que require que teñas os dereitos da voz ou un consentimento explícito por escrito.

Os motores autoaloxados funcionan en GPU propiedade de Free.ai; nada sae dos nosos servidores. Os motores premium pasan o texto a provedores de modelos externos baixo o noso DPA. Non adestramos coas túas entradas nin vendemos datos.

Si - Free.ai concede o uso comercial do audio xerado. A licenza subxacente do motor (Apache 2.0, MIT ou termos do provedor) móstrase arriba e na páxina de referencia do modelo; na práctica isto significa que locucións, anuncios, podcasts e aplicacións entran todos.

Si - os traballos fallidos reembólsanse automaticamente á orixe (reserva diaria ou tokens de pago). Se un reembolso non aparece o mesmo día, escribe a contact@free.ai.

Gústache Free.ai? Cóntallo aos teus amigos!

Valora esta páxina