StyleTTS 2

Free.ai (self-hosted) · tts · ~500 jetons par clip · 4.6 de 5 utilisateurs de cette catégorie
~500 jetons par clip

StyleTTS 2 est a voix texte à parole construit par Yinghao Aaron Li. Plus fort à Voice cloning without training data; expressive multilingual speech.. Self-hosted sur Free.ai GPUs — fonctionne gratuitement contre votre pool de tokens journaliers (500 tokens par clip). Libéré sous MIT - utilisation commerciale autorisée sur Free.ai.

Foire aux questions

StyleTTS 2 prend en charge une large gamme de langues. La liste exacte dépend du moteur; le formulaire de cette page accepte tout texte et le moteur rendra dans ses langues prises en charge. Voir /voice/ pour le sélectionneur multimoteur complet si vous avez besoin d'une langue spécifique.

La plupart des moteurs rendent l'anglais neutre-américain par défaut et un accent approprié pour la région pour les langues non-anglaises.

Le support SSML varie selon le moteur. Pause, prosody, et les balises de mise en valeur sont honorés sur la plupart des moteurs premium et sur quelques auto-hôtes.

Le streaming TTS est disponible sur les moteurs premium via le paramètre /v1/tts/ API avec stream=true. L'interface utilisateur web de cette page retourne le clip complet une fois que le rendu est terminé.

StyleTTS 2 fonctionne sur nos propres GPU. Generation tire de votre piscine gratuite quotidienne d'abord. Une fois épuisé, jetons payés commencent à $5 → 200 000 jetons. Environ ~5 jetons par personnage, minimum 100 par clip.

Jusqu'à 5000 caractères par demande sur l'interface utilisateur web. Pour les pièces plus longues (audiobooks, chapitres complets), utilisez /voice/audiobook/ qui découpe et suture automatiquement, ou appelez l'API en boucle.

Oui - POST une liste de chaînes vers /v1/tts/batch/, ou utiliser l'interface utilisateur de l'espace de travail à /workspace/ pour chaîner TTS dans un pipeline plus long (par exemple, traduire → parler → point).

Oui - Texte POST vers /v1/tts/ avec model, StyleTTS 2" (ou la limace sur cette page). Retourne WAV ou MP3. Voir /api/ pour la référence complète + extraits SDK.

Cette page est texte-à-parler, pas le clonage vocal - la voix est la valeur par défaut du moteur. Pour le clonage vocal (en téléchargeant un audio de référence), voir /voice/clone/, qui vous oblige à posséder les droits vocals ou à avoir un consentement écrit explicite.

Les moteurs auto-portés fonctionnent sur les GPUs propriétaires de Free.ai ; rien ne laisse nos serveurs. Les moteurs Premium transmettent du texte aux fournisseurs de modèles en amont sous notre DPA. Nous ne formons pas vos entrées et ne vendons pas de données.

Oui - Free.ai accorde l'utilisation commerciale de l'audio généré. La licence sous-jacente du moteur (Apache 2.0, MIT, ou les termes du fournisseur) est affichée ci-dessus et sur la page de référence du modèle; dans la pratique, cela signifie que les voix offs, annonces, podcasts et applications sont toutes dans le champ.

Oui - les emplois échoués sont automatiquement remboursés à la source (pool quotidien ou jetons payés). Si un remboursement ne se présente pas le même jour, envoyez un courriel à contact@free.ai.

Aimez Free.ai? Dites à vos amis!

Évaluer cette page