StyleTTS 2

Free.ai (self-hosted) · tts · ~500 tokens per clip · 4.6 van 5 gebruikers van deze categorie
~500 tokens per clip

StyleTTS 2 is a tekst-tot-spraak-stem gebouwd door Yinghao Aaron Li. Sterkste bij Voice cloning without training data; expressive multilingual speech.. Zelf gehost op Free.ai GPU's loopt gratis tegen uw dagelijkse token pool (500 tokens per clip). Vrijgegeven onder MIT - commercieel gebruik toegestaan op Free.ai.

Veelgestelde vragen

StyleTTS 2 ondersteunt een breed scala aan talen. De exacte lijst hangt af van de motor; het formulier op deze pagina accepteert een tekst en de motor zal renderen in de ondersteunde talen. Zie /voice/ voor de volledige multi-motor picker als u een specifieke taal nodig hebt.

De meeste motoren maken standaard neutraal-Amerikaans Engels en een regio-passend accent voor niet-Engelse talen. Premium motoren kunnen accentvarianten blootleggen - plak een monster om te vergelijken.

SSML ondersteuning varieert per motor. Pauzeer, prosody, en de nadruk tags worden geëerd op de meeste premium motoren en op een paar zelf-gehoste degenen. Gewoon tekst werkt altijd - geen markup vereist.

Streaming TTS is beschikbaar op premium motoren via het /v1/tts/ API eindpunt met stream=true. De web UI op deze pagina geeft de volledige clip terug zodra rendering voltooid is.

StyleTTS 2 draait op onze eigen GPU's. Generatie trekt uit uw dagelijkse gratis zwembad eerst. Eenmaal uitgeput, betaalde tokens beginnen bij $5 → 200.000 tokens. Ongeveer ~5 tokens per karakter, minimum 100 per clip.

Tot 5000 tekens per verzoek op de web UI. Voor langere stukken (audioboeken, volledige hoofdstukken), gebruik /voice/audiobook/ die automatisch brokken en steken, of bel de API in een lus.

Ja - POST een lijst van tekenreeksen naar /v1/tts/batch/, of gebruik de werkruimte UI op /werkruimte/ om TTS te koppelen aan een langere pijplijn (bijv., vertaal → spreek → steek).

Ja - POST tekst naar /v1/tts/ met model="StyleTTS 2" (of de kogel op deze pagina). Geeft WAV of MP3 terug. Zie /api/ voor volledige referentie + SDK knipsels.

Deze pagina is tekst-naar-spraak, niet stemklonen - de stem is de standaard van de motor. Voor het klonen van stemmen (het uploaden van een referentieaudio), zie /voice/clone/, die vereist dat u ofwel eigenaar bent van de spraakrechten of expliciete schriftelijke toestemming heeft.

Zelfgehoste motoren draaien op Free.ai-eigen GPU's; niets laat onze servers achter. Premium motoren geven tekst door aan upstream model providers onder onze DPA. Wij trainen niet op uw ingangen en verkopen geen gegevens.

Ja - Free.ai verleent commercieel gebruik van gegenereerde audio. De onderliggende licentie van de motor (Apache 2.0, MIT, of leveranciersvoorwaarden) wordt hierboven en op de modelreferentiepagina weergegeven; in de praktijk betekent dit voiceovers, advertenties, podcasts en apps zijn allemaal in-scope.

Ja - mislukte jobs automatisch terug te betalen naar de bron (dagelijkse pool of betaalde tokens). Als een terugbetaling niet verschijnt op dezelfde dag, e-mail contact@free.ai.

Love Free.ai? Vertel het uw vrienden!

Beoordeel deze pagina