StyleTTS 2

Free.ai (self-hosted) · tts · ~500 fitxes per clip · 4.6 des de 5 Usuaris d' aquesta categoria
~500 fitxes per clip

StyleTTS 2 és a veu de text a veu construït per Yinghao Aaron Li. Més fort a Voice cloning without training data; expressive multilingual speech.. Auto- màquina en les GPUs Free.ai - executades en contra de la vostra piscina diària (500 fitxes per clip). Publicat sota MIT - Ús comercial permès en Free.ai.

Preguntes més freqüents

StyleTTS 2 accepta un ampli abast de llenguatges. La llista exacta depèn del motor; el formulari d' aquesta pàgina accepta qualsevol text i el motor mostrarà en les seves llengües acceptades. Vegeu /voice/ per al selector de múltiples multienginyeria complet si necessiteu un idioma específic.

La majoria dels motors representen l' anglès neutral-americà per omissió i un accent de regió a les llengües no anglesos. Els motors Premium poden exposar variants d' accent - enganxar una mostra a comparar.

La implementació del SSM variada pel motor. Pausa, prosodi i les etiquetes èmfasi són un honor en els motors més de la barra alta i en alguns auto- màquina. El text pla sempre funciona - no es requereix marques.

El flux TTS està disponible en motors de longitud de ritme mitjançant el punt d' acabament / v1/ tts/ API amb flux=true. La interfície web d' aquesta pàgina retorna el sencer de vídeo una vegada que finalitzi el joc.

StyleTTS 2 runs on our own GPUs. Generation draws from your daily free pool first. Once depleted, paid tokens start at $5 → 200,000 tokens. Roughly ~5 tokens per character, minimum 100 per clip.

Fins a 5000 caràcters per petició a la IU web. Per a peces més llargues (audibooks, capítols sencers), useu /voice/audbook/ que s' enganxen automàticament o cridar l' API en un bucle.

Sí, POST una llista de cadenes a / v1/ tts/ batch /, o useu l' UI de l' espai de treball a / workspace/ to tail TTS en una canonada més llarga (p. ex., traduïu ascii RT RT).

Sí - Text POST a / v1/ tts / amb model=" StyleTTS 2 (o la bala d' aquesta pàgina). Retorna WAV o MP3. Vegeu / api/ per a una referència completa + SDK photos.

Aquesta pàgina és de text a veu, no clonada la veu - la veu és la per omissió del motor. Per a la clonació de veu (cal carregar un so de referència), mireu /voice/clone /, el qual requereix que tingueu els drets de veu o teniu el consentiment explícit.

Els motors auto- màquina s' executen a Free.ai-line- GPUs. Res deixa els nostres servidors. Els motors Premium passen text als proveïdors de model de sortida sota el nostre DPA. No entrenem a les vostres dades d'entrada i no venguem dades.

Sí - Free.ai concedeix ús comercial d' àudio generat. La llicència subjacent del motor és sota llicència (Apache 2.0, MIT, o termes de venedor) es mostra a dalt i a la pàgina de referència de model; en la pràctica això significa veu sobre, anuncis, podcasts i aplicacions estan totes en cas de cas de cas.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Like this tool? Share it!

Valora aquesta pàgina