OpenAI: GPT Audio Mini
OpenAI
·
tts
·
~1147 polletter per clip
·
4.3
från 3 användare i denna kategori
OpenAI: GPT Audio Mini är {artikel} {kategori} byggd av OpenAI. Körs genom externa modeller — ~1,147 polletter per klipp (50 % uppräkning över uppströmskostnad).
Använd via API
OpenAI-kompatibelt REST API. Skapa en nyckel och ring denna modell på några sekunder.
curl -X POST https://api.free.ai/v1/tts/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"openai/gpt-audio-mini","text":"hello world"}'
API-dokumentation
Hämta API- nyckel
Liknande modeller
Vanliga frågor
OpenAI: GPT Audio Mini stöder ett brett spektrum av språk. Den exakta listan beror på motorn. Formuläret på den här sidan accepterar alla texter och motorn kommer att visa på sina språk som stöds. Se /voice/ för den fullständiga multimotorväljaren om du behöver ett specifikt språk.
De flesta motorer ger neutral-amerikanska engelska som standard och en region-lämplig accent för icke-engelska språk. Premium motorer kan exponera accent varianter - klistra in ett prov för att jämföra.
SSML stöd varierar beroende på motor. Pause, prosody, och betoning taggar hedras på de flesta premium motorer och på några självvärdiga. Enkel text fungerar alltid - ingen markering krävs.
Streaming TTS är tillgänglig på premium motorer via /v1/tts/ API endpoint med stream=true. Webben UI på denna sida returnerar hela klippet när rendering avslutas.
OpenAI: GPT Audio Mini är en premium TTS-motor. Kostnadsskalor med teckenräkning - typiskt ~30 tokens per tecken, visas live innan du genererar. Självvärdiga röster körs gratis på din 30 000-token dagliga pool; premium modeller är pay-as-you-go, med toppar från $ 1.
Upp till 5000 tecken per begäran på webben UI. För längre stycken (audioböcker, fullständiga kapitel), använd /voice/audiobook/ som delar och stygn automatiskt, eller ring API i en loop.
Ja — POST en lista med strängar till /v1/tts/batch/, eller använd arbetsytan UI på /workspace/ för att kedja TTS till en längre pipeline (t.ex., översätta → tala → stygn).
Ja – POST text till /v1/tts/ med modell="OpenAI: GPT Audio Mini" (eller snigel på denna sida). Returnerar WAV eller MP3. Se /api/ för fullständig referens + SDK snippets.
Den här sidan är text-till-tal, inte röstkloning – rösten är motorns standard. För röstkloning (uppladdning av ett referensljud), se /voice/clone/, vilket kräver att du antingen äger rösträttigheterna eller har ett uttryckligt skriftligt samtycke.
Self-hosted motorer körs på Free.ai-ägda GPUs; ingenting lämnar våra servrar. Premium motorer passerar text till uppströms modellleverantörer under vår DPA. Vi tränar inte på dina ingångar och säljer inte data.
Ja — Free.ai beviljar kommersiell användning av genererat ljud. Motorns underliggande licens (Apache 2.0, MIT, eller leverantörstermer) visas ovan och på modellens referenssida; i praktiken betyder detta röstövergångar, annonser, podcasts, och appar är alla i-scope.
Ja — misslyckades jobb automatisk återbetalning till källan (dagligen pool eller betalade polletter). Om en återbetalning inte visas samma dag, e-post kontakt@free.ai.