ElevenLabs STT

Free.ai · stt · ~500 Semne de referință minute

Aruncă un fișier audio sau video sau încoace o URL de mai jos

~500 Semne de referință minute
Fugi gratis pe GPU-urile noastre. Actualizează pentru ElevenLabs STT →

ElevenLabs STT este a model de vorbire-în-text. Rulate prin modele externe - ~500 tokens pe minut (50% de marcaj peste costul amonte).

Utilizați prin API

API REST compatible cu OpenAI. Generați o cheie și apelați acest model în secunde.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
Documentare API Obține cheie API

Întrebări frecvente

ElevenLabs STT transcrie audio vorbit în text. Încarcă un fișier MP3, WAV, M4A sau video și ElevenLabs STT returnează transcripția completă plus subtitrarea opțională SRT/VTT cu timelor.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Rata de eroare cu cuvânt este de 5-10% pe audio curat englez, 10-20% pe audio zgomotos sau accentuat. Variante mari ale aceleiași arhitecturi fac semnificativ mai bine pe cazurile dure - alege mai mare atunci când audio este rușinos.

Da - fiecare segment include start-up/end timelor. Export ca SRT sau VTT și harta de timpuri direct pe video.

ElevenLabs STT este un motor de transcripție premium. Despre ~500-1,500 de jetonuri pe minut de audio, afișat live înainte de a genera. Transcription auto-gazdă funcționează gratuit pe piscina zilnică de 30.000 token; modelele premium sunt de pay-as-you-go, cu top-up de la $ 1.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - extragem audio. Max 500 MB pe încărcare. Fișiere mai lungi? Split cu /audio/cut/ sau folosirea /v1/stt/batch /.

Diarizarea speakerului este un pas separat - comuta "diarizeaza" pe /transcribe /. ElevenLabs STT se ocupă de transcriere; etichete de diarizare fiecare segment cu Speaker 1 / Speaker 2 / etc.

Da - /batch/ acceptă un dosar de fișiere audio. Fiecare trancriptare terenuri în /compte /?tab=historial cu numele de fișier original. Pentru conservarea de dosare- arbore utiliza API.

Da - POST audio la /v1/stt/transcrie/ cu model="ElevenLabs STT". Returnează JSON cu text + segmente + date horologice de nivel de cuvânt. /api/ are referință completă.

Modelele auto-gazdă păstrează audio pe GPU-urile noastre; premium trece prin cu un DPA. Audio este șterse după ferestre de partaj (24h anon, 7d semnat-in). Noi nu antrenăm pe intrarea dumneavoastră.

Da - Free.ai acordă utilizarea comercială a tranșelor. Aveți nevoie de drepturi la audio pe care l-ați încărcat (înregistrarea propriu, material licențiat sau conținut cu consimțământ).

Factorul în timp real este de aproximativ 0.05-0.2× - un podcast de 60 de minute transcrie în 3-12 minute. Modelele premium finalizează adesea mai repede. Folosește butonul de coada pentru a închide tab.

Love Free.ai? Tell your friends!

Ratați această pagină