ElevenLabs STT
Free.ai
·
stt
·
~500 kuponki minute
ElevenLabs STT on a puheesta tekstiin -malli. Reititetty ulkoisten mallien kautta — ~500 tokens minuutissa (50 % lisäys ylävirran kustannuksiin).
Käyttö API:n kautta
OpenAI-yhteensopiva REST API. Luo avain ja soita tähän malliin sekunneissa.
curl -X POST https://api.free.ai/v1/stt/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API-dokumentaatio
Hae API-avain
Usein kysyttyjä
â € € #ElevenLabs STT _ transscripteds speed audio into text. Lataa MP3, WAV, M4A tai videotiedosto ja â €ElevenLabs STT returned the full transkript plus optional SRT/VTT tekstitys aikaleimalla.
ElevenLabs STT käsittelee kymmeniä kieliä – Whisper-perhemallit kattavat 90+, Parakeet kattaa ~25, muut vaihtelevat. Valitse "auto-havaitse" tai määrittele kieli mahdollisimman tarkasti.
Sanavirheiden määrä on 5–10 prosenttia puhtaassa englanninkielisessä äänessä, 10–20 prosenttia äänekkäässä tai korostetussa äänessä. Suuret saman arkkitehtuurin variaatiot ovat huomattavasti parempia vaikeissa tapauksissa – valitse suurempi, kun ääni on karkeaa.
Kyllä – jokaisessa segmentissä on start/end-leimat. Vie SRT:nä tai VTT:nä ja aikakartta suoraan videollesi.
ElevenLabs STT on premium-transkriptiomoottori. Noin ~500–1 500 kuponkia minuutissa äänitettäessä, suora lähetys ennen kuin luot. Itseohjattu transkriptio kulkee ilmaiseksi 30 000 dollarin päiväpoolissasi; premium-mallit maksavat jakona, ja lisäksi 1 dollarin korotus.
MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) – poistamme äänen. Max 500 MB per lataus. Pidemmät tiedostot? Jaa /audio/cut/ or use /v1/st/batch/.
Kaiuttimen diarisointi on erillinen kulkukortti, jossa "diarisoidaan" /transcription/. ElevenLabs STT käsittelee transkriptiota; diarisoinnin tarroja kussakin segmentissä kaiuttimella 1 / kaiutin 2 / jne.
Kyllä – /batch/ hyväksyy äänitiedostojen kansion. Jokainen transkriptio laskeutuu /country/?tab=historiaan alkuperäisellä tiedostonimellä. Kansioiden ja puiden säilytykseen käytetään API:tä.
Kyllä – PYSÄYTTÄÄ äänen tasolle /v1/st/transcribe/ with model="ElevenLabs STT". Palauttaa JSONin tekstillä + segmenteillä + sanatasolla. /apilla on koko viite.
Itseohjautuvat mallit pitävät äänen GPU:issamme; premium kulkee läpi DPA:lla. Ääni poistetaan osakeikkunan jälkeen (24h anon, 7d kirjautuneena). Emme harjoittele tuloksillasi.
Kyllä – Free.ai myöntää transkriptioiden kaupallisen käytön. Tarvitset oikeudet lataamaasi äänitteeseen (omaan tallenteeseen, luvanvaraiseen materiaaliin tai sisältöön suostumuksella).
Reaaliaikakerroin on noin 0,05–0,2 x – 60 minuutin podcast kirjoitetaan 3–12 minuutissa. Premium-mallit valmistuvat usein nopeammin. Sulje välilehti jonon painikkeella.