ElevenLabs STT
Free.ai
·
stt
·
~500 žetonov na minute
ElevenLabs STT je a model govora v besedilo. Potoval skozi zunanje modele - ~500 žetons na minuto (50% označevanje nad stroški pred stream).
Uporaba prek API
OpenAI- kompatibilen REST API. Ustvarite ključ in pokličite ta model v sekundah.
curl -X POST https://api.free.ai/v1/stt/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
Dokumentacija API
Dobi ključ API
Pogosta vprašanja
ElevenLabs STT transliberji v besedila. Naložite MP3, WAV, M4A ali video datoteko in ElevenLabs STT vrne celoten transkript in neobvezna podnapisa SRT/VTT s časovnimi oznakami.
ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.
Hitrost besednih-grehtih je 5-10% na čistem angleškem avdio, 10-20% na hrupnem ali naglasnem avdio. Velika različica iste arhitekture naredi smiselno boljše na trdih primerih - izberite večji, ko je zvok grob.
Ja - vsak odsek vključuje začetna/končna časovna oznaka. Izvoz kot SRT ali VTT in časovna mapa naravnost na vaš video.
ElevenLabs STT je premium transkripcion motor. O ~500-1,500 žetonov na minuto avdio, prikazan v živo, preden ustvarite. Samovoditeljski transkripcija teče brezplačno na 30.000-taken dnevni bazen; premium modeli so pay-as-yo-go, z top-up od $1.
MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - izvlečimo zvok. Max 500 MB na nalaganje. Datoteke dlje? Razdelite z /audio/cut/ ali uporabite /v1/stt/batch /.
Diarizacija zvočnika je ločena prepustnica - prekini "diarize" na /transcribec /. ElevenLabs STT obvladuje transkripcijo; diariziranje oznake vsak segment z zvočnik 1 / zvočnik 2 / itd.
Da - /batch / sprejme mapo zvočnih datotek. Vsak transkript pristane v /account /?tab=history z izvirnim imenom datoteke. Za ohranjanje mape- drevo uporabite API.
Da - POST vaš zvok na /v1/stt/transcribec / z modelom="ElevenLabs STT". Vrača JSON z besedilom + segmenti + časovni razpored besede. /api/ ima polno sklicevanje.
Samohostiteljski modeli imajo zvok na naših GPU; premium prehod z DPA. Audio se izbriše po delnem oknu (24h anon, 7d podpisa). Ne treniramo na vhodih.
Da - Free.ai dodeljuje komercialno uporabo transkriptov. Potrebujete pravice do avdio, ki ste ga naložili (vaši lastni zapisi, licencirani material ali vsebino s soglasjem).
Faktor v realnem času je približno 0,05-0,2× - 60-minutni podcast transkripter v 3-12 minutah. Premium modeli pogosto končajo hitreje. Uporabite gumb za zapretev zavihka.