ElevenLabs STT
Free.ai
·
stt
·
~500 žetoni minute
ElevenLabs STT ir {da}ļiņu__ {kategorija}. Maršruts, izmantojot ārējos modeļus — ~{tpm_markes} minūtē(50 % atzīme virs iepriekšējā posma izmaksām).
Izmantošana caur API
AtvērtAI savietojama REST API. Generējiet atslēgu un zvaniet šo modeli sekundēs.
curl -X POST https://api.free.ai/v1/stt/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API dokumentācija
Iegūst API atslēgu
Bieži uzdoti jautājumi
ElevenLabs STT tranraksti skaļi audio tekstā. Ielādējiet MP3, WAV, M4A vai video failu un ElevenLabs STT atgriež pilnu transkriptu plus izvēles SRT/VTT subtitrus ar laika zīmogiem.
ElevenLabs STT hands desmiti valodu — Whisper-ģimenes modeļi aptver 90+, Parakeet cover ~25, citi atšķiras. Izvēlieties "auto-detektēšana" vai norādiet valodu, lai panāktu augstāko precizitāti.
Word-error ātrums ir 5-10% uz tīra angļu audio, 10-20% uz trokšņains vai izcelts audio. Lieli varianti tās pašas arhitektūras dara jēgpilni labāk par grūtiem gadījumiem — izvēlieties lielāku, kad audio ir raupja.
Jā — katrs segments ietver sākuma/gala laika zīmjus. Eksportēt kā SRT vai VTT un laika karti tieši uz jūsu video.
ElevenLabs STT ir augstākās kvalitātes transkripcijas dzinējs. Par ~500-1 500 žetoniem minūtē audio, kas tiek rādīti tiešraidē pirms ģenerēšanas. Pašuzņemamā transkripcija bez maksas notiek jūsu 30 000- tokena dienas baseinā; premium modeļi ir pay- as- you-go, ar papildpakalpojumiem no $ 1.
MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) — mēs iegūstam audio. Maksimāli 500 MB uz augšupielādi. Ilgāki faili? Split with /audio/cut/ or use /v1/stt/partch/.
Skaļruņa diarizācija ir atsevišķa caurlaide — pārslēdziet "dializējiet" par / transkripciju/. ElevenLabs STT roku transkripciju; Diarizēšanas etiķetes katram segmentam ar Skaļruņu 1 / Skaļrunis 2 / uc
Jā — /partch/ pieņem audio failu mapi. Katra transkripcijas laukuma / konts /? tab=vēsture ar oriģinālo faila nosaukumu. Mapju koku saglabāšanai izmantojiet API.
Jā — Parakstīt audio uz /v1/stt/ transliter/ ar modeli="ElevenLabs STT". Atgriež JSON ar tekstu + segmentiem + vārda līmeņa rakstzīmēm. /api/ ir pilna atsauce.
Pašuzturēti modeļi saglabāt audio uz mūsu GPUs; premium iet cauri ar DPA. Audio tiek dzēsts pēc Share-window (24h anon, 7d pierakstīšanās). Mēs nemācāmies uz jūsu ievades.
Jā — Free.ai dod tiesības komerciāli izmantot transkriptus. Jums ir vajadzīgas tiesības uz jūsu augšupielādēto audio (savu ierakstu, licencēto materiālu vai saturu ar piekrišanu).
Reālā laika faktors ir aptuveni 0,05-0,2× — 60 minūšu podcast transkripcija 3–12 minūšu laikā. Premium modeļi bieži vien beidzas ātrāk. Izmantojiet rindas pogu, lai aizvērtu cilni.