ElevenLabs STT

Free.ai · stt · ~500 žetoni minute

Nometiet audio vai video failu vai ielīmējiet URL zemāk

~500 žetoni minute
Skrien bez maksas pie mūsu GPU. Uzlabot ElevenLabs STT →

ElevenLabs STT ir a runas un teksta modelis. Maršruts caur ārējiem modeļiem - ~500 tokens minūtē (50% marka virs augšupējā izmaksām).

Izmantošana caur API

AtvērtAI savietojama REST API. Ģenerējiet atslēgu un zvaniet šo modeli sekundēs.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API dokumentācija Iegūst API atslēgu

Bieži uzdoti jautājumi

ElevenLabs STT tranraksti skaļi audio tekstā. Ielādējiet MP3, WAV, M4A vai video failu un ElevenLabs STT atgriež pilnu transkriptu plus izvēles SRT/VTT subtitrus ar laika zīmogiem.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Vārdu kļūdu ātrums ir 5-10% uz tīra angļu audio, 10-20% uz trokšņains vai izcelts audio. Lieli varianti tās pašas arhitektūras darīt nozīmīgi labāk par grūtiem gadījumiem - izvēlieties lielāku, ja audio ir raupja.

Jā - katrs segments ietver start/end laika zīmjus. Eksportēt kā SRT vai VTT un laika karti tieši uz jūsu video.

ElevenLabs STT ir premium transkripcijas dzinējs. Par ~500-1,500 žetoni minūtē audio, parādīts dzīvot, pirms jūs ģenerējat. Pašhosted transkripcija darbojas bezmaksas jūsu 30,000-token dienas baseins; premium modeļi ir pay-as-you-go, ar papild-ups no $ 1.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - mēs izvelkam audio. Maksimāli 500 MB uz augšupielādi. Ilgāki faili? Sadalīti ar /audio/cut/ vai izmantot /v1/stt/partch/.

Garsētājs diarizācija ir atsevišķa caurlaide - toggle "dializēt" uz / transkripcijas /. ElevenLabs STT apstrādā transkripciju; Diarizēšanas etiķetes katram segmentam ar skaļruņu 1 / Skaļruņu 2 / uc

Jā - /partch/ pieņem audio failu mapi. Katra transkripcijas laukuma /konta/?tab=vēsture ar oriģinālo faila nosaukumu. Mapju- koku saglabāšanai izmantojiet API.

Jā - Ievieto audio uz /v1/stt/ transparent/ ar modeli="ElevenLabs STT". Atgriež JSON ar tekstu + segmentiem + vārda līmeņa rakstzīmes. /api/ ir pilna atsauce.

Pašuzturēti modeļi saglabāt audio par mūsu GPU; premium iet cauri ar DPA. Audio tiek dzēsts pēc akcijas-vindow (24h anon, 7d pierakstīšanās). Mēs nemācāmies uz jūsu ievades.

Jā - Free.ai piešķir transkriptu komerciālu izmantošanu. Jums ir nepieciešamas tiesības uz jūsu augšupielādēto audio (savu ierakstu, licencēto materiālu vai saturu ar piekrišanu).

Reālā laika faktors ir aptuveni 0,05-0,2× - 60 minūšu podcast transkripcijas transkripcijas 3-12 minūšu laikā. Premium modeļi bieži vien beidzas ātrāk. Izmantojiet rindas pogu, lai aizvērtu cilni.

Mīlestība Free.ai? Stāsti saviem draugiem!

Novērtēt šo lapu