ElevenLabs STT

Free.ai · stt · ~500 Prometium minute

Laat val 'n oudio- of videolêer, of plak 'n URL hieronder

~500 Prometium minute
Loop gratis op ons GPU's. Gradeer op vir ElevenLabs STT →

ElevenLabs STT is a spraak- tot- teks model. Routed through external models - ~500 tokens per minuut (50% markup over upstream cost).

Gebruik via API

OpenAI- versoenbaar met REST API. Genereer 'n sleutel en noem hierdie model in sekondes.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API Dokumentasie Kry 'n Pi-sleutel

Vrae wat dikwels gevra word

ElevenLabs STT tran Intifs gepraat klank in teks. Oplaai 'n Mp3, WAV, M4A, of video lêer en ElevenLabs STT gee terug die volledige transkripsie plus opsionele SRT/VTT sub titles met tyetamps.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Word-error tempo is 5-10% op skoon Engelse oudio, 10-20% op lawaaierige of aksent-oudio. Groot variante van dieselfde argitektuur doen betekenisvol beter op moeilike gevalle - kies groter wanneer die oudio grof is.

Ja - elke deel sluit begin/end timestampe in. Voer uit as SRT of VTT en die kerekaart reguit op jou video.

ElevenLabs STT is a premium transcription engine. About ~500-1,500 tokens per minute of audio, shown live before you generate. Self-hosted transcription runs free on your 30,000-token daily pool; premium models are pay-as-you-go, with top-ups from $1.

MP3, WAV, M4A, FLAC, OG, plus video (MP4, MOV, WebM) - ons onttrek die oudio. Max 500 mb per oplaai. Langer lêers? Skei met /audio/cut/ of gebruik /v1/st/bat/.

Luidspreker diarisering is 'n aparte herhaling ą skakel "diariseer" op /trantint /. ElevenLabs STT hanteer die transkripsie; diarisering etikette elke deel met Luidder 1 / Speaker 2 / etc.

Ja - /bat/ aanvaar 'n gids van oudio lêers. Elke transkripsie lande in /accote/?tab=historie met die oorspronklike lêernaam. Vir kabinet- boom bewaar gebruik die API.

Ja - POST jou oudio na /v1/stint/ met model= "ElevenLabs STT". Gee terug JSON met teks + segmente + woord-vlak maaltampe. /api/ het die volledige verwysing.

Self-gegasheerde modelle hou oudio op ons GPUs; premies deur met 'n DPA. Audio word uitgevee na die deel-venster (24h anon, 7d getekende-in). Ons oefen nie op jou invoers nie.

Ja - Free.ai gee kommersiële gebruik van transkripsie. Jy het regte nodig op die oudio wat jy opgelaai het (jou eie opname, gelisensieerde materiaal of inhoud met toestemming).

Real-time factor is roughly 0.05-0.2× - a 60-minute podcast transcribes in 3-12 minutes. Premium models often finish faster. Use the queue button to close the tab.

Like this tool? Share it!

Tempo hierdie bladsy