ElevenLabs STT

Free.ai · stt · ~500 tokens per minute

Ngundur berkas audio utawa video, utawa tempel URL ing ngisor iki

~500 tokens per minute
Ing ngisor iki ya iku paraga ing filem iki. Nampilaké kanggo ElevenLabs STT →

ElevenLabs STT iku a model swara-ka-teks. Routed through external models - ~500 tokens saben menit (50% markup over upstream cost).

Nganggo liwat API

REST API kang kompatibel karo OpenAI. Janji kunci lan waca model iki ing sekon.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
Dokumen Njupuk Kunci API

Takon kang asring diajukake

ElevenLabs STT ngrekam swara kang diucakaké dadi teks. Ngunduh MP3, WAV, M4A, utawa file video lan ElevenLabs STT bakal ngembali transkripsi lengkap plus subtitle SRT/VTT pilihan karo timestamp.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Kasalahan tembung rata-rata 5-10% ing audio Inggris kang bersih, 10-20% ing audio sing noise utawa akcented. Varian gedhe saka arsitektur sing padha luwih apik ing kasus hard - pilih luwih gedhé nalika audio ora rata.

Ya - saben segmen nglumpukaké stempel wektu wiwitan/akhiran. Eksport minangka SRT utawa VTT lan peta wektu langsung ing videomu.

ElevenLabs STT iku mesin transkripsi premium. Sawetara ~500-1,500 token saben menit audio, ditampilaké langsung sadurunge sampeyan ngasilaké. Transkripsi sing dihost kanthi mandiri dioperasikaké kanthi gratis ing pool 30,000-token saben dina; model premium dibayar-kaya-kanggo-mu, karo top-up saka $1.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - kita ngekstrak audio. Max 500 MB saben upload. File luwih dawa? Dipisahake karo /audio/cut/ utawa nggunakake /v1/stt/batch/.

Speaker diarization is a separate pass - toggle "diarize" on /transcribe/. ElevenLabs STT handles the transcription; diarization labels each segment with Speaker 1 / Speaker 2 / etc.

Ya - /batch/ nampi folder kanggé file audio. Saben transcript dipun-simpen ing /account/?tab=history kaliyan nama file asli. Kanggo perlindungan folder-tree, gunaka API.

Yes - POST your audio to /v1/stt/transcribe/ with model="ElevenLabs STT". Returns JSON with text + segments + word-level timestamps. /api/ has the full reference.

Model self-hosted nyimpen audio ing GPU kita; premium ngliwati karo DPA. Audio dipatèni sawisé jendela share (24 jam anon, 7 dina mlebu). Kita ora latihan ing input sampeyan.

Ya - Free.ai nyedhiyani panggunaan komersial transkripsi. Sampeyan butuh hak kanggo audio sing sampeyan unggah (rekaman dhewe, materi lisensi, utawa isi kanthi persetujuan).

Faktor wektu nyata kira-kira 0.05-0.2× - podcast 60 menit ditranskripsi ing 3-12 menit. Model Premium asring rampung luwih cepet. Gunake tombol baris tunggu kanggo nutup tab.

Love Free.ai? Nyathet kanca-kancamu!

Rangking kaca iki