ElevenLabs STT

Free.ai · stt · ~500 tokens per minute

Jatuhkan fail audio atau video, atau tampal URL di bawah

~500 tokens per minute
Berjalan percuma pada GPU kami. Naik taraf untuk ElevenLabs STT →

ElevenLabs STT adalah a model ucapan-ke-teks. Dilalui melalui model luaran - ~500 token per minit (50% markup atas kos upstream).

Guna melalui API

API REST serasi OpenAI. Janakan kekunci dan panggil model ini dalam beberapa saat.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
Dokumentasi API Dapatkan Kekunci API

Soalan Lazim

ElevenLabs STT mentranskripsikan audio yang diucapkan ke teks. Muat naik fail MP3, WAV, M4A, atau video dan ElevenLabs STT mengembalikan transkripsi penuh plus subtitle SRT/VTT pilihan dengan setem masa.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Kadar ralat perkataan ialah 5-10% pada audio Inggeris bersih, 10-20% pada audio bising atau accented. Varian besar dari arsitektur yang sama melakukan lebih baik pada kes sukar - pilih yang lebih besar apabila audio kasar.

Ya - setiap segmen termasuk setem masa mula/akhir. Eksport sebagai SRT atau VTT dan peta masa terus ke video anda.

ElevenLabs STT adalah enjin transkripsi premium. Sekitar ~500-1,500 token per minit audio, dipaparkan secara langsung sebelum anda cipta. Transkripsi sendiri-dihost berjalan percuma pada kolam 30,000-token harian anda; model premium adalah bayar-seperti-anda-guna, dengan top-up dari $1.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - kami mengekstrak audio. Maksimum 500 MB per muat naik. Fail lebih panjang? Pisahkan dengan /audio/cut/ atau gunakan /v1/stt/batch/.

Diarisasi Speaker adalah laluan terpisah - togol "diarize" pada /transcribe/. ElevenLabs STT mengendalikan transkripsi; diarisasi melabel setiap segmen dengan Speaker 1 / Speaker 2 / dll

Ya - /batch/ menerima folder fail audio. Setiap transkripsi akan berada dalam /account/?tab=history dengan nama fail asal. Untuk pemeliharaan pepohon folder gunakan API.

Ya - POST audio anda ke /v1/stt/transcribe/ dengan model="ElevenLabs STT". Kembalikan JSON dengan teks + segmen + timestamp aras-perkataan. /api/ mempunyai rujukan penuh.

Model sendiri-hosting menyimpan audio pada GPU kami; premium lalu melalui dengan DPA. Audio dipadam selepas tetingkap berkongsi (24h anon, 7d log masuk). Kami tidak melatih pada input anda.

Ya - Free.ai memberi kebenaran penggunaan komersial transkripsi. Anda perlukan hak audio yang anda muat naik (rekod anda sendiri, bahan berlesen, atau kandungan dengan kebenaran).

Faktor masa nyata adalah kira-kira 0.05-0.2× - podcast 60 minit transkripsi dalam 3-12 minit. Model premium biasanya selesai lebih cepat. Guna butang baris gilir untuk menutup tab.

Love Free.ai? Tell your friends!

Nilai halaman ini