faster-whisper large-v3-turbo

Free.ai (self-hosted) · stt · ~500 Ama-token ngalinye minute

Thola ifayela lomsindo noma levidiyo, noma chofoza i-URL ngezansi

~500 Ama-token ngalinye minute

faster-whisper large-v3-turbo yi an imodeli yokukhuluma-ku-tekisi eyenziwe ngu OpenAI / SYSTRAN. Onamandla kakhulu ku-Accurate transcription. I-self-hosted ku-Free.ai GPUs - isebenza ngokukhululekile ngaphezu kwe-token pool yakho yansuku zonke (500 tokens imizuzu). Kukhishwa ngaphansi kwe-MIT - ukusetshenziswa kokuthengiswayo kuvunyelwe ku-Free.ai.

Sebenzisa nge-API

I-REST API ehambisana ne-OpenAI. Dala isithonjana bese ubiza le modeli emaminithini.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"whisper","audio_url":"https://..."}'
Ulwazi-mbhalo lwe-API Thola isithonjana se-API

Imibuzo ebuzwa kaningi

faster-whisper large-v3-turbo iguqula umsindo okhuluma ube sihloko. Layisha i-MP3, WAV, M4A, noma ihele levidiyo futhi faster-whisper large-v3-turbo ibuyisela ukuguqulelwa okugcwele kanye ne-SRT/VTT ekhethiwe engezansi nesikhathi sosuku.

faster-whisper large-v3-turbo handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Izinga lephutha legama lingu-5-10% ku-English audio ecacile, 10-20% ku-noise or accented audio. Ama-variants amakhulu we-architecture afanayo asebenza kahle kakhulu ezimoni ezinzima - khetha okukhulu uma umsindo unzima.

Yebo - yonke inhlamvu ifaka iqala/siphele isikhathi sokufaka. Rhweba ngaphandle njenge-SRT noma i-VTT futhi amahora amaphiwe ngokuqondile kwividiyo yakho.

faster-whisper large-v3-turbo ihamba ku-GPU yethu yangempela ephikisana ne-pool yakho yamahhala yansuku zonke kuqala; $ 5 → 200,000 i-token ekhokhelwa ngemuva kwalokho. Ngokuphathelene ne-token ~ 500 ngomzuzu.

MP3, WAV, M4A, FLAC, OGG, kanye nevidiyo (MP4, MOV, WebM) - sikhipha umsindo. Max 500 MB ngayinye ukuthunyelwa. Amafayela ade kakhulu? Yahlula nge /audio/cut/ noma sebenzisa /v1/stt/batch/.

Umsindo womuntu okhulumayo uhlukaniswe - shintsha "ukukhuluma" ku /ukubhala/. faster-whisper large-v3-turbo uphatha ukubhala; umsindo womuntu okhulumayo uphawula nganoma yisiphi isiqephu nomsindo 1 / umsindo 2 / njll.

Yebo - /batch/ ithatha isibaya sefayela lomsindo. Isingeniso ngasinye siwela ku /account/?tab=history ngegama lefayela elisemthethweni. Ukugcina isibaya-isihlahla sebenzisa i-API.

Yebo - ITHOLA umsindo wakho ku /v1/stt/transcribe/ ngemodeli "faster-whisper large-v3-turbo". Ibuyisela i-JSON ngesihloko + amasekhondi + amahora egama-level. /api/ inesimo esigcwele.

Amamodeli ahlala ahlala agcina umsindo ku-GPU yethu; ipremiyamu idlula nge-DPA. Umsindo ususwa ngemuva kohlelo lokusibelana (24h anon, 7d ukungena). Asiqeqeshi ngemingeniso yakho.

Yebo - Free.ai inikeza ukusetshenziswa komphakathi kwe-transcripts. Udinga izimfanelo zesandi esilayishiwe (ukurekhoda kwakho, izinto ezilayisense, noma okuqukethwe ngesivumelwano).

Isikhathi sangempela somphumela yi 0.05-0.2× - ipodcast yemizuzu engu-60 ibhala imizuzwana engu-3-12. Amamodeli aphezulu avame ukuqedela ngokushesha. Sebenzisa inkinobho yokulinganisa ukuvala i-tab.

Uthando Free.ai? Uthi abangane bakho!

Linganisa lelikhasi