faster-whisper large-v3-turbo

Free.ai (self-hosted) · stt · ~500 žetonov na minute

Izpusti zvočno ali video datoteko ali zalepi URL spodaj

~500 žetonov na minute

faster-whisper large-v3-turbo je a model govora v besedilo, ki ga zgradi OpenAI / SYSTRAN. Najmočnejši v Accurate transcription. Samostojni gostitelj na Free.ai GPU – teče brezplačno proti vašemu dnevnemu žeton bazenu (500 žetonov na minuto). Izpuščeno pod MIT - komercialna uporaba dovoljena na Free.ai.

Uporaba prek API

OpenAI- kompatibilen REST API. Ustvarite ključ in pokličite ta model v sekundah.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"whisper","audio_url":"https://..."}'
Dokumentacija API Dobi ključ API

Pogosta vprašanja

faster-whisper large-v3-turbo transliberji v besedila. Naložite MP3, WAV, M4A ali video datoteko in faster-whisper large-v3-turbo vrne celoten transkript in neobvezna podnapisa SRT/VTT s časovnimi oznakami.

faster-whisper large-v3-turbo handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Hitrost besednih-grehtih je 5-10% na čistem angleškem avdio, 10-20% na hrupnem ali naglasnem avdio. Velika različica iste arhitekture naredi smiselno boljše na trdih primerih - izberite večji, ko je zvok grob.

Ja - vsak odsek vključuje začetna/končna časovna oznaka. Izvoz kot SRT ali VTT in časovna mapa naravnost na vaš video.

faster-whisper large-v3-turbo teče na lastne GPUs proti vaš dnevni brezplačni bazen najprej; 5 → 200.000 plačanih žetonov po tem. O ~500 žetonov na minuto.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - izvlečimo zvok. Max 500 MB na nalaganje. Datoteke dlje? Razdelite z /audio/cut/ ali uporabite /v1/stt/batch /.

Diarizacija zvočnika je ločena prepustnica - prekini "diarize" na /transcribec /. faster-whisper large-v3-turbo obvladuje transkripcijo; diariziranje oznake vsak segment z zvočnik 1 / zvočnik 2 / itd.

Da - /batch / sprejme mapo zvočnih datotek. Vsak transkript pristane v /account /?tab=history z izvirnim imenom datoteke. Za ohranjanje mape- drevo uporabite API.

Da - POST vaš zvok na /v1/stt/transcribec / z modelom="faster-whisper large-v3-turbo". Vrača JSON z besedilom + segmenti + časovni razpored besede. /api/ ima polno sklicevanje.

Samohostiteljski modeli imajo zvok na naših GPU; premium prehod z DPA. Audio se izbriše po delnem oknu (24h anon, 7d podpisa). Ne treniramo na vhodih.

Da - Free.ai dodeljuje komercialno uporabo transkriptov. Potrebujete pravice do avdio, ki ste ga naložili (vaši lastni zapisi, licencirani material ali vsebino s soglasjem).

Faktor v realnem času je približno 0,05-0,2× - 60-minutni podcast transkripter v 3-12 minutah. Premium modeli pogosto končajo hitreje. Uporabite gumb za zapretev zavihka.

Ljubezen Free.ai, povej prijateljem!

Oceni to stran