faster-whisper large-v3-turbo

Free.ai (self-hosted) · stt · ~500 tákn fyrir minute

Slepptu hljóð- eða myndskrá eða límdu slóð hér fyrir neðan

~500 tákn fyrir minute

faster-whisper large-v3-turbo er a tal- í- texta líkan byggt af OpenAI / SYSTRAN. Sterkasta á Accurate transcription. Sjálfstætt hýst á Free.ai GPUs - keyrir ókeypis gegn daglegu táknlauginni þinni (500 tákn á mínútu). Útgáfa undir MIT - notkun í atvinnuskyni leyft á Free.ai.

Notaðu í gegnum API

OpenAI-samhæft REST API. Búa til lykil og kalla þetta líkan í sekúndum.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"whisper","audio_url":"https://..."}'
API skjölun Fá API lykil

Algengar spurningar

faster-whisper large-v3-turbo transcribes spoken audio into text. Upload an MP3, WAV, M4A, or video file and faster-whisper large-v3-turbo returns the full transcript plus optional SRT/VTT subtitles with timestamps.

faster-whisper large-v3-turbo handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Orðvillahlutfall er 5-10% á hreinu ensku hljóði, 10-20% á háværum eða accented hljóði. Stórar afbrigði af sömu arkitektúr gera merkingarbært betur á erfiðum tilvikum - velja stærri þegar hljóðið er gróft.

Já - hver hluti inniheldur byrjun / lok tímastimpil. Flytja út sem SRT eða VTT og tímakort beint á myndskeiðið þitt.

faster-whisper large-v3-turbo keyrir á eigin GPU okkar gegn daglegu ókeypis laug þinni fyrst; $ 5 → 200.000 greidd tákn eftir það. Um ~ 500 tákn á mínútu.

MP3, WAV, M4A, FLAC, OGG, auk myndskeiða (MP4, MOV, WebM) - við tökum út hljóðin. Hámark 500 MB á hverja upphleðslu. Lengri skrár? Skipta með /audio/cut/ eða nota /v1/stt/batch/.

Speaker diarization er sérstakt framhjá - skipta "diarize" á / transcribe /. faster-whisper large-v3-turbo meðhöndlar uppskrift; diarization merkir hvern hluta með Speaker 1 / Speaker 2 / osfrv.

Já - / batch / tekur við möppu með hljóðskrám. Hver afritunarskrá lendir í / account /? tab=history með upprunalegu skráarheitinu. Til að varðveita möpputré notaðu API.

Já - POST hljóðið þitt til /v1/stt/transcribe/ með model="faster-whisper large-v3-turbo". Skila JSON með texta + hlutum + orð-stig tímastimpil. /api/ hefur fulla tilvísun.

Self-hosted módel halda hljóð á GPU okkar; Premium fara í gegnum með DPA. Hljóð er eytt eftir hluta gluggann (24h anon, 7d skráður-í). Við þjálfum ekki á inntak þitt.

Þú þarft að hafa réttindi á hljóðinu sem þú hlaðir upp (eigin upptöku, efni með leyfi eða efni með samþykki) til að geta notað afritunarþjónustu Free.ai í viðskiptalegum tilgangi.

Rauntímaþátturinn er um það bil 0,05-0,2 × - 60 mínútna podcast afrita á 3-12 mínútum. Premium módel klárast oft hraðar. Notaðu biðröð hnappinn til að loka flipanum.

Elska Free.ai? Segðu vinum þínum!

Gefa þessari síðu einkunn