faster-whisper large-v3-turbo

Free.ai (self-hosted) · stt · ~500 mynter pr. minute

Slipp en lyd- eller video- fil, eller lim inn en URL nedenfor

~500 mynter pr. minute

faster-whisper large-v3-turbo er a tale-til-tekst-modell bygget av OpenAI / SYSTRAN. Sterkeste ved Accurate transcription. Selv vert på Free.ai GPUer – går fritt mot din daglige token pool (500 tokens per minutt). Frigitt under MIT - kommersiell bruk tillatt på Free.ai.

Bruk via API

OpenAI- kompatibel REST API. Lag en nøkkel og kall denne modellen i sekunder.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"whisper","audio_url":"https://..."}'
API- dokumentasjon Hent API- nøkkel

Ofte stilte spørsmål

faster-whisper large-v3-turbo transcribes talte lyd til tekst. Last opp en MP3, WAV, M4A eller videofil og faster-whisper large-v3-turbo returnerer hele utskriften pluss valgfri SRT/VTT teksting med tidsstempel.

faster-whisper large-v3-turbo handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

word- error rate er 5-10% på ren engelsk, 10-20% på støyende eller aksentisert lyd. Store varianter av samme arkitektur gjør meningsfylt bedre i hard- tilfeller - pick større når lyden er grov.

Ja, hvert segment inneholder start - og slutt-tidsstempel. Eksporter som SRT eller VTT og tidskart rett på videoen.

faster-whisper large-v3-turbo runs on our own GPUs against your daily free pool first; $5 → 200,000 paid tokens after that. About ~500 tokens per minute.

MP3, WAV, M4A, FLAC, OGG, pluss video (MP4, MOV, WebM) - vi trekker ut lyden. Maks 500 MB per opplasting. Lengere filer? Del med /audio/cut/ eller bruk / v1/ stt/ batch /.

Høytaler- arisering er et eget gjennomløp - slå av/ på « diarisisér » på / transcribe/. faster-whisper large-v3-turbo håndterer transkriptionen. Diarisasjon merker hvert segment med høyttaler 1 / høyttaler 2 / osv.

Ja - /atch/ godtar en mappe med lydfiler. Hver utskrift lander i / account /? tab=historie med det opprinnelige filnavnet. Bruk API for mappe- tre.

Ja - SYKKKER lyden din til / v1/ st/ trancribe/ with model=" faster-whisper large-v3-turbo". Returnerer JSON med tekst + segmenter + tidsstempel på ordnivå. /api/ har full referanse.

Selvværte modeller holder lyd på våre GPU- er, premium passerer gjennom med DPA. Lyden slettes etter delingsvinduet (24h anon, 7d signert). Vi trener ikke på dine inndata.

Ja - Free.ai gir kommersiell bruk av utskrifter. Du trenger rettigheter til lyden du opplastet (din egen opptak, lisensiert materiale eller innhold med samtykke).

Sanntidsfaktoren er omtrent 0.05– 0.2× – en 60- minutters podkasttranskriber på 3– 12 minutter. Premiummodeller avsluttes ofte raskere. Bruk køknappen for å lukke fanen.

Elsk Free.ai? Fortell vennene dine!

Bedøm denne siden