Distil-Whisper large-v3

Free.ai (self-hosted) · stt · ~500 mynter pr. minute

Slipp en lyd- eller video- fil, eller lim inn en URL nedenfor

~500 mynter pr. minute

Distil-Whisper large-v3 er a tale-til-tekst-modell bygget av HuggingFace. Sterkeste ved Real-time transcription, large-volume batch STT.. Selv vert på Free.ai GPUer – går fritt mot din daglige token pool (500 tokens per minutt). Frigitt under MIT - kommersiell bruk tillatt på Free.ai.

Bruk via API

OpenAI- kompatibel REST API. Lag en nøkkel og kall denne modellen i sekunder.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"distil-whisper-large-v3","audio_url":"https://..."}'
API- dokumentasjon Hent API- nøkkel

Ofte stilte spørsmål

Distil-Whisper large-v3 transcribes talte lyd til tekst. Last opp en MP3, WAV, M4A eller videofil og Distil-Whisper large-v3 returnerer hele utskriften pluss valgfri SRT/VTT teksting med tidsstempel.

Distil-Whisper large-v3 handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

word- error rate er 5-10% på ren engelsk, 10-20% på støyende eller aksentisert lyd. Store varianter av samme arkitektur gjør meningsfylt bedre i hard- tilfeller - pick større når lyden er grov.

Ja, hvert segment inneholder start - og slutt-tidsstempel. Eksporter som SRT eller VTT og tidskart rett på videoen.

Distil-Whisper large-v3 runs on our own GPUs against your daily free pool first; $5 → 200,000 paid tokens after that. About ~500 tokens per minute.

MP3, WAV, M4A, FLAC, OGG, pluss video (MP4, MOV, WebM) - vi trekker ut lyden. Maks 500 MB per opplasting. Lengere filer? Del med /audio/cut/ eller bruk / v1/ stt/ batch /.

Høytaler- arisering er et eget gjennomløp - slå av/ på « diarisisér » på / transcribe/. Distil-Whisper large-v3 håndterer transkriptionen. Diarisasjon merker hvert segment med høyttaler 1 / høyttaler 2 / osv.

Ja - /atch/ godtar en mappe med lydfiler. Hver utskrift lander i / account /? tab=historie med det opprinnelige filnavnet. Bruk API for mappe- tre.

Ja - SYKKKER lyden din til / v1/ st/ trancribe/ with model=" Distil-Whisper large-v3". Returnerer JSON med tekst + segmenter + tidsstempel på ordnivå. /api/ har full referanse.

Selvværte modeller holder lyd på våre GPU- er, premium passerer gjennom med DPA. Lyden slettes etter delingsvinduet (24h anon, 7d signert). Vi trener ikke på dine inndata.

Ja - Free.ai gir kommersiell bruk av utskrifter. Du trenger rettigheter til lyden du opplastet (din egen opptak, lisensiert materiale eller innhold med samtykke).

Sanntidsfaktoren er omtrent 0.05– 0.2× – en 60- minutters podkasttranskriber på 3– 12 minutter. Premiummodeller avsluttes ofte raskere. Bruk køknappen for å lukke fanen.

Elsk Free.ai? Fortell vennene dine!

Bedøm denne siden