Distil-Whisper large-v3

Free.ai (self-hosted) · stt · ~500 tokens per minute

Een audio- of videobestand laten vallen of een URL plakken

~500 tokens per minute

Distil-Whisper large-v3 is a spraak-tekstmodel gebouwd door HuggingFace. Sterkste bij Real-time transcription, large-volume batch STT.. Zelf gehost op Free.ai GPU's loopt gratis tegen uw dagelijkse token pool (500 tokens per minuut). Vrijgegeven onder MIT - commercieel gebruik toegestaan op Free.ai.

Gebruik via API

OpenAI-compatibele REST API. Genereer een sleutel en bel dit model in seconden.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"distil-whisper-large-v3","audio_url":"https://..."}'
API-documentatie API-sleutel ophalen

Veelgestelde vragen

Distil-Whisper large-v3 transcribeert gesproken audio in tekst. Upload een MP3, WAV, M4A, of videobestand en Distil-Whisper large-v3 geeft het volledige transcript plus optionele SRT/VTT ondertitels met tijdstempels terug.

Distil-Whisper large-v3 handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Word-error rate is 5-10% op schone Engelse audio, 10-20% op lawaaierige of geaccentueerde audio. Grote varianten van dezelfde architectuur doen betekenisvol beter op harde gevallen - kies groter wanneer de audio is ruw.

Ja - elk segment bevat start/end tijdstempels. Exporteer als SRT of VTT en de tijdkaart direct op uw video.

Distil-Whisper large-v3 draait op onze eigen GPU's tegen uw dagelijkse gratis zwembad eerst; $5 → 200.000 betaalde tokens daarna. Ongeveer ~ 500 tokens per minuut.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - we halen de audio. Max 500 MB per upload. Langere bestanden? Splitsen met /audio/cut/of gebruik /v1/stt/batch/.

Speaker diarization is een aparte pas - toggle "diarize" op /transcribe/. Distil-Whisper large-v3 behandelt de transcriptie; diarization labels elk segment met Speaker 1 / Speaker 2 / etc.

Ja - /batch/ accepteert een map met audiobestanden. Elke transcript landt in /account/?tab=history met de oorspronkelijke bestandsnaam. Voor het bewaren van de map-boom gebruik de API.

Ja - POST uw audio naar /v1/stt/transcribe/ met model="Distil-Whisper large-v3." Geeft JSON terug met tekst + segmenten + woord-level timestamps. /api/ heeft de volledige referentie.

Zelfgehoste modellen houden audio op onze GPU's; premium door te voeren met een DPA. Audio wordt verwijderd na het share-venster (24h anon, 7d ingelogd). We trainen niet op uw ingangen.

Ja - Free.ai verleent commercieel gebruik van transcripten. U heeft rechten nodig op de audio die u hebt geüpload (uw eigen opname, licentiemateriaal of inhoud met toestemming).

Real-time factor is ongeveer 0,05-0.2× - een 60 minuten durende podcast transcribes in 3-12 minuten. Premium modellen vaak sneller eindigen. Gebruik de wachtrij knop om het tabblad te sluiten.

Love Free.ai? Vertel het uw vrienden!

Beoordeel deze pagina