Fal Speech-to-Text

Free.ai · stt · ~500 tokens per minute

Een audio- of videobestand laten vallen of een URL plakken

~500 tokens per minute
Hij is vrij op onze GPU's. Upgrade voor Fal Speech-to-Text →

Fal Speech-to-Text is a spraak-tekstmodel. Gerouteerd via externe modellen - ~500 tokens per minuut (50% opwaardering boven upstream kosten).

Gebruik via API

OpenAI-compatibele REST API. Genereer een sleutel en bel dit model in seconden.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/speech-to-text","audio_url":"https://..."}'
API-documentatie API-sleutel ophalen

Veelgestelde vragen

Fal Speech-to-Text transcribeert gesproken audio in tekst. Upload een MP3, WAV, M4A, of videobestand en Fal Speech-to-Text geeft het volledige transcript plus optionele SRT/VTT ondertitels met tijdstempels terug.

Fal Speech-to-Text handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Word-error rate is 5-10% op schone Engelse audio, 10-20% op lawaaierige of geaccentueerde audio. Grote varianten van dezelfde architectuur doen betekenisvol beter op harde gevallen - kies groter wanneer de audio is ruw.

Ja - elk segment bevat start/end tijdstempels. Exporteer als SRT of VTT en de tijdkaart direct op uw video.

Fal Speech-to-Text is een premium transcriptie-engine. Ongeveer ~500-1,500 tokens per minuut van audio, live getoond voordat u genereert. Zelf-gehost transcriptie draait gratis op uw 30.000-token dagelijkse pool; premium modellen zijn pay-as-you-go, met top-ups van $1.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - we halen de audio. Max 500 MB per upload. Langere bestanden? Splitsen met /audio/cut/of gebruik /v1/stt/batch/.

Speaker diarization is een aparte pas - toggle "diarize" op /transcribe/. Fal Speech-to-Text behandelt de transcriptie; diarization labels elk segment met Speaker 1 / Speaker 2 / etc.

Ja - /batch/ accepteert een map met audiobestanden. Elke transcript landt in /account/?tab=history met de oorspronkelijke bestandsnaam. Voor het bewaren van de map-boom gebruik de API.

Ja - POST uw audio naar /v1/stt/transcribe/ met model="Fal Speech-to-Text." Geeft JSON terug met tekst + segmenten + woord-level timestamps. /api/ heeft de volledige referentie.

Zelfgehoste modellen houden audio op onze GPU's; premium door te voeren met een DPA. Audio wordt verwijderd na het share-venster (24h anon, 7d ingelogd). We trainen niet op uw ingangen.

Ja - Free.ai verleent commercieel gebruik van transcripten. U heeft rechten nodig op de audio die u hebt geüpload (uw eigen opname, licentiemateriaal of inhoud met toestemming).

Real-time factor is ongeveer 0,05-0.2× - een 60 minuten durende podcast transcribes in 3-12 minuten. Premium modellen vaak sneller eindigen. Gebruik de wachtrij knop om het tabblad te sluiten.

Love Free.ai? Vertel het uw vrienden!

Beoordeel deze pagina