Wizper (Whisper v3)

Free.ai · stt · ~500 fitxes per minute

Deixa anar un fitxer d' àudio o vídeo, o enganxa un URL a sota

~500 fitxes per minute
Corre lliure a les nostres GPUs. Actualitza per Wizper (Whisper v3) →

Wizper (Whisper v3) és a Model de text a text. Pataded by models externs - ~500 fitxes per minut (50% marcat sobre el cost de la pujada).

Ús mitjançant l' API

L' API OpenAI compatible amb l' OpenAI. Genera una clau i l' anomenen en segons.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/wizper","audio_url":"https://..."}'
Documentació de l' API Obtén la clau de l' API

Preguntes més freqüents

Wizper (Whisper v3) transcribes spoken audio into text. Upload an MP3, WAV, M4A, or video file and Wizper (Whisper v3) returns the full transcript plus optional SRT/VTT subtitles with timestamps.

Wizper (Whisper v3) handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

La taxa de paraules és de 5-10% en àudio anglès net, 10-20% sobre àudio sorollós o accentuat. Les grans variants de la mateixa arquitectura fan molt millor en casos difícils - escullen més quan l' àudio és dur.

Sí, cada segment inclou marques de temps d' inici/ final. Exporta com SRT o VT i les hores del mapa directament al vídeo.

Wizper (Whisper v3) is a premium transcription engine. About ~500-1,500 tokens per minute of audio, shown live before you generate. Self-hosted transcription runs free on your 30,000-token daily pool; premium models are pay-as-you-go, with top-ups from $1.

MP3, WAV, M4A, FLAC, OGG, més vídeo (MP4, MOV, WebM) - extractes l' àudio. Max 500 MB per pujada. Els fitxers Long? Divideixs amb / audio/cut / o useu /v1t/ batch /.

La diarització del altaveu és una passa a part - commutació "dirar" a / trancrib /. Wizper (Whisper v3) gestiona la transcripció; etiquetes diarització cada segment amb un president 1 / 2 / etc.

Sí - / batch/ accepta una carpeta de fitxers d' àudio. Cada entrada de la transcripció en / compte /? tab=hi història amb el nom del fitxer original. Per a la preservació de carpetes usa l' API.

Sí Irene PPOST de l' àudio a / v1t/ trancrib / amb model="Wizper (Whisper v3) ___ ". Retorna JSON amb text + segments + línies de temps de nivell. / api/ té la referència completa.

Els models auto-ordinadors mantenen àudio a les nostres GPU; el valor més alt passa amb una DPA. Audio s' esborra després de la finestra de compartició (24h anon, 7d signat-in). No entren en les vostres entrades.

Sí - Free.ai concedeix l' ús comercial de les transcripcions. Necessiteu drets a l' àudio que heu pujat (el vostre propi enregistrament, material amb llicència o contingut amb el consentiment).

Real-time factor is roughly 0.05-0.2× - a 60-minute podcast transcribes in 3-12 minutes. Premium models often finish faster. Use the queue button to close the tab.

Like this tool? Share it!

Valora aquesta pàgina