Wizper (Whisper v3)

Free.ai · stt · ~500 gettoni per minute

Lasciare un file audio o video, o incollare un URL qui sotto

~500 gettoni per minute
E' Gratis sulle nostre GPU. Aggiorna per Wizper (Whisper v3) →

Wizper (Whisper v3) è a modello discorso-testo. Percorsa attraverso modelli esterni - ~500 token al minuto (50% di markup sopra il costo upstream).

Utilizzare tramite API

API OpenAI-compatibile REST. Generare una chiave e chiamare questo modello in pochi secondi.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/wizper","audio_url":"https://..."}'
Documentazione API Ottieni la chiave API

Domande frequenti

Wizper (Whisper v3) traduce l'audio parlato in testo. Carica un file MP3, WAV, M4A o video e Wizper (Whisper v3) restituisce la trascrizione completa più i sottotitoli opzionali SRT/VTT con timestamp.

Wizper (Whisper v3) handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

La velocità di errore è del 5-10% su audio inglese pulito, del 10-20% su audio rumoroso o accentato. Le grandi varianti della stessa architettura fanno significativamente meglio su casi rigidi - scegliere più grande quando l'audio è grezzo.

Sì, ogni segmento include la timestamp di inizio/fine. Esporta come SRT o VTT e i tempi di mappa direttamente sul tuo video.

Wizper (Whisper v3) è un motore di trascrizione premium. Circa ~500-1500 gettoni al minuto di audio, mostrato in diretta prima di generare. Trascrizione auto-ospitata funziona gratis sul vostro piscina quotidiana 30.000-token; modelli premium sono pay-as-you-go, con top-up da $1.

MP3, WAV, M4A, FLAC, OGG, più video (MP4, MOV, WebM) - estraiamo l'audio. Max 500 MB per upload. File più lunghi? Dividi con /audio/cut/ o usa /v1/stt/batch/.

La diarizzazione degli altoparlanti è un passaggio separato - seleziona "diarizzare" su /transcribe/. Wizper (Whisper v3) gestisce la trascrizione; le etichette di diarizzazione ogni segmento con Speaker 1 / Speaker 2 / ecc.

Sì - /batch/ accetta una cartella di file audio. Ogni trascrizione è in /account/?tab=storia con il nome originale del file. Per la conservazione dell'albero delle cartelle, utilizzare l'API.

Sì - POST il tuo audio a /v1/stt/transcribe/ con model="Wizper (Whisper v3)." Restituisce JSON con testo + segmenti + timestamp a livello word. /api/ ha il riferimento completo.

I modelli auto-hosted mantengono l'audio sulle nostre GPU; il premio passa attraverso con un DPA. L'audio viene eliminato dopo la share-window (24h anon, 7d signature-in). Non ci alleniamo sui vostri input.

Sì - Free.ai concede l'uso commerciale delle trascrizioni. È necessario avere diritti sull'audio che hai caricato (la registrazione, il materiale autorizzato o il contenuto con il consenso).

Real-time factor is roughly 0.05-0.2× - a 60-minute podcast transcribes in 3-12 minutes. Premium models often finish faster. Use the queue button to close the tab.

Love Free.ai? Dillo ai tuoi amici!

Valuta questa pagina