Fal Speech-to-Text

Free.ai · stt · ~500 žetony na žetony minute

Spusťte audio nebo video soubor, nebo vložte URL níže

~500 žetony na žetony minute
Na našich GPU to běží zdarma. Aktualizace pro Fal Speech-to-Text →

Fal Speech-to-Text je a model řeči na text. Převedeno přes externí modely - ~500 tokens za minutu (50% markup nad náklady proti proudu).

Použití přes API

OpenAI kompatibilní REST API. Generovat klíč a zavolat tento model v sekundách.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/speech-to-text","audio_url":"https://..."}'
Dokumentace API Získat API klíč

Často kladené otázky

Fal Speech-to-Text transcribes speed audio into text. Nahrajte MP3, WAV, M4A, nebo video soubor a Fal Speech-to-Text vrátí plný přepis plus volitelné SRT/VTT titulky s časovými známkami.

Fal Speech-to-Text handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Word-error rate je 5-10% na čisté anglické audio, 10-20% na hlučné nebo akcentované audio. Velké varianty stejné architektury dělat smysluplně lepší na tvrdých případech - vybrat větší, když je zvuk hrubý.

Ano - každý segment obsahuje spouštěcí/koncové časové značky. Exportujte jako SRT nebo VTT a časy mapujte přímo na vaše video.

Fal Speech-to-Text je prémiový transkripční motor. O ~500-1 500 žetonů za minutu zvuku, zobrazeno živě před generováním. Samohostované přepisování běží zdarma na vašem 30 000-token denní bazén; prémiové modely jsou pay-as-you-go, s top-up od 1 dolar.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - extrahujeme zvuk. Max 500 MB na nahrát. Delší soubory? Split s /audio/cut/ nebo použít /v1/stt/batch/.

Diarizace reproduktoru je samostatný průsmyk - přepnout "diarizaci" na /transcribe/. Fal Speech-to-Text zpracovává přepis; diarizační štítky každý segment pomocí reproduktoru 1 / Reproduktor 2 / atd.

Ano - /batch/ přijímá složku audio souborů. Každý přepis se zapíše do /concount/?tab=historie s původním názvem souboru. Pro uchování adresáře stromem použijte API.

Ano - Odešlete svůj zvuk na /v1/stt/přepis/ s modelem="Fal Speech-to-Text."Vrací JSON s textem + segmenty + word-level timeramps. /api/ má plnou referenci.

Samohostované modely udržují zvuk na našich GPU; prémiový průchod s DPA. Audio je smazán po share-window (24h anon, 7d signed-in). My netrénujeme na vašich vstupech.

Ano - Free.ai uděluje komerční využití přepisů. Potřebujete práva na audio, které jste nahráli (vlastní záznam, licencovaný materiál nebo obsah se souhlasem).

Faktor reálného času je zhruba 0,05-0.2× - 60 minutový podcast přepíše za 3-12 minut. Premium modely často končí rychleji. Pomocí tlačítka fronty zavřete kartu.

Love Free.ai? Tell your friends!

Ohodnotit tuto stránku