Fal Speech-to-Text

Free.ai · stt · ~500 kuponki minute

Pudota ääni- tai videotiedosto tai liitä alla olevaan URL-osoitteeseen

~500 kuponki minute
Se kulkee ilmaiseksi GPU:n avulla. Päivitys Fal Speech-to-Text →

Fal Speech-to-Text on a puheesta tekstiin -malli. Reitoitettu ulkoisten mallien kautta - ~500-topones minuutissa (50 % yli alkutuotantokustannusten).

Käyttö API:n kautta

OpenAI-yhteensopiva REST API. Luo avain ja soita tähän malliin sekunneissa.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/speech-to-text","audio_url":"https://..."}'
API-dokumentaatio Hae API-avain

Usein kysyttyjä

Fal Speech-to-Text kirjoittaa puhuttua ääntä tekstiin. Lataa MP3-, WAV-, M4A- tai videotiedosto ja Fal Speech-to-Text palauttaa koko selostuksen sekä valinnaisen SRT/VTT-tekstityksen aikaleimalla.

Fal Speech-to-Text handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Sananhimon luku on 5-10 prosenttia puhtaalla englannin äänellä, 10-20 prosenttia äänekkäällä tai korostuneella äänellä. Suuret saman arkkitehtuurin versiot tekevät paljon paremmin kovissa tapauksissa - valitse suurempi, kun ääni on karkeaa.

Kyllä - jokaisessa segmentissä on aloitus- ja loppuaikaleimat. Vie SRT:nä tai VTT:nä ja aikakartta suoraan videollesi.

Fal Speech-to-Text on premium-transkriptiomoottori, joka näyttää noin 500-1 500 kuponkia minuutissa ennen kuin luot. Itseohjattu transkriptio toimii ilmaiseksi 30 000-token päiväpoolissasi; premium-mallit maksavat jakona, ja lisäksi 1 dollarista.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - poistamme äänen. Max 500 MB per lataus. Pidemmät tiedostot? Jaettuna /audio/cut/ tai käyttää /v1/st/batch/.

Kaiuttimen diarisointi on erillinen syöttö - "diarisoida" /transcription/. Fal Speech-to-Text käsittelee transkription; diarisoinnin tarroja kussakin segmentissä kaiuttimen 1 / kaiuttimen 2 / jne.

Kyllä - /batch/ hyväksyy äänitiedostojen kansion. Jokainen transkripti laskeutuu /country/?tab=historiaan alkuperäisen tiedostonimellä. Kansion ja puun säilytykseen käytetään API:tä.

Kyllä - POST äänitasosi on /v1/stt/transcribe/ with model="Fal Speech-to-Text". Palauttaa JSONin tekstillä + segmenteillä + sanatasolla. /apilla on koko viite.

Omatoimiset mallit pitävät äänen GPU:ssa; premium-maksu kulkee läpi DPA:lla. Ääni poistetaan osakeikkunan jälkeen (24h anon, 7d kirjautumisesta). Emme harjoittele tuloksillasi.

Kyllä - Free.ai myöntää kaupallisen käytön skriptikirjoituksille. Tarvitset oikeudet lataamaasi äänitteeseen (oma tallenne, lisensoitu materiaali tai sisältö suostumuksella).

Reaaliaikakerroin on noin 0,05-0,2 x - 60 minuutin podcast-kirjoitus 3-12 minuutissa. Premium-mallit valmistuvat usein nopeammin. Sulje välilehti jonon painikkeella.

Love Free.ai? Tell your friends!

Arvostele tätä sivua