Wizper (Whisper v3)

Free.ai · stt · ~500 kuponki minute

Pudota ääni- tai videotiedosto tai liitä alla olevaan URL-osoitteeseen

~500 kuponki minute
Se kulkee ilmaiseksi GPU:n avulla. Päivitys Wizper (Whisper v3) →

Wizper (Whisper v3) on a puheesta tekstiin -malli. Reitoitettu ulkoisten mallien kautta - ~500-topones minuutissa (50 % yli alkutuotantokustannusten).

Käyttö API:n kautta

OpenAI-yhteensopiva REST API. Luo avain ja soita tähän malliin sekunneissa.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/wizper","audio_url":"https://..."}'
API-dokumentaatio Hae API-avain

Usein kysyttyjä

Wizper (Whisper v3) kirjoittaa puhuttua ääntä tekstiin. Lataa MP3-, WAV-, M4A- tai videotiedosto ja Wizper (Whisper v3) palauttaa koko selostuksen sekä valinnaisen SRT/VTT-tekstityksen aikaleimalla.

Wizper (Whisper v3) handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Sananhimon luku on 5-10 prosenttia puhtaalla englannin äänellä, 10-20 prosenttia äänekkäällä tai korostuneella äänellä. Suuret saman arkkitehtuurin versiot tekevät paljon paremmin kovissa tapauksissa - valitse suurempi, kun ääni on karkeaa.

Kyllä - jokaisessa segmentissä on aloitus- ja loppuaikaleimat. Vie SRT:nä tai VTT:nä ja aikakartta suoraan videollesi.

Wizper (Whisper v3) on premium-transkriptiomoottori, joka näyttää noin 500-1 500 kuponkia minuutissa ennen kuin luot. Itseohjattu transkriptio toimii ilmaiseksi 30 000-token päiväpoolissasi; premium-mallit maksavat jakona, ja lisäksi 1 dollarista.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - poistamme äänen. Max 500 MB per lataus. Pidemmät tiedostot? Jaettuna /audio/cut/ tai käyttää /v1/st/batch/.

Kaiuttimen diarisointi on erillinen syöttö - "diarisoida" /transcription/. Wizper (Whisper v3) käsittelee transkription; diarisoinnin tarroja kussakin segmentissä kaiuttimen 1 / kaiuttimen 2 / jne.

Kyllä - /batch/ hyväksyy äänitiedostojen kansion. Jokainen transkripti laskeutuu /country/?tab=historiaan alkuperäisen tiedostonimellä. Kansion ja puun säilytykseen käytetään API:tä.

Kyllä - POST äänitasosi on /v1/stt/transcribe/ with model="Wizper (Whisper v3)". Palauttaa JSONin tekstillä + segmenteillä + sanatasolla. /apilla on koko viite.

Omatoimiset mallit pitävät äänen GPU:ssa; premium-maksu kulkee läpi DPA:lla. Ääni poistetaan osakeikkunan jälkeen (24h anon, 7d kirjautumisesta). Emme harjoittele tuloksillasi.

Kyllä - Free.ai myöntää kaupallisen käytön skriptikirjoituksille. Tarvitset oikeudet lataamaasi äänitteeseen (oma tallenne, lisensoitu materiaali tai sisältö suostumuksella).

Reaaliaikakerroin on noin 0,05-0,2 x - 60 minuutin podcast-kirjoitus 3-12 minuutissa. Premium-mallit valmistuvat usein nopeammin. Sulje välilehti jonon painikkeella.

Love Free.ai? Tell your friends!

Arvostele tätä sivua