Moonshine Base

Free.ai (self-hosted) · stt · ~500 zsetononként minute

Dobjon le egy audio vagy video fájlt, vagy illessze be egy URL-t az alábbi

~500 zsetononként minute

Moonshine Base a szöveges-beszélő modell által épített Useful Sensors. A legerősebb a Low-latency live transcription, embedded devices.-nél. Önálló, Free.ai GPU-n fut ingyenes ellen a napi token medence (500 tokens percenként). MIT alatt jelent meg - a Free.ai-en engedélyezett kereskedelmi felhasználás.

Alkalmazása API-n keresztül

OpenAI-kompatibilis REST API. Létrehoz egy kulcsot, és hívja ezt a modellt másodpercek alatt.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"moonshine-base","audio_url":"https://..."}'
API dokumentáció Szerezd meg az API kulcsot

Gyakran ismételt kérdések

Moonshine Base átírja a beszélt audiót szövegbe. MP3, WAV, M4A vagy videó fájl feltöltése és Moonshine Base visszaadja a teljes átiratot plusz az opcionális SRT/VTT feliratokat időbélyegekkel.

Moonshine Base handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

A Word-error arány 5-10% a tiszta angol audió, 10-20% a zajos vagy kihangsúlyozott audió. Nagy változatok azonos építészet nem jelentékenyen jobb kemény esetekben - válassz nagyobb, ha a hang durva.

Igen - minden szegmens tartalmaz start/end időbélyegeket. Exportálás SRT vagy VTT és az idő térkép egyenesen a videó.

Moonshine Base fut a mi saját GPU ellen a napi ingyenes medence először; $5 → 200 000 fizetett zseton után. Körülbelül ~500 zseton percenként.

MP3, WAV, M4A, FLAC, OGG, plusz videó (MP4, MOV, WebM) - kivonjuk a hangot. Max 500 MB feltöltésenként. Hosszabb fájlok? /audio/cut/ vagy /v1/stt/batch/ használatával osztjuk szét.

A hangszóró diarization egy külön pass - a /transcript/. Moonshine Base-en a "diarize" gombot kell használni; a diarization minden szegmensben 1 / hangszóró 2 / stb.

Igen - /batch/ elfogad egy audio fájlt. Minden egyes átirat az eredeti fájlnévvel történik. A mappák és a fa megőrzéséhez használja az API-t.

Igen - Posztolja a hangodat a /v1/stt/transscribe/ modellel="Moonshine Base" -ra. JSON-t szöveg + szegmensek + szó szintű időbélyegek segítségével tér vissza. /api/-nál van a teljes hivatkozás.

Önálló modellek tartsa audio a GPU; prémium átmegy egy DPA. Hang törölve után a megosztás-ablak (24h anon, 7d bejelentkezve). Mi nem vonat a bemenetek.

Igen - Free.ai ad kereskedelmi használatát átiratok. Szüksége van a jogokat a feltöltött audio (a saját felvétel, licences anyag, vagy tartalom hozzájárulás).

Valós idejű tényező nagyjából 0.05-0,2× - 60 perces podcast trascribes 3-12 perc alatt. Premium modellek gyakran gyorsabban befejezik. Használja a sor gombot a fül bezárásához.

Love Free.ai? Tell your friends!

Szavazz erre az oldalra