Moonshine Base

Free.ai (self-hosted) · stt · ~500 Semne de referință minute

Aruncă un fișier audio sau video sau încoace o URL de mai jos

~500 Semne de referință minute

Moonshine Base este a model de vorbire-în-text construit de Useful Sensors. Cel mai puternic la Low-latency live transcription, embedded devices.. Self-hosted pe Free.ai GPUs — rula gratuit împotriva poolului de token zilnic (500 tokens pe minut). Eliberat sub MIT - utilizarea comercială permisă pe Free.ai.

Utilizați prin API

API REST compatible cu OpenAI. Generați o cheie și apelați acest model în secunde.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"moonshine-base","audio_url":"https://..."}'
Documentare API Obține cheie API

Întrebări frecvente

Moonshine Base transcrie audio vorbit în text. Încarcă un fișier MP3, WAV, M4A sau video și Moonshine Base returnează transcripția completă plus subtitrarea opțională SRT/VTT cu timelor.

Moonshine Base handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Rata de eroare cu cuvânt este de 5-10% pe audio curat englez, 10-20% pe audio zgomotos sau accentuat. Variante mari ale aceleiași arhitecturi fac semnificativ mai bine pe cazurile dure - alege mai mare atunci când audio este rușinos.

Da - fiecare segment include start-up/end timelor. Export ca SRT sau VTT și harta de timpuri direct pe video.

Moonshine Base rulează pe propriile noastre GPUs împotriva piscină gratuită zilnic prima; $ 5 → 200.000 de jetonuri plătite după asta. Aproximativ ~500 jetonuri pe minut.

MP3, WAV, M4A, FLAC, OGG, plus video (MP4, MOV, WebM) - extragem audio. Max 500 MB pe încărcare. Fișiere mai lungi? Split cu /audio/cut/ sau folosirea /v1/stt/batch /.

Diarizarea speakerului este un pas separat - comuta "diarizeaza" pe /transcribe /. Moonshine Base se ocupă de transcriere; etichete de diarizare fiecare segment cu Speaker 1 / Speaker 2 / etc.

Da - /batch/ acceptă un dosar de fișiere audio. Fiecare trancriptare terenuri în /compte /?tab=historial cu numele de fișier original. Pentru conservarea de dosare- arbore utiliza API.

Da - POST audio la /v1/stt/transcrie/ cu model="Moonshine Base". Returnează JSON cu text + segmente + date horologice de nivel de cuvânt. /api/ are referință completă.

Modelele auto-gazdă păstrează audio pe GPU-urile noastre; premium trece prin cu un DPA. Audio este șterse după ferestre de partaj (24h anon, 7d semnat-in). Noi nu antrenăm pe intrarea dumneavoastră.

Da - Free.ai acordă utilizarea comercială a tranșelor. Aveți nevoie de drepturi la audio pe care l-ați încărcat (înregistrarea propriu, material licențiat sau conținut cu consimțământ).

Factorul în timp real este de aproximativ 0.05-0.2× - un podcast de 60 de minute transcrie în 3-12 minute. Modelele premium finalizează adesea mai repede. Folosește butonul de coada pentru a închide tab.

Love Free.ai? Tell your friends!

Ratați această pagină