Moonshine Base

Free.ai (self-hosted) · stt · ~500 fitxes per minute

Deixa anar un fitxer d' àudio o vídeo, o enganxa un URL a sota

~500 fitxes per minute

Moonshine Base és a Model de text a text construït per Useful Sensors. Més fort a Low-latency live transcription, embedded devices.. Auto- màquina en les GPUs Free.ai - executades en contra de la vostra piscina diària (500 fitxes per minut). Publicat sota MIT - Ús comercial permès en Free.ai.

Ús mitjançant l' API

L' API OpenAI compatible amb l' OpenAI. Genera una clau i l' anomenen en segons.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"moonshine-base","audio_url":"https://..."}'
Documentació de l' API Obtén la clau de l' API

Preguntes més freqüents

Moonshine Base transcribes spoken audio into text. Upload an MP3, WAV, M4A, or video file and Moonshine Base returns the full transcript plus optional SRT/VTT subtitles with timestamps.

Moonshine Base handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

La taxa de paraules és de 5-10% en àudio anglès net, 10-20% sobre àudio sorollós o accentuat. Les grans variants de la mateixa arquitectura fan molt millor en casos difícils - escullen més quan l' àudio és dur.

Sí, cada segment inclou marques de temps d' inici/ final. Exporta com SRT o VT i les hores del mapa directament al vídeo.

Moonshine Base runs on our own GPUs against your daily free pool first; $5 → 200,000 paid tokens after that. About ~500 tokens per minute.

MP3, WAV, M4A, FLAC, OGG, més vídeo (MP4, MOV, WebM) - extractes l' àudio. Max 500 MB per pujada. Els fitxers Long? Divideixs amb / audio/cut / o useu /v1t/ batch /.

La diarització del altaveu és una passa a part - commutació "dirar" a / trancrib /. Moonshine Base gestiona la transcripció; etiquetes diarització cada segment amb un president 1 / 2 / etc.

Sí - / batch/ accepta una carpeta de fitxers d' àudio. Cada entrada de la transcripció en / compte /? tab=hi història amb el nom del fitxer original. Per a la preservació de carpetes usa l' API.

Sí Irene PPOST de l' àudio a / v1t/ trancrib / amb model="Moonshine Base ___ ". Retorna JSON amb text + segments + línies de temps de nivell. / api/ té la referència completa.

Els models auto-ordinadors mantenen àudio a les nostres GPU; el valor més alt passa amb una DPA. Audio s' esborra després de la finestra de compartició (24h anon, 7d signat-in). No entren en les vostres entrades.

Sí - Free.ai concedeix l' ús comercial de les transcripcions. Necessiteu drets a l' àudio que heu pujat (el vostre propi enregistrament, material amb llicència o contingut amb el consentiment).

Real-time factor is roughly 0.05-0.2× - a 60-minute podcast transcribes in 3-12 minutes. Premium models often finish faster. Use the queue button to close the tab.

Like this tool? Share it!

Valora aquesta pàgina