Moonshine Base

Free.ai (self-hosted) · stt · ~500 tokens per minute

Lascia un figghiu audio o video, o incolla un URL sutta

~500 tokens per minute

Moonshine Base is a mudellu di parlatu-versu-testu built by Useful Sensors. U più forti in Low-latency live transcription, embedded devices.. Auto-ospitatu in Free.ai GPU - corre gratuitamente contr'à u vostru pool di token giornalieru (500 tokens per minutu). Rilasciatu sutta MIT - usu cummerciali permessu sutta Free.ai.

Uso via API

API REST compatibili OpenAI. Genera una chiavi è chiama stu mudellu in siconni.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"moonshine-base","audio_url":"https://..."}'
Documentazione Otteni a chiavi API

Dumande frequenti

Moonshine Base trascrivi l'audiu parlatu in testu. Carica un MP3, WAV, M4A, o un figghiu video è Moonshine Base riturna a trascrizzioni cumpleta più i sottotituli SRT/VTT opziunali cù timestamps.

Moonshine Base handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

U tassu di erruri di parolla hè 5-10% in audio inglese pulitu, 10-20% in audio rumorosu o accentatu. Varianti grandi di a stessa architettura fannu significativamente megliu in casi duri - sceglite più grandi quandu l'audiu hè russu.

Sì - ogni segmentu cunteni l'indicazioni di tempu di iniziu/fini. Esporta comu SRT o VTT e li tempi s'appiceranu drittu a lu vostru video.

Moonshine Base corre nantu à i nostri propri GPU contru u vostru pool gratuitu ogni ghjornu prima; $ 5 → 200,000 tokens pagati dopu. Circa ~ 500 tokens à u minutu.

MP3, WAV, M4A, FLAC, OGG, più video (MP4, MOV, WebM) - estrichemu l'audiu. Max 500 MB per caricamentu. File più lunghi? Divide cù /audio/cut/ o usa /v1/stt/batch/.

A diarizazione di l'oraturi è un passaggiu separatu - attivate "diarize" in /transcribe/. Moonshine Base gestisci a trascrizzioni; a diarizazione etichetta ogni segmentu cu Oratore 1 / Oratore 2 / ecc.

Sì - /batch/ accetta na cartella di fichieri audio. Ogni trascrizzioni finisci in /account/?tab=history cu u nomi di figghiu origginali. Pi cunservari l'arbulu di cartelli usa l'API.

Sì - POST l'audiu à /v1/stt/transcribe/ cu model="Moonshine Base". Ritorna JSON cu testu + segmenti + timestamp a livellu di parola. /api/ hà u rifirimentu cumpletu.

Li mudelli auto-ospitati mantèninu l'audiu supra li nostri GPU; i mudelli premium passanu cu un DPA. L'audiu è cancellatu dopu a finestra di cunnizzioni (24 ore anònimu, 7 ghjorni di cunniscenza). Non ci addestramu a basa di i vostri input.

Sì - Free.ai cunzenti l'usu cummerciali di li trascrizzioni. Avete bisognu di li diritti di l'audiu ca caricate (a vostra registrazioni, materiali licenziatu, o cuntinutu cun cunsensu).

U fatturi di tempu reale hè approssimativamente 0.05-0.2× - un podcast di 60 minuti trascrive in 3-12 minuti. I mudelli Premium spessu finiscinu più veloci. Usate u buttone di coda per chiudiri a scheda.

Amuri Free.ai? Dì i vostri amichi!

Valuta sta pàggina