Moonshine Base

Free.ai (self-hosted) · stt · ~500 टोकन प्रति minute

ऑडिओ किंवा व्हिडीओ फाइल टाकून द्या, किंवा URL खाली चिकटवा

~500 टोकन प्रति minute

Moonshine Base हे a आहे भाषण- ते- पाठ्य मॉडेल Useful Sensors द्वारे बनवलेले आहे. Strongest at Low-latency live transcription, embedded devices.. Free.ai GPUs वर स्व-होस्ट - आपल्या दैनंदिन टोकन पूल विरुद्ध मुक्तपणे चालते (500 टोकन प्रति मिनिट). Released under MIT — commercial use permitted on Free.ai.

API द्वारे वापरा

OpenAI-सुसंगत REST API. किल्ली निर्माण करा व सेकंदांमध्ये हे मॉडेल कॉल करा.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"moonshine-base","audio_url":"https://..."}'
API दस्तऐवजीकरण API कि प्राप्त करा

वारंवार विचारले जाणारे प्रश्न

Moonshine Base बोलल्या गेलेल्या ऑडिओला पाठ्य मध्ये रूपांतरित करते. MP3, WAV, M4A, किंवा व्हिडीओ फाइल अपलोड करा आणि Moonshine Base पूर्ण रूपांतरित परत करते आणि पर्यायी SRT/VTT उपशीर्षक वेळ स्टॅम्पसह.

Moonshine Base handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

5-10% शब्द-त्रुटी दर स्वच्छ इंग्रजी ऑडिओवर आहे, 10-20% शोर किंवा उच्चार ऑडिओवर आहे. मोठ्या प्रमाणे तेच आर्किटेक्चरचे मोठे प्रकार कठीण प्रकरणांवर अधिक चांगले कार्य करतात - ऑडिओ कठीण असल्यास मोठे निवडा.

होय - प्रत्येक खंडात प्रारंभ/अंत वेळ स्टॅम्प समाविष्टीत आहे. SRT किंवा VTT प्रमाणे एक्सपोर्ट करा व वेळ मापा तुमच्या व्हिडीओवर थेट.

Moonshine Base runs on our own GPUs against your daily free pool first; $5 → 200,000 paid tokens after that. About ~500 tokens per minute.

MP3, WAV, M4A, FLAC, OGG, प्लस व्हिडीओ (MP4, MOV, WebM) - आम्ही ऑडिओ एक्सट्रॅक्ट करतो. प्रति अपलोड किमान 500 MB. मोठे फाइल? /audio/cut/ सह विभाजित करा किंवा /v1/stt/batch/ वापरा.

Speaker diarization is a separate pass - toggle "diarize" on /transcribe/. Moonshine Base handles the transcription; diarization labels each segment with Speaker 1 / Speaker 2 / etc.

होय - /batch/ ऑडिओ फाइलचे संचयीका स्वीकारते. प्रत्येक ट्रान्सक्रिप्ट /account/?tab=history मध्ये मूळ फाइलनाव सह उतरते. संचयीका-वृक्ष संवर्धन करीता API चा वापर करा.

Yes - POST your audio to /v1/stt/transcribe/ with model="Moonshine Base". Returns JSON with text + segments + word-level timestamps. /api/ has the full reference.

स्वतः-होस्ट केलेले मॉडेल ऑडिओ आपल्या GPU वर ठेवतात; प्रीमियम DPA द्वारे पार पडते. ऑडिओ शेअर-विंडो नंतर काढून टाकले जाते (24h अनॉन, 7d दाखलन-इन). आम्ही तुमच्या इनपुटवर प्रशिक्षण देत नाही.

होय - Free.ai मुद्रणाच्या व्यावसायिक वापरास परवानगी देते. तुम्ही अपलोड केलेल्या ऑडिओसाठी तुम्हाला अधिकार हवे आहेत (तुमचे स्वतःचे रेकॉर्डिंग, परवानाकृत सामग्री, किंवा परवानगीसह अनुक्रम).

वास्तविक वेळ घटक सुमारे 0.05–0.2× आहे — 60 मिनिटांचे पॉडकास्ट3– 12 मिनिटांमध्ये transcribes. प्रीमियम मॉडेल बहुधा लवकर पूर्ण होते. टॅब बंद करण्यासाठी क्यु बटण वापरा.

Free.ai ला आवडते? आपल्या मित्रांना सांगा!

या पानाचे गुणांकन करा