Moonshine Base

Free.ai (self-hosted) · stt · ~500 tokens per minute

Ses veya video dosyasını bırakın veya URL'yi aşağıya yapıştırın

~500 tokens per minute

Moonshine Base a konuşma- metin modeli tarafından Useful Sensors tarafından inşa edildi. En güçlüsü Low-latency live transcription, embedded devices.. Free.ai GPU'da kendi başına konumlandırılmış — günlük token havuzunuza karşı ücretsiz çalışır (500 tokens dakika). MIT altında yayınlanmıştır - ticari kullanım Free.ai üzerinde izin verilmiştir.

API üzerinden kullan

OpenAI uyumlu REST API. Bir anahtar oluştur ve bu modeli saniyeler içinde çağır.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"moonshine-base","audio_url":"https://..."}'
API belgelendirmesi API Anahtarını Al

Sık Sorulan Sorular

Moonshine Base konuşulan sesleri metin haline çevirir. Bir MP3, WAV, M4A veya video dosyasını yükleyin ve Moonshine Base tam metin ile zaman damgalı seçenek SRT/VTT altyazılarını geri verir.

Moonshine Base handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Sözcük hata oranı temiz İngilizce seslerde %5-10, gürültülü veya aksanlı seslerde %10-20'dir. Aynı mimarinin büyük varyantları zor durumlarda anlamlı şekilde daha iyi çalışır - ses sert olduğunda büyükleri seçin.

Evet - her bölüm başlangıç/son zaman damgaları içerir. SRT veya VTT olarak ihraç et ve zamanlar doğrudan videonuza kaydedilir.

Moonshine Base, önce günlük ücretsiz havuzunuza karşı kendi GPU'larımız üzerinde çalışır; $5 → 200.000 ödenmiş token sonra. dakikada ~500 token.

MP3, WAV, M4A, FLAC, OGG, video (MP4, MOV, WebM) - ses çıkarıyoruz. Yükleme başına en fazla 500 MB. Daha uzun dosyalar? /audio/cut/ ile böl veya /v1/stt/batch/ kullan.

Konuşmacı diarization ayrı bir geçiş - /transcribe / üzerinde "diarize"yi değiştirin. Moonshine Base transkripi yönetir; diarization her segmenti Konuşmacı 1 / Konuşmacı 2 / vs ile etiketler.

Evet - /batch/ ses dosyalarının bir dizinini kabul eder. Her bir transkrip orijinal dosya adı ile /account/?tab=history'ye düşer. Dizin ağacı koruması için API'yi kullanın.

Evet - Sesinizi model="Moonshine Base" ile /v1/stt/transcribe/'a POST edin. JSON'u metin + segmentler + kelime seviyesi zaman damgalarıyla geri verir. /api/ tam referansa sahiptir.

Kendi başına konumlanan modellerde ses GPU'larımızda kalır; premium modellerde DPA ile geçer. Ses paylaşım penceresinden sonra silinir (24 saat anon, 7 gün giriş). Girişleriniz üzerinde eğitim yapmayız.

Evet - Free.ai ticari kullanım için kopyaları kabul eder. Yüklediğiniz ses için haklarınıza ihtiyacınız var (kendi kayıtlarınız, lisanslı materyaller veya izinle içerik).

Gerçek zaman faktörü yaklaşık 0.05-0.2× - 60 dakikalık bir podcast 3-12 dakikada yazılır. Premium modelleri genellikle daha hızlı biter. Sekmeyi kapatmak için kuyruk düğmesini kullanın.

Love Free.ai? Tell your friends!

Bu sayfayı değerlendir