Wizper (Whisper v3)

Free.ai · stt · ~500 tokens per minute

Ses veya video dosyasını bırakın veya URL'yi aşağıya yapıştırın

~500 tokens per minute
GPU'larımızda ücretsiz çalışıyor. Üst düzey Wizper (Whisper v3) →

Wizper (Whisper v3) a konuşma- metin modeli. Dış modellerden yönlendirildi - ~500 tokenleri dakika (% 50 üst maliyet üzerinde markup).

API üzerinden kullan

OpenAI uyumlu REST API. Bir anahtar oluştur ve bu modeli saniyeler içinde çağır.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/wizper","audio_url":"https://..."}'
API belgelendirmesi API Anahtarını Al

Sık Sorulan Sorular

Wizper (Whisper v3) konuşulan sesleri metin haline çevirir. Bir MP3, WAV, M4A veya video dosyasını yükleyin ve Wizper (Whisper v3) tam metin ile zaman damgalı seçenek SRT/VTT altyazılarını geri verir.

Wizper (Whisper v3) handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Sözcük hata oranı temiz İngilizce seslerde %5-10, gürültülü veya aksanlı seslerde %10-20'dir. Aynı mimarinin büyük varyantları zor durumlarda anlamlı şekilde daha iyi çalışır - ses sert olduğunda büyükleri seçin.

Evet - her bölüm başlangıç/son zaman damgaları içerir. SRT veya VTT olarak ihraç et ve zamanlar doğrudan videonuza kaydedilir.

Wizper (Whisper v3), premium bir çeviri motorudur. Üretmeden önce canlı olarak gösterildiği gibi, dakikada yaklaşık ~500-1,500 token ses. Kendi başına işletilen çeviri, günlük 30,000 token havuzunuzda ücretsiz olarak çalışır; premium modeller, $1'dan başlayan yüklemelerle, kullandığınızda ödenir.

MP3, WAV, M4A, FLAC, OGG, video (MP4, MOV, WebM) - ses çıkarıyoruz. Yükleme başına en fazla 500 MB. Daha uzun dosyalar? /audio/cut/ ile böl veya /v1/stt/batch/ kullan.

Konuşmacı diarization ayrı bir geçiş - /transcribe / üzerinde "diarize"yi değiştirin. Wizper (Whisper v3) transkripi yönetir; diarization her segmenti Konuşmacı 1 / Konuşmacı 2 / vs ile etiketler.

Evet - /batch/ ses dosyalarının bir dizinini kabul eder. Her bir transkrip orijinal dosya adı ile /account/?tab=history'ye düşer. Dizin ağacı koruması için API'yi kullanın.

Evet - Sesinizi model="Wizper (Whisper v3)" ile /v1/stt/transcribe/'a POST edin. JSON'u metin + segmentler + kelime seviyesi zaman damgalarıyla geri verir. /api/ tam referansa sahiptir.

Kendi başına konumlanan modellerde ses GPU'larımızda kalır; premium modellerde DPA ile geçer. Ses paylaşım penceresinden sonra silinir (24 saat anon, 7 gün giriş). Girişleriniz üzerinde eğitim yapmayız.

Evet - Free.ai ticari kullanım için kopyaları kabul eder. Yüklediğiniz ses için haklarınıza ihtiyacınız var (kendi kayıtlarınız, lisanslı materyaller veya izinle içerik).

Gerçek zaman faktörü yaklaşık 0.05-0.2× - 60 dakikalık bir podcast 3-12 dakikada yazılır. Premium modelleri genellikle daha hızlı biter. Sekmeyi kapatmak için kuyruk düğmesini kullanın.

Love Free.ai? Tell your friends!

Bu sayfayı değerlendir