Distil-Whisper large-v3

Free.ai (self-hosted) · stt · ~500 tokens တစ်ဦးချင်းစီ minute

အသံ/ဗီဒီယိုဖိုင်ကိုချလိုက်၊ သို့မဟုတ် URL ကိုအောက်တွင် ရေးထည့်

~500 tokens တစ်ဦးချင်းစီ minute

Distil-Whisper large-v3 သည် a ဘာသာစကား-သို့-စာသား ပုံစံ ကို HuggingFace မှတည်ဆောက်ထားသည်။ Real-time transcription, large-volume batch STT. မှာအခိုင်အမာဆုံး. Free.ai GPUs အပေါ် Self-hosted - သင်၏နေ့စဉ် token ကိုရေကန် (500 tokens မိနစ်) ကိုတိုက်ခိုက်အခမဲ့ runs ။ အောက်တွင်ထုတ်ဝေ MIT - စီးပွားရေးလုပ်ငန်းအသုံးပြုခွင့်အပေါ် Free.ai.

API ကိုမှတဆင့်အသုံးပြု

OpenAI-ကိုက်ညီ REST API ကို။ တစ်ဦးကုတ်ကို generate နှင့်စက္ကန့်အတွင်းဤမော်ဒယ်ကိုခေါ်ဆို.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"distil-whisper-large-v3","audio_url":"https://..."}'
API စာရွက်စာတမ်းများ API Key ကိုရယူပါ

မေးလေ့ရှိသောမေးခွန်းများ

Distil-Whisper large-v3 text ကိုသို့ပြောဆိုအသံ transcribes. MP3 ကို upload, WAV, M4A, သို့မဟုတ်ဗီဒီယိုဖိုင်နှင့် Distil-Whisper large-v3 ချိန်ညှိချက်များနှင့်အတူ optional SRT / VTT subtitles ပေါင်းပြီးအပြည့်အဝ transcript ကိုပြန်လာ.

Distil-Whisper large-v3 handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Word-အမှားနှုန်း 5-10% ရှင်းလင်းအင်္ဂလိပ်အသံ, 10-20% မြည်တမ်းသို့မဟုတ် accented အသံအပေါ်ဖြစ်ပါသည်. အလားတူအဆောက်အအုံ၏ကြီးမားသောအမျိုးအစားများအလွန်ခက်ခဲသောကိစ္စရပ်များအပေါ်အဓိပ္ပါယ်ပိုကောင်းလုပ် - အသံကခက်ခဲတဲ့အခါပိုကြီး pick.

ဟုတ်ကဲ့ - အားလုံး segment ကိုစတင် / ပြီးဆုံးအချိန်စတိုင်များပါဝင်သည်. SRT သို့မဟုတ် VTT နှင့်အချိန်မြေပုံသင်၏ဗီဒီယိုပေါ်သို့တိုက်ရိုက်အဖြစ် Export.

Distil-Whisper large-v3 သင့်ရဲ့နေ့စဉ်အခမဲ့ရေချိုးခန်းပထမဦးဆုံးကိုယ့်ကိုယ်ကို GPUs ကိုတိုက်ခိုက်ကျွန်တော်တို့ရဲ့ကိုယ်ပိုင်အပေါ် runs; $5 → 200,000 ထိုနောက်ပေးဆောင် tokens တွေကို. အကြောင်းကို ~500 မိနစ်လျှင် tokens တွေကို.

MP3, WAV, M4A, FLAC, OGG, ပေါင်းစပ်ဗီဒီယို (MP4, MOV, WebM) - ကျွန်တော်တို့ဟာအသံဖိုင်ကိုထုတ်ယူ. Max 500 MB တစ်ခု upload ကို. ပိုမိုကြာရှည်ဖိုင်များ? Split /audio/cut/ သို့မဟုတ်အသုံးပြု /v1/stt/batch/.

Speaker diarization တစ်ခုတည်းသောဖြတ်သန်းဖြစ်ပါသည် - toggle "diarize" / transcribe / အပေါ်. Distil-Whisper large-v3 transcription ကိုကိုင်တွယ်; Speaker ကိုနှင့်အတူတစ်ဦးချင်းစီ segment ကို diarization labels 1 / Speaker ကို2/ စသည်တို့ကို

ဟုတ်ကဲ့ - / batch / audio files များ၏ folder ကိုလက်ခံ. တစ်ခုချင်းစီကို transcript / account /? tab = သမိုင်းတွင်မြေပုံများမူရင်း filename နှင့်အတူ. folder-သစ်ပင်ထိန်းသိမ်းရေးအတွက် API ကိုအသုံးပြု.

ဟုတ်ကဲ့ - POST ကို /v1/stt/transcribe / model ကို "Distil-Whisper large-v3" နှင့်အတူသင်၏အသံကို. စာသားနှင့်အတူ JSON ကိုပြန်လာ + segments + စကားလုံး-အဆင့် timestamps. /api/ ပြည့်စုံသောအညွှန်းရှိပါတယ်.

Self-hosted ပုံစံများကျွန်တော်တို့ရဲ့ GPUs အပေါ်အသံကိုထိန်းသိမ်းထား; premium ကိုတစ်ဦး DPA နှင့်အတူဖြတ်သန်းသွားပါ. အသံက share-window ကိုပြီးနောက်ဖျက်ပစ်သည် (24h anon, 7d signed-in). ကျွန်တော်တို့ဟာသင်၏ inputs တွေကိုသင်တန်းမပေး.

ဟုတ်ကဲ့ - Free.ai transcripts ၏စီးပွားရေးလုပ်ငန်းအသုံးပြုမှုကိုပေးအပ်. သင် uploaded အသံကိုပိုင်ခွင့်လိုအပ် (သင့်ရဲ့ကိုယ်ပိုင်မှတ်တမ်းတင်, လိုင်စင်ပစ္စည်း, သဘောတူညီချက်နှင့်အတူသို့မဟုတ်အကြောင်းအရာ).

Real-time အကြောင်းရင်းအနည်းငယ် 0.05-0.2 × ဖြစ်ပါတယ်။ - 60-မိနစ် podcast ကို 3-12 မိနစ်အတွင်း transcribes ။ Premium ကိုမော်ဒယ်များအစဉ်အလာပိုမိုမြန်ဆန်ပြီးဆုံး. tab ကိုပိတ်ရန်တန်းဘုတ်ကိုသုံးပါ။

ချစ်ခြင်းမေတ္တာ Free.ai? သင့်ရဲ့မိတ်ဆွေများကိုပြောပါ!

ဒီစာမျက်နှာကိုရမှတ်