ElevenLabs STT

Free.ai · stt · ~500 tokens တစ်ဦးချင်းစီ minute

အသံ/ဗီဒီယိုဖိုင်ကိုချလိုက်၊ သို့မဟုတ် URL ကိုအောက်တွင် ရေးထည့်

~500 tokens တစ်ဦးချင်းစီ minute
ကျွန်တော်တို့ရဲ့ GPUs အပေါ်အခမဲ့ Runs ။ များအတွက်အဆင့်မြှင့် ElevenLabs STT →

ElevenLabs STT သည် a ဘာသာစကား-သို့-စာသား ပုံစံ ဖြစ်ပါတယ်။ ပြင်ပမော်ဒယ်များမှတဆင့်လမ်းကြောင်း - ~500 tokens ကို မိနစ် (50% upstream ကုန်ကျစရိတ်ထက် markup).

API ကိုမှတဆင့်အသုံးပြု

OpenAI-ကိုက်ညီ REST API ကို။ တစ်ဦးကုတ်ကို generate နှင့်စက္ကန့်အတွင်းဤမော်ဒယ်ကိုခေါ်ဆို.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/elevenlabs/speech-to-text","audio_url":"https://..."}'
API စာရွက်စာတမ်းများ API Key ကိုရယူပါ

မေးလေ့ရှိသောမေးခွန်းများ

ElevenLabs STT text ကိုသို့ပြောဆိုအသံ transcribes. MP3 ကို upload, WAV, M4A, သို့မဟုတ်ဗီဒီယိုဖိုင်နှင့် ElevenLabs STT ချိန်ညှိချက်များနှင့်အတူ optional SRT / VTT subtitles ပေါင်းပြီးအပြည့်အဝ transcript ကိုပြန်လာ.

ElevenLabs STT handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Word-အမှားနှုန်း 5-10% ရှင်းလင်းအင်္ဂလိပ်အသံ, 10-20% မြည်တမ်းသို့မဟုတ် accented အသံအပေါ်ဖြစ်ပါသည်. အလားတူအဆောက်အအုံ၏ကြီးမားသောအမျိုးအစားများအလွန်ခက်ခဲသောကိစ္စရပ်များအပေါ်အဓိပ္ပါယ်ပိုကောင်းလုပ် - အသံကခက်ခဲတဲ့အခါပိုကြီး pick.

ဟုတ်ကဲ့ - အားလုံး segment ကိုစတင် / ပြီးဆုံးအချိန်စတိုင်များပါဝင်သည်. SRT သို့မဟုတ် VTT နှင့်အချိန်မြေပုံသင်၏ဗီဒီယိုပေါ်သို့တိုက်ရိုက်အဖြစ် Export.

ElevenLabs STT တစ်ဦးပရီမီယံ transcription engine ကိုဖြစ်ပါသည်. အကြောင်းကို ~500-1,500 audio ကိုမိနစ်လျှင် tokens တွေကို, သင်ဖန်တီးမတိုင်မီသက်တမ်းတိုးပြသ. Self-hosted transcription ကိုသင်၏ 30,000-token နေ့စဉ်ရေကန်အပေါ်အခမဲ့ runs; ပရီမီယံမော်ဒယ်များ pay-as-you-go နေကြတယ်, $1 မှ top-ups နှင့်အတူ.

MP3, WAV, M4A, FLAC, OGG, ပေါင်းစပ်ဗီဒီယို (MP4, MOV, WebM) - ကျွန်တော်တို့ဟာအသံဖိုင်ကိုထုတ်ယူ. Max 500 MB တစ်ခု upload ကို. ပိုမိုကြာရှည်ဖိုင်များ? Split /audio/cut/ သို့မဟုတ်အသုံးပြု /v1/stt/batch/.

Speaker diarization တစ်ခုတည်းသောဖြတ်သန်းဖြစ်ပါသည် - toggle "diarize" / transcribe / အပေါ်. ElevenLabs STT transcription ကိုကိုင်တွယ်; Speaker ကိုနှင့်အတူတစ်ဦးချင်းစီ segment ကို diarization labels 1 / Speaker ကို2/ စသည်တို့ကို

ဟုတ်ကဲ့ - / batch / audio files များ၏ folder ကိုလက်ခံ. တစ်ခုချင်းစီကို transcript / account /? tab = သမိုင်းတွင်မြေပုံများမူရင်း filename နှင့်အတူ. folder-သစ်ပင်ထိန်းသိမ်းရေးအတွက် API ကိုအသုံးပြု.

ဟုတ်ကဲ့ - POST ကို /v1/stt/transcribe / model ကို "ElevenLabs STT" နှင့်အတူသင်၏အသံကို. စာသားနှင့်အတူ JSON ကိုပြန်လာ + segments + စကားလုံး-အဆင့် timestamps. /api/ ပြည့်စုံသောအညွှန်းရှိပါတယ်.

Self-hosted ပုံစံများကျွန်တော်တို့ရဲ့ GPUs အပေါ်အသံကိုထိန်းသိမ်းထား; premium ကိုတစ်ဦး DPA နှင့်အတူဖြတ်သန်းသွားပါ. အသံက share-window ကိုပြီးနောက်ဖျက်ပစ်သည် (24h anon, 7d signed-in). ကျွန်တော်တို့ဟာသင်၏ inputs တွေကိုသင်တန်းမပေး.

ဟုတ်ကဲ့ - Free.ai transcripts ၏စီးပွားရေးလုပ်ငန်းအသုံးပြုမှုကိုပေးအပ်. သင် uploaded အသံကိုပိုင်ခွင့်လိုအပ် (သင့်ရဲ့ကိုယ်ပိုင်မှတ်တမ်းတင်, လိုင်စင်ပစ္စည်း, သဘောတူညီချက်နှင့်အတူသို့မဟုတ်အကြောင်းအရာ).

Real-time အကြောင်းရင်းအနည်းငယ် 0.05-0.2 × ဖြစ်ပါတယ်။ - 60-မိနစ် podcast ကို 3-12 မိနစ်အတွင်း transcribes ။ Premium ကိုမော်ဒယ်များအစဉ်အလာပိုမိုမြန်ဆန်ပြီးဆုံး. tab ကိုပိတ်ရန်တန်းဘုတ်ကိုသုံးပါ။

ချစ်ခြင်းမေတ္တာ Free.ai? သင့်ရဲ့မိတ်ဆွေများကိုပြောပါ!

ဒီစာမျက်နှာကိုရမှတ်