ဒိန်းမတ် ဘာသာပြန်ချက်

AI နှင့်အတူစာသားကို transcribe ဒိန်းမတ် audio နှင့်ဗီဒီယို။ မြန်ဆန်, တိကျ, နှင့်အခမဲ့။

၎င်းသည်အလုပ်လုပ်ပုံ

  1. ဆီသို့သွားပါ Free.ai ဘာသာပြန်သူ
  2. ဒိန်းမတ် အသံ/ဗီဒီယိုဖိုင်ကိုတင်ပါ
  3. ကျွန်တော်တို့ရဲ့ AI ဒိန်းမတ် အလိုအလျောက်ရှာဖွေတွေ့ရှိပြီး transcribes
  4. စာသားသို့မဟုတ် SRT subtitles အဖြစ်သင်၏ transcript ကို download လုပ်ပါ

ဒိန်းမတ် ဘာသာပြန်ခြင်း အင်္ဂါရပ်များ

  • faster-whisper (MIT လိုင်စင်) အားဖြင့် Powered
  • ဒိန်းမတ် ဘာသာစကားကို အလိုအလျောက် ရှာဖွေ
  • MP3, WAV, MP4, M4A, FLAC, နှင့်ပိုမိုထောက်ခံ
  • အချိန်စနစ်နှင့်စာသားအတိုကောက်များ တင်ပို့ခြင်း (SRT)
  • ပေးဆောင်အစီအစဉ်များအပေါ်ဖိုင်အရွယ်အစားကန့်သတ်ချက်မရှိ
  • သီးခြားနှင့်လုံခြုံမှုရှိသော -- ဖိုင်များကိုလုပ်ဆောင်ပြီးမှ ဖျက်ပစ်သည်

ဘာသာစကား အသေးစိတ်

ဘာသာစကားဒိန်းမတ်
ISO ကုဒ်da
AI မော်ဒယ်faster-whisper တွင်
ဈေးနှုန်းလွတ်လပ်မှု

ပိုပြီးဘာသာစကားများ

ဘာသာစကားအားလုံးကိုကြည့်ပါ

FAQ

Whisper ကြီးမားတဲ့-v3-turbo ဒိန်းမတ် ခိုင်မာစွာကိုင်တွယ် - 7-15% စံအသံအပေါ်စကားလုံးအမှားနှုန်း. နာမည်တပ်ထားသော entities များပေါ်တွင်တစ်ခါတစ်ရံအစားထိုးမျှော်လင့်, နံပါတ်များ, နှင့်အထူနည်းပညာဝေါဟာရများ; ၏ transcript ၏အကြီးအကျယ်မှန်ကန်လိမ့်မည်။(Tier B, 7-15% word error rate benchmark sets အပေါ် - ကျွန်တော်တို့ဟာစျေးကွက်ရှာဖွေရေးတောင်းဆိုမှုများထက်ရိုးသားတဲ့ WER tiers ကိုထုတ်ဝေ။ )

ဟုတ်ကဲ့ — ဒိန်းမတ် transcription ကိုသင်၏နေ့စဉ်အခမဲ့ token ကိုရေကန်မှပထမဦးဆုံးဆွဲ. အသံအကြောင်းကိုကုန်ကျစရိတ် 50 မိနစ်လျှင် tokens, ဒါကြောင့်အမည်မဲ့နေ့စဉ်ရေကန်တစ်နေ့လျှင်အသံ၏နာရီအနည်းငယ်ကိုဖုံးလွှမ်း. Signed-in အကောင့်များအကြီးစား 30,000-token တစ်နေ့တာရေကန်ရ. လွန်ခဲ့သော, transcription ကိုသင်-သွားအဖြစ်ပေးဆောင်သည်, $1 မှ token ကို top-ups နှင့်အတူ.

ဒိန်းမတ် transcripts ဘာသာစကား၏ပုံမှန်စာလုံးပေါင်းနှင့်အတူစံ UTF-8 မှာပြန်လာကြသည်။

MP3, WAV, M4A, FLAC, OGG, OPUS, နှင့် WEBM တိုက်ရိုက်လက်ခံကြသည်။ ဗီဒီယိုများအတွက် (MP4, MOV, MKV) ကျွန်တော်တို့ဟာ Whisper သို့ပို့ဆောင်မတိုင်မီ audio track ကို server-side ကိုထုတ်ယူ — သင်ကိုယ်တိုင်ဘာမှပြောင်းလဲရန်မလိုပါ. တူညီတဲ့ပိုက်လိုင်းအရင်းအမြစ်ဘာသာစကားမပါဘဲ, ဒိန်းမတ် အပါအဝင်.

အမည်မဲ့ upload များအနည်းငယ်မှာခေါင်း 500 MB ကိုဖိုင်တစ်ဖိုင်. မှတ်ပုံတင်-in အကောင့်များ2GB အထိသွား. ကြာချိန်သည်အလွန်အမင်းအကနင်းမဟုတ်ပါ - ကြာရှည်ဖိုင်များကိုအလိုအလျောက် chunked နေကြတယ် (30-စက္ကန့် windows များအထပ်ထပ်နှင့်အတူ) နှင့်ဆက်လက်အချိန်စင်ကြယ်သောအတူတစ်ဦးတည်း transcript သို့ပြန်ချည်. Multi-နာရီ ဒိန်းမတ် မှတ်တမ်းတင် (podcasts, အပြည့်အဝသင်တန်း, တွေ့ဆုံ) ကောင်းစွာအလုပ်လုပ်.

ဟုတ်ကဲ့ — speaker diarization အားလုံး ဒိန်းမတ် transcript အတွက် default အားဖြင့်ပေါ်တွင်ဖြစ်ပါသည်. ထုတ်ကုန် Speaker အဖြစ် segmented ခံရသည် 1 / Speaker2/ Speaker3timestamps နှင့်အတူ, ဒါကြောင့်အင်တာဗျူး, panel ကိုဆွေးနွေး, နှင့် multi-ပါတီအစည်းအဝေးများ label ကိုပြန်လာ. Diarization သီးခြားမော်ဒယ်ပေါ်တွင် runs နှင့်ကျွန်ုပ်တို့ထောက်ခံသောဘာသာစကားအားလုံးအကြားတူညီသောအလုပ်လုပ်.

ဟုတ်ကဲ့ — YouTube ကိုသို့မဟုတ် podcast feeds များအတွက် / transcribe / podcast / ထဲသို့ URL ကို paste (Apple, Spotify, RSS). ကျနော်တို့အသံကိုဒေါင်းလုပ်, language = da နှင့်အတူ Whisper မှတဆင့်၎င်းကို run, နှင့်အချိန်စတိုင်နှင့်ပြောဆိုသူလိပ်စာများနှင့်အတူ transcript ကိုပြန်ပို့. ယေဘုယျအားဖြင့် ဒိန်းမတ် အကြောင်းအရာ: ဒိန်းမတ် အားလုံးအလုပ် — / transcribe / youtube / သို့ URL ကို paste သို့မဟုတ်တိုက်ရိုက်ဖိုင်ကို upload.

Whisper အကြောင်းကို audio ကိုမိနစ်လျှင် 50 tokens ကုန်ကျစရိတ်, ဒါကြောင့်တစ်နာရီမှတ်တမ်းတင် ~3,000 tokens ဖြစ်ပါတယ်။ အများစုအသုံးပြုသူများသည်ဘာမှမသုံးစွဲ - 30,000 tokens ၏အခမဲ့နေ့စဉ်ရေကန်တိုတောင်းတဲ့ clip များ, အသံမှတ်စုများနှင့်တစ်ဦး-off podcasts ကိုဖုံးလွှမ်း။ ဒါကိုကျော်လွန်, transcription သည် $1 မှ token top-ups နှင့်အတူသင်သွားကြသည်အဖြစ်ပေးချေသည်။

ဟုတ်ကဲ့ — နှစ်ဦးစလုံး segment-အဆင့် (တစ်ခါတစ်ရံ ~ 10-30 စက္ကန့်) နှင့်စကားလုံး-အဆင့် timestamps ရရှိနိုင်. စကားလုံး-အဆင့် VTT / SRT ရုပ်သံဇာတ်လမ်းတွဲတင်ပို့ဖို့ default ဖြစ်ပါတယ်ဒါကြောင့်စာသားလိုင်း-by-line ကို sync. API ကို set ကို timestamps အပေါ် "စကားလုံး" တောင်းဆိုချက်ကိုယ်ခန္ဓာထဲမှာ. ဒိန်းမတ် transcripts ဘာသာစကား၏ပုံမှန်စာလုံးပေါင်းနှင့်အတူစံ UTF-8 မှာပြန်လာကြသည်။

ဟုတ်ကဲ့. POST audio (multipart / form-data, field name "file") to /v1/transcribe/ with language=da — or omit the language parameter to let Whisper auto-detect. အဆိုပါ transcript နှင့်အတူ JSON ကိုပြန်လာ, segments, timestamps, နှင့် Speaker labels. Full reference and SDK snippets at /api/.

ဟုတ်ကဲ့ — တစ်ခါ transcription ပြီးဆုံး, ကလစ်နှိပ်ပါ ဘာသာပြန်သို့မဟုတ် / translate / ထဲသို့စာသားကို paste. ဒိန်းမတ် ကျွန်တော်တို့ထောက်ခံသောအခြားဘာသာစကားအားလုံးနှင့်အတူစုံတွဲများ (200+). တွေ့ဆုံမိနစ် pipe ကို / summarize / မှတဆင့် transcript ကိုများအတွက်; ဘာသာပြန်များအတွက် / voice / tts / ရည်မှန်းချက်ဘာသာစကားတွင်အသံကို render ဖို့ပို့.

Whisper သည် အစစ်အမှန်ကမ္ဘာမှ အသံ နာရီပေါင်းထောင်ပေါင်းများစွာကို သင်ကြားပေးထားပြီးဖြစ်သည် ။ ဒါကြောင့် ဒိန်းမတ် တွင် ဖုန်းအရည်အသွေးမြင့် မှတ်တမ်းတင်မှုများကို ပြုလုပ်နိုင်သည်။ အကောင်းဆုံးရလဒ်များအတွက် ရှင်းလင်းသော အသံ (headset mic, no music bed) ကို ထောက်ပံ့ပေးပါ။မှတ်တမ်းတစ်စောင်ကို အသုံးပြုလို့မရတော့လျှင် contact@free.ai သို့ အီးမေးလ်ပို့ပါ။

ချစ်ခြင်းမေတ္တာ Free.ai? သင့်မိတ်ဆွေများကိုပြောပါ!

ဒီစာမျက်နှာကိုတန်ဖိုးထား