GOT-OCR v2

Free.ai · ocr · ~500 tokens တစ်ဦးချင်းစီ page

ဖိုင်ကိုဒီနေရာမှာချလိုက် ဒါမှမဟုတ် ရှာဖွေဖို့နှိပ်ပါ

~500 tokens တစ်ဦးချင်းစီ page
ကျွန်တော်တို့ရဲ့ GPUs အပေါ်အခမဲ့ Runs ။ များအတွက်အဆင့်မြှင့် GOT-OCR v2 →

GOT-OCR v2 သည် an OCR မော်ဒယ် ဖြစ်ပါတယ်။ ပြင်ပမော်ဒယ်များမှတဆင့်လမ်းကြောင်း - ~500 tokens ကို စာမျက်နှာတိုင်း (50% upstream ကုန်ကျစရိတ်ထက် markup).

API ကိုမှတဆင့်အသုံးပြု

OpenAI-ကိုက်ညီ REST API ကို။ တစ်ဦးကုတ်ကို generate နှင့်စက္ကန့်အတွင်းဤမော်ဒယ်ကိုခေါ်ဆိုပါ။

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
API စာရွက်စာတမ်းများ API Key ကိုရယူပါ

မေးလေ့ရှိသောမေးခွန်းများ

GOT-OCR v2 ရုပ်ပုံများနှင့် PDFs မှစာသား extracts. scanned စာမျက်နှာတစ်ခု upload, screenshot, သို့မဟုတ်စာရွက်စာတမ်း၏ဓာတ်ပုံနှင့် GOT-OCR v2 စာသားပြန်လာ - လိုင်း breaks တွေကိုထိန်းသိမ်းခြင်းနှင့် (တတ်နိုင်အင်ဂျင်များအပေါ်) စားပွဲ, ဖော်မြူလာ, နှင့်ဖွဲ့စည်းပုံ.

GOT-OCR v2 script များထောင်ပေါင်းများစွာ၏ကိုင်တွယ် - လတ်တလော, Cyrillic, CJK, အဘိဓါန်, Devanagari, နှင့်ပိုပြီး. အဆိုပါ /ocr/ ဆင်းသက်ခြင်းအင်ဂျင်တစ်စီးလျှင်အပြည့်အဝဘာသာစကားစာရင်းရှိပါတယ်.

ဟုတ်ကဲ့, ရှင်းလင်းသောပုံနှိပ်-style လက်ရေးအတွက်; ရေးဆွဲနှင့် shorthand ပိုပြီးခက်ခဲကြသည်။ TrOCR နှင့်ခေတ်သစ် transformer-based engines များလက်ရေးအပေါ်အမွေ Tesseract ထက်သိသိသာသာပိုကောင်းကြသည်။

Layout-အသိအမြင်အင်ဂျင်များ (GOT-OCR, Marker, Florence-2) Markdown / HTML ကိုစားပွဲများနှင့်ဖော်မွန်များအတွက် LaTeX ပြန်ပေး။ ရိုးရှင်း-စာသားအင်ဂျင်များဖွဲ့စည်းပုံမရှိဘဲစာသားပြန်ပေး - ဒီမော်ဒယ်ရဲ့ output mode ကိုစစ်ဆေးပါ။

GOT-OCR v2 တစ်ဦးပရီမီယံ OCR အင်ဂျင်တစ်ခုဖြစ်ပါသည်. About ~500-1,500 page ကိုတစ်ဦး tokens, သင်ဖန်တီးမတိုင်မီပြသနေ. Self-hosted OCR သင့်ရဲ့ 30,000-token နေ့စဉ်ရေကန်အပေါ်အခမဲ့ runs; ပရီမီယံမော်ဒယ်များ pay-as-you-go နေကြတယ်, $1 မှ top-ups နှင့်အတူ.

PNG, JPG, WebP, HEIC, BMP, နှင့်အတူတကွ single-နှင့် multi-စာမျက်နှာ PDF များကို 50 MB အထိ။ skewed သို့မဟုတ်လှည့်စာမျက်နှာများ extracting ရှေ့မှာ auto-ပြင်ဆင်ထားကြသည်။

character accuracy is typically >98% on clean printed pages, low-res photos on dropping, ပြင်းထန်စွာ skewed scans, or unusual fonts. တိကျမှုကိစ္စများအခါ /ocr/compare/ အပေါ်အင်ဂျင်ကိုနှိုင်းယှဉ်ပါ.

ဟုတ်ကဲ့ - / batch / ရုပ်ပုံများ / PDF များဖိုင်တွဲကိုလက်ခံ. တစ်ခုချင်းစီကို extracting / account /? tab = သမိုင်းတွင်မြေပုံ. ဖိုင်တွဲ-သစ်ပင်ထိန်းသိမ်းရေးအတွက် API ကိုအသုံးပြု.

ဟုတ်ကဲ့ - POST ကို /v1 / ocr / နှင့်အတူသင်၏ဖိုင်ကို model="GOT-OCR v2"။ စာသားနှင့်အတူ JSON + (ထောက်ခံသောအခါ) layout ကို + စကားလုံး-အဆင့် bounding box များကိုပြန်ပေးသည်။ /api / ပြည့်စုံသောအညွှန်းရှိသည်။

Self-hosted ပုံစံများကျွန်တော်တို့ရဲ့ GPUs အပေါ်သင့်ရဲ့ဖိုင်ကိုထိန်းသိမ်းထား; premium ကိုတစ်ဦး DPA ဖြင့်ဖြတ်ပြီးသွား. မှတ်တမ်းများမျှဝေ-window ကိုပြီးနောက်ဖျက်ပစ်ကြသည်. ကျွန်တော်တို့ဟာသင်၏ inputs တွေကိုအပေါ်လေ့ကျင့်သင်ကြားမထား.

ဟုတ်ကဲ့ - Free.ai extracted စာသား၏စီးပွားရေးလုပ်ငန်းအသုံးပြုမှုခွင့်ပြု. သင်မူရင်းစာရွက်စာတမ်းကိုပိုင်ခွင့်လိုအပ်.

1-5 စက္ကန့်စာမျက်နှာတစ်ပုံမှန်အားဖြင့်တစ်ဦး။ layout-အသိအင်ဂျင် (စားပွဲ, သင်္ချာ) ပိုမိုကြာရှည်ယူ. multi-စာမျက်နှာ PDFs အရွယ်အစားအနည်းငယ် linearly ။

ချစ်ခြင်းမေတ္တာ Free.ai? သင့်ရဲ့မိတ်ဆွေများကိုပြောပါ!

ဒီစာမျက်နှာကိုရမှတ်