Unlimited-OCR 3B

Free.ai (self-hosted) · ocr · ~300 tokens တစ်ဦးချင်းစီ page

ဖိုင်ကိုဒီနေရာမှာချလိုက် ဒါမှမဟုတ် ရှာဖွေဖို့နှိပ်ပါ

~300 tokens တစ်ဦးချင်းစီ page

Unlimited-OCR 3B သည် an OCR မော်ဒယ် ကို Baidu မှတည်ဆောက်ထားသည်။ Image / scan to structured Markdown, complex layouts, tables, multi-page documents. မှာအခိုင်အမာဆုံး. Free.ai GPUs အပေါ် Self-hosted - သင်၏နေ့စဉ် token ကိုရေကန် (300 tokens စာမျက်နှာတိုင်း) ကိုတိုက်ခိုက်အခမဲ့ runs ။ အောက်တွင်ထုတ်ဝေ MIT - စီးပွားရေးလုပ်ငန်းအသုံးပြုခွင့်အပေါ် Free.ai.

API ကိုမှတဆင့်အသုံးပြု

OpenAI-ကိုက်ညီ REST API ကို။ တစ်ဦးကုတ်ကို generate နှင့်စက္ကန့်အတွင်းဤမော်ဒယ်ကိုခေါ်ဆိုပါ။

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"unlimited-ocr","prompt":"your prompt here"}'
API စာရွက်စာတမ်းများ API Key ကိုရယူပါ

မေးလေ့ရှိသောမေးခွန်းများ

Unlimited-OCR 3B ရုပ်ပုံများနှင့် PDFs မှစာသား extracts. scanned စာမျက်နှာတစ်ခု upload, screenshot, သို့မဟုတ်စာရွက်စာတမ်း၏ဓာတ်ပုံနှင့် Unlimited-OCR 3B စာသားပြန်လာ - လိုင်း breaks တွေကိုထိန်းသိမ်းခြင်းနှင့် (တတ်နိုင်အင်ဂျင်များအပေါ်) စားပွဲ, ဖော်မြူလာ, နှင့်ဖွဲ့စည်းပုံ.

Unlimited-OCR 3B script များထောင်ပေါင်းများစွာ၏ကိုင်တွယ် - လတ်တလော, Cyrillic, CJK, အဘိဓါန်, Devanagari, နှင့်ပိုပြီး. အဆိုပါ /ocr/ ဆင်းသက်ခြင်းအင်ဂျင်တစ်စီးလျှင်အပြည့်အဝဘာသာစကားစာရင်းရှိပါတယ်.

ဟုတ်ကဲ့, ရှင်းလင်းသောပုံနှိပ်-style လက်ရေးအတွက်; ရေးဆွဲနှင့် shorthand ပိုပြီးခက်ခဲကြသည်။ TrOCR နှင့်ခေတ်သစ် transformer-based engines များလက်ရေးအပေါ်အမွေ Tesseract ထက်သိသိသာသာပိုကောင်းကြသည်။

Layout-အသိအမြင်အင်ဂျင်များ (GOT-OCR, Marker, Florence-2) Markdown / HTML ကိုစားပွဲများနှင့်ဖော်မွန်များအတွက် LaTeX ပြန်ပေး။ ရိုးရှင်း-စာသားအင်ဂျင်များဖွဲ့စည်းပုံမရှိဘဲစာသားပြန်ပေး - ဒီမော်ဒယ်ရဲ့ output mode ကိုစစ်ဆေးပါ။

Unlimited-OCR 3B သင့်ရဲ့နေ့စဉ်အခမဲ့ရေကန်မှကျွန်တော်တို့ရဲ့ GPUs အပေါ် runs; $5 → 200,000 ပေးဆောင် tokens ကိုပြီးနောက်. ~300 စာမျက်နှာတစ်ဦးလျှင် tokens ကို.

PNG, JPG, WebP, HEIC, BMP, နှင့်အတူတကွ single-နှင့် multi-စာမျက်နှာ PDF များကို 50 MB အထိ။ skewed သို့မဟုတ်လှည့်စာမျက်နှာများ extracting ရှေ့မှာ auto-ပြင်ဆင်ထားကြသည်။

character accuracy is typically >98% on clean printed pages, low-res photos on dropping, ပြင်းထန်စွာ skewed scans, or unusual fonts. တိကျမှုကိစ္စများအခါ /ocr/compare/ အပေါ်အင်ဂျင်ကိုနှိုင်းယှဉ်ပါ.

ဟုတ်ကဲ့ - / batch / ရုပ်ပုံများ / PDF များဖိုင်တွဲကိုလက်ခံ. တစ်ခုချင်းစီကို extracting / account /? tab = သမိုင်းတွင်မြေပုံ. ဖိုင်တွဲ-သစ်ပင်ထိန်းသိမ်းရေးအတွက် API ကိုအသုံးပြု.

ဟုတ်ကဲ့ - POST ကို /v1 / ocr / နှင့်အတူသင်၏ဖိုင်ကို model="Unlimited-OCR 3B"။ စာသားနှင့်အတူ JSON + (ထောက်ခံသောအခါ) layout ကို + စကားလုံး-အဆင့် bounding box များကိုပြန်ပေးသည်။ /api / ပြည့်စုံသောအညွှန်းရှိသည်။

Self-hosted ပုံစံများကျွန်တော်တို့ရဲ့ GPUs အပေါ်သင့်ရဲ့ဖိုင်ကိုထိန်းသိမ်းထား; premium ကိုတစ်ဦး DPA ဖြင့်ဖြတ်ပြီးသွား. မှတ်တမ်းများမျှဝေ-window ကိုပြီးနောက်ဖျက်ပစ်ကြသည်. ကျွန်တော်တို့ဟာသင်၏ inputs တွေကိုအပေါ်လေ့ကျင့်သင်ကြားမထား.

ဟုတ်ကဲ့ - Free.ai extracted စာသား၏စီးပွားရေးလုပ်ငန်းအသုံးပြုမှုခွင့်ပြု. သင်မူရင်းစာရွက်စာတမ်းကိုပိုင်ခွင့်လိုအပ်.

1-5 စက္ကန့်စာမျက်နှာတစ်ပုံမှန်အားဖြင့်တစ်ဦး။ layout-အသိအင်ဂျင် (စားပွဲ, သင်္ချာ) ပိုမိုကြာရှည်ယူ. multi-စာမျက်နှာ PDFs အရွယ်အစားအနည်းငယ် linearly ။

ချစ်ခြင်းမေတ္တာ Free.ai? သင့်ရဲ့မိတ်ဆွေများကိုပြောပါ!

ဒီစာမျက်နှာကိုရမှတ်