Unlimited-OCR 3B
Free.ai (self-hosted)
·
ocr
·
~300 ቶኮን page
Unlimited-OCR 3B a የOCR ሞዴል በ Baidu የተገነባ ነው. በጣም ጠንካራ በ Image / scan to structured Markdown, complex layouts, tables, multi-page documents.. በ Free.ai GPUs ላይ ራስ-ተስተናገደ - በዕለት ተዕለት ቶኬን ፑልዎ ላይ ነፃ ይሰራል (300 ቶኬኖች በየገጹ)። በ MIT ስር የተሰጠ - በ Free.ai ላይ የቢዝነስ ጥቅም የተፈቀደ
ብዙ ጊዜ የሚጠየቁ ጥያቄዎች
Unlimited-OCR 3B ጽሑፉን ከስዕሎች እና PDFs ያወጣል. የተሰካውን ገጽ፣ የስልክ ምስል ወይም የስዕል ምስል ይጫኑ እና Unlimited-OCR 3B ጽሑፉን ይመልሳል - የመስመር መስመርን እና (በተቻለ ሞተር ላይ) ሰሌዳዎችን፣ ፎርሙላዎችን እና ግንባታውን ይቆጣጠራል።
Unlimited-OCR 3B የጽሑፍ ዐበይት ክፍሎችን ይቆጣጠራል - ላቲን, ቄርሎሳዊ, CJK, አረብኛ, Devanagari, እና ሌሎች. /ocr/ መነሻ በእያንዳንዱ ማሽን የሙሉ ቋንቋ ዝርዝር አለው.
አዎ ለተጠናቀቀ የጽሑፍ-ስርዓት የጽሑፍ-ስርዓት; ፊደል አጻጻፍ እና ቅርጽ ከባድ ናቸው. TrOCR እና ዘመናዊ ትራንስፎርሜሽን-ተኮር ማሽኖች በጽሑፍ ላይ ከታሪክ Tesseract ይልቅ በግልጽ የተሻሉ ናቸው.
የቅርጽ-አውቃቂዎች (GOT-OCR, Marker, Florence-2) Markdown/HTML ሰሌዳዎችን እና ለፎርሙላዎች LaTeXን ይመልሳሉ. የቀላል-ጽሑፍ ማሽንዎች ጽሑፉን ያለ ቅርጽ ይመልሳሉ - የዚህ ሞዴል የምርጫ ሞዴልን ይመልከቱ
Unlimited-OCR 3B ከዕለታዊ ነፃ ስብሰባዎ በጂፒዩዎች ላይ ይሰራል። $5 → 200,000 የተከፈለ ቶኬኖች በኋላ. ~300 ቶኬኖች ለእያንዳንዱ ገጽ.
PNG, JPG, WebP, HEIC, BMP, plus single- እና multi-page PDFs እስከ 50 MB ድረስ. የተጣመሩ ወይም የተዞሩ ገጾች ከመውጣት በፊት በራስ-ሰር ይስተካከላሉ
የፊደል ቅርጽ ትክክለኛነት በነጻ የተጻፉ ገጾች ላይ በብዛት >98% ነው፣ በጥቂት የፎቶግራፍ ረቂቅ ላይ የሚወድቅ፣ በከፍተኛ ደረጃ የተሳሳተ ስካን ወይም ያልተለመደ ፊደል ቅርጽ። ትክክለኛነት አስፈላጊ ከሆነ /ocr/compare/ ላይ መሳሪያዎችን ይወዳደሩ።
አዎ - /batch/ የፎልደርን የፎቶግራፎች/PDFs ይቀበላል. ማውጣት ሁሉ በ /account/?tab=history ውስጥ ይደርሳል. ለፎልደር-ዘንግ መቆጣጠሪያ APIን ይጠቀሙ
አዎ - ፋይሉን ወደ /v1/ocr/ በሞዴል "Unlimited-OCR 3B" ላክ። በጽሑፍ + (በተደገፈ ጊዜ) ቅርጸት + ቃል-ደረጃ ድንበር ሳጥን JSON ይመለሳል. /api/ ሙሉውን ማመልከት አለው።
የራስ-አስተናጋጅ ሞዴሎች ፋይሉን በጂፒዩዎች ላይ ያቆያሉ፤ ፕሪሚየም በዲፒአ ውስጥ ይሻሻላል፤ ሰነዶች ከጋራ-አስተናጋጅ በኋላ ይታጠፋሉ፤ እኛ በእርስዎ ፋይሎች ላይ አናስተምራም
አዎ - Free.ai የተገኘውን ፅሁፍ የቢዝነስ ጥቅም ይሰጣል. የፋይል ስም፦
ገጽ ለገጽ 1-5 ሰከንዶች በብዛት. ቅርጸት-አውቃይ ማሽኖች (ሰንጠረዥ, ምህንድስና) ረጅም ጊዜ ይወስዳሉ. ብዙ-ገጽ PDFs በቅርበት መስመር ይጨምራሉ.