PaddleOCR-VL

Free.ai (self-hosted) · ocr · ~300 टोकन प्रति page

फाइल इथे टाकून द्या किंवा संचारन करीता क्लिक करा

~300 टोकन प्रति page

PaddleOCR-VL हे an आहे OCR नमूना PaddlePaddle द्वारे बनवलेले आहे. सर्वात जवळील अभियांत्रिकी महाविद्यालय (अकोला) ५. Free.ai GPUs वर स्व-होस्ट - आपल्या दैनंदिन टोकन पूल विरुद्ध मुक्तपणे चालते (300 टोकन प्रति पान). Released under Apache 2.0 — commercial use permitted on Free.ai.

API द्वारे वापरा

OpenAI-सुसंगत REST API. किल्ली निर्माण करा व सेकंदांमध्ये हे मॉडेल कॉल करा.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"paddleocr-vl","prompt":"your prompt here"}'
API दस्तऐवजीकरण API कि प्राप्त करा

वारंवार विचारले जाणारे प्रश्न

PaddleOCR-VL प्रतिमा व PDFs पासून पाठ्य काढून घेते. स्कॅन केलेले पान, स्क्रीनशॉट किंवा दस्तऐवजाचे छायाचित्र अपलोड करा व PaddleOCR-VL पाठ्य परत करतो — ओळीचे ब्रेक आणि (सक्षम इंजिनवर) तक्ता, सूत्रे व रचना संरक्षित करते.

PaddleOCR-VL अनेक स्क्रिप्ट हाताळते - लॅटिन, सिरिलिक, CJK, अरबी, देवनागरी, आणि अधिक. /ocr/ landing मध्ये प्रत्येक इंजिनसाठी पूर्ण भाषा यादी आहे.

मुद्रित शैलीतील शुद्ध हस्तलिखितासाठी होय; कर्सीव्ह आणि शॉर्टहँड कठीण आहेत. TrOCR आणि आधुनिक ट्रान्सफॉर्मर-आधारित इंजिने हस्तलिखितावर लेगसी टेसेराक्ट्सपेक्षा चांगली आहेत.

लेआऊट-जाणणारे इंजिन (GOT-OCR, Marker, Florence-2) फॉर्म्युलासाठी मार्कडाउन/HTML टेबल व LaTeX परत करतात. सादा-पाठ्य इंजिन स्थापत्य विना पाठ्य परत करते - या नमुन्याचा आऊटपुट मोड तपासा.

PaddleOCR-VL आपल्या रोजच्या मोफत पूलमधून आपल्या GPU वर चालते; $5 → नंतर 200,000 मोफत टोकन.

PNG, JPG, WebP, HEIC, BMP, आणि एक किंवा अनेक पानांचे 50 MB पर्यंतचे PDF. स्केवेड किंवा फिरविलेले पान काढण्यापूर्वी स्वतः सुधारले जाते.

मुद्रित पानांवर अक्षरांची अचूकता साधारणपणे >९८% असते, कमी-रिझोल्यूशन छायाचित्रांवर पडणे, गंभीरपणे विचलित स्कॅन, किंवा असामान्य फॉन्ट. /ocr/compare/ वरील इंजिन तुलना करा जेव्हा अचूकता महत्वाची असते.

होय — /batch/ प्रतिमा/PDFs चे संचयीका स्वीकारते. प्रत्येक एक्सट्रॅक्शन /account/?tab=history मध्ये उतरते. संचयीका-वृक्ष संवर्धनासाठी API चा वापर करा.

होय - तुमची फाइल /v1/ocr/ वर POST करा मॉडेल ="PaddleOCR-VL" सह. पाठ्य + (समर्थित असल्यास) रचना + शब्द-स्तरीय बाउंड बॅक्ससह JSON परत करतो. /api/ मध्ये पूर्ण संदर्भ आहे.

स्वतः-होस्ट मॉडेल आपल्या फाइल आपल्या GPU वर ठेवतात; प्रीमियम DPA सह पार पडतात. दस्तऐवज शेअर-विंडो नंतर काढून टाकले जातात. आम्ही तुमच्या इनपुट वर प्रशिक्षण देत नाही.

होय — Free.ai एक्सट्रॅक्ट केलेले पाठ्यचा व्यावसायिक वापर करीता परवानगी देतो. तुम्हाला स्त्रोत दस्तऐवज करीता अधिकार आवश्यक आहेत.

साधारणपणे प्रत्येक पानासाठी 1-5 सेकंद. लेआऊट-जाणणारे इंजिन (तालिका, गणित) जास्त वेळ घेते. बहु-पान PDFs अंदाजे रेखीयरित्या आकारात वाढ करतात.

Free.ai ला आवडते?

या पानाला गुण द्या