PaddleOCR-VL

Free.ai (self-hosted) · ocr · ~300 ટોકન પ્રતિ page

ફાઇલ અહીં મૂકો અથવા બ્રાઉઝ કરવા માટે ક્લિક કરો

~300 ટોકન પ્રતિ page

PaddleOCR-VL એ an OCR મોડેલ છે, PaddlePaddle દ્વારા બનાવેલ છે. Fast multilingual image / scan to Markdown; tables, formulas, charts; 109 languages. પર સૌથી મજબૂત. Free.ai GPUs પર સ્વયં-હોસ્ટ થયેલ — તમારા રોજિંદા ટોકન પુલ (300 ટોકન પાના પર) સામે મુક્ત રીતે ચાલે છે. Apache 2.0 નીચે બહાર પાડવામાં આવ્યું - Free.ai પર વ્યવસાયિક ઉપયોગની પરવાનગી.

API વડે વાપરો

OpenAI-સુસંગત REST API. કી બનાવો અને સેકન્ડોમાં આ મોડેલને બોલાવો.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"paddleocr-vl","prompt":"your prompt here"}'
API દસ્તાવેજ API કી મેળવો

વારંવાર પૂછાતા પ્રશ્નો

PaddleOCR-VL ચિત્ર અને PDFs માંથી લખાણ કાઢે છે. સ્કેન થયેલ પાનું, સ્ક્રીનશોટ, અથવા દસ્તાવેજનો ફોટો અપલોડ કરો અને PaddleOCR-VL લખાણ પાછું આપે છે - લીટી વિરામોને સંભાળીને અને (સક્ષમ એન્જિનો પર) કોષ્ટકો, સમીકરણો, અને બંધારણ.

PaddleOCR-VL સ્ક્રિપ્ટની ડઝનબંધ નિયંત્રણ કરે છે - લેટિન, સિરીલીક, CJK, અરેબિક, દેવનાગરી, અને વધુ. /ocr/ લૅન્ડિંગ એ એન્જિન પ્રતિ સંપૂર્ણ ભાષા યાદી છે.

સાફ છાપેલી-શૈલી હાથવખરી માટે હા; કર્સિવ અને ટૂંકી હસ્તરેખા કઠિન છે. TrOCR અને આધુનિક રૂપાંતરક-આધારિત એન્જિનો હાથવખરી પર લીગસી ટેસરેક્ટ કરતા નોંધપાત્ર રીતે સારા છે.

દેખાવ-જાણતા એન્જિનો (GOT-OCR, Marker, Florence-2) Markdown/HTML કોષ્ટકો અને સમીકરણો માટે LaTeX પાછા આપે છે. સરળ-લખાણ એન્જિનો બંધારણ વગર લખાણ પાછું આપે છે - આ મોડેલની આઉટપુટ સ્થિતિ ચકાસો.

PaddleOCR-VL તમારા રોજિંદા મુક્ત પુલમાંથી અમારા GPUs પર ચાલે છે; $5 → 200,000 ચૂકવેલ ટોકન પછી. ~300 ટોકન પ્રતિ પાનું.

PNG, JPG, WebP, HEIC, BMP, અને એક અને ઘણાં પાનાંઓની PDFs 50 MB સુધી. ખોટા અથવા ફેરવેલાં પાનાંઓ આયાત કરતા પહેલા આપોઆપ સુધારાયેલ છે.

અક્ષર ચોકસાઈ સામાન્ય રીતે સાફ છાપેલા પાનાંઓ પર >98% છે, નીચા-રીઝોલ્યુશન ફોટા પર પડી જવું, ગંભીર રીતે ખોટા સ્કેન, અથવા અસામાન્ય ફોન્ટો. /ocr/compare/ પર એન્જિનોની સરખામણી કરો જ્યારે ચોકસાઈ મહત્વની હોય.

હા - /batch/ ચિત્ર/PDFs ફોલ્ડર સ્વીકારે છે. દરેક આયાત /account/?tab=history માં સ્થિત થાય છે. ફોલ્ડર-ટ્રી સંગ્રહ માટે API વાપરો.

હા - મોડેલ="PaddleOCR-VL" સાથે /v1/ocr/ માં તમારી ફાઇલને POST કરો. લખાણ + (જ્યારે આધારભૂત હોય) દેખાવ + શબ્દ-સ્તર મર્યાદા બોક્સ સાથે JSON પાછું આપે છે. /api/ એ સંપૂર્ણ સંદર્ભ છે.

સ્વયં-હોસ્ટ કરેલ મોડેલો તમારી ફાઇલને અમારા GPUs પર રાખે છે; પ્રીમિયમ DPA સાથે પસાર થાય છે. દસ્તાવેજો વહેંચણી-વિન્ડો પછી કાઢી નાંખવામાં આવે છે. અમે તમારા ઇનપુટ પર તાલીમ આપતા નથી.

હા - Free.ai એ બહાર કાઢેલ લખાણનો વાણિજ્યિક ઉપયોગ આપવાની પરવાનગી આપે છે. તમારે સ્ત્રોત દસ્તાવેજ માટે અધિકારોની જરૂર છે.

સામાન્ય રીતે પાના દીઠ ૧-૫ સેકન્ડો. દેખાવ-જાણતા એન્જિનો (કોષ્ટકો, ગણિત) વધારે સમય લે છે. ઘણા પાનાવાળા PDFs લગભગ રેખીય રીતે માપન કરે છે.

Free.ai પ્રેમ કરો? તમારા મિત્રોને કહો!

આ પાનાંને દર આપો