PaddleOCR

Free.ai (self-hosted) · ocr · ~300 প্রতি page

এখানে একটি ফাইল ছেড়ে দিন অথবা ব্রাউজ করতে ক্লিক করুন

~300 প্রতি page

PaddleOCR হল an OCR মডেল PaddlePaddle দ্বারা নির্মিত। সবচেয়ে শক্তিশালী Multi-language OCR, document layout extraction, receipts.. Free.ai GPUs-এ স্ব-হোস্ট করা - আপনার দৈনিক টোকেন পুলের বিরুদ্ধে বিনামূল্যে চলছে (300 টোকেন প্রতি পৃষ্ঠা)। Apache 2.0 লাইসেন্সের অধীনে প্রকাশিত - বাণিজ্যিক ব্যবহারের অনুমতি Free.ai লাইসেন্সের অধীনে।

API ব্যবহার করো

OpenAI-সমর্থিত REST API। একটি কী তৈরি করুন এবং সেকেন্ডের মধ্যে এই মডেলটি কল করুন।

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"paddleocr","prompt":"your prompt here"}'
API ডকুমেন্টেশন API কী পাওয়া যায়নি

প্রায়শ জিজ্ঞাসিত প্রশ্ন

PaddleOCR ছবি এবং PDF থেকে টেক্সট এক্সট্র্যাক্ট করে। স্ক্যান করা পৃষ্ঠা, স্ক্রিনশট, অথবা নথির একটি ছবি আপলোড করুন এবং PaddleOCR টেক্সট ফিরিয়ে দেবে - লাইন ব্রেক এবং (সক্ষম ইঞ্জিন) টেবিল, সূত্র এবং গঠন সংরক্ষণ করে।

PaddleOCR ডজনখানেক স্ক্রিপ্ট পরিচালনা করে - ল্যাটিন, সিরিলিক, CJK, আরবি, দেভানাগারি, এবং আরও অনেক কিছু। /ocr/ ল্যান্ডিং ইঞ্জিন প্রতি পূর্ণ ভাষা তালিকা আছে।

পরিষ্কার মুদ্রণ-শৈলীর হাতের লেখার জন্য হ্যাঁ; কার্সিভ এবং শর্টকাট লেখা কঠিন। TrOCR এবং আধুনিক ট্রান্সফরমার-ভিত্তিক ইঞ্জিনগুলি হাতের লেখার ক্ষেত্রে পুরোনো Tesseract-এর চেয়ে উল্লেখযোগ্যভাবে ভাল।

বিন্যাস-সচেতন ইঞ্জিন (GOT-OCR, Marker, Florence-2) Markdown/HTML টেবিল এবং সূত্রের জন্য LaTeX ফিরিয়ে দেয়। প্লেইন-টেক্সট ইঞ্জিন গঠনবিহীন টেক্সট ফিরিয়ে দেয় - এই মডেলের আউটপুট মোড পরীক্ষা করুন।

PaddleOCR আমাদের জিপিইউতে আপনার দৈনিক ফ্রি পুল থেকে চালিত হয়; $৫ → ২০০,০০০ পেমেন্ট টোকেন পরে। ~৩০০ টোকেন প্রতি পৃষ্ঠা।

PNG, JPG, WebP, HEIC, BMP, এবং একক এবং মাল্টি-পেজ PDFs ৫০ মেগাবাইট পর্যন্ত। ঝুঁকিপূর্ণ বা ঘুরানো পৃষ্ঠাগুলি এক্সট্র্যাক্ট করার আগে স্বয়ংক্রিয়ভাবে সংশোধন করা হয়।

অক্ষর সঠিকতা সাধারণত >৯৮% পরিষ্কার মুদ্রণ পৃষ্ঠা, কম-রেজোলিউশন ছবি, গুরুতরভাবে বিকৃত স্ক্যান, অথবা অসাধারণ ফন্টে ড্রপ। সঠিকতা গুরুত্বপূর্ণ হলে /ocr/compare/ এ তুলনা ইঞ্জিন তুলনা করুন।

হ্যাঁ - /batch/ ছবি/PDF-এর ফোল্ডার গ্রহণ করে। প্রত্যেক এক্সট্র্যাক্ট /account/?tab=history-এ অবস্থিত হয়। ফোল্ডার-ট্রী সংরক্ষণের জন্য API ব্যবহার করুন।

হ্যাঁ - আপনার ফাইল /v1/ocr/ এ POST করুন model="PaddleOCR" ব্যবহার করে। JSON ফিরিয়ে দেয় টেক্সট + (সমর্থিত হলে) বিন্যাস + শব্দ-স্তরের সীমাবদ্ধ বাক্স সহ। /api/-এ সম্পূর্ণ রেফারেন্স রয়েছে।

স্ব-হোস্টকৃত মডেলগুলি আপনার ফাইলগুলি আমাদের GPU-তে রাখে; প্রাইম ডিপিএ-র মাধ্যমে প্রবেশ করে। শেয়ার-উইন্ডোর পরে নথিগুলি মুছে ফেলা হয়। আমরা আপনার ইনপুটগুলিতে প্রশিক্ষণ দিই না।

হ্যাঁ - Free.ai এক্সট্র্যাক্ট করা টেক্সট বাণিজ্যিকভাবে ব্যবহার করার অনুমতি দেয় । আপনার উৎস নথির অধিকার প্রয়োজন ।

সাধারণত প্রতি পৃষ্ঠা ১-৫ সেকেন্ড। বিন্যাস-সচেতন ইঞ্জিন (ট্যাবল, গণিত) বেশি সময় নেয়। বহু-পৃষ্ঠার PDF-এর স্কেল প্রায় লাইনগত।

Free.ai ভালোবাসো?

এই পাতাটি রেটিং দিন