TrOCR Base

Free.ai (self-hosted) · ocr · ~300 প্রতি page

এখানে একটি ফাইল ছেড়ে দিন অথবা ব্রাউজ করতে ক্লিক করুন

~300 প্রতি page

TrOCR Base হল an OCR মডেল Microsoft দ্বারা নির্মিত। সবচেয়ে শক্তিশালী Handwritten documents, low-resource scripts.. Free.ai GPUs-এ স্ব-হোস্ট করা - আপনার দৈনিক টোকেন পুলের বিরুদ্ধে বিনামূল্যে চলছে (300 টোকেন প্রতি পৃষ্ঠা)। MIT লাইসেন্সের অধীনে প্রকাশিত - বাণিজ্যিক ব্যবহারের অনুমতি Free.ai লাইসেন্সের অধীনে।

API ব্যবহার করো

OpenAI-সমর্থিত REST API। একটি কী তৈরি করুন এবং সেকেন্ডের মধ্যে এই মডেলটি কল করুন।

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"trocr-base","prompt":"your prompt here"}'
API ডকুমেন্টেশন API কী পাওয়া যায়নি

প্রায়শ জিজ্ঞাসিত প্রশ্ন

TrOCR Base ছবি এবং PDF থেকে টেক্সট এক্সট্র্যাক্ট করে। স্ক্যান করা পৃষ্ঠা, স্ক্রিনশট, অথবা নথির একটি ছবি আপলোড করুন এবং TrOCR Base টেক্সট ফিরিয়ে দেবে - লাইন ব্রেক এবং (সক্ষম ইঞ্জিন) টেবিল, সূত্র এবং গঠন সংরক্ষণ করে।

TrOCR Base ডজনখানেক স্ক্রিপ্ট পরিচালনা করে - ল্যাটিন, সিরিলিক, CJK, আরবি, দেভানাগারি, এবং আরও অনেক কিছু। /ocr/ ল্যান্ডিং ইঞ্জিন প্রতি পূর্ণ ভাষা তালিকা আছে।

পরিষ্কার মুদ্রণ-শৈলীর হাতের লেখার জন্য হ্যাঁ; কার্সিভ এবং শর্টকাট লেখা কঠিন। TrOCR এবং আধুনিক ট্রান্সফরমার-ভিত্তিক ইঞ্জিনগুলি হাতের লেখার ক্ষেত্রে পুরোনো Tesseract-এর চেয়ে উল্লেখযোগ্যভাবে ভাল।

বিন্যাস-সচেতন ইঞ্জিন (GOT-OCR, Marker, Florence-2) Markdown/HTML টেবিল এবং সূত্রের জন্য LaTeX ফিরিয়ে দেয়। প্লেইন-টেক্সট ইঞ্জিন গঠনবিহীন টেক্সট ফিরিয়ে দেয় - এই মডেলের আউটপুট মোড পরীক্ষা করুন।

TrOCR Base আমাদের জিপিইউতে আপনার দৈনিক ফ্রি পুল থেকে চালিত হয়; $৫ → ২০০,০০০ পেমেন্ট টোকেন পরে। ~৩০০ টোকেন প্রতি পৃষ্ঠা।

PNG, JPG, WebP, HEIC, BMP, এবং একক এবং মাল্টি-পেজ PDFs ৫০ মেগাবাইট পর্যন্ত। ঝুঁকিপূর্ণ বা ঘুরানো পৃষ্ঠাগুলি এক্সট্র্যাক্ট করার আগে স্বয়ংক্রিয়ভাবে সংশোধন করা হয়।

অক্ষর সঠিকতা সাধারণত >৯৮% পরিষ্কার মুদ্রণ পৃষ্ঠা, কম-রেজোলিউশন ছবি, গুরুতরভাবে বিকৃত স্ক্যান, অথবা অসাধারণ ফন্টে ড্রপ। সঠিকতা গুরুত্বপূর্ণ হলে /ocr/compare/ এ তুলনা ইঞ্জিন তুলনা করুন।

হ্যাঁ - /batch/ ছবি/PDF-এর ফোল্ডার গ্রহণ করে। প্রত্যেক এক্সট্র্যাক্ট /account/?tab=history-এ অবস্থিত হয়। ফোল্ডার-ট্রী সংরক্ষণের জন্য API ব্যবহার করুন।

হ্যাঁ - আপনার ফাইল /v1/ocr/ এ POST করুন model="TrOCR Base" ব্যবহার করে। JSON ফিরিয়ে দেয় টেক্সট + (সমর্থিত হলে) বিন্যাস + শব্দ-স্তরের সীমাবদ্ধ বাক্স সহ। /api/-এ সম্পূর্ণ রেফারেন্স রয়েছে।

স্ব-হোস্টকৃত মডেলগুলি আপনার ফাইলগুলি আমাদের GPU-তে রাখে; প্রাইম ডিপিএ-র মাধ্যমে প্রবেশ করে। শেয়ার-উইন্ডোর পরে নথিগুলি মুছে ফেলা হয়। আমরা আপনার ইনপুটগুলিতে প্রশিক্ষণ দিই না।

হ্যাঁ - Free.ai এক্সট্র্যাক্ট করা টেক্সট বাণিজ্যিকভাবে ব্যবহার করার অনুমতি দেয় । আপনার উৎস নথির অধিকার প্রয়োজন ।

সাধারণত প্রতি পৃষ্ঠা ১-৫ সেকেন্ড। বিন্যাস-সচেতন ইঞ্জিন (ট্যাবল, গণিত) বেশি সময় নেয়। বহু-পৃষ্ঠার PDF-এর স্কেল প্রায় লাইনগত।

Free.ai ভালোবাসো?

এই পাতাটি রেটিং দিন