PaddleOCR

Free.ai (self-hosted) · ocr · ~300 توکنها در هر page

پرونده‌ای را اینجا بگذارید یا برای مرور کلیک کنید

~300 توکنها در هر page

. PaddleOCR a مدل OCR ساخته شده توسط PaddlePaddle Strongest at Multi-language OCR, document layout extraction, receipts.. Free.ai GPUs self-hosted — freely runs against your daily token pool (300 tokens در هر صفحه). انتشار تحت Apache 2.0 - استفاده تجاری اجازه داده شده در Free.ai.

استفاده از طریق API

API REST OpenAI-compatible. یک کلید تولید کنید و این مدل را در چند ثانیه فراخوانی کنید.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"paddleocr","prompt":"your prompt here"}'
مستندات API دریافت کلید API

پرسشهای متداول

PaddleOCR متن را از تصاویر و پی‌دی‌اف‌ها استخراج می‌کند. یک صفحه اسکن شده، یک تصویر صفحه نمایش یا عکس سند را بارگذاری کنید و PaddleOCR متن را با حفظ شکست خط و (در موتورهای قادر به انجام آن) جدول‌ها، فرمول‌ها و ساختار باز می‌گرداند.

PaddleOCR ده‌ها اسکریپت را مدیریت می‌کند - لاتین، سیریلیک، CJK، عربی، Devanagari و بیشتر. /ocr/ landing دارای فهرست کامل زبان‌ها برای موتور است.

بله برای نوشتن دست نوشته به سبک چاپی؛ خط کش و خط کوتاه سخت‌تر هستند. TrOCR و موتورهای مدرن مبتنی بر ترانسفورماتور به‌طور قابل توجهی بهتر از Tesseract در نوشتن دست نوشته هستند.

موتورهای آگاه از طرح (GOT-OCR, Marker, Florence-2) جدول‌های Markdown/HTML و LaTeX را برای فرمول‌ها برمی‌گردانند. موتورهای متن ساده متن بدون ساختار را برمی‌گردانند - حالت خروجی این مدل را چک کنید.

PaddleOCR بر روی GPUهای ما از pool روزانه رایگان شما اجرا می‌شود؛ $5 → 200,000 tokens paid after. ~300 tokens per page.

PNG, JPG, WebP, HEIC, BMP, plus single- and multi-page PDFs up to 50 MB. صفحات منحرف یا چرخیده قبل از استخراج خودکار اصلاح می‌شوند.

دقت کاراکتر معمولاً در صفحات چاپ شده تمیز بیشتر از ۹۸٪ است، در عکس‌های با وضوح پایین، اسکن‌های شدیداً انحرافی یا قلم‌های غیرمعمول افت می‌کند.

بله - /batch/ پوشه‌ای از تصاویر/PDFها را قبول می‌کند. هر استخراجی در /account/?tab=history قرار می‌گیرد. برای حفظ درخت پوشه از API استفاده کنید.

بله - فایل خود را به /v1/ocr/ با مدل "PaddleOCR" POST کنید. JSON را با متن + (اگر پشتیبانی شود) layout + boxes bounding word-level بازگرداند. /api/ دارای مرجع کامل است.

مدلهای خود میزبانی پرونده شما را در GPUهای ما نگه می‌دارند؛ پریمیوم با DPA عبور می‌کند. سندها پس از پنجره اشتراک حذف می‌شوند. ما بر روی ورودی‌های شما آموزش نمی‌دهیم.

بله - Free.ai اجازه استفاده تجاری از متن استخراج شده را می‌دهد. نیاز به حقوق سند منبع دارید.

معمولاً ۱- ۵ ثانیه در هر صفحه. موتورهای آگاه از طرح (جدول، ریاضی) بیشتر طول می‌کشد. پی‌دی‌اف‌های چندصفحه‌ای تقریباً خطی مقیاس‌بندی می‌شوند.

دوست Free.ai رو به دوستانت بگو

رتبه این صفحه