PaddleOCR

Free.ai (self-hosted) · ocr · ~300 ҳар бир page

Файлни бу ерга ташланг ёки кўриш учун босинг

~300 ҳар бир page

PaddleOCR an OCR модели томонидан PaddlePaddle томонидан яратилган. Multi-language OCR, document layout extraction, receipts. да энг кучли. Free.ai GPU'ларда ўз-ўзидан жойлаштирилган — сизнинг кундалик токенларингизга қарши бепул ишлайди (300 токенлар саҳифа). Apache 2.0 остида чиқарилган - Free.ai остида савдо учун фойдаланишга рухсат берилган.

API орқали фойдаланиш

OpenAI-га мос REST API. Алоқани яратинг ва бу моделни секундларда чақиринг.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"paddleocr","prompt":"your prompt here"}'
Ҳужжатлар API калитини олиш

Худди шундай моделлар

Доимий сўраладиган саволлар

PaddleOCR тасвирлар ва PDFлардан матн ажратади. Скан қилинган саҳифа, скриншот ёки ҳужжат суратини юклаб олинг ва PaddleOCR матнни қайтаради - сатрлар оралиғини сақлаб қолади ва (мобил двигателларда) жадваллар, формулалар ва тузилмаларни сақлайди.

PaddleOCR ўнлаб ёзувларни қўллай олади - латиница, кирилл, CJK, араб, деванагари ва бошқалар. /ocr/ landing ҳар бир двигатель учун тўлиқ тиллар рўйхатини беради.

Ҳа, тоза босма услубдаги қўл ёзуви учун; курсив ва қисқа қўл ёзуви қийинроқ. TrOCR ва замонавий трансформаторли моторлар қўл ёзувда Tesseractдан яхшироқ.

Таркибига эътиборли моторлар (GOT-OCR, Marker, Florence-2) Markdown/HTML жадвалларини ва формулалар учун LaTeX'ни қайтаради. Оддий матн моторлари тузилмасиз матнларни қайтаради - бу моделнинг чиқим режимини текширинг.

PaddleOCR бизнинг GPUларимизда сизнинг кундалик бепул пулингиздан ишлайди; $5 → 200,000 тўлов чеки кейин. ~300 чеки саҳифада.

PNG, JPG, WebP, HEIC, BMP, шунингдек, 50 МБгача бўлган бир саҳифали ва кўп саҳифали PDF файллар. Қизилаётган ёки айланаётган саҳифалар ажратиб олишдан олдин автоматик равишда тўғриланади.

Характер аниқлиги одатда тоза босилган саҳифаларда >98%, паст резолюцияли суратларда тушиш, жуда нотўғри скан қилиш ёки ноодатий шрифтларда >98% ни ташкил қилади. Агар аниқлик муҳим бўлса, /ocr/compare/даги таққослашни қўлланг.

Ҳа - /batch/ тасвирлар/PDFлар жилдини қабул қилади. Ҳар бир ажратиб олинган файл /account/?tab=history'га тушади. Жилд дарахти сақлаш учун API'дан фойдаланинг.

Ҳа - файлингизни /v1/ocr/га POST қилинг ва "PaddleOCR" моделини танланг. Матн + (агар қўллаб-қувватланган бўлса) кўриниш + сўз даражасидаги чегаралар билан JSON қайтарилади. /api/ тўлиқ манбага эга.

Ўз-ўзини хост қилувчи моделлар файлингизни бизнинг GPUларда сақлайди; премиум DPA билан ўтади. Ҳужжатлар ўртоқлашиш ойнасидан кейин ўчирилади. Биз сизнинг киритишларингизни ўрганмаймиз.

Ҳа - Free.ai ажратилган матннинг савдо мақсадларида фойдаланишига рухсат беради. Сизга манба ҳужжатига эгалик ҳуқуқи керак.

Ҳар бир саҳифа учун одатда 1-5 секунд. Таркибига эътибор берадиган моторлар (жадваллар, математика) кўпроқ вақтни олади. Кўп саҳифали PDFлар деярли тўғри чизиқ бўйлаб ўлчанади.

Free.aiни севинг? Дўстларингизга айтинг!

Бу саҳифани баҳолаш