Unlimited-OCR 3B

Free.ai (self-hosted) · ocr · ~300 ҳар бир page

Файлни бу ерга ташланг ёки кўриш учун босинг

~300 ҳар бир page

Unlimited-OCR 3B an OCR модели томонидан Baidu томонидан яратилган. Image / scan to structured Markdown, complex layouts, tables, multi-page documents. да энг кучли. Free.ai GPU'ларда ўз-ўзидан жойлаштирилган — сизнинг кундалик токенларингизга қарши бепул ишлайди (300 токенлар саҳифа). MIT остида чиқарилган - Free.ai остида савдо учун фойдаланишга рухсат берилган.

API орқали фойдаланиш

OpenAI-га мос REST API. Алоқани яратинг ва бу моделни секундларда чақиринг.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"unlimited-ocr","prompt":"your prompt here"}'
Ҳужжатлар API калитини олиш

Худди шундай моделлар

Доимий сўраладиган саволлар

Unlimited-OCR 3B тасвирлар ва PDFлардан матн ажратади. Скан қилинган саҳифа, скриншот ёки ҳужжат суратини юклаб олинг ва Unlimited-OCR 3B матнни қайтаради - сатрлар оралиғини сақлаб қолади ва (мобил двигателларда) жадваллар, формулалар ва тузилмаларни сақлайди.

Unlimited-OCR 3B ўнлаб ёзувларни қўллай олади - латиница, кирилл, CJK, араб, деванагари ва бошқалар. /ocr/ landing ҳар бир двигатель учун тўлиқ тиллар рўйхатини беради.

Ҳа, тоза босма услубдаги қўл ёзуви учун; курсив ва қисқа қўл ёзуви қийинроқ. TrOCR ва замонавий трансформаторли моторлар қўл ёзувда Tesseractдан яхшироқ.

Таркибига эътиборли моторлар (GOT-OCR, Marker, Florence-2) Markdown/HTML жадвалларини ва формулалар учун LaTeX'ни қайтаради. Оддий матн моторлари тузилмасиз матнларни қайтаради - бу моделнинг чиқим режимини текширинг.

Unlimited-OCR 3B бизнинг GPUларимизда сизнинг кундалик бепул пулингиздан ишлайди; $5 → 200,000 тўлов чеки кейин. ~300 чеки саҳифада.

PNG, JPG, WebP, HEIC, BMP, шунингдек, 50 МБгача бўлган бир саҳифали ва кўп саҳифали PDF файллар. Қизилаётган ёки айланаётган саҳифалар ажратиб олишдан олдин автоматик равишда тўғриланади.

Характер аниқлиги одатда тоза босилган саҳифаларда >98%, паст резолюцияли суратларда тушиш, жуда нотўғри скан қилиш ёки ноодатий шрифтларда >98% ни ташкил қилади. Агар аниқлик муҳим бўлса, /ocr/compare/даги таққослашни қўлланг.

Ҳа - /batch/ тасвирлар/PDFлар жилдини қабул қилади. Ҳар бир ажратиб олинган файл /account/?tab=history'га тушади. Жилд дарахти сақлаш учун API'дан фойдаланинг.

Ҳа - файлингизни /v1/ocr/га POST қилинг ва "Unlimited-OCR 3B" моделини танланг. Матн + (агар қўллаб-қувватланган бўлса) кўриниш + сўз даражасидаги чегаралар билан JSON қайтарилади. /api/ тўлиқ манбага эга.

Ўз-ўзини хост қилувчи моделлар файлингизни бизнинг GPUларда сақлайди; премиум DPA билан ўтади. Ҳужжатлар ўртоқлашиш ойнасидан кейин ўчирилади. Биз сизнинг киритишларингизни ўрганмаймиз.

Ҳа - Free.ai ажратилган матннинг савдо мақсадларида фойдаланишига рухсат беради. Сизга манба ҳужжатига эгалик ҳуқуқи керак.

Ҳар бир саҳифа учун одатда 1-5 секунд. Таркибига эътибор берадиган моторлар (жадваллар, математика) кўпроқ вақтни олади. Кўп саҳифали PDFлар деярли тўғри чизиқ бўйлаб ўлчанади.

Free.aiни севинг? Дўстларингизга айтинг!

Бу саҳифани баҳолаш