PDF OCR

Тижорат мақсадларида фойдаланиш мумкин 380+ моделлар Сув белгиси йўқ Қўшилиш талаб этилмайди
Модель:
+ GPT-5, Claude, Gemini
Скан қилинган PDF файлини танлаб олиш мумкин бўлган, қидириш мумкин бўлган матнга айлантиради. Ҳар бир саҳифани 200 DPI да растрлаштиради ва OCR'ни ишга туширади — Tesseract (тез, бепул), GOT-OCR2 (кўп сонли столблар + жадваллар учун яхшироқ) ёки premium fal OCR'ни танланг (деградацияланган / тарихий сканлар учун яхшироқ). Чоп этиш.txt,.docx ёки саҳифа-белгиланган матн сифатида. PDF эмас, тасвирингиз борми? /ocr/ ни ишлатинг →

Скан қилинган PDF файлини бу ерга олиб боринг ёки юклаш учун босинг

50 МБ гача PDF. Скан қилинган + фақат тасвирли PDFларда ишлайди. Матн танлаш мумкинми? Сизга OCR керак эмас.

·
Бу PDF'да танланадиган матн мавжуд - сизга OCR керак бўлмаслиги мумкин. Тақризчидан фойдаланинг →
Махфий сўз билан ҳимояланган - аввал уни қулфдан чиқаринг. PDF қулфини очиш
Тишсиз босилган сканлар учун Tesseract. Кўп-стуллар учун GOT-OCR2 + Осиё ёзувлари. Фақат ҳар бир пиксел аҳамиятли бўлганда Premium.
Тил маслаҳати Tesseract'ни 2-3× тезлаштиради ва 30-50% га латинча бўлмаган ёзувларда аниқликни оширади.
Токен баҳоси
Токенларни сотиб олиш
Тўғри нархни кўриш учун PDF файлини юкланг.
OCR натижа
Юклаб олиш

        

Қачон PDF OCR'ни қўллаш керак

Счетлар + тасдиқномалар

Скан қилинган ҳисобварақ-фактураларни ҳисоботлар, тўловлар ёки AP автоматизацияси учун таҳрирлаш мумкин бўлган матнга айлантиринг.

Кўп китоблар ва архивлар

Чоп этилмаган китобларни, тарихий ҳужжатларни ёки китобхона архивларини қидириш мумкин бўлган матнга рақамлаштириш.

Юрисдик + тиббий маълумотлар

Скан қилинган ҳолат файллари, тиббий ҳисоботлар ёки факс қилинган ҳужжатлардаги матнни кашф қилиш + eDiscovery иш жараёнлари учун қулфдан очиш.

Таржимадан олдин

Матнни ажратиш учун OCR'ни ишга туширинг, сўнгра натижани /pdf/translator/'га юборинг, у ерда у бошқа тилга таржима қилинади.

Free.ai PDF OCR ва тўловли воситалар

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Бошланғич нархиОқ$19.99/mo$199 one-time$9/mo
OCR двигатели танлаш (3)
Тиллар100+40+200+20+
Жамият API
Кирмасдан ишлайди
Олдинги параметрлар
Натижа
Токенлар тугади. Яна теги олиш
Яхшироқ натижаларни хоҳлайсизми? Premium моделлари (GPT-5, Claude, Gemini) юқори сифатни таъминлайди. Планларни кўриш
Яна кўпроқ хоҳлайсанми? 30K tokens/day + 10K bonus учун бепул рўйхатдан ўтинг
Бепул рўйхатдан ўтиш

Сизнинг илтимосингиз ишланмоқда...

Скан қилинган PDF файлларни танлаб олиш мумкин бўлган, қидириш мумкин бўлган матнга айлантиринг. Tesseract, GOT-OCR2 ва юқори сифатли OCR моторлари. 99 тил. Бепул.

Қўллаш усули PDF OCR

1
Ўзингизнинг киритмани киритинг

Матн ёзинг, файл юкланг ёки нимани хоҳлаётганингизни айтинг. Ҳисоб керак эмас.

2
Юклаб олишни босинг

Бизнинг ИИ сизнинг талабингизни энг яхши очиқ манбали моделларни қўллаган ҳолда сониялар ичида ишлайди.

3
Юклаб олиш ва улаш

Натижаларни юклаб олиш, нусха кўчириш ёки ўртоқлашиш. Шахсий ва бизнес мақсадлар учун бепул.

Бу асбобни API орқали ишлатиш

Бу асбобни ўз кодингиздан автоматлаштиринг. OpenAI-га мос келувчи REST охирги нуқтаси, Bearer-token аутентификацияси, қўшимча SDK талаб этилмайди. Токен қиймати веб интерфейсига мос келади.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Скан қилинган PDF файлларни (фақат тасвир, танланмайдиган матн) қидириш мумкин бўлган, нусха кўчириш мумкин бўлган, AI-ўқиш мумкин бўлган матнга айлантиринг. Скан қилинган саҳифалар — ҳисобварақ-фактуралар, шартномалар, эски китоблар, қўлёзма ёзувлар — PDF файлини юклаб олинг ва оддий матн,.docx ёки саҳифа рақамланган матнни қайтаринг.

Бизнинг ўз-ўзини хост қилувчи Tesseract OCR (бепул-даража) саҳифасига 500 та токен. GOT-OCR2 нархи ~800/саҳифа ва мураккаб кўринишларни (кўп-стуллар, жадваллар, тенгламалар) яхшироқ бошқаради. Premium fal OCR нархи ~2500/саҳифа бўлиб, бу паст даражадаги сканларда энг юқори аниқлик учун ишлайди. Ҳамма учтасида 800 та токен, шунинг учун 1-саҳифа юклашлар фақатгина ортиқча харажатлар эмас.

Tesseract (стандарт, бепул) тоза босилган сканлар учун. GOT-OCR2 (бепул, секинроқ) кўп-стулларли тадқиқот мақолалари, илмий тенгламалар ёки Осиё тилидаги ҳужжатлар учун — у жуда яхши кўриниш моделига эга. Premium fal OCR фақат ҳар бир пиксел аҳамиятга эга бўлган деградацияланган / паст резолюцияли / тарихий сканлар учун.

Tesseract 100+ тилларни, жумладан латинча, хитойча, японча, корейсча, арабча, кириллча, ивритча, ҳиндча, тайча, вьетнамча тилларни қўллаб-қувватлайди. 30-50% аниқлик учун тил маслаҳатини (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) беринг — автоматик аниқлаш ишлайди, аммо секинроқ.

Учинчиси:.txt (одатий, бутун ҳужжат учун битта файл),.docx (Word саҳифалар оралиғи сақланган ҳолда) ва саҳифа-маъноли.txt (===== Page N ===== саҳифалар орасидаги бошлар, шунинг учун сиз чиқимда муайян саҳифани топишингиз мумкин).

300-DPI тоза сканларда, 99%+ босилган лотин ёзувида. 150-DPI сканларда, йўқолган ҳужжатда ёки қўл ёзувда 90-95% га тушади. Лотин ёзуви бўлмаган (Хитой, Араб, Ҳинд) ёзувлар Tesseractдан кўра тил маслаҳати ва GOT-OCR2 билан яхшироқ ишлайди.

Қол ёзув OCR чоп этилган матндан анча қийинроқ — ҳаттоки, юқори сифатли OCR дан ҳам 70-85% аниқликни кутиш мумкин. Оқ қоғозда тоза қўл ёзув шакллари учун (курсивсиз) Tesseract қўлланилади. Курсив / нотўғри ёзувлар учун, юқори сифатли fal OCR қўл ёзуви режими билан ишончлироқ.

Tesseract'да ҳар бир саҳифа учун 1-3 сония, GOT-OCR2'да 3-5 сония, premium fal'да 5-10 сония. 50 саҳифали скан қилинган китоб 1-3 дақиқани олади — оғир вазифа баннери сизга саҳифани ёпишга ва тугаганида натижани электрон почта орқали олишга имкон беради.

Йўқ. Юкланган PDFлар растрлаштирилади, саҳифама-саҳифа OCRed қилинади, сўнгра ўчирилади. Чоп этилган файллар 24 соат давомида (пулли планда 7 кун) CDN'да сақланади.

Тезкор эмас. Аввал уни /pdf/unlock/ манзилида қулфдан чиқаринг (агар махфий сўзни билсангиз), сўнгра қайтинг. Биз юклашда шифрлашни аниқлаймиз ва сизни қулфдан чиқариш асбобига боғлаймиз.

Free.ai бепул, 3 OCR моторини таклиф қилади (документ тури бўйича танлаш), 99 тилларни қўллаб-қувватлайди ва жамоат API'сини етказиб беради. Adobe Acrobat Pro ($19.99/mo, 1 мотор), ABBYY FineReader ($199 бир марталик, API йўқ), Smallpdf ($9/mo, 1 мотор). Бизнинг OCR сифати тоза сканларда Adobe билан бир хил; тарихий сканларда эса ABBYYнинг рақиблари.

Ҳа — файл + тил + модел + output_format майдонлари билан /v1/pdf/ocr/га кўп қисмли POST. Цитата охири: /v1/pdf/ocr-quote/?pages=N&model=M. /api/да тўлиқ curl рецепти.

30,000 та тош учун бепул рўйхатдан ўтинг

Бепул ҳисоб яратиш

Кредит картаси талаб этилмайди

Бу асбобни қандай баҳолайсиз?

Free.aiни севасанми? Дўстларингга айт!