PDF OCR

Тижорат мақсадларида фойдаланиш мумкин 567 моделлари Сув белгиси йўқ Қўшилиш талаб этилмайди
Модель:
+ GPT-5, Claude, Gemini
Скан қилинган PDF файлини танлаб олиш мумкин бўлган, қидириш мумкин бўлган матнга айлантиради. Ҳар бир саҳифани 200 DPI да растрлаштиради ва OCR'ни ишга туширади — Tesseract (тез, бепул), GOT-OCR2 (кўп сонли столблар + жадваллар учун яхшироқ) ёки premium fal OCR'ни танланг (деградацияланган / тарихий сканлар учун яхшироқ). Чоп этиш.txt,.docx ёки саҳифа-белгиланган матн сифатида. PDF эмас, тасвирингиз борми? /ocr/ ни ишлатинг →

Скан қилинган PDF файлини бу ерга олиб боринг ёки юклаш учун босинг

50 МБ гача PDF. Скан қилинган + фақат тасвирли PDFларда ишлайди. Матн танлаш мумкинми? Сизга OCR керак эмас.

-
- · -
Бу PDF'да танланадиган матн мавжуд - сизга OCR керак бўлмаслиги мумкин. Тақризчидан фойдаланинг →
Махфий сўз билан ҳимояланган - аввал уни қулфдан чиқаринг. PDF қулфини очиш
Тишсиз босилган сканлар учун Tesseract. Кўп-стуллар учун GOT-OCR2 + Осиё ёзувлари. Фақат ҳар бир пиксел аҳамиятли бўлганда Premium.
Тил маслаҳати Tesseract'ни 2-3× тезлаштиради ва 30-50% га латинча бўлмаган ёзувларда аниқликни оширади.
Токен баҳоси
-
Токенларни сотиб олиш
Тўғри нархни кўриш учун PDF файлини юкланг.
OCR натижа
Юклаб олиш

        

Қачон PDF OCR'ни қўллаш керак

Счетлар + тасдиқномалар

Скан қилинган ҳисобварақ-фактураларни ҳисоботлар, тўловлар ёки AP автоматизацияси учун таҳрирлаш мумкин бўлган матнга айлантиринг.

Кўп китоблар ва архивлар

Чоп этилмаган китобларни, тарихий ҳужжатларни ёки китобхона архивларини қидириш мумкин бўлган матнга рақамлаштириш.

Юрисдик + тиббий маълумотлар

Скан қилинган ҳолат файллари, тиббий ҳисоботлар ёки факс қилинган ҳужжатлардаги матнни кашф қилиш + eDiscovery иш жараёнлари учун қулфдан очиш.

Таржимадан олдин

Матнни ажратиш учун OCR'ни ишга туширинг, сўнгра натижани /pdf/translator/'га юборинг, у ерда у бошқа тилга таржима қилинади.

Free.ai PDF OCR ва тўловли воситалар

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Бошланғич нархиОқ$19.99/mo$199 one-time$9/mo
OCR двигатели танлаш (3)---
Тиллар100+40+200+20+
Жамият API---
Кирмасдан ишлайди---
Кўпроқ параметрлар
Натижа
Токенлар тугади. Яна теги олиш
Яхшироқ натижаларни хоҳлайсизми? Premium моделлар (GPT-5, Claude, Gemini) юқори сифатни таъминлайди. Планларни кўриш

❤️ Free.aiни севинг? Дўстларингизга айтинг!

Реферал линк олиш учун ва ҳар бир дўст учун 30,000 токен олиш учун га рўйхатдан ўтинг.

Яна кўпроқ хоҳлайсизми? Бепул рўйхатдан ўтиш: 30,000 tokens/day
Бепул рўйхатдан ўтиш

Сизнинг илтимосингиз ишлатилмоқда...

Скан қилинган PDF файлларни танлаб олиш мумкин бўлган, қидириш мумкин бўлган матнга айлантиринг. Tesseract, GOT-OCR2 ва юқори сифатли OCR моторлари. 99 тил. Бепул.

Қўллаш усули PDF OCR

1
Ўзингизнинг киритмани киритинг

Матн ёзинг, файл юкланг ёки хоҳлаган нарсангизни таърифланг. Ҳисоб керак эмас.

2
Юклаб олишни босинг

Бизнинг ИИ сизнинг илтимосни энг яхши очиқ манба моделлари ёрдамида секундлар ичида ишлайди.

3
Юклаб олиш ва улаш

Юклаб олиш, нусха кўчириш ёки натижани ўртоқлаш. Шахсий ва бизнес учун бепул.

Бу асбобни API орқали қўллаш

Бу асбобни ўз кодингиздан автоматлаштиринг. OpenAI-га мос келувчи REST охирги нуқтаси, Bearer-token аутентификацияси, қўшимча SDK талаб этилмайди. Токен қиймати веб интерфейсига мос келади.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

Скан қилинган PDF файлларни (фақат сурат, танлаб бўлмайдиган матн) қидириш мумкин бўлган, нусха кўчириш мумкин бўлган, AI-ўқиш мумкин бўлган матнга айлантиринг. Скан қилинган саҳифалар - ҳисобварақлар, шартномалар, эски китоблар, қўлёзма ёзувлар - PDF файлини юклаб олинг ва оддий матн,.docx ёки саҳифа рақамланган матнни қайтаринг.

Бизнинг ўз-ўзини хост қилувчи Tesseract OCR (бепул-даража) саҳифасига 500 та токен. GOT-OCR2 нархи ~800/саҳифа ва мураккаб кўринишларни (кўп-стуллар, жадваллар, тенгламалар) яхшироқ бошқаради. Premium fal OCR нархи ~2500/саҳифа бўлиб, бу паст даражадаги сканларда энг юқори аниқлик учун ишлайди. Ҳамма учтасида 800 та токен, шунинг учун 1-саҳифа юклашлар фақатгина ортиқча харажатлар эмас.

Tesseract (стандарт, бепул) тоза босилган сканлар учун. GOT-OCR2 (бепул, секинроқ) кўп-стулларли тадқиқот мақолалари, илмий тенгламалар ёки Осиё тилидаги ҳужжатлар учун - у жуда яхши кўриниш моделига эга. Premium fal OCR фақат ҳар бир пиксел аҳамиятли бўлган деградацияланган / паст резолюцияли / тарихий сканлар учун.

Tesseract 100 дан ортиқ тилларни қўллаб-қувватлайди, жумладан латинча, хитойча, японча, корейсча, арабча, кириллча, ивритча, ҳиндча, тайча, вьетнамча. 30-50% аниқлик учун тил маслаҳатини (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) беринг - автоматик аниқлаш ишлайди, аммо секинроқ.

Учинчиси:.txt (одатий, бутун ҳужжат учун битта файл),.docx (Word саҳифалар оралиғи сақланган ҳолда) ва саҳифа-маъноли.txt (===== Page N ===== саҳифалар орасидаги бошлар, шунинг учун сиз чиқимда муайян саҳифани топишингиз мумкин).

300-DPI тоза сканларда, 99%+ босилган лотин ёзувида. 150-DPI сканларда, йўқолган ҳужжатда ёки қўл ёзувда 90-95% га тушади. Лотин ёзуви бўлмаган (Хитой, Араб, Ҳинд) ёзувлар Tesseractдан кўра тил маслаҳати ва GOT-OCR2 билан яхшироқ ишлайди.

Қўлёзма OCR босма матндан кўра анча қийин - ҳаттоки, premium OCR дан ҳам 70-85% аниқликни кутиш мумкин. Оқ қоғозда тоза қўл билан босилган шакллар учун (курсивсиз) Tesseract ишлатилиши мумкин. Курсив / нотўғри ёзувлар учун, қўлёзма режими билан premium fal OCR ишончлироқ.

Tesseract'да ҳар бир саҳифа учун 1-3 сония, GOT-OCR2'да 3-5 сония, premium fal'да 5-10 сония. 50 саҳифали скан қилинган китоб 1-3 дақиқани олади - оғир вазифа баннери сизга саҳифани ёпишга ва натижани тугаганида электрон почта орқали олишга имкон беради.

Йўқ. Юкланган PDFлар растрлаштирилади, саҳифама-саҳифа OCRed қилинади, сўнгра ўчирилади. Чоп этилган файллар 24 соат давомида (пулли планда 7 кун) CDN'да сақланади.

Тезкор эмас. Аввал уни /pdf/unlock/ манзилида қулфдан чиқаринг (агар махфий сўзни билсангиз), сўнгра қайтинг. Биз юклашда шифрлашни аниқлаймиз ва сизни қулфдан чиқариш асбобига боғлаймиз.

Free.ai бепул, 3 OCR моторини таклиф қилади (документ тури бўйича танлаш), 99 тилларни қўллаб-қувватлайди ва жамоат API'сини етказиб беради. Adobe Acrobat Pro ($19.99/mo, 1 мотор), ABBYY FineReader ($199 бир марталик, API йўқ), Smallpdf ($9/mo, 1 мотор). Бизнинг OCR сифати тоза сканларда Adobe билан бир хил; тарихий сканларда эса ABBYYнинг рақиблари.

Ҳа - файл + тил + модел + output_format майдонлари билан /v1/pdf/ocr/га кўп қисмли POST. Quote endpoint: /v1/pdf/ocr-quote/?pages=N&model=M. Full curl recipe at /api/.

Бепул рўйхатдан ўтиш: 30,000 tokens/day

Бепул ҳисоб яратиш

Кредит картаси талаб этилмайди

Ушбу асбобни қандай баҳолайсиз?

Free.aiни севинг? Дўстларингизга айтинг!