PDF OCR

Ọrụ ọhaneze OK 567 models Enweghị akara mmiri Enweghị mkpa ịbanye
Móòdù:
+ GPT-5, Claude, Gemini
Kpọchie ngwe PDF emeredịkachọrọ ka ọ bụrụ ngwe a ga-ahọrọ, a ga-achọta ya. Rasterịza ihuakwụkwọ ọbụla na 200 DPI na-agba OCR - họrọ Tesseract (n'ụzọ nkịtị, n'efu), GOT-OCR2 (n'aka mma maka ọtụtụ-colon + táàbụ̀), mọọbụ OCR fal premium (n'aka mma maka ngwe a na-ewepụ/akụkọ akụkọ ihe mere eme). Ọnụọgụgụ dịka.txt,.docx, mọọbụ ngwe a na-edebe na peeji. I nwere inyogo, ọ bụghị PDF? Jiri /ocr/ →

Kpụga PDF emeredịkachọrọ ebe a mọọbụ pịa ka e bubata ya

PDF ruo 50 MB. Ọrụ na ịpị + inyogo-ọbụla PDFs. Ọ dịlarịị ngwe-ahọrọ? Ịchọrọghị OCR.

-
- · -
PDF a nwere ngwe a ga-ahọrọlarị - ị ga-achọghị OCR. Chọpụta
Nchedo okwuntughe - mechie ya n'oge mbụ. Wepụ ntọala PDF
Tesseract maka mbipụta scans dị ọcha. GOT-OCR2 maka akwụkwọ ndị dị iche iche-colon + Asian scripts. Premium naanị mgbe pixel ọbụla dị mkpa.
A na-ejikarị ya eme ihe n'ihe gbasara 30-50% nke ihe ndị na-emerụ ahụ.
Nhazi Token
-
Zụlite
Wepụta PDF iji hụ ọnụọgụgụ nke ihe ahụ.
OCR nsonaazụ
Bubata

        

Mgbe a ga-eji PDF OCR

Invoices + receipts

Kpọchie stack nke inwóùtù skenètị̀ n'ime ngwe a ga-edezi maka ịgụ akwụkwọ, nkwụghachi, mọọbụ AP ọfụụ.

Akwụkwọ ochie na archives

Dijitịzi akwụkwọ ndị a na-ebipụtaghị, dọkumenti akụkọ ihe mere eme, mọọbụ archives nke laịibrọri ka ha bụrụ ngwe a ga-achọta.

Legal + medical records

Wepụ ngwe n'ime faịlụ ndị ahụ, ozi ahụike, mọọbụ dọkumenti ndị a faịlụ maka ntinye aka + eDiscovery.

N'elu ntụgharị

Bido OCR iji wepụta ngwe, wee banye nsonaazụ na /pdf/ntụgharị/ maka ọbụla-na-ọbụla asụsụ ntụgharị.

Free.ai PDF OCR vs ndị ọrụ na-akwụ ụgwọ

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Nhazi_Nkebi$19.99/mo$199 one-time$9/mo
Họrọ OCR engine (3)---
Asụsụ ndị ahụ100+40+200+20+
API nke ndị mmadụ---
Ọrụ na-enweghị ndebanye---
Nkarachọ ndị ahụ
Nke ahụ
Token na-aga n'okpuru. Wepụta Token
Ịchọrọ nsonaazụ ka mma? Premium models (GPT-5, Claude, Gemini) na-enye ogo dị elu. Gosi _Nhazi

❤️ Ịhụnanya Free.ai? Kpọtụrụ enyi gị!

Sign up iji nweta a referral njikọ na-enweta 30,000 tokens kwa enyi.

Ịchọrọ ihe ọzọ? Nweta n'efu: 30,000 tokens/ụbọchị
Ndebanye aha

Na-arụ ọrụ n'ihe nchọgharị gị...

Kpọgharịa PDFs skened ka ọ bụrụ ngwe a ga-ahọrọ, a ga-achọta ya. Tesseract, GOT-OCR2, na ndịnweta OCR premium. Asụsụ 99. Free.

Otu esi eji ya PDF OCR

1
Tinye inu gị

Tinye ngwe, bubata faịlụ, mọọbụ gosi ihe ịchọrọ. Achọrọghị akaụntụ.

2
Pịa iji mepụta

Anyị AI na-enyocha arịrịọ gị n'ime sekọnd na-eji ihe kacha mma open-source models.

3
Bubata na akwado

Bubata, debata, mọọbụ kesaa nsonaazụ gị. Free maka ojiji nkeonwe na nke azụmahịa.

Jiri tùlè a site na API

Megharịa ihenhọrọ a site na koodị gị. OpenAI-compatible REST endpoint, Bearer-token auth, enweghị SDK ọzọ achọrọ. Token costs match the web interface.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

Kpọnye PDFs skened (ihumkpụrụedemede-ọbụla, ngwe a na-ahọrọghị) n'ime ihe nchọgharị, na-edebata, ngwe AI-nwere ike ịgụ. Gbanye PDF nke ibe ndị skened - inwou, nkwekọrịta, akwụkwọ ochie, n'aka-edepụtara n'aka - na nwetaghachi ngwe dị mfe,.docx, mọọbụ ngwe peeji-numered.

N'ihe banyere 500 tokens kwa peeji na Tesseract OCR anyị na-echekwa onwe ya (free-tier). GOT-OCR2 na-akwụ ụgwọ ~ 800 / peeji ma na-ejikwa layouts dị mfe (multi-colon, tebụl, equations) ka mma. Premium fal OCR na-agba ọsọ ~ 2,500 / peeji maka nghọta dị elu na scans degradated. 800-token floor na atọ niile ya mere 1-page uploading bụ enweghị n'efu.

Tesseract (dìfọ́ọ̀ltụ̀, ọ̀hà nàghị akwụ ụgwọ) maka nlegharị anya nke e bipụtara n'ụzọ dị ọcha. GOT-OCR2 (ọhà nàghị akwụ ụgwọ, dị n'okpuru) maka akwụkwọ nlegharị anya nke nwere ọtụtụ kọlụm, equations saịnsị, mọọbụ Asia-asụsụ akwụkwọ - ọ nwere model nke nlelegharị anya dị mma. Premium fal OCR maka nlegharị anya nke a na-ewepụtụla / n'okpuru-nhazi / akụkọ ihe mere eme ebe pixel ọbụla dị mkpa.

Tesseract na-akwado asụsụ 100+ gụnyere Latin, Chinese, Japanese, Korean, Arabic, Cyrillic, Hebrew, Hindi, Thai, Vietnamese. Kpụga asụsụ nzọụkwụ (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) maka 30-50% n'ezigbo ihe - ọbụna-ahụta ọrụ mana ọ dị n'oge.

Ụdị:.txt (ọdịnala, faịlụ otu maka dọkumenti ahụ dum),.docx (Word na nkwụsị peeji nke echekwara), na peeji-wise.txt (===== peeji N ===== isiokwu n'etiti peeji ka ị nwee ike ịchọta ibe ọbụla n'ọnụọgụgụ.

Na 300-DPI scans, 99%+ na mbipụta Latin script. Na-apụ na 90-95% na 150-DPI scans, faded documents, mọọbụ handwriting. Non-Latin scripts (Chinese, Arabic, Hindi) na-eme ka ọ dịkwuo mma na njirimara asụsụ na GOT-OCR2 kama Tesseract.

OCR nke n'aka bụ n'ebe dị njọ karịa ngwe nke n'aka - hụ na 70-85% n'ezigbo nakwa na OCR nke n'aka. Maka usoroiheomume nke n'aka (enweghị n'aka) na akwụkwọ ọcha, Tesseract dị mfe iji. Maka n'aka / n'aka, OCR nke n'aka na-egosipụta n'aka mode bụ nke dị n'aka.

N'ihe banyere 1-3 sekọnd kwa peeji na Tesseract, 3-5 sekọnd na GOT-OCR2, 5-10 sekọnd na premium fal. A 50-page scanned book takes 1-3 minutes - the heavy-task banner allows you to close the tab and get the result emailed when it finishes.

Ọ dịghị. PDFs na-ebugharị bụ rasterized, OCRed peeji nke site na peeji, wee weghachite. Faịlụ ọpụpụ a na-echekwa na CDN anyị maka awa 24 (7 ụbọchị na atụmatụ ịkwụ ụgwọ) na njikọ ntinye.

Ọ bụghị n'ụzọ ziri ezi. Wepu ya na /pdf/unlock/ mbụ (ọ bụrụ na ị nwere okwuntughe), mgbe ahụ banye. Anyị na-ahụ encryption na mbipụta nakwa njikọ gị na ihenhọrọ wepu.

Free.ai bụ n'efu, na-enye 3 OCR engines (pịa site na ụdị doc), na-akwado asụsụ 99, na-ebufe API nke ndị mmadụ. Adobe Acrobat Pro ($ 19.99 / mo, 1 engine), ABBYY FineReader ($ 199 otu oge, enweghị API), Smallpdf ($ 9 / mo, 1 engine).

Ee - POST multipart ka /v1/pdf/ocr/ na faịlụ + asụsụ + model + output_format mpaghara. Nkọwapụta ngwụcha: /v1/pdf/ocr-quote/?pages=N&model=M. Nkọwapụta zuru ezu na /api/.

Nweta n'efu: 30,000 tokens/ụbọchị

Kewapụta Akaụntụ

Enweghị kaadị kredit achọrọ

Olee otú ị ga-esi họrọ ihenhọrọ a?

Ịhụnanya Free.ai? Kpọtụrụ enyi gị!