PDF OCR

Ukusetshenziswa kwebhizinisi OK 567 amamodeli Akukho phawu lwamanzi Akukho ubhaliso olungenayo
Imodeli:
+ GPT-5, Claude, Gemini
Guqula i-PDF exhunywe ibe ngumbhalo okhethiwe, otholakale. I-raster ikhasi ngalinye ku-200 DPI futhi iqhuba i-OCR — khetha i-Tesseract (isheshayo, imahhala), i-GOT-OCR2 (ingcono nge-column eminingi + amathebula), noma i-premium fal OCR (ingcono nge-degraded / historical scans). I-output njenge-.txt,.docx, noma umbhalo wekhasi-obhalwe nge-label. Uthola isithombe, hhayi i-PDF? Sebenzisa /ocr/ →

Thola i-PDF ehlolwe lapha noma chofoza ukulayisha

PDF kuze kube yi-50 MB. Isebenza ku-scanned + isithombe- kuphela PDFs. Sekuyisikhathi sokukhetha umbhalo? Awudingi i-OCR.

-
- · -
Le PDF sele inesihloko esikhethiwe - ungase ungadingi i-OCR. Zama isiqephu
Ikhuselwe ngegama lokuthela — vula kuqala. Vula i-PDF
Tesseract ukuhlola okuphrintiwe okuhlanzekile. GOT-OCR2 amakhasi ahlukahlukene + amaskripthi ase-Asia. I-premium kuphela uma i-pixel ngayinye ibalulekile.
Usizo lwesilimi lusheshisa i-Tesseract 2-3× futhi luthuthukisa ukunemba 30-50% kuma-scripts anga-Latin.
Ukulinganiselwa kwe-token
-
Thenga ama-token
Layisha phezulu i-PDF ukuze ubone izindleko ezifanele.
Imiphumela ye-OCR
Layisha phezulu

        

Lapho usebenzisa i-PDF OCR

I-invoyisi + izipho

Guqula i-stack ye-invoyisi ehlobene ibe ngumbhalo ohlelayo wokugcina i-bookkeeping, ukubuyiselwa kwemali, noma ukwenziwa kwe-AP.

Amabhukwana adala + amagobolondo

I-digitalize i-out-of-print books, amadokhumende emlando, noma amafayela e-library abe ngumbhalo otholakale.

I-legal + medical records

Vula umbhalo ngaphakathi kwefayela lecala elihlolwe, izibikezelo zodokotela, noma amadokhumende afakisiwe ukuphenya + ukufinyelela kwemisebenzi.

Phambi kokuguqulelwa

Sebenzisa i-OCR ukukhishwa kombhalo, bese ufaka imiphumela ku /pdf/uguquleli/ ukuguqulwa kwesilimi ngasinye-kunoma iyiphi.

Free.ai PDF OCR vs amathuluzi akhokhelwayo

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Intengo yokuqalaIkhululekile$19.99/mo$199 one-time$9/mo
Khetha i-OCR engine (3)---
Izilimi100+40+200+20+
I-API yomphakathi---
Isebenza ngaphandle kokungena---
Izinketho ezithuthukisiwe
Imiphumela
Ama-token aphansi. Thola ama-token amaningi
Ufuna izimpendulo ezinhle? Amamodeli aphezulu (GPT-5, Claude, Gemini) inikeza umgangatho ophezulu. Bona ama-plans

❤️ Uthando Free.ai? Uthi abangane bakho!

Ngena ukuthola i-link yokuqondisa futhi uthole ama-30,000 ama-token ngamunye umngane.

Ufuna okuningi? Ubhalise mahhala: 30,000 tokens/day
Ubhalise

Kuqedwa isicelo sakho...

Guqula ama-PDF axhunywe abe mbhalo okhetha ukuwukhetha, otholakale. Tesseract, GOT-OCR2, nama-premium OCR engines. Izilimi ezingu-99.

Indlela yokusetshenziswa PDF OCR

1
Faka isingeniso sakho

Bhala umbhalo, thumela ihele, noma chaza ofuna ukukwenza. Akukho akhawunti edingekayo.

2
Chofoza ukudala

I-AI yethu isebenza isicelo sakho emaminithini ambalwa usebenzisa amamodeli angcono kakhulu avulekile.

3
Layisha phezulu futhi uhlukanise

Layisha phezulu, kopela, noma uhlukanise imiphumela yakho. Imahhala ukusebenziseka komuntu siqu nebhizinisi.

Sebenzisa lesi sisetshenziswa nge-API

Yenza lokhu sixhobo sisebenze ngokuzenzakalela kusuka kukhodi yakho. I-REST ehambisanayo ne-OpenAI, ubufakazi be-token, akukho SDK edingekayo. Izindleko ze-token zifana ne-web interface.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

Gcina ama-PDF axhunywe (isithombe kuphela, umbhalo ongakhethiwe) ku-searchable, copyable, AI-readable text. Layisha i-PDF yamakhasi axhunywe - amafayela, amakontraka, amabhuku adala, ama-notes abhalwe ngesandla - futhi ubuyisele umbhalo ojwayelekile,.docx, noma umbhalo wekhasi onombolo.

I-GOT-OCR2 ibiza u-~800/ikhasi futhi iphatha ama-layouts anzima (amakholamsi amaningi, amathebulethi, ama-equations) kahle. I-Premium fal OCR isebenza u-~2,500/ikhasi ukuze kube nokuthembeka okuphezulu ekusakazeni okunciphayo. I-800-token floor kuzo zonke ezintathu ngakho-ke ukuthunyelwa kwekhasi le-1 akuyona i-overhead ecacile.

Tesseract (iphutha, mahhala) ukuhlola okuphrintiwe okuhlanzekile. GOT-OCR2 (mahhala, okulula) ukuhlola amabhukwana ahlukahlukene, ama-equations asayensi, noma amadokhumende e-Asian-language - inesimo esingcono kakhulu. Premium fal OCR kuphela ukuhlola okubi / ukuxazulula okuphansi / okumlando lapho wonke ama-pixel abalulekile.

I-Tesseract isekela izilimi ezingaphezu kuka-100 kufaka phakathi isiLatini, isiChinese, isiJapane, isiKorea, isi-Arabhu, isiCyrillic, isiHebhere, isiHindi, isiThai, isiVietnam. Phazamisa incazelo yesilimi (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) ukuze uqinisekise ukuthembeka ngo-30-50% - ukuhlola okuzenzakalelayo kusebenza kodwa kusheshe.

Usuku:.txt (ilula, ifayela elinye ledokhumende lonke),.docx (Igama nengxenye yekhasi egcinwe), nekhasi-lolwazi.txt (===== Ikhasi N ===== izihloko phakathi kwekhasi ukuze ukwazi ukuthola ikhasi elithile kwi-output).

Ku-300-DPI scans, 99% + kushicilelwe isiLatini. Kukhuphuka ku-90-95% ku-150-DPI scans, amadokhumende amnyama, noma ukubhala ngesandla. Ama-Latin scripts (Chinese, Arabic, Hindi) asebenza kahle kakhulu nge-language hint ne GOT-OCR2 ngaphezu kwe-Tesseract.

Ukubhala ngesandla OCR kunzima kakhulu kunamagama ashicilelwe - cabanga 70-85% ukunemba ngisho ne-premium OCR. Ifomu eliphrintiwe ngesandla elihlanzekile (alikho eli-cursive) kwiphepha elimhlophe, i-Tesseract lisebenza. I-cursive / amabhukwana anzima, i-premium fal OCR ngendlela yokubhala ngesandla ithembekile.

Izinga elilingana nemizuzu engu-1-3 ngekhasi ngalinye ku-Tesseract, imizuzu engu-3-5 ku-GOT-OCR2, imizuzu engu-5-10 ku-premium fal. Incwadi ekhasini elingama-50 eliscanwe lithatha imizuzu engu-1-3 - ibha yemisebenzi enzima ikuvumela ukuthi uvale i-tab futhi uthole imiphumela e-imeyili uma iqediwe.

Akunalutho. Ama-PDF alayishwe phezulu afakwe i-raster, ikhasi le-OCRed ngekhasi, bese lisuswa. Ifayela le-output ligcinwa ku-CDN yethu ngehora le-24 (izinsuku ze-7 ku-plan ekhokhelwayo) ku-share link.

Akunjalo ngokuqondile. Vula ku /pdf/unlock/ kuqala (uma unegama lokungena), bese ubuyela emuva. Sizothola ukufihla-sithombe uma sifaka futhi sizoxhumana nawe kuthuluzi lokuvala.

Free.ai imahhala, inikeza ama-engine we-3 OCR (ukukhetha ngohlobo lwedoc), ixhasa izilimi ze-99, futhi ithumela i-API yamahhala. Adobe Acrobat Pro ($ 19.99 / mo, 1 engine), ABBYY FineReader ($ 199 kanye, akukho API), Smallpdf ($ 9 / mo, 1 engine). Umgangatho wethu we-OCR ku-scans acocekileyo ufana ne-Adobe; ku-historical scans premium fal rivals ABBYY.

Yebo - UTHENGA ingxenye eminingi ku /v1/pdf/ocr/ ngefayela + ulwimi + imodeli + izimo ze-output_format. Cisha indawo yokuqeda: /v1/pdf/ocr-quote/?pages=N&model=M. I-curl recipe ephelele ku /api/.

Ubhalise mahhala: 30,000 tokens/day

Dala i-akhawunti

Akukho khadi le-credit elidingekayo

Ungayilinganisela kanjani le thuluzi?

Uthando Free.ai? Uthi abangane bakho!