PDF OCR

Përdorimi komercial OK 380+ modele Pa shenjë uji Nuk është e nevojshme regjistrimi
Modeli:
+ GPT-5, Claude, Gemini
Kthe një PDF të skanuar në tekst të zgjedhshëm dhe të kërkueshëm. Rasterizohet çdo faqe në 200 DPI dhe kryen OCR — zgjedh Tesseract (të shpejtë, pa pagesë), GOT-OCR2 (më i mirë për kollona të shumta + tabela), ose fal OCR premium (më i miri për skanime të degraduara/historike). Shfaq si.txt,.docx, ose tekst me etiketë faqeje. Keni një figurë, jo një PDF? Përdor /ocr/ →

Tërhiq një PDF të skanuar këtu ose kliko për të ngarkuar

PDF deri në 50 MB. Punon me PDF të skanuar + vetëm me imazhe. Tashmë tekst i zgjedhshëm? Nuk ju duhet OCR.

·
Ky PDF ka tashmë tekst të zgjedhshëm - mund të mos të duhet OCR. Provo Përmbledhësin →
Mbrojtur me fjalëkalim — zhbllokoje së pari. Shblloko PDF →
Tesseract për skanime të pastra të shtypura. GOT-OCR2 për letra shumë-kolonëshe + shkrime aziatike. Premium vetëm kur çdo piksel ka rëndësi.
Gjuha e këshillës shpejton Tesseract 2-3 × dhe rritë saktësinë 30-50% në shkrimet jo-latine.
Vlerësimi i token
Ble token
Ngarko një PDF për të parë koston e saktë.
Rezultati OCR
Shkarko

        

Kur të përdoret PDF OCR

Faktura + Rrethje

Kthe një stivë të faturave të skanuara në tekst të editueshme për mbajtjen e llogarive, rimbursimet, apo automatikimin e AP.

Librat e vjetër + arkivat

Dixhitalizo librat e shkruar, dokumentet historike, apo arkivat e bibliotekës në tekst të kërkueshëm.

Regjistrim ligjor + mjekësor

Zbloko tekstin brenda dosjeve të skanuara të rasteve, raporteve mjekësore ose dokumenteve të dërguar me faks për zbulimet + rrjedhët e punës eDiscovery.

Para përkthimit

Ekzekuto OCR për të nxjerrë tekstin, pastaj fute rezultatin në /pdf/translator/ për konvertimin nga çdo gjuhë në çdo gjuhë.

Free.ai PDF OCR vs instrumentët e paguar

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Çmimi fillestarI lirë$19.99/mo$199 one-time$9/mo
Zgjidh motorin OCR (3)
Gjuhë100+40+200+20+
API Publike
Punon pa regjistrim
Mundësitë e avancuara
Rezultati
Tokenët po i mbaron. Merr më shumë token
Dëshiron rezultate më të mira? Modelet Premium (GPT-5, Claude, Gemini) ofrojnë cilësi më të lartë. Shiko Planet

❤️ Të pëlqen Free.ai?

Regjistrohu për të marrë një lidhje referuese dhe fiton 25,000 token për mik.

Do më shumë? Regjistrohu falas për 30K token/ditë + 10K bonus
Regjistrohu

Duke përpunuar kërkesën tuaj...

Kthe PDF-të e skanuar në tekst të zgjedhshëm dhe të kërkueshëm. Tesseract, GOT-OCR2, dhe motorë premium OCR. 99 gjuhë. Pa pagesë.

Si të përdorësh PDF OCR

1
Shkruaj

Shkruaj tekst, ngarko një file, ose përshkruaj atë që do. Nuk duhet asnjë llogari.

2
Kliko për të krijuar

AI jonë e përpunon kërkesën tuaj në sekonda duke përdorur modelet më të mira të burimit të hapur.

3
Shkarko dhe nda

Shkarko, kopjo ose ndaje rezultatin tënd. Pa pagesë për përdorim personal dhe komercial.

Përdor këtë mjet nëpërmjet API

Automatizo këtë mjet nga kodi juaj. Pika e fundit REST e përshtatshme me OpenAI, autentifikimi me token e bartësit, nuk kërkohet SDK shtesë. Kostot e token-it përputhen me interfaqen web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Kthe PDF-të e skanuar (vetëm figura, tekst i pazgjidhur) në tekst të kërkueshëm, të kopjueshëm, të lexueshme nga AI. Ngarko një PDF të faqes së skanuar - faturat, kontratat, librat e vjetër, shënimet e shkruara me dorë - dhe ktheje tekstin e thjeshtë,.docx, ose tekstin me faqe të numëruar.

Rreth 500 token për faqe në Tesseract OCR (nivel i lirë) të vetë-hostuar. GOT-OCR2 kushton ~800/faqe dhe trajton më mirë formatet komplekse (me shumë kollona, tabela, ekuacione). Premium fal OCR punon ~2,500/faqe për saktësi më të lartë në skanimet e degraduara. 800 token në të tre, kështu që ngarkimet e 1 faqes nuk janë të papërpunuara.

Tesseract (i paracaktuar, i lirë) për skanimet e pastra të shtypura. GOT-OCR2 (i lirë, më i ngadalshëm) për dokumentet kërkimore me shumë kollona, ekuacionet shkencore ose dokumentet në gjuhën aziatike — ka një model shumë më të mirë të hartimit. Premium fal OCR vetëm për skanimet e degraduara / me rezolucion të ulët / historike ku çdo piksel ka rëndësi.

Tesseract suporton më shumë se 100 gjuhë duke përfshirë latinishten, kineze, japoneze, koreane, arabe, cirilike, hebraike, hindi, thai, vietnameze. Përdor një këshillë gjuhe (ang/spa/fra/deu/jpn/chi_sim/ara/etc.) për 30-50% saktësi më të mirë — auto-zbulimi punon por është më i ngadalshëm.

Tre:.txt (e thjeshtë, një file për të gjithë dokumentin),.docx (Fjalë me ndërprerje faqesh të ruajtura), dhe faqe-wise.txt (===== Faqe N ===== krerët midis faqes kështu që ju mund të gjeni një faqe të veçantë në dalje).

Në skanimet e pastra 300-DPI, 99%+ në shkrimin latin të shtypur. Rënia në 90-95% në skanimet 150-DPI, dokumentet e zhdukur, ose shkrimin me dorë. shkrimet jo-latine (kinez, arab, hindi) bëjnë shumë më mirë me një këshillë gjuhe dhe GOT-OCR2 sesa Tesseract.

OCR e shkrimit me dorë është shumë më e vështirë se teksti i shtypur - prit 70-85% saktësi edhe me OCR premium. Për formularë të pastër të shtypur me dorë (jo kursiv) në letër të bardhë, Tesseract është i përdorshëm. Për shënime kursive / të rrënuara, OCR fal premium me modalitetin e shkrimit me dorë është më i besueshëm.

Rreth 1-3 sekonda për faqe në Tesseract, 3-5 sekonda në GOT-OCR2, 5-10 sekonda në fal premium. Një libër me 50 faqe të skanuara merr 1-3 minuta — banneri i detyrave të rënda të lejon të mbyllësh skedën dhe të marrësh rezultatin me email kur të përfundojë.

Jo. PDF-të e ngarkuara rasterizohen, OCRed faqe pas faqe, pastaj eleminohen. File i daljes ruhet në CDN tonë për 24 orë (7 ditë në një plan të paguar) tek lidhjet e ndarjes.

Jo direkt. Shbllokoje tek /pdf/unlock/ së pari (nëse e ke fjalëkalimin), pastaj kthehu. Ne zbulojmë kriptimin kur ngarkohet dhe të lidhim me instrumentin e shbllokimit.

Free.ai është falas, ofron 3 motorë OCR (zgjidh sipas llojit të dokumentit), mbështet 99 gjuhë, dhe dërgon një API publike. Adobe Acrobat Pro ($19.99/muaj, 1 motor), ABBYY FineReader ($199 një herë, pa API), Smallpdf ($9/muaj, 1 motor). Cilësia jonë OCR në skanimet e pastra barazohet me Adobe; në skanimet historike premium fal rivalët ABBYY.

Po — POST multipart në /v1/pdf/ocr/ me file + gjuhë + model + fusha output_format. Pika e fundit e citimit: /v1/pdf/ocr-quote/?pages=N&model=M. Recepta e plotë e kurl në /api/.

Regjistrohu falas për 30,000 token

Krijo një profil të ri

Nuk kërkohet karta e kreditit

Si do ta vlerësoni këtë mjet?

Të pëlqen Free.ai?