PDF OCR

Utilizare comercială OK 380+ modele Fără semn de apă Nu este nevoie de înscriere
Model:
+ GPT-5, Claude, Gemini
Transformă un PDF scanat în text selectabil, care poate fi căutat. Rasteriza fiecare pagină la 200 DPI și rulează OCR — alege Tesseract (gratuit, gratuit), GOT-OCR2 (mai bun pentru multi-coluna + tabele), sau OCR premium (mai bun pentru scanări degradate / istorice). Ieșirea ca.txt,.docx, sau text marcat de pagină. Ai o imagine, nu un PDF? Foloseste /ocr / →

Trage un PDF scanat aici sau click pentru a încărca

PDF până la 50 MB. Funcționează pe PDF scanat + doar imagini. Deja text selectabil? Nu aveți nevoie de OCR.

·
Acest PDF are deja un text selectabil — s-ar putea să nu aveţi nevoie de OCR. Încearcă Summarizator →
Protejată prin parolă — deblocați-l mai întâi. Deschide PDF →
Tesseract pentru scanări tipărite curate. GOT-OCR2 pentru hârtii multi-columna + scripturi asiatice. Premium doar atunci când fiecare pixel contează.
Limba sugestiv viteze Tesseract 2-3× și sporește precizia 30-50% pe scripturi non-latine.
Valori estimate pentru token
Cumpără tokenuri
Încarcă un PDF pentru a vedea costul exact.
Rezultatul OCR
Descărcare

        

Când se utilizează PDF OCR

Facturi + chitanțe

Transformă un stack de facturi scanate în text editabil pentru contabilitate, rambursări sau automatizare AP.

Cărți vechi + arhive

Digitalizează cărțile neimprimate, documentele istorice sau arhivele bibliotecilor în textul care poate fi căutat.

Dosarele legale + medicale

Deblocați textul în fișiere de caz scanate, rapoarte medicale sau documente faxate pentru descoperirea + fluxuri de lucru eDescovery.

Înainte de traducere

Executați OCR pentru a extrage text, apoi furnizați rezultatul în /pdf/translator/ pentru conversia oricărei limbi.

Free.ai PDF OCR vs instrumentele plătite

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Preț de pornireGratuit$19.99/mo$199 one-time$9/mo
Alegeți motorul OCR (3)
Limbi100+40+200+20+
API publică
Funcționează fără înscriere
Opțiuni avansate
Rezultatul
Tokens scade. Obține mai multe tokens
Vrei rezultate mai bune? Modele premium (GPT-5, Claude, Gemini) oferă o calitate mai mare. Vizualizare planuri

❤️ Love this tool? Share it!

Inscrie-te pentru a obține o legătură de referință și câștiga 25.000 de tokeni pe prieten.

Vrei mai mult? Inregistreaza-te gratis pentru 30K tokens/zi + 10K bonus
Inscrie-te gratis

Prelucrarea cererii...

Transformă PDF-urile scanate în text selectabil, căutabil. Tesseract, GOT-OCR2, și motoare OCR premium. 99 de limbi. Gratuit.

Cum să utilizaţi PDF OCR

1
Introduceți intrarea

Tastați text, încărcați un fișier sau descrieți ce doriți. Nu este nevoie de cont.

2
Click generare

IA noastra proceseaza cererea ta in secunde folosind cele mai bune modele de open-source.

3
Descărcați & împărțiți

Descărcaţi, copiaţi sau împărtăşiţi rezultatul. Gratuit pentru utilizare personală şi comercială.

Folosește acest instrument prin API

Automatizați acest instrument din propriul cod. Endpoint REST-compatibil cu OpenAI, Bearer-token auth, nu este necesar SDK suplimentar. Costurile token corespunde interfață web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Transformă PDF-urile scanate (numai imagini, text neselecționabile) în text cautabil, copiabil, lectibil pentru IA. Încarcă un PDF de pagini scanate — facturi, contracte, cărți vechi, note scrise pe mână — și obține înapoi textul simplu,.docx, sau text numărat pe pagină.

Aproximativ 500 de tokens pe pagina noastră de auto-hosted Tesseract OCR (gratuit). GOT-OCR2 costă ~800/page și se ocupă de layouturi complexe (multi-coluna, tabele, ecuații) mai bine. Fal Premium OCR rulează ~2.500/page pentru cea mai mare precizie pe scanări degradate. etaj de 800-token pe toate trei astfel că 1-page încărcare nu sunt puri supraveghere.

Tesseract (defectuos, gratuit) pentru scanări curat tipărite. GOT-OCR2 (gratuit, lent) pentru documente de cercetare multi-columna, ecuații științifice sau documente din limba asiatică - are un model de layout mult mai bun. Premium fal OCR doar pentru scanări degradate / de rezoluție scăzută / istorice în cazul în care fiecare pixel contează.

Tesseract suportă 100+ limbi, inclusiv latină, chineză, japoneză, coreeană, arabă, cirilică, ebraică, hindi, tailandeză, vietnameză. Pass un indiciu limbaj (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) pentru 30-50% mai bună precizie — auto-detectare lucrări, dar este mai lent.

Trei:.txt (plain, un fișier pentru întregul document),.docx (Cuvântul cu pauze de pagină conservate), și.txt (== Pagina N = Entități între pagini astfel încât să puteți găsi o pagină specifică în ieșire).

Pe scanări curate de 300-DPI, 99%+ pe scriptul tipărit latin. Pune la 90-95% pe scanări de 150-DPI, documente dispersate, sau scris la mână. Scripturi non-Latine (Chinez, Arab, Hindi) fac mult mai bine cu un indiciu limbaj și GOT-OCR2 mai degrabă decât Tesseract.

Scrierea manuală OCR este mult mai dificilă decât textul imprimat — se așteaptă la precizie de 70-85% chiar și pe OCR premium. Pentru formele curate cu imprimare manuală (nu cursive) pe hârtie albă, Tesseract este utilizabil. Pentru note cursive / messy, premium fal OCR cu modul de scris manual este mai fiabil.

Aproximativ 1-3 secunde pe pagina de pe Tesseract, 3-5 secunde pe GOT-OCR2, 5-10 secunde pe premium fal. O carte scanată de 50 de pagini durează 1-3 minute — bannerul de sarcină grea vă permite să închideți tab și obțineți rezultatul e-mail-ul atunci când se termină.

Nu. PDF-urile încărcate sunt rasterizate, OCR pagina pe pagina, apoi șterse. Fișierul de ieșire este păstrat pe CDN nostru timp de 24 de ore (7 zile pe un plan plătit) la link-ul share.

Nu direct. Deblocați-l la /pdf/unlock/ primul (dacă aveți parola), apoi întoarceți-vă. Detectăm criptare la încărcare și legăm-vă la instrumentul de deblocare.

Free.ai este gratuit, oferă 3 motoare OCR (alege după tip doc), suportă 99 de limbi, și oferă o API publică. Adobe Acrobat Pro (19.99$/mo, 1 motor), ABBY FineReader (199$ o dată, fără API), Smallpdf (9/mo, 1 motor). Calitatea noastră OCR pentru scanări curate se potrivește cu Adobe; pe scanari premium rivals ABBYY.

Da — POST multipart to /v1/pdf/ocr / cu fișier + limba + model + output_format câmpuri. Cota endpoint: /v1/pdf/ocr-quote/?pages=N&model=M. Rețeta completă de curl la /api /.

Inscrie-te gratis pentru 30.000 de tokeni

Creează cont liber

Nu sunt necesare carduri de credit

Cum ai evalua acest instrument?

Love this tool? Share it!