PDF OCR

Utilizare comercială OK Modele 567 Fără semn de apă Nu este nevoie de înscriere
Model:
+ GPT-5, Claude, Gemini
Transformă un PDF scanat în text selectabil, care poate fi căutat. Rasteriza fiecare pagină la 200 DPI și rulează OCR — alege Tesseract (gratuit, gratuit), GOT-OCR2 (mai bun pentru multi-coluna + tabele), sau OCR premium (mai bun pentru scanări degradate / istorice). Ieșirea ca.txt,.docx, sau text marcat de pagină. Ai o imagine, nu un PDF? Foloseste /ocr / →

Trage un PDF scanat aici sau click pentru a încărca

PDF până la 50 MB. Funcționează pe PDF scanat + doar imagini. Deja text selectabil? Nu aveți nevoie de OCR.

-
- · -
Acest PDF are deja un text selectabil — s-ar putea să nu aveţi nevoie de OCR. Încearcă Summarizator →
Protejată prin parolă — deblocați-l mai întâi. Deschide PDF →
Tesseract pentru scanări tipărite curate. GOT-OCR2 pentru hârtii multi-columna + scripturi asiatice. Premium doar atunci când fiecare pixel contează.
Limba sugestiv viteze Tesseract 2-3× și sporește precizia 30-50% pe scripturi non-latine.
Valori estimate pentru token
-
Cumpără jetonuri
Încarcă un PDF pentru a vedea costul exact.
Rezultatul OCR
Descărcare

        

Când se utilizează PDF OCR

Facturi + chitanțe

Transformă un stack de facturi scanate în text editabil pentru contabilitate, rambursări sau automatizare AP.

Cărți vechi + arhive

Digitalizează cărțile neimprimate, documentele istorice sau arhivele bibliotecilor în textul care poate fi căutat.

Dosarele legale + medicale

Deblocați textul în fișiere de caz scanate, rapoarte medicale sau documente faxate pentru descoperirea + fluxuri de lucru eDescovery.

Înainte de traducere

Executați OCR pentru a extrage text, apoi furnizați rezultatul în /pdf/translator/ pentru conversia oricărei limbi.

Free.ai PDF OCR vs instrumentele plătite

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Preț de pornireGratuit$19.99/mo$199 one-time$9/mo
Alegeți motorul OCR (3)---
Limbi100+40+200+20+
API publică---
Funcționează fără înscriere---
Opțiuni avansate
Rezultatul
Tokens sunt scăzuti. Obține mai multe tokens
Vrei rezultate mai bune? Modele premium (GPT-5, Claude, Gemini) oferă o calitate mai mare. Vizualizare planuri

❤️ Love Free.ai? Tell your friends!

Inscrie-te pentru a obține un link de referință și câștiga 30.000 de jetonuri pe prieten.

Mai vrei? Inscrie-te gratis: 30.000 tokens/zi
Inregistrează-te gratis

Prelucrarea cererii...

Transformă PDF-urile scanate în text selectabil, căutabil. Tesseract, GOT-OCR2, și motoare OCR premium. 99 de limbi. Gratuit.

Cum să utilizaţi PDF OCR

1
Introduceți intrarea

Tastați text, încărcați un fișier sau descrieți ce doriți. Nu este nevoie de cont.

2
Clic genera

AI-ul nostru procesează cererea ta în secunde folosind cele mai bune modele de surse deschise.

3
Descărcați & împărțiți

Descărcaţi, copiaţi sau împărtăşiţi rezultatul. Gratuit pentru utilizare personală şi comercială.

Folosește acest instrument prin API

Automatizează acest instrument din propriul cod. Îndpoint REST compatibil cu OpenAI, Bearer-token auth, nu este necesar SDK suplimentar. Costurile token corespund interfeței web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

Transformă PDF-urile scanate (sau imagine, text neselectabil) în text cautat, copiabil, licit. Încărcă un PDF de pagini scanate - facturi, contracte, cărți vechi, note scrise pe mână - și obține înapoi text simplu,.docx, sau text numărat de pagină.

Aproximativ 500 de tokens pe pagina noastră de auto-hosted Tesseract OCR (gratuit). GOT-OCR2 costă ~800/page și se ocupă de layouturi complexe (multi-coluna, tabele, ecuații) mai bine. Fal Premium OCR rulează ~2.500/page pentru cea mai mare precizie pe scanări degradate. etaj de 800-token pe toate trei astfel că 1-page încărcare nu sunt puri supraveghere.

Tesseract (defect, gratuit) pentru scanări curat. GOT-OCR2 (gratuit, lent) pentru documente de cercetare multi-columna, ecuații științifice sau documente din limba asiatică - are un model de layout mult mai bun. OCR premium doar pentru scanări degradate / de rezoluție scăzută / istorice în cazul în care fiecare pixel contează.

Teseract suportă 100+ limbi, inclusiv latină, chineză, japoneză, coreeană, arabă, cirilică, ebraică, hindi, tailandeză, vietnameză. Pass un indiciu limbaj (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) pentru 30-50% mai bună precizie - auto-detectare lucrări, dar este mai lent.

Trei:.txt (plain, un fișier pentru întregul document),.docx (Cuvântul cu pauze de pagină conservate), și.txt (== Pagina N = Entități între pagini astfel încât să puteți găsi o pagină specifică în ieșire).

Pe scanări curate de 300-DPI, 99%+ pe scriptul tipărit latin. Pune la 90-95% pe scanări de 150-DPI, documente dispersate, sau scris la mână. Scripturi non-Latine (Chinez, Arab, Hindi) fac mult mai bine cu un indiciu limbaj și GOT-OCR2 mai degrabă decât Tesseract.

Scrierea manuală OCR este mult mai dificilă decât textul imprimat - se aşteaptă precizie 70-85% chiar şi pe premium OCR. Pentru formele curate cu imprimare manuală (nu curzive) pe hârtie albă, Tesseract este utilizabil. Pentru note cursive / messy, premium fal OCR cu modul de scris manual este mai fiabil.

Aproximativ 1-3 secunde pe pagina de pe Tesseract, 3-5 secunde pe GOT-OCR2, 5-10 secunde pe primam fal. O carte scanată de 50 de pagini durează 1-3 minute - bannerul de sarcini grea vă permite să închideți tab și obțineți rezultatul e-mail-ul atunci când se termină.

Nu. PDF-urile încărcate sunt rasterizate, OCR pagina pe pagina, apoi șterse. Fișierul de ieșire este păstrat pe CDN nostru timp de 24 de ore (7 zile pe un plan plătit) la link-ul share.

Nu direct. Deblocați-l la /pdf/unlock/ primul (dacă aveți parola), apoi întoarceți-vă. Detectăm criptare la încărcare și legăm-vă la instrumentul de deblocare.

Free.ai este gratuit, oferă 3 motoare OCR (alege după tip doc), suportă 99 de limbi, și oferă o API publică. Adobe Acrobat Pro (19.99$/mo, 1 motor), ABBY FineReader (199$ o dată, fără API), Smallpdf (9/mo, 1 motor). Calitatea noastră OCR pentru scanări curate se potrivește cu Adobe; pe scanari premium rivals ABBYY.

Da - POST multipart to /v1/pdf/ocr / cu fișier + limba + model + ieșire_format câmpuri. Citată endpoint: /v1/pdf/ocr-quote/?pages=N&model=M. Reţeta completă de curl la /api /.

Inscrie-te gratis: 30.000 tokens/zi

Creează cont liber

Nu este necesară carte de credit

Cum ai evalua acest instrument?

Love Free.ai? Tell your friends!