PDF OCR

Erabilera komertziala Ados 380+ modelo Ur- markarik ez Ez da izen-ematerik behar
Modeloa:
+ GPT-5, Claude, Gemini
Bihurtu eskaneatutako PDF bat testu hautagarri eta bilagarrian. Orrialde bakoitza 200 DPI-tan rasterizatzen du eta OCR exekutatzen du — aukeratu Tesseract (abiadura handikoa, doakoa), GOT-OCR2 (hobe zutabe anitzeko eta taulen eskaneaketan), edo fal OCR premium (hobe eskaneatze degradatuetan/historikoetan). Irteera.txt,.docx edo orrialde-etiketadun testu gisa. Irudi bat duzu, ez PDF bat? Erabili /ocr/ →

Arrastatu eskaneatutako PDF bat hona edo egin klik igotzeko

PDFa, 50 MB arte. Eskaneatutako PDFetan eta irudiak soilik dituztenetan funtzionatzen du. Testua hautatzen al da dagoeneko? Ez duzu OCR behar.

·
PDF honek testu hautagarria du jadanik — baliteke OCRrik ez izatea behar. Saiatu laburtzailea →
Pasahitzarekin babestua — desblokeatu lehenik. Desblokeatu PDFa →
Tesseract inprimatutako eskaneatze garbietarako. GOT-OCR2 zutabe anitzeko paperetarako + Asiako idazkerarako. Premium, pixel bakoitzak garrantzia duenean soilik.
Hizkuntza-iradokizunak Tesseract 2-3x azkarragoa egiten du eta zehaztasuna %30-50 handitzen du latinezko idazkera ez dutenetan.
Tokenaren estimazioa
Erosi tokenak
Igo PDF bat kostu zehatza ikusteko.
OCR emaitza
Deskargatzen

        

Noiz erabili PDF OCR

Fakturak + ordainagiriak

Bihurtu eskaneatutako faktura pila bat testu editagarri bihurtzeko, kontabilitate, itzulketa edo AP automatizaziorako.

Liburu zaharrak + artxiboak

Digitalizatu inprimatu gabe dauden liburuak, dokumentu historikoak edo liburutegiko artxiboak testu bilagarri bihurtzeko.

Legezko eta mediku erregistroak

Desblokeatu eskaneatutako kasu-fitxategien, txosten medikoen edo fax bidez bidalitako dokumentuen testua aurkikuntza + eDiscovery lan-fluxuetarako.

Itzulpenaren aurretik

Exekutatu OCR testua ateratzeko, eta, ondoren, emaitza /pdf/translator/-en sartu edozein hizkuntzatik beste edozeinera bihurtzeko.

Free.ai PDF OCR vs ordaindutako tresnak

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Hasierako prezioaLibre$19.99/mo$199 one-time$9/mo
Hautatu OCR motorra (3)
Hizkuntzak100+40+200+20+
API publikoa
Izena eman gabe funtzionatzen du
Aukerak aurreratuak
Emaitza
Token gutxi. Eskuratu token gehiago
Emaitza hobeak nahi dituzu? Premium modeloak (GPT-5, Claude, Gemini) kalitate hobea ematen dute. Ikusi planoak

❤️ Free.ai maite duzu?

Izen eman erreferentzia-esteka bat lortzeko eta 25.000 token laguneko irabazteko.

Gehiago nahi duzu? Izena eman doan 30K token/egun + 10K bonus
Izena eman doan

Zure eskaera prozesatzen...

Bihurtu eskaneatutako PDFak testu hautagarri eta bilagarri bihurtzeko. Tesseract, GOT-OCR2 eta OCR motor premiumak. 99 hizkuntza. Doakoa.

Nola erabili PDF OCR

1
Sartu zure sarrera

Idatzi testua, igo fitxategi bat edo deskribatu nahi duzuna. Ez da konturik behar.

2
Egin klik sortzean

Gure AI-ak zure eskaera segundotan prozesatzen du, kode irekiko eredurik onenak erabiliz.

3
Deskargatu eta partekatu

Deskargatu, kopiatu edo partekatu zure emaitza. Dohainik erabilpen pertsonal eta komertzialerako.

Erabili tresna hau API bidez

Automatizatu tresna hau zure kodetik. OpenAI-rekin bateragarria den REST amaiera-puntua, eramantzailearen tokenaren autentifikazioa, ez da SDK gehigarririk behar. Tokenen kostuak web-interfazearekin bat datoz.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Bihurtu eskaneatutako PDFak (irudi soilik, testu hautaezina) testu bilagarri, kopiagarri eta AI-k irakur daitekeen testu bihurtzeko. Kargatu eskaneatutako orrialdeen PDF bat —fakturak, kontratuak, liburuak, eskuz idatzitako oharrak— eta berreskuratu testu arrunta,.docx edo orrialde-zenbakidun testua.

Gutxi gorabehera 500 token orri bakoitzeko gure Tesseract OCR auto-ostatuan (geruza librea). GOT-OCR2k ~800 kostatzen du orri bakoitzeko eta diseinu konplexuak (zutabe anitzekoak, taulak, ekuazioak) hobeto kudeatzen ditu. Premium fal OCR-ek ~2.500 orri bakoitzeko exekutatzen du eskaneatze degradatuetan zehaztasun handiena lortzeko. 800 token-eko solairua hiruretan, beraz orri 1-ko igoketak ez dira gainkarga hutsa.

Tesseract (lehenetsia, doakoa) inprimatutako eskaneatze garbietarako. GOT-OCR2 (doakoa, motelagoa) zutabe anitzeko ikerketa-artikuluetarako, ekuazio zientifikoetarako edo asiarreko dokumentuetarako — diseinu-eredu askoz hobea du. Premium fal OCR degradatutako / bereizmen baxukoak / pixel bakoitzak garrantzia duen eskaneatze historikoetarako bakarrik.

Tesseract-ek 100 hizkuntza baino gehiago onartzen ditu, besteak beste, latina, txinera, japoniera, koreera, arabiera, zirilikoa, hebreera, hindia, thaiera eta vietnamera. Hizkuntza-iradokizun bat pasa (eng/spa/fra/deu/jpn/chi_sim/ara/eta abar) %30-50eko zehaztasun handiagoa lortzeko — autodetekzioak funtzionatzen du, baina mantsoagoa da.

Hiru:.txt (arrunta, dokumentu osorako fitxategi bakarra),.docx (Word, orri-jauziak gordetzen dituena) eta orri bakoitzeko.txt (===== Page N ===== orrialdeen arteko goiburua, irteeran orrialde jakin bat aurkitu ahal izateko).

300 dpi-ko eskaneatze garbietan, %99+ inprimatutako latinezko idazkeran. %90-95era jaisten da 150 dpi-ko eskaneatzeetan, dokumentu ilunduetan edo eskuz idatzita. Latinezkoak ez diren idazkera (txinera, arabiera, hindia) askoz hobeto doaz hizkuntza-iradokizun batekin eta GOT-OCR2rekin Tesseract baino.

Eskuz idatzitako OCRa inprimatutako testua baino askoz zailagoa da — %70-85eko zehaztasuna espero daiteke, baita OCR premiumarekin ere. Paper zurian eskuz idatzitako formulario garbietarako (ez kurtsiboa), Tesseract erabilgarria da. Kurtsiboa / ohar nahasia dutenetarako, fal OCR premiuma eskuz idatzitako moduarekin fidagarriagoa da.

1-3 segundo orri bakoitzeko Tesseract-en, 3-5 segundo GOT-OCR2-n, 5-10 segundo premium fal-en. 50 orrialdeko liburu bat eskaneatzeak minutu bat edo hiru behar ditu — lan handiak egiteko banner-ak fitxa ixtea eta emaitza posta elektronikoz jasotzea ahalbidetzen du bukatzean.

Ez. Igotako PDFak rasterizatu egiten dira, OCRed-ek orrialdez orrialde aztertzen ditu eta, ondoren, ezabatzen ditu. Irteerako fitxategia gure CDN-n gordetzen da 24 orduz (7 egun ordaindutako plan batean) partekatze-estekan.

Ez zuzenean. Desblokeatu lehenik /pdf/unlock/-en (pasahitza baduzu), eta itzuli. Enkriptazioa detektatzen dugu kargatzean eta desblokeatzeko tresnara estekatzen zaitugu.

Free.ai doakoa da, 3 OCR motor eskaintzen ditu (dokumentu motaren arabera aukeratu), 99 hizkuntza onartzen ditu eta API publiko bat bidaltzen du. Adobe Acrobat Pro ($19.99/hilean, motor 1), ABBYY FineReader ($199 behin-behinekoa, APIrik gabe), Smallpdf ($9/hilean, motor 1). Gure OCR kalitatea Adoberen parekoa da eskaneaketa garbietan; eskaneaketa historikoetan, premium fal ABBYYren lehiakide da.

Bai — POST multipart /v1/pdf/ocr/-ra fitxategi + hizkuntza + modeloa + irteera_formatua eremuekin. Zita amaierako puntua: /v1/pdf/ocr-quote/?pages=N&model=M. Curl errezeta osoa /api/-n.

Izena eman doan 30.000 token-en truke

Sortu kontu librea

Ez da kreditu-txartelik behar

Nola baloratuko zenuke tresna hau?

Free.ai maite duzu?