PDF OCR

Naudojimas komerciniais tikslais 380+ modeliai Nėra vandens ženklo Nėra reikalo pasirašyti
Modelis:
+ GPT-5, Claude, Gemini
Pasukite nuskaitytą PDF į pasirinktą, ieškomą tekstą. Kiekvienas puslapis yra 200 DPI ir veikia OCR — pasirinkite Tesseract (greitas, nemokamas), GOT-OCR2 (geresnis kelių stulpelių + lentelių), arba aukščiausios klasės OCR (geriausias sugedęs / istorinis nuskaitymo). Išvestis kaip.txt,.docx, arba puslapio pažymėtas tekstas. Turi paveikslėlį, o ne PDF? Naudojimas / ocr/ →

Spauskite nuskaitytą PDF čia arba spustelėkite norėdami įkelti

PDF iki 50 MB. Darbai naudojant nuskaitytus + tik vaizdo PDF. Jau pasirenkamas tekstas? Jums nereikia OCR.

·
Šis PDF jau turi pasirinktą tekstą — jums gali nereikėti OCR. Pabandykite summarizer →
Slaptažodžiu apsaugoti - atrakinti jį pirmas. Atrakinti PDF →
Tesseract švariai atspausdintiems skenavimui. GOT-OCR2 daugiakolonė popierius + Azijos scenarijai. Premium tik tada, kai yra svarbus kiekvienas pikselis.
Kalbų patarimas pagreitina Tesseract 2-3× ir padidina tikslumą 30-50% nelotyniškų scenarijų.
Įvertis tokenu
Pirkimo žetonai
Įkelkite PDF norėdami pamatyti tikslią kainą.
OCR rezultatas
Atsiųsti

        

Kada naudoti PDF OCR

Sąskaitos faktūros + kvitai

Pasukite skenuotų sąskaitų krūvą į redaguojamą tekstą buhalterijos, kompensavimo, arba AP automatizavimo.

Senos knygos + archyvai

Suskaitmeninkite nespausdintas knygas, istorinius dokumentus ar bibliotekos archyvus į ieškomą tekstą.

Teisiniai ir medicininiai įrašai

Atrakinti tekstą viduje skenuotų bylų failus, medicinos ataskaitas, arba faksu dokumentai atradimas + eDiscovery darbiniai srautai.

Prieš vertimą

Paleisti OCR išgauti tekstą, tada šerti rezultatą /pdf/translator / bet kokios kalbos konvertavimo.

Free.ai PDF OCR vs mokamų priemonių

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Pradinė kainaNeapmuitinama$19.99/mo$199 one-time$9/mo
Pasirinkti OCR variklį (3)
Kalbos100+40+200+20+
Vieša API
Darbai be prisijungimo
Sudėtingesnės parinktys
Rezultatas
Maži žetonai. Gaukite daugiau žetonų
Nori geresnių rezultatų? Premium modeliai (GPT-5, Claude, Gemini) užtikrina geresnę kokybę. Peržiūrėti planus

❤️ Love Free.ai? Tell your friends!

Sign up norėdami gauti kreipimosi nuorodą ir uždirbti 25,000 žetonų vienam draugui.

Nori daugiau? Užsiregistruoti nemokamai 30K žetonams per dieną + 10K bonusas
Užsiregistruoti nemokamai

Apdorokite savo užklausą...

Skenuoti PDF į pasirinktą, paieškos tekstą. Tesseract, GOT-OCR2, ir premium OCR varikliai. 99 kalbos. Nemokamas.

Kaip vartoti PDF OCR

1
Įveskite įvedinį

Įveskite tekstą, įkelkite failą arba apibūdinkite ką norite. Sąskaitos nereikia.

2
Spustelėkite generavimą

Mūsų AI apdoroja Jūsų užklausą per kelias sekundes, naudodami geriausius atviro kodo modelius.

3
Atsisiųsti ir dalintis

Atsisiųskite, nukopijuokite arba pasidalinkite savo rezultatais. Nemokamas asmeniniam ir komerciniam naudojimui.

Naudoti šį įrankį per API

Automatizuoti šį įrankį iš savo kodo. OpenAI suderinama REST vertinamoji baigtis, Beaker-token auth, papildomų SDK nereikia. Token išlaidos atitinka interneto sąsają.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Pasukite nuskaitytus PDF (tik atvaizdą, nepasirinktas tekstas) į paiešką, nukopijuoti, AI skaitomą tekstą. Įkelkite nuskaitytų puslapių PDF – sąskaitas faktūras, sutartis, senas knygas, rašytas užrašas – ir atsiųskite paprastą tekstą,.docx, arba puslapio numeriu pažymėtą tekstą.

Apie 500 markių per puslapį mūsų savarankiškai-hosteract OCR (nemokamas). GOT-OCR2 kainuoja ~800/puslapis ir rankenos sudėtingų išdėstymų (daugi stulpeliai, lentelės, lygtys) geriau. Premium fal OCR veikia ~2500/puslapis dėl aukščiausio tikslumo sugedusios skenavimas. 800-token grindys visų trijų taip 1-lapis įkeltos nėra grynas orinis.

Tesseract (numatytasis, nemokamas) švariai atspausdintas skenavimas. GOT-OCR2 (laisvas, lėtesnis) daugiakolonėms studijoms, mokslinėms lygtybėms ar Azijos kalbos dokumentams – jis turi daug geresnį išdėstymo modelį. Premium fal OCR tik pablogėjusio / mažo raiškos / istorinio nuskaitymo, kai kiekvienas pikselis yra svarbus.

Tesseract palaiko 100+ kalbų, įskaitant lotynų, kinų, japonų, korėjiečių, arabų, kirilica, hebrajų, hindi, tajų, Vietnamiečių. Perduoti kalbos patarimą (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) už 30-50% geresnį tikslumą – automatinio nustatymo darbų, bet yra lėtesnis.

Trys:.txt (plginti, vienas failas visam dokumentui),.docx (Žr. su puslapio pertraukomis išsaugotas) ir puslapio-veidrodis.txt (==== Puslapis N===== Antraštės tarp puslapių, kad jūs galite rasti konkretų puslapį išvesties).

Ant švaraus 300-DPI skenavimas, 99%+ ant spausdinto lotyniško scenarijaus. Numetama iki 90-95% 150-DPI skenavimas, išblukę dokumentai, arba ranka rašymas. Ne lotynų scenarijai (Kinijos, Arabų, Hindi) padaryti daug geriau su kalbos patarimą ir GOT-OCR2, o ne Tesseract.

Rankinis spausdinimas OCR yra daug sunkiau nei spausdintas tekstas - tikėtis 70-85% tikslumas net premium OCR. Dėl švarių rankomis atspausdintų formų (ne curesive) ant balto popieriaus, Tesseract yra naudojamas. Kūrybinių / netvarkingų užrašų, premium fal OCR su ranka spausdinimo režimas yra patikimesnis.

Apie 1-3 sekundžių per puslapį apie Tesseract, 3-5 sekundžių GOT-OCR2, 5-10 sekundžių dėl aukščiausios kokybės fiktyvus. 50-lapų skenuota knyga trunka 1-3 minutes — sunkiųjų užduočių vėliava leidžia jums uždaryti skirtuką ir gauti rezultatą elektroniniu paštu, kai ji baigiasi.

Ne. Įkeltas PDF yra rastrasterizuotos, OCRed puslapis pagal puslapį, tada ištrinta. Išvedimo failas yra laikomas mūsų CDN 24 valandas (7 dienas mokamą planą) ne akcijų nuorodą.

Ne tiesiogiai. Atrakinkite jį ties /pdf/atrakinti/ pirmas (jei turite slaptažodį), tada grįšite atgal. Įkeldami užšifruojame užšifravimą ir susiejame jus su atrakinimo įrankiu.

Free.ai yra nemokama, siūlo 3 OCR varikliai (pick pagal doc tipo), palaiko 99 kalbos, ir laivai viešas API. Adobe Acrobat Pro ($19.99/mo, 1 variklis), ABBY FineReader ($199 vieną kartą, ne API), Smallpdf ($9/mo, 1 variklis). Mūsų OCR kokybė švaraus skenavimo atitinka Adobe; istorinis skenavimas aukščiausios klasės varžovai ABBYY.

Taip — Pocket multipart to /v1/pdf/ocr/ with file + language + output_format laukai.Kitas tikslas: /v1/pdf/ocr-quote/?pages=N&model=M. Pilnas garbanos receptas ne /api/.

Užsiregistruoti nemokamai 30,000 žetonų

Sukurti nemokamą paskyrą

Kredito kortelės nereikia

Kaip vertinate šį įrankį?

Like this tool? Share it!