PDF OCR

Naudojimas komerciniais tikslais 567 modeliai Nėra vandens ženklo Nėra reikalo pasirašyti
Modelis:
+ GPT-5, Claude, Gemini
Pasukite nuskaitytą PDF į pasirinktą, ieškomą tekstą. Kiekvienas puslapis yra 200 DPI ir veikia OCR — pasirinkite Tesseract (greitas, nemokamas), GOT-OCR2 (geresnis kelių stulpelių + lentelių), arba aukščiausios klasės OCR (geriausias sugedęs / istorinis nuskaitymo). Išvestis kaip.txt,.docx, arba puslapio pažymėtas tekstas. Turi paveikslėlį, o ne PDF? Naudojimas / ocr/ →

Spauskite nuskaitytą PDF čia arba spustelėkite norėdami įkelti

PDF iki 50 MB. Darbai naudojant nuskaitytus + tik vaizdo PDF. Jau pasirenkamas tekstas? Jums nereikia OCR.

-
- · -
Šis PDF jau turi pasirinktą tekstą — jums gali nereikėti OCR. Pabandykite summarizer →
Slaptažodžiu apsaugoti - atrakinti jį pirmas. Atrakinti PDF →
Tesseract švariai atspausdintiems skenavimui. GOT-OCR2 daugiakolonė popierius + Azijos scenarijai. Premium tik tada, kai yra svarbus kiekvienas pikselis.
Kalbų patarimas pagreitina Tesseract 2-3× ir padidina tikslumą 30-50% nelotyniškų scenarijų.
Įvertis tokenu
-
Pirkimo žetonai
Įkelkite PDF norėdami pamatyti tikslią kainą.
OCR rezultatas
Atsiųsti

        

Kada naudoti PDF OCR

Sąskaitos faktūros + kvitai

Pasukite skenuotų sąskaitų krūvą į redaguojamą tekstą buhalterijos, kompensavimo, arba AP automatizavimo.

Senos knygos + archyvai

Suskaitmeninkite nespausdintas knygas, istorinius dokumentus ar bibliotekos archyvus į ieškomą tekstą.

Teisiniai ir medicininiai įrašai

Atrakinti tekstą viduje skenuotų bylų failus, medicinos ataskaitas, arba faksu dokumentai atradimas + eDiscovery darbiniai srautai.

Prieš vertimą

Paleisti OCR išgauti tekstą, tada šerti rezultatą /pdf/translator / bet kokios kalbos konvertavimo.

Free.ai PDF OCR vs mokamų priemonių

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Pradinė kainaNeapmuitinama$19.99/mo$199 one-time$9/mo
Pasirinkti OCR variklį (3)---
Kalbos100+40+200+20+
Vieša API---
Darbai be prisijungimo---
Sudėtingesnės parinktys
Rezultatas
Ženklai bėga. Gaukite daugiau žetonų
Nori geresnių rezultatų? Pirminės įmokos modeliai (GPT-5, Claude, Gemini) užtikrina geresnę kokybę. Peržiūrėti planus

❤️ Love Free.ai? Tell your friends!

Sign up gauti kreipimosi nuorodą ir uždirbti 30,000 žetonų už draugą.

Norite daugiau? Užsiregistruoti nemokamai: 30,000 žetonų per dieną
Pasirašyti nemokamai

Apdorokite jūsų prašymą...

Skenuoti PDF į pasirinktą, paieškos tekstą. Tesseract, GOT-OCR2, ir premium OCR varikliai. 99 kalbos. Nemokamas.

Kaip vartoti PDF OCR

1
Įveskite savo įvesties failą

Įveskite tekstą, įkelkite failą arba aprašykite, ko norite. Sąskaitos nereikia.

2
Spustelėkite generavimą

Mūsų AI apdoroja Jūsų užklausą per kelias sekundes, naudodami geriausius atviro kodo modelius.

3
Parsiųsti ir dalintis

Atsisiųskite, nukopijuokite arba pasidalinkite savo rezultatais. Nemokamas asmeniniam ir komerciniam naudojimui.

Naudoti šį įrankį per API

Automatizuoti šį įrankį iš savo kodo. Atviras suderinamas REST rezultatas, Beaker-token auth, nereikia papildomų SDK. Atkurti išlaidas atitinka interneto sąsają.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

Įveskite nuskaitytus PDF (tik atvaizdui, nepasirinktinam tekstui) į paieškos, nukopijuojamą, AI skaitomą tekstą. Įkelkite nuskaitytų puslapių PDF - sąskaitų faktūrų, sutarčių, senų knygų, užrašų - ir grąžinkite paprastą tekstą,.docx arba puslapio numeriu pažymėtą tekstą.

Apie 500 markių per puslapį mūsų savarankiškai-hosteract OCR (nemokamas). GOT-OCR2 kainuoja ~800/puslapis ir rankenos sudėtingų išdėstymų (daugi stulpeliai, lentelės, lygtys) geriau. Premium fal OCR veikia ~2500/puslapis dėl aukščiausio tikslumo sugedusios skenavimas. 800-token grindys visų trijų taip 1-lapis įkeltos nėra grynas orinis.

Tesseract (numatyta, nemokama) švariai spausdinti skenavimui. GOT-OCR2 (laisvas, lėtesnis) daugiakolonėms studijoms, mokslinėms lygtims ar Azijos kalbos dokumentams - tai turi daug geresnį išdėstymo modelį. Premium fal OCR tik sugedusiam / mažai raiškam / istoriniam skenavimui, kai kiekvienas pikselis svarbus.

Tesseract palaiko 100+ kalbų, įskaitant lotynų, kinų, japonų, korėjiečių, arabų, kirilikų, hebrajų, hindi, tajų, Vietnamiečių. Perduoti kalbos patarimą (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) už 30-50% geresnį tikslumą - automatinio nustatymo darbus, bet yra lėtesnis.

Trys:.txt (plginti, vienas failas visam dokumentui),.docx (Žr. su puslapio pertraukomis išsaugotas) ir puslapio-veidrodis.txt (==== Puslapis N===== Antraštės tarp puslapių, kad jūs galite rasti konkretų puslapį išvesties).

Ant švaraus 300-DPI skenavimas, 99%+ ant spausdinto lotyniško scenarijaus. Numetama iki 90-95% 150-DPI skenavimas, išblukę dokumentai, arba ranka rašymas. Ne lotynų scenarijai (Kinijos, Arabų, Hindi) padaryti daug geriau su kalbos patarimą ir GOT-OCR2, o ne Tesseract.

Rankinis rašymas OCR yra daug sunkiau nei spausdintas tekstas - tikėtis 70-85% tikslumas net ir ant aukščiausios OCR. Dėl švarių rankų atspaudų formų (ne cresive) ant balto popieriaus, Tesseract yra naudojamas. Kūrybinių / netvarkingų užrašų, premium fal OCR su ranka rašymo režimu yra patikimesnis.

Apie 1-3 sekundžių per puslapį Tesseract, 3-5 sekundžių GOT-OCR2, 5-10 sekundžių premium fal. 50-lapų nuskaitytos knygos trunka 1-3 minutes - sunkiųjų užduočių dangtelis leidžia jums uždaryti skirtuką ir gauti rezultatą elektroniniu paštu, kai ji baigiasi.

Ne. Įkeltas PDF yra rastrasterizuotos, OCRed puslapis pagal puslapį, tada ištrinta. Išvedimo failas yra laikomas mūsų CDN 24 valandas (7 dienas mokamą planą) ne akcijų nuorodą.

Ne tiesiogiai. Atrakinkite jį ties /pdf/atrakinti/ pirmas (jei turite slaptažodį), tada grįšite atgal. Įkeldami užšifruojame užšifravimą ir susiejame jus su atrakinimo įrankiu.

Free.ai yra nemokama, siūlo 3 OCR varikliai (pick pagal doc tipo), palaiko 99 kalbos, ir laivai viešas API. Adobe Acrobat Pro ($19.99/mo, 1 variklis), ABBY FineReader ($199 vieną kartą, ne API), Smallpdf ($9/mo, 1 variklis). Mūsų OCR kokybė švaraus skenavimo atitinka Adobe; istorinis skenavimas aukščiausios klasės varžovai ABBYY.

Taip - Point multidalis į /v1/pdf/ocr/ su failu + kalba + modelis + išvestis_format laukai.Kitata vertinamoji baigtis: /v1/pdf/ocr-quote/?pages=N&model=M. Pilnas garbanos receptas ne /api/.

Užsiregistruoti nemokamai: 30,000 žetonų per dieną

Sukurti nemokamą paskyrą

Kredito kortelės nereikia

Kaip vertinate šį įrankį?

Like this tool? Share it!