PDF OCR

상업적 사용 OK 380+ 모델 워터마크 없음 가입이 필요하지 않습니다
모델:
+ GPT-5, Claude, Gemini
스캔된 PDF를 선택 가능한 검색 가능한 텍스트로 변환합니다. 각 페이지를 200 DPI로 래스터화하고 OCR을 실행합니다. Tesseract(빠르고 무료), GOT-OCR2(다중 열 + 테이블에 적합) 또는 프리미엄 fal OCR(하향/이력 스캔에 적합)을 선택하십시오..txt,.docx 또는 페이지 라벨 텍스트로 출력합니다. PDF가 아닌 이미지가 있으신가요? /ocr/ 를 사용해 보세요 →

스캔한 PDF를 여기로 드래그하거나 업로드하려면 클릭하십시오.

PDF 최대 50 MB. 스캔 + 이미지 전용 PDF에서 작동합니다. 이미 텍스트 선택 가능? OCR이 필요하지 않습니다.

·
이 PDF에는 이미 선택 가능한 텍스트가 있습니다. OCR이 필요하지 않을 수 있습니다. 요약기를 시도해 보세요 →
암호로 보호된 — 먼저 잠금을 해제하십시오. PDF 잠금 해제 →
깨끗한 인쇄 스캔을 위한 Tesseract. 다열 종이 + 아시아 스크립트를 위한 GOT-OCR2. 모든 픽셀이 중요한 경우에만 프리미엄.
언어 힌트는 테세랙트의 속도를 2-3배 향상시키고 비라틴 문자에 대한 정확도를 30-50% 향상시킵니다.
토큰 추정
토큰을 구입하세요
정확한 비용을 보려면 PDF를 업로드하십시오.
OCR 결과
다운로드

        

PDF OCR을 사용할 때

청구서 + 영수증

스캔된 청구서 스택을 편집 가능한 텍스트로 변환하여 부서 관리, 환불 또는 AP 자동화를 위해 사용할 수 있습니다.

오래된 책 + 아카이브

판매 중단된 책, 역사 문서 또는 도서관 아카이브를 검색 가능한 텍스트로 디지털화합니다.

법적 + 의료 기록

검색 + eDiscovery 워크플로우를 위해 스캔된 사례 파일, 의료 보고서 또는 팩스 문서 내의 텍스트 잠금을 해제합니다.

번역하기 전

OCR을 실행하여 텍스트를 추출한 다음 결과를 /pdf/translator/에 입력하여 어떤 언어로든 변환할 수 있습니다.

Free.ai PDF OCR 대 유료 도구

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
시작 가격자유$19.99/mo$199 one-time$9/mo
OCR 엔진 선택 (3)
언어100+40+200+20+
공개 API
가입없이 작동
고급 옵션
결과
토큰이 부족해요 더 많은 토큰을 얻으십시오
더 나은 결과를 원하십니까? 프리미엄 모델 (GPT-5, Claude, Gemini) 보다 높은 품질을 제공합니다. 계획 보기

❤️ Love this tool? Share it!

가입 추천 링크를 얻을 수 있으며 친구 당 25,000 토큰을 적립합니다.

더 먹고 싶어? 하루 30K 토큰 + 10K 보너스를 무료로 가입하세요
무료로 가입하세요

귀하의 요청을 처리 중...

스캔된 PDF를 선택 가능한 검색 가능한 텍스트로 변환합니다. Tesseract, GOT-OCR2, 프리미엄 OCR 엔진. 99개 언어. 무료.

사용 방법 PDF OCR

1
입력을 입력하십시오

텍스트를 입력하거나 파일을 업로드하거나 원하는 내용을 설명하세요. 계정이 필요하지 않습니다.

2
생성하기를 클릭하십시오

당사의 AI는 최고의 오픈 소스 모델을 사용하여 몇 초 만에 요청을 처리합니다.

3
다운로드 및 공유

다운로드, 복사 또는 결과를 공유. 개인 및 상업용 무료.

API를 통해 이 도구를 사용

이 도구를 자신의 코드로 자동화하세요. OpenAI 호환 REST 엔드포인트, 베어러 토큰 인증, 추가 SDK 필요 없음. 토큰 비용은 웹 인터페이스와 일치합니다.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

스캔된 PDF(이미지 전용, 선택할 수 없는 텍스트)를 검색 가능하고 복사 가능한 AI 판독 가능한 텍스트로 변환합니다. 청구서, 계약서, 오래된 책, 손으로 쓴 메모 등 스캔된 페이지의 PDF를 업로드하고 일반 텍스트,.docx 또는 페이지 번호가 붙은 텍스트를 다시 가져옵니다.

페이지당 약 500 토큰의 테세라크트 OCR(무료 계층). GOT-OCR2는 페이지당 약 800 토큰이 들며 복잡한 레이아웃(다중 열, 테이블, 방정식)을 더 잘 처리합니다. 프리미엄 fal OCR은 손상된 스캔에서 최고의 정확도를 위해 페이지당 약 2,500 토큰을 사용합니다.

깨끗한 인쇄 스캔을 위한 Tesseract (기본값, 무료). 다열 연구 논문, 과학 방정식, 아시아 언어 문서를 위한 GOT-OCR2 (무료, 느리다) — 훨씬 더 나은 레이아웃 모델을 가지고 있습니다. 프리미엄 fal OCR은 모든 픽셀이 중요한 퇴화 / 저해상도 / 역사 스캔에만 사용할 수 있습니다.

Tesseract는 라틴어, 중국어, 일본어, 한국어, 아랍어, 키릴 문자, 히브리어, 힌디어, 태국어, 베트남어를 포함한 100개 이상의 언어를 지원합니다. 언어 힌트를 전달하면 (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) 30-50% 더 나은 정확도를 얻을 수 있습니다. — 자동 감지는 작동하지만 느립니다.

세 가지:.txt (일반, 전체 문서에 대한 하나의 파일),.docx (페이지 브레이크가 보존된 워드), 페이지별.txt (===== 페이지 N ===== 페이지 사이의 헤더로 출력에서 특정 페이지를 찾을 수 있습니다.)

깨끗한 300 DPI 스캔에서 인쇄된 라틴 문자의 99% 이상. 150 DPI 스캔, 변색된 문서 또는 손글씨에서 90-95%로 감소합니다. 비라틴 문자 (중국어, 아랍어, 힌디어)는 Tesseract 대신 언어 힌트 및 GOT-OCR2로 훨씬 더 잘 작동합니다.

손글씨 OCR은 인쇄된 텍스트보다 훨씬 어렵습니다. 프리미엄 OCR에서도 70-85%의 정확도를 기대하십시오. 흰 종이에 깨끗한 손으로 인쇄 된 양식 (이탈리아어가 아닌)을 위해 Tesseract를 사용할 수 있습니다. 이탈리아어 / 엉망진창 노트를 위해 프리미엄 fal OCR은 손글씨 모드가 더 신뢰할 수 있습니다.

Tesseract에서 페이지당 약 1-3초, GOT-OCR2에서 3-5초, 프리미엄 fal에서 5-10초. 50페이지의 스캔된 책은 1-3분이 걸립니다. 큰 크기의 배너를 통해 탭을 닫고 완료되면 결과를 이메일로 보낼 수 있습니다.

아니요. 업로드된 PDF는 래스터화되고, 페이지별로 OCRed가 처리한 후 삭제됩니다. 출력 파일은 공유 링크에서 24시간 동안(유료 플랜의 경우 7일) 저희 CDN에 보관됩니다.

직접적으로는 아닙니다. 먼저 /pdf/unlock/에서 잠금을 해제하십시오 (비밀번호가 있으면), 다음에 다시 오십시오. 업로드 시 암호화를 감지하고 잠금 해제 도구로 연결합니다.

Free.ai은 무료이며, 3개의 OCR 엔진을 제공합니다(문서 유형별로 선택), 99개의 언어를 지원하며 공개 API를 제공합니다. 어도비 아크로바트 프로(19.99달러/월, 1개의 엔진), ABBYY FineReader(199달러/월, API 없음), Smallpdf(9달러/월, 1개의 엔진). 깨끗한 스캔에 대한 우리의 OCR 품질은 어도비와 일치하며, 역사적 스캔에 대한 프리미엄 품질은 ABBYY와 경쟁합니다.

예 — 파일 + 언어 + 모델 + output_format 필드를 포함한 멀티파트를 /v1/pdf/ocr/로 POST합니다. 인용 끝점: /v1/pdf/ocr-quote/?pages=N&model=M. /api/에 있는 전체 컬 레시피.

30,000 토큰을 무료로 등록하세요

무료 계정 만들기

신용카드 필요 없음

이 도구를 어떻게 평가하시겠습니까?

Love this tool? Share it!