PDF OCR

Dùng thương mại được. 380+ mô hình Không dấu nước Không cần đăng ký
Mô hình:
+ GPT-5, Claude, Gemini
Đổi một PDF đã quét thành văn bản có thể chọn và tìm kiếm. Raster hóa mỗi trang ở 200 DPI và chạy OCR — chọn Tesseract (nhanh, miễn phí), GOT- OCR2 (tốt hơn cho nhiều cột + bảng), hoặc OCR fal cao cấp (tốt nhất cho quét bị giảm chất lượng/ lịch sử). Xuất thành.txt,.docx, hoặc văn bản có nhãn trang. Có ảnh, không phải là PDF? Dùng /ocr/ →

Kéo một PDF đã quét tới đây hoặc nhấn để tải lên

PDF lên đến 50 MB. Làm việc trên PDF quét + chỉ ảnh. Có thể chọn văn bản chưa? Bạn không cần OCR.

·
PDF này đã có văn bản có thể chọn — bạn có thể không cần OCR. Thử trình tóm tắt →
Mật khẩu bảo vệ — mở khóa nó trước. Mở khóa PDF
Tesseract cho các bản in quét sạch. GOT- OCR2 cho giấy nhiều cột + văn bản châu Á. Chỉ cao cấp khi từng điểm ảnh quan trọng.
Gợi ý ngôn ngữ tăng tốc Tesseract 2-3 lần và tăng độ chính xác 30-50% trên các văn bản không phải Latin.
Ước tính token
Mua tiền mặt
Tải lên một PDF để xem chi phí chính xác.
Kết quả OCR
Tải về

        

Khi nào nên dùng OCR PDF

Hóa đơn + nhận tiền

Đổi một đống hóa đơn quét thành văn bản có thể chỉnh sửa cho kế toán, hoàn trả, hoặc tự động hóa AP.

Sách cũ + lưu trữ

Số hóa sách đã hết hạn in, tài liệu lịch sử, hoặc lưu trữ thư viện thành văn bản có thể tìm kiếm.

Bản ghi pháp lý + y tế

Mở khóa văn bản bên trong các tập tin trường hợp được quét, báo cáo y tế, hoặc tài liệu fax cho các luồng công việc phát hiện + eDiscovery.

Trước khi dịch

Chạy OCR để trích xuất văn bản, sau đó đưa kết quả vào /pdf/translator/ để chuyển đổi bất kỳ ngôn ngữ nào.

Free.ai PDF OCR vs các công cụ trả tiền

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Giá khởi đầuTự do$19.99/mo$199 one-time$9/mo
Chọn bộ máy OCR (3)
Ngôn ngữ100+40+200+20+
API công cộng
Không cần đăng ký
Tùy chọn cao cấp
Kết quả
Tiền hết rồi. Lấy thêm biểu tượng
Muốn kết quả tốt hơn? Các mẫu cao cấp (GPT-5, Claude, Gemini) cung cấp chất lượng cao hơn. Xem kế hoạch

❤️ Love this tool? Share it!

Đăng ký để nhận được một liên kết giới thiệu và kiếm được 25.000 token cho mỗi người bạn.

Muốn thêm nữa không? Đăng ký miễn phí 30K token/ngày + 10K thưởng
Đăng ký miễn phí

Đang xử lý yêu cầu của bạn...

Đổi PDF đã quét thành văn bản có thể chọn, tìm kiếm. Tesseract, GOT-OCR2, và các công cụ OCR cao cấp. 99 ngôn ngữ. Miễn phí.

Cách sử dụng PDF OCR

1
Nhập thông tin

Nhập văn bản, tải lên tập tin, hoặc mô tả điều bạn muốn. Không cần tài khoản.

2
Nhấn để tạo

AI của chúng tôi xử lý yêu cầu của bạn trong vài giây sử dụng các mô hình nguồn mở tốt nhất.

3
Tải về và chia sẻ

Tải xuống, sao chép, hoặc chia sẻ kết quả của bạn. Miễn phí cho sử dụng cá nhân và thương mại.

Dùng công cụ này qua API

Tự động hóa công cụ này từ mã của bạn. Điểm kết thúc REST tương thích với OpenAI, xác thực bằng token của người mang, không cần SDK bổ sung. Chi phí token tương ứng với giao diện web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Đổi PDF quét (chỉ hình ảnh, văn bản không chọn) thành văn bản có thể tìm kiếm, sao chép, đọc AI. Tải lên một PDF của các trang quét — hóa đơn, hợp đồng, sách cũ, ghi chú viết tay — và lấy lại văn bản đơn giản,.docx, hoặc văn bản có số trang.

Khoảng 500 token mỗi trang trên Tesseract OCR tự lưu của chúng tôi (mở cấp). GOT- OCR2 có giá ~800/ trang và xử lý các bảng phức tạp (nhiều cột, bảng, phương trình) tốt hơn. Premium fal OCR chạy ~2. 500/ trang cho độ chính xác cao nhất trên các bản quét bị giảm chất lượng. 800 token trên cả ba vì vậy việc tải lên 1 trang không phải là chi phí tổng thể.

Tesseract (mặc định, miễn phí) cho các bản quét in sạch. GOT- OCR2 (miễn phí, chậm hơn) cho các bài nghiên cứu nhiều cột, phương trình khoa học, hoặc tài liệu tiếng châu Á — nó có mô hình bố trí tốt hơn nhiều. Premium fal OCR chỉ cho các bản quét bị suy giảm / độ phân giải thấp / lịch sử nơi mà từng điểm ảnh đều quan trọng.

Tesseract hỗ trợ hơn 100 ngôn ngữ bao gồm Latin, Trung Quốc, Nhật Bản, Hàn Quốc, Ả Rập, Cyrillic, Hebrew, Hindi, Thái, Việt Nam. Cho một gợi ý ngôn ngữ (en/spa/fra/deu/jpn/chi_sim/ara/v.v.) cho độ chính xác tốt hơn 30-50% — tự động phát hiện hoạt động nhưng chậm hơn.

Ba:.txt (phẳng, một tập tin cho toàn bộ tài liệu),.docx (Word với các đoạn tách trang được bảo tồn), và.txt theo trang (===== Page N ===== headers giữa các trang để bạn có thể tìm thấy một trang cụ thể trong kết quả).

Trên các bản quét 300- DPI sạch, 99%+ trên chữ Latinh in. Thấp hơn 90- 95% trên các bản quét 150- DPI, tài liệu bị phai màu, hoặc chữ viết tay. Các chữ không Latinh (Trung Quốc, Ả Rập, Hindi) làm tốt hơn nhiều với gợi ý ngôn ngữ và GOT- OCR2 hơn là Tesseract.

OCR chữ viết tay khó hơn nhiều so với văn bản in — đợi độ chính xác 70- 85% ngay cả với OCR cao cấp. Đối với các mẫu in tay sạch (không phải chữ nghiêng) trên giấy trắng, Tesseract có thể dùng được. Đối với ghi chú nghiêng / lộn xộn, OCR chữ viết tay cao cấp có thể tin cậy hơn.

Khoảng 1-3 giây mỗi trang trên Tesseract, 3-5 giây trên GOT-OCR2, 5-10 giây trên fal cao cấp. một cuốn sách 50 trang được quét mất 1-3 phút — cờ nặng nhiệm vụ cho phép bạn đóng thẻ và nhận kết quả qua email khi nó kết thúc.

Không. Các PDF đã tải lên sẽ được raster hóa, OCRed trang theo trang, sau đó bị xóa. Tập tin xuất được lưu trên CDN của chúng tôi trong 24 giờ (7 ngày trên kế hoạch trả phí) tại liên kết chia sẻ.

Không phải trực tiếp. Mở khóa nó tại /pdf/unlock/ trước (nếu bạn có mật khẩu), rồi quay lại. Chúng tôi sẽ phát hiện mã hóa khi tải lên và liên kết bạn đến công cụ mở khóa.

Free.ai là miễn phí, cung cấp 3 động cơ OCR (bỏ chọn theo loại tài liệu), hỗ trợ 99 ngôn ngữ, và có API công cộng. Adobe Acrobat Pro ($19.99/tháng, 1 động cơ), ABBYY FineReader ($199 một lần, không API), Smallpdf ($9/tháng, 1 động cơ).

Truy cập ngày 1 tháng 1 năm 2011.  ^ “Yes — POST multipart to /v1/pdf/ocr/ with file + language + model + output_format fields”.

Đăng ký miễn phí 30,000 token

Tạo tài khoản miễn phí

Không cần thẻ tín dụng

Anh đánh giá công cụ này thế nào?

Love this tool? Share it!