PDF OCR

Penggunaan komersial OK 380+ model Tiada tanda air Tiada pendaftaran diperlukan
Model:
+ GPT-5, Claude, Gemini
Tukar PDF yang diimbas kepada teks boleh pilih dan boleh dicari. Rasterkan setiap halaman pada 200 DPI dan jalankan OCR — pilih Tesseract (cepat, percuma), GOT-OCR2 (lebih baik untuk lajur berbilang + jadual), atau OCR fal premium (lebih baik untuk imbasan terdegradasi/sejarah). Output sebagai.txt,.docx, atau teks berlabel halaman. Ada imej, bukan PDF? Guna /ocr/ →

Seret PDF yang diimbas ke sini atau klik untuk muat naik

PDF sehingga 50 MB. Berfungsi pada PDF yang diimbas + imej sahaja. Sudah boleh dipilih teks? Anda tidak perlukan OCR.

·
PDF ini sudah mempunyai teks boleh dipilih — anda mungkin tidak memerlukan OCR. Cuba Ringkasan →
Dilindungi kata laluan — buka ia dahulu. Nyahkunci PDF →
Tesseract untuk imbasan cetak bersih. GOT-OCR2 untuk kertas berbilang lajur + skrip Asia. Premium sahaja apabila setiap piksel penting.
Petua bahasa mempercepatkan Tesseract 2-3× dan meningkatkan ketepatan 30-50% pada skrip bukan-Latin.
Kiraan token
Beli token
Muat naik PDF untuk melihat kos yang tepat.
Hasil OCR
Muat turun

        

Bila untuk guna PDF OCR

Bil + resit

Tukar stack bil yang diimbas ke teks boleh edit untuk buku-buku, bayaran balik, atau automasi AP.

Buku lama + arkib

Digitkan buku-buku yang tidak lagi dicetak, dokumen sejarah, atau arkib perpustakaan ke teks boleh dicari.

Rekod undang-undang + perubatan

Buka teks dalam fail kes yang diimbas, laporan perubatan, atau dokumen faks untuk aliran kerja penemuan + ePenemuan.

Sebelum terjemahan

Jalankan OCR untuk mengekstrak teks, kemudian isikan hasil ke /pdf/translator/ untuk penukaran bahasa mana-mana-ke-mana-mana.

Free.ai PDF OCR vs alat berbayar

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Harga mulaBebas$19.99/mo$199 one-time$9/mo
Pilih enjin OCR (3)
Bahasa100+40+200+20+
API Awam
Berfungsi tanpa mendaftar masuk
Opsyen Lanjutan
Hasil
Token semakin habis. Dapatkan Lebih Token
Nak hasil yang lebih baik? Model premium (GPT-5, Claude, Gemini) memberikan kualiti yang lebih tinggi. Lihat Reka Bentuk

❤️ Love this tool? Share it!

Mendaftar untuk mendapatkan pautan rujukan dan memperoleh 25,000 token per rakan.

Nak lagi? Daftar percuma untuk 30K token/hari + 10K bonus
Daftar Masuk

Memproses permintaan anda...

Tukar PDF yang diimbas kepada teks yang boleh dipilih dan dicari. Tesseract, GOT-OCR2, dan enjin OCR premium. 99 bahasa. Percuma.

Bagaimana untuk Guna PDF OCR

1
Masukkan input anda

Taip teks, muat naik fail, atau jelaskan apa yang anda mahu. Tiada akaun diperlukan.

2
Klik cipta

AI kami memproses permintaan anda dalam beberapa saat menggunakan model sumber terbuka terbaik.

3
Muat turun & kongsi

Muat turun, salin, atau kongsi hasil anda. Muat turun percuma untuk kegunaan peribadi dan komersial.

Guna alat ini melalui API

Automatikkan alat ini dari kod anda sendiri. Titik akhir REST serasi OpenAI, pengesahan token-pemegang, tiada SDK tambahan diperlukan. Kos token sepadan dengan antaramuka web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Tukar PDF yang diimbas (imej sahaja, teks tidak boleh dipilih) ke teks boleh dicari, boleh disalin, boleh dibaca AI. Muat naik PDF halaman yang diimbas — bil, kontrak, buku lama, nota tertulis — dan dapatkan semula teks biasa,.docx, atau teks bernombor halaman.

Sekitar 500 token per halaman pada Tesseract OCR kami yang dihost sendiri (tahap percuma). GOT-OCR2 kos ~800/halaman dan mengendalikan susunatur kompleks (kolom berbilang, jadual, persamaan) lebih baik. OCR fal premium berjalan ~2,500/halaman untuk ketepatan tertinggi pada imbasan yang diturunkan. Lantai 800-token pada ketiga-tiga jadi muat naik 1-halaman bukanlah kos tambahan murni.

Tesseract (piawai, percuma) untuk imbasan cetak bersih. GOT-OCR2 (bebas, lebih perlahan) untuk kertas penyelidikan berbilang-kolum, persamaan saintifik, atau dokumen bahasa Asia — ia mempunyai model susunatur yang lebih baik. OCR fal premium hanya untuk imbasan yang diturunkan / resolusi rendah / sejarah di mana setiap piksel penting.

Tesseract menyokong 100+ bahasa termasuk Latin, Cina, Jepun, Korea, Arab, Cyrillic, Ibrani, Hindi, Thai, Vietnam. Serahkan petunjuk bahasa (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) untuk ketepatan 30-50% lebih baik — autokesan berfungsi tetapi lebih perlahan.

Tiga:.txt (biasa, satu fail untuk keseluruhan dokumen),.docx (Word dengan pemotongan halaman terpelihara), dan.txt halaman-sedar (===== Halaman N ===== pengepala antara halaman supaya anda boleh cari halaman tertentu dalam output).

Pada imbasan 300-DPI bersih, 99%+ pada skrip Latin cetak. Turun kepada 90-95% pada imbasan 150-DPI, dokumen pudar, atau tulisan tangan. Skrip bukan-Latin (Cina, Arab, Hindi) lebih baik dengan petunjuk bahasa dan GOT-OCR2 berbanding Tesseract.

OCR tulisan tangan lebih sukar daripada teks cetak - jangkakan ketepatan 70-85% walaupun pada OCR premium. Untuk borang cetak tangan bersih (bukan kursif) pada kertas putih, Tesseract boleh digunakan. Untuk nota kursif / berantakan, OCR fal premium dengan mod tulisan tangan lebih boleh dipercayai.

Kira-kira 1-3 saat per halaman pada Tesseract, 3-5 saat pada GOT-OCR2, 5-10 saat pada fal premium. Buku 50-halaman yang diimbas mengambil masa 1-3 minit — banner tugas berat membolehkan anda tutup tab dan dapatkan hasil di emel apabila ia selesai.

Tidak. PDF yang dimuat naik dirasterkan, OCRed halaman demi halaman, kemudian dipadam. Fail output disimpan pada CDN kami selama 24 jam (7 hari pada rancangan berbayar) pada pautan kongsi.

Tidak secara langsung. Nyahkunci ia di /pdf/unlock/ dahulu (jika anda ada kata laluan), kemudian kembali. Kami mengesan penyulitan pada muat naik dan pautkan anda ke alat nyahkunci.

Free.ai adalah percuma, menawarkan 3 enjin OCR (pilih mengikut jenis dokumen), menyokong 99 bahasa, dan menghantar API awam. Adobe Acrobat Pro ($19.99/bulan, 1 enjin), ABBYY FineReader ($199 sekali, tiada API), Smallpdf ($9/bulan, 1 enjin). Kualiti OCR kami pada imbasan bersih sepadan dengan Adobe; pada imbasan sejarah premium fal saingan ABBYY.

Ya — POST bahagian berbilang ke /v1/pdf/ocr/ dengan fail + bahasa + model + medan output_format. Titik akhir kutipan: /v1/pdf/ocr-quote/?pages=N&model=M. Resepi curl penuh di /api/.

Daftar percuma untuk 30,000 token

Cipta Akaun Bebas

Tiada kad kredit diperlukan

Bagaimana anda menilai alat ini?

Love this tool? Share it!