PDF OCR

Penggunaan komersial OK 567 model Tiada tanda air Tiada pendaftaran diperlukan
Model:
+ GPT-5, Claude, Gemini
Tukar PDF yang diimbas kepada teks boleh pilih dan boleh dicari. Rasterkan setiap halaman pada 200 DPI dan jalankan OCR — pilih Tesseract (cepat, percuma), GOT-OCR2 (lebih baik untuk lajur berbilang + jadual), atau OCR fal premium (lebih baik untuk imbasan terdegradasi/sejarah). Output sebagai.txt,.docx, atau teks berlabel halaman. Ada imej, bukan PDF? Guna /ocr/ →

Seret PDF yang diimbas ke sini atau klik untuk muat naik

PDF sehingga 50 MB. Berfungsi pada PDF yang diimbas + imej sahaja. Sudah boleh dipilih teks? Anda tidak perlukan OCR.

-
- · -
PDF ini sudah mempunyai teks boleh dipilih — anda mungkin tidak memerlukan OCR. Cuba Ringkasan →
Dilindungi kata laluan — buka ia dahulu. Nyahkunci PDF →
Tesseract untuk imbasan cetak bersih. GOT-OCR2 untuk kertas berbilang lajur + skrip Asia. Premium sahaja apabila setiap piksel penting.
Petua bahasa mempercepatkan Tesseract 2-3× dan meningkatkan ketepatan 30-50% pada skrip bukan-Latin.
Kiraan token
-
Beli token
Muat naik PDF untuk melihat kos yang tepat.
Hasil OCR
Muat turun

        

Bila untuk guna PDF OCR

Bil + resit

Tukar stack bil yang diimbas ke teks boleh edit untuk buku-buku, bayaran balik, atau automasi AP.

Buku lama + arkib

Digitkan buku-buku yang tidak lagi dicetak, dokumen sejarah, atau arkib perpustakaan ke teks boleh dicari.

Rekod undang-undang + perubatan

Buka teks dalam fail kes yang diimbas, laporan perubatan, atau dokumen faks untuk aliran kerja penemuan + ePenemuan.

Sebelum terjemahan

Jalankan OCR untuk mengekstrak teks, kemudian isikan hasil ke /pdf/translator/ untuk penukaran bahasa mana-mana-ke-mana-mana.

Free.ai PDF OCR vs alat berbayar

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Harga mulaBebas$19.99/mo$199 one-time$9/mo
Pilih enjin OCR (3)---
Bahasa100+40+200+20+
API Awam---
Berfungsi tanpa mendaftar masuk---
Opsyen Lanjutan
Hasil
Token semakin kurang. Dapatkan Lebih Token
Nak hasil yang lebih baik? Model Premium (GPT-5, Claude, Gemini) memberikan kualiti yang lebih tinggi. Lihat Reka Bentuk

❤️ Love Free.ai? Tell your friends!

Lamarlahuntuk dapatkan pautan rujukan dan dapat 30,000 token per kawan.

Nak lagi? Daftar percuma: 30,000 token/hari
Daftar Masuk

Mengproses permintaan anda...

Tukar PDF yang diimbas kepada teks yang boleh dipilih dan dicari. Tesseract, GOT-OCR2, dan enjin OCR premium. 99 bahasa. Percuma.

Bagaimana untuk Guna PDF OCR

1
Masukkan input anda

Taip teks, muat naik fail, atau jelaskan apa yang anda mahu. Tiada akaun diperlukan.

2
Klik cipta

AI kami memproses permintaan anda dalam beberapa saat menggunakan model sumber terbuka terbaik.

3
Muat turun & kongsi

Muat turun, salin, atau kongsi hasil anda. Muat turun percuma untuk kegunaan peribadi dan komersial.

Guna alat ini melalui API

Automatikkan alat ini dari kod anda sendiri. Titik akhir REST serasi OpenAI, auth token-pemegang, tiada SDK tambahan diperlukan. Kos token sepadan dengan antaramuka web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

Tukar PDF yang diimbas (imej sahaja, teks tidak boleh dipilih) ke teks boleh dicari, boleh salinan, boleh dibaca AI. Muat naik PDF dari halaman yang diimbas - bil, kontrak, buku lama, nota tulisan tangan - dan dapatkan semula teks biasa,.docx, atau teks bernombor halaman.

Sekitar 500 token per halaman pada Tesseract OCR kami yang dihost sendiri (tahap percuma). GOT-OCR2 kos ~800/halaman dan mengendalikan susunatur kompleks (kolom berbilang, jadual, persamaan) lebih baik. OCR fal premium berjalan ~2,500/halaman untuk ketepatan tertinggi pada imbasan yang diturunkan. Lantai 800-token pada ketiga-tiga jadi muat naik 1-halaman bukanlah kos tambahan murni.

Tesseract (piawai, percuma) untuk imbasan cetak bersih. GOT-OCR2 (bebas, lambat) untuk kertas penyelidikan berbilang-kolum, persamaan saintifik, atau dokumen bahasa Asia - ia mempunyai model susunatur yang lebih baik. OCR fal premium hanya untuk imbasan terdegradasi / resolusi rendah / sejarah di mana setiap piksel penting.

Tesseract menyokong 100+ bahasa termasuk Latin, Cina, Jepun, Korea, Arab, Cyrillic, Hebrew, Hindi, Thai, Vietnam. Serahkan petunjuk bahasa (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) untuk 30-50% ketelusan yang lebih baik - autokesan berfungsi tetapi lebih perlahan.

Tiga:.txt (biasa, satu fail untuk keseluruhan dokumen),.docx (Word dengan pemotongan halaman terpelihara), dan.txt halaman-sedar (===== Halaman N ===== pengepala antara halaman supaya anda boleh cari halaman tertentu dalam output).

Pada imbasan 300-DPI bersih, 99%+ pada skrip Latin cetak. Turun kepada 90-95% pada imbasan 150-DPI, dokumen pudar, atau tulisan tangan. Skrip bukan-Latin (Cina, Arab, Hindi) lebih baik dengan petunjuk bahasa dan GOT-OCR2 berbanding Tesseract.

OCR tulisan tangan lebih sukar daripada teks cetak - jangkakan ketepatan 70-85% walaupun pada OCR premium. Untuk borang cetak tangan bersih (bukan kursif) pada kertas putih, Tesseract boleh digunakan. Untuk nota kursif / berantakan, OCR fal premium dengan mod tulisan tangan lebih boleh dipercayai.

Sekitar 1-3 saat per halaman pada Tesseract, 3-5 saat pada GOT-OCR2, 5-10 saat pada fal premium. Buku 50-halaman yang diimbas mengambil masa 1-3 minit - banner tugas berat membolehkan anda tutup tab dan dapatkan hasil diemail apabila ia selesai.

Tidak. PDF yang dimuat naik dirasterkan, OCRed halaman demi halaman, kemudian dipadam. Fail output disimpan pada CDN kami selama 24 jam (7 hari pada rancangan berbayar) pada pautan kongsi.

Tidak secara langsung. Nyahkunci ia di /pdf/unlock/ dahulu (jika anda ada kata laluan), kemudian kembali. Kami mengesan penyulitan pada muat naik dan pautkan anda ke alat nyahkunci.

Free.ai adalah percuma, menawarkan 3 enjin OCR (pilih mengikut jenis dokumen), menyokong 99 bahasa, dan menghantar API awam. Adobe Acrobat Pro ($19.99/bulan, 1 enjin), ABBYY FineReader ($199 sekali, tiada API), Smallpdf ($9/bulan, 1 enjin). Kualiti OCR kami pada imbasan bersih sepadan dengan Adobe; pada imbasan sejarah premium fal saingan ABBYY.

Ya - POST multipart ke /v1/pdf/ocr/ dengan fail + bahasa + model + output_format medan. Petikan titik akhir: /v1/pdf/ocr-quote/?pages=N&model=M. Resepi curl penuh di /api/.

Daftar percuma: 30,000 token/hari

Cipta Akaun

Tiada kad kredit diperlukan

Bagaimana anda menilai alat ini?

Love Free.ai? Tell your friends!