Unlimited-OCR 3B

Free.ai (self-hosted) · ocr · ~300 tokens per page

Letakkan fail di sini atau klik untuk layari

~300 tokens per page

Unlimited-OCR 3B adalah a Model OCR dibina oleh Baidu. Paling kuat di Image / scan to structured Markdown, complex layouts, tables, multi-page documents.. Dihost sendiri pada Free.ai GPU — berjalan percuma terhadap kolam token harian anda (300 tokens setiap halaman). Dikeluarkan di bawah MIT - penggunaan komersial dibenarkan di Free.ai.

Guna melalui API

API REST serasi OpenAI. Janakan kekunci dan panggil model ini dalam beberapa saat.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"unlimited-ocr","prompt":"your prompt here"}'
Dokumentasi API Dapatkan Kekunci API

Soalan Lazim

Unlimited-OCR 3B mengekstrak teks dari imej dan PDF. Muat naik halaman yang diimbas, skrin sentuh, atau foto dokumen dan Unlimited-OCR 3B mengembalikan teks - memelihara pecahan baris dan (pada enjin yang boleh) jadual, formula, dan struktur.

Unlimited-OCR 3B mengendalikan berpuluh-puluh skrip - Latin, Cyrillic, CJK, Arab, Devanagari, dan lain-lain. Pendaratan /ocr/ mempunyai senarai bahasa penuh bagi setiap enjin.

Ya untuk tulisan tangan gaya cetak bersih; kursif dan shorthand lebih sukar. TrOCR dan enjin berdasar transformator moden lebih baik daripada Tesseract lama pada tulisan tangan.

Enjin yang tahu bentangan (GOT-OCR, Marker, Florence-2) mengembalikan jadual Markdown/HTML dan LaTeX untuk formula. Enjin teks biasa mengembalikan teks tanpa struktur - semak mod output model ini.

Unlimited-OCR 3B berjalan pada GPU kami dari kolam percuma harian anda; $5 → 200,000 token dibayar selepas. ~300 token per halaman.

PNG, JPG, WebP, HEIC, BMP, plus PDF satu halaman dan berbilang halaman sehingga 50 MB. Halaman yang terbengkok atau diputar akan dibetulkan secara automatik sebelum mengekstrak.

Ketepatan aksara biasanya >98% pada halaman cetak bersih, jatuh pada foto resolusi rendah, imbasan yang teruk tergelincir, atau font tidak biasa. Bandingkan enjin pada /ocr/compare/ bila ketepatan penting.

Ya - /batch/ menerima folder imej/PDF. Setiap pengekstrakan akan ditempatkan dalam /account/?tab=history. Untuk pemeliharaan pepohon folder gunakan API.

Ya - POST fail anda ke /v1/ocr/ dengan model="Unlimited-OCR 3B". Kembalikan JSON dengan teks + (bila disokong) susunatur + kotak sempadan aras perkataan. /api/ mempunyai rujukan penuh.

Model sendiri-hosting menyimpan fail anda pada GPU kami; premium lalu melalui dengan DPA. Dokumen dipadam selepas tetingkap berkongsi. Kami tidak melatih pada input anda.

Ya - Free.ai memberi kebenaran penggunaan komersial teks yang diekstrak. Anda perlukan hak ke atas dokumen sumber.

1-5 saat per halaman biasanya. Enjin yang tahu susunatur (tabel, matematik) mengambil masa lebih lama. PDF berbilang halaman skala secara linear.

Love Free.ai? Tell your friends!

Nilai halaman ini