TrOCR Base

Free.ai (self-hosted) · ocr · ~300 token per page

Jatuhkan berkas di sini atau klik untuk diramban

~300 token per page

TrOCR Base adalah a Model OCR built by Microsoft. Terkuat di Handwritten documents, low-resource scripts.. Self-hosted on Free.ai GPUs - runs free against your daily token pool (300 token per halaman). Dibebaskan dengan MIT - penggunaan komersial diijinkan pada Free.ai.

Gunakan melalui API

API TERSAKAAI-kompatibel. Hasilkan kunci dan panggil model ini dalam detik.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"trocr-base","prompt":"your prompt here"}'
Dokumentasi API Dapatkan Kunci API

Pertanyaan yang Sering Diajukan

TrOCR Base mengekstrak teks dari gambar dan PDF. Upload halaman yang dipindai, cuplikan layar, atau foto dokumen dan TrOCR Base mengembalikan teks - menjaga garis garis istirahat dan (di tabel, rumus, dan struktur yang mampu.

TrOCR Base menangani puluhan skrip - Latin, Cyrillic, CJK, Arab, Devanagari, dan lebih banyak lagi. /okr/ landing memiliki daftar bahasa lengkap per mesin.

Ya untuk tulisan tangan bergaya tercetak yang bersih; tulisan latin dan pendek lebih sulit. TrOCR dan mesin transformer modern lebih baik daripada peninggalan Tesseract pada tulisan tangan.

Mesin winaout-aware (GOT-OCR, Marker, Florence-2) kembalikan tabel Markdown/HTML dan LaTeX untuk formula. Mesin teks polos kembali teks tanpa struktur - periksa mode keluaran model ini.

TrOCR Base berjalan pada GPU kami dari kolam renang Gratis harian Anda; $ 5 → 200.000 token dibayar setelah. ~300 token per halaman.

PNG, JPG, WebP, HEIC, BMP, ditambah tunggal- dan multi-halaman PDFs sampai 50 MB. Skewed atau halaman diputar otomatis diperbaiki sebelum ekstraksi.

Keakuratan karakter biasanya >98% pada halaman tercetak bersih, menjatuhkan foto berukuran rendah, memindai dengan tajam, atau fonta yang tidak biasa. Bandingkan mesin pada /okr/compare/ ketika akurasi penting.

Ya - /batch/menerima folder gambar/PDFs. Setiap lahan ekstraksi di /account/?tab=history. Untuk pelestarian folder-tree menggunakan API.

Ya - POST berkas Anda ke /v1/ocr/ dengan model="TrOCR Base." Mengembalikan JSON dengan teks + (ketika didukung) tata letak + tingkat kata kotak batas. /api/ memiliki referensi penuh.

Model berhostal diri menyimpan file Anda pada GPU kami; premium lulus dengan DPA. Dokumen dihapus setelah jendela berbagi.

Ya - Free.ai hibah penggunaan komersial teks diekstrak. Anda perlu hak untuk dokumen sumber.

1-5 detik per halaman biasanya. Mesin yang siap-Dibuka (tables, matematika) memakan waktu lebih lama. Skala PDF multi-halaman kira-kira linier.

Cinta Free.ai?

Tingkatkan halaman ini