Unlimited-OCR 3B

Free.ai (self-hosted) · ocr · ~300 tokens per page

Kéo tập tin vào đây hoặc nhấn để duyệt

~300 tokens per page

Unlimited-OCR 3B là a Mô hình OCR được xây bởi Baidu. Đứng đầu là Image / scan to structured Markdown, complex layouts, tables, multi-page documents.. Tự lưu trữ trên Free.ai GPU — chạy miễn phí đối với hồ token hàng ngày của bạn (300 tokens mỗi trang). Phát hành dưới MIT - sử dụng thương mại được phép trên Free.ai.

Dùng qua API

API REST tương thích OpenAI. Tạo một chìa khóa và gọi mô hình này trong vài giây.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"unlimited-ocr","prompt":"your prompt here"}'
Tài liệu API Nhập khóa API

Câu hỏi thường gặp

Unlimited-OCR 3B trích xuất văn bản từ ảnh và PDF. Tải lên một trang đã quét, một màn hình chụp, hoặc một ảnh của tài liệu và Unlimited-OCR 3B trả lại văn bản - giữ lại các đoạn chia dòng và (trên các động cơ có khả năng) bảng, công thức, và cấu trúc.

Unlimited-OCR 3B xử lý hàng chục kiểu chữ - Latin, Cyrillic, CJK, Arabic, Devanagari, và nhiều hơn nữa. /ocr/ landing có danh sách đầy đủ các ngôn ngữ cho mỗi động cơ.

Có cho chữ viết tay kiểu in sạch; chữ nghiêng và chữ viết tắt khó hơn. TrOCR và các động cơ dựa trên biến đổi hiện đại là đáng chú ý hơn Tesseract cũ trên chữ viết tay.

Các động cơ nhận thức về bố cục (GOT-OCR, Marker, Florence-2) trả lại bảng Markdown/HTML và LaTeX cho công thức. Các động cơ văn bản đơn giản trả lại văn bản không có cấu trúc - kiểm tra chế độ xuất của mô hình này.

Unlimited-OCR 3B chạy trên GPU của chúng tôi từ hồ bơi miễn phí hàng ngày của bạn; $5 → 200,000 token trả sau. ~300 token mỗi trang.

PNG, JPG, WebP, HEIC, BMP, plus single- và multi-page PDFs up to 50 MB. Paged or rotated pages are auto-corrected before extracting.

Độ chính xác của ký tự thường là >98% trên các trang in sạch, rơi xuống trên ảnh độ phân giải thấp, scan nghiêm trọng, hoặc phông chữ bất thường. So sánh các động cơ trên /ocr/compare/ khi độ chính xác quan trọng.

Có - /batch/ chấp nhận một thư mục ảnh/PDF. Mỗi lần nén sẽ nằm trong /account/?tab=history. Để bảo tồn cây thư mục, dùng API.

Có - POST tập tin của bạn vào /v1/ocr/ với model="Unlimited-OCR 3B". Trả lại JSON với văn bản + (nếu hỗ trợ) bố cục + hộp giới hạn cấp từ. /api/ có tham chiếu đầy đủ.

Các mô hình tự chủ giữ tập tin của bạn trên GPU của chúng tôi; cao cấp đi qua với DPA. Tài liệu bị xóa sau cửa sổ chia sẻ. Chúng tôi không huấn luyện vào đầu vào của bạn.

Có - Free.ai cho phép sử dụng thương mại văn bản đã nén. Bạn cần quyền truy cập tài liệu nguồn.

Thông thường là 1- 5 giây mỗi trang. Các động cơ nhận thức về bố cục (bảng, toán học) cần lâu hơn. PDF nhiều trang sẽ tăng kích cỡ theo đường thẳng.

Cậu yêu Free.ai?

Đánh giá trang này