GOT-OCR v2

Free.ai · ocr · ~500 tokens per page

Kéo tập tin vào đây hoặc nhấn để duyệt

~500 tokens per page
Chạy miễn phí trên GPU của chúng tôi. Cập nhật cho GOT-OCR v2 →

GOT-OCR v2 là a Mô hình OCR. Đường dẫn qua các mô hình bên ngoài - ~500 tokens mỗi trang (50% markup trên chi phí upstream).

Dùng qua API

API REST tương thích OpenAI. Tạo một chìa khóa và gọi mô hình này trong vài giây.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
Tài liệu API Nhập khóa API

Câu hỏi thường gặp

GOT-OCR v2 trích xuất văn bản từ ảnh và PDF. Tải lên một trang đã quét, một màn hình chụp, hoặc một ảnh của tài liệu và GOT-OCR v2 trả lại văn bản - giữ lại các đoạn chia dòng và (trên các động cơ có khả năng) bảng, công thức, và cấu trúc.

GOT-OCR v2 xử lý hàng chục kiểu chữ - Latin, Cyrillic, CJK, Arabic, Devanagari, và nhiều hơn nữa. /ocr/ landing có danh sách đầy đủ các ngôn ngữ cho mỗi động cơ.

Có cho chữ viết tay kiểu in sạch; chữ nghiêng và chữ viết tắt khó hơn. TrOCR và các động cơ dựa trên biến đổi hiện đại là đáng chú ý hơn Tesseract cũ trên chữ viết tay.

Các động cơ nhận thức về bố cục (GOT-OCR, Marker, Florence-2) trả lại bảng Markdown/HTML và LaTeX cho công thức. Các động cơ văn bản đơn giản trả lại văn bản không có cấu trúc - kiểm tra chế độ xuất của mô hình này.

GOT-OCR v2 là một máy OCR cao cấp. Khoảng ~500–1,500 token trên mỗi trang, hiển thị trực tiếp trước khi bạn tạo ra. OCR tự động chạy miễn phí trên 30,000 token hàng ngày của bạn; các mô hình cao cấp là trả theo thời gian, với tiền nạp từ $1.

PNG, JPG, WebP, HEIC, BMP, plus single- và multi-page PDFs up to 50 MB. Paged or rotated pages are auto-corrected before extracting.

Độ chính xác của ký tự thường là >98% trên các trang in sạch, rơi xuống trên ảnh độ phân giải thấp, scan nghiêm trọng, hoặc phông chữ bất thường. So sánh các động cơ trên /ocr/compare/ khi độ chính xác quan trọng.

Có - /batch/ chấp nhận một thư mục ảnh/PDF. Mỗi lần nén sẽ nằm trong /account/?tab=history. Để bảo tồn cây thư mục, dùng API.

Có - POST tập tin của bạn vào /v1/ocr/ với model="GOT-OCR v2". Trả lại JSON với văn bản + (nếu hỗ trợ) bố cục + hộp giới hạn cấp từ. /api/ có tham chiếu đầy đủ.

Các mô hình tự chủ giữ tập tin của bạn trên GPU của chúng tôi; cao cấp đi qua với DPA. Tài liệu bị xóa sau cửa sổ chia sẻ. Chúng tôi không huấn luyện vào đầu vào của bạn.

Có - Free.ai cho phép sử dụng thương mại văn bản đã nén. Bạn cần quyền truy cập tài liệu nguồn.

Thông thường là 1- 5 giây mỗi trang. Các động cơ nhận thức về bố cục (bảng, toán học) cần lâu hơn. PDF nhiều trang sẽ tăng kích cỡ theo đường thẳng.

Cậu yêu Free.ai?

Đánh giá trang này