Unlimited-OCR 3B

Free.ai (self-hosted) · ocr · ~300 Torneiras por page

Deixe um arquivo aqui ou clique para navegar

~300 Torneiras por page

Unlimited-OCR 3B é a Modelo OCR construído por Baidu. A mais forte em Image / scan to structured Markdown, complex layouts, tables, multi-page documents.. Self-hosted on Free.ai GPUs — corre livre contra a sua piscina cotidiana de tokens (300 tokens Por página). Lançado sob MIT - uso comercial permitido em Free.ai.

Utilizar através da API

API REST compatível com o OpenAI. Gere uma chave e chame este modelo em segundos.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"unlimited-ocr","prompt":"your prompt here"}'
Documentação da API Obter a chave da API

Perguntas Frequentes

Unlimited-OCR 3B extrai texto de imagens e PDFs. Envie uma página digitalizada, uma imagem ou uma foto de um documento e Unlimited-OCR 3B devolve o texto - preservação de quebras de linha e (em motores capazes) tabelas, fórmulas e estrutura.

Unlimited-OCR 3B maneja dezenas de scripts - Latino, Cirílico, CJK, Árabe, Devanagari e muito mais. O /ocr/ desembarque tem a lista completa de idiomas por motor.

Sim para escrita de mão de estilo impresso limpo; cursive e shorthand são mais difíceis. TrOCR e motores modernos baseados em transformadores são noteavelmente melhores do que tesseract legado em escrita de mão.

Motores de layout-ware (GOT-OCR, Marker, Florence-2) retornam tabelas Markdown/HTML e LaTeX para fórmulas. Os motores de texto simples retornam texto sem estrutura - verifique o modo de saída deste modelo.

Unlimited-OCR 3B funciona em nossas UPGs de sua piscina gratuita diária; $5 → 200.000 fichas pagas depois. ~300 fichas por página.

PNG, JPG, WebP, HEIC, BMP, mais PDFs de uma única e multi página até 50 MB. As páginas escorregidas ou giradas são auto-corregidas antes da extração.

A precisão dos caracteres é tipicamente >98% em páginas impressas limpas, cair em fotos de baixos-res, escaneamentos severamente escovados ou fontes incomum. Compare motores em /ocr/compare/ quando importa a precisão.

Sim - /batch/ aceita uma pasta de imagens/PDF. Cada extração aterriza em /account /?tab=história. Para a preservação de pastas-árvore use a API.

Sim - POST seu arquivo para /v1/ocr / com model="Unlimited-OCR 3B". Devolve JSON com texto + (quando suportado) layout + caixas de ligações de nível de palavra. /api/ tem a referência completa.

Os modelos auto-hostados mantêm o seu arquivo em nossas UCP; premium passam com um DPA. Os documentos são excluídos após a janela de compartilhamento. Não treinamos em seus insumos.

Sim - Free.ai concede uso comercial de texto extraído. Você precisa de direitos para o documento de origem.

1-5 segundos por página tipicamente. Os motores de layout-aware (tabos, matemática) demoram mais. Escala de PDFs multipágina aproximadamente linearmente.

Adoro Free.ai? Diga aos seus amigos!

Avaliar esta página