GOT-OCR v2

Free.ai · ocr · ~500 tokens per page

Suelta un archivo aquí o haz clic para navegar

~500 tokens per page
Es gratis en nuestras GPUs. Actualizar para GOT-OCR v2 →

GOT-OCR v2 es a Modelo OCR. Enrutado a través de modelos externos - ~500 tokens por página (marque del 50% sobre el costo de la corriente).

Uso a través de API

API REST compatible con OpenAI. Genera una clave y llama a este modelo en segundos.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
Documentación API Obtener clave API

Preguntas frecuentes

GOT-OCR v2 extrae texto de imágenes y PDFs. Sube una página escaneada, una captura de pantalla o una foto de un documento y GOT-OCR v2 devuelve el texto - preservando saltos de línea y (en motores capaces) tablas, fórmulas y estructura.

GOT-OCR v2 maneja docenas de guiones - latín, cirílico, CJK, árabe, devanagari, y más. El /ocr/ aterrizaje tiene la lista completa del idioma por motor.

Sí para la escritura de estilo impreso limpio; cursiva y taquigrafía son más difíciles. TrOCR y modernos motores basados en transformadores son notablemente mejores que Tesseract legado en la escritura.

Los motores de diseño (GOT-OCR, Marker, Florence-2) devuelven las tablas Markdown/HTML y LaTeX para fórmulas. Los motores de texto plano devuelven el texto sin estructura - comprueba el modo de salida de este modelo.

GOT-OCR v2 es un motor OCR premium. Alrededor de ~500-1,500 tokens por página, se muestra en vivo antes de generar. OCR auto-alojado funciona gratis en su piscina diaria de 30.000 tokens; los modelos premium son de pago como se va, con recargas de $1.

PNG, JPG, WebP, HEIC, BMP, más PDF de una sola página y varias páginas de hasta 50 MB. Las páginas rotadas o aserradas se corrigen automáticamente antes de la extracción.

La precisión de caracteres es > 98% en páginas limpias impresas, cayendo en fotos de baja resolución, escaneos con sesgos severos o fuentes inusuales. Compare los motores en /ocr/compare/ cuando la precisión importa.

Sí - /batch/ acepta una carpeta de imágenes/PDFs. Cada extracción se realiza en /account/?tab=historia. Para la preservación de árboles de carpetas, use la API.

Sí - POST su archivo a /v1/ocr/ con model="GOT-OCR v2". Devuelve JSON con texto + (cuando se admite) diseño + cuadros de nivel de palabra. /api/ tiene la referencia completa.

Los modelos auto-alojados mantienen su archivo en nuestras GPUs; pase premium con un DPA. Los documentos se eliminan después de la ventana de intercambio. No entrenamos en sus entradas.

Sí - Free.ai otorga uso comercial de texto extraído. Necesita derechos sobre el documento fuente.

1-5 seconds per page typically. Layout-aware engines (tables, math) take longer. Multi-page PDFs scale roughly linearly.

¿Ama a Free.ai? ¡Dile a tus amigos!

Calificar esta página