PDF OCR

Uso comercial aceptado Modelos 567 Sen marca de auga Non é preciso rexistrarse
Modelo:
+ GPT-5, Claude, Gemini
Converte un PDF dixitalizado en texto seleccionábel e pescudábel. Rasteriza cada páxina a 200 PPP e executa o OCR. Escolla Tesseract (rápido, gratuíto), GOT- OCR2 (mellor para táboas con varias columnas) ou fal OCR premium (mellor para dixitalizacións degradadas/ históricas). Saída como.txt,.docx ou texto etiquetado por páxina. Ten unha imaxe, non un PDF? Use / ocr / →

Arrastre aquí un PDF dixitalizado ou prema para enviar

PDF de ata 50 MB. Funciona con PDF dixitalizados + só imaxes. Xa pode seleccionar texto? Non precisa OCR.

-
- · -
Este PDF xa ten texto escollíbel; pode que non precise OCR. Probar o Resumidor →
Protexido por contrasinal — desbloquee primeiro. Desbloquear PDF →
Tesseract para dixitalizacións limpas. GOT- OCR2 para papel de varias columnas + escrituras asiáticas. Premium só cando cada píxel importa.
A axuda de linguaxe acelera Tesseract 2- 3 veces e aumenta a precisión nun 30- 50% en escrituras non latinas.
Estimación do token
-
Comprar fichas
Envíe un PDF para ver o custo exacto.
Resultado do OCR
Obter

        

Cando usar o OCR de PDF

Facturas + recibos

Converta unha pila de facturas dixitalizadas en texto editábel para contabilidade, reembolsos ou automatización de AP.

Libros antigos e arquivos

Dixitale libros esgotados, documentos históricos ou arquivos de bibliotecas en texto pesquisábel.

Registros legais e médicos

Desbloquee o texto dentro de arquivos de casos escaneados, informes médicos ou documentos enviados por fax para fluxos de traballo de descubrimento + eDiscovery.

Antes da tradución

Executar OCR para extraer texto e despois introducir o resultado en /pdf/translator/ para converter calquera idioma en calquera outro.

Free.ai PDF OCR vs as ferramentas de pago

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Prezo inicialLibre$19.99/mo$199 one-time$9/mo
Escoller o motor de OCR (3)---
Linguas100+40+200+20+
API pública---
Funciona sen rexistro---
Opcións avanzadas
Resultado
A faltar fichas. Obter máis fichas
Queres mellores resultados? Modelos Premium (GPT-5, Claude, Gemini) ofrecen unha calidade superior. Ver os planos

❤️ Amas a Free.ai?

Regístrese para obter unha ligazón de referencia e gañar 30. 000 tokens por amigo.

Queres máis? Sign up free: 30,000 tokens/day
Inscríbete gratis

A procesar o seu pedido...

Converta os PDF escaneados en texto seleccionábel e pescudábel. Tesseract, GOT-OCR2 e motores OCR premium. 99 linguas. Gratuito.

Como usar PDF OCR

1
Indique a súa entrada

Escriba texto, envíe un ficheiro ou describa o que queira. Non se precisa conta ningunha.

2
Prema para xerar

A nosa IA procesa a túa solicitude en segundos empregando os mellores modelos de código aberto.

3
Obter e compartir

Obteña, copie ou comparta o seu resultado. Gratuito para uso persoal e comercial.

Empregar esta ferramenta mediante API

Automatice esta ferramenta co seu propio código. Punto final REST compatíbel con OpenAI, autenticación con token de portador, non se require SDK adicional. Os custos dos tokens son iguais aos da interface web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

Converta PDF escaneados (só imaxes, texto non seleccionábel) en texto buscable, copiable e lexíbel por IA. Envíe un PDF de páxinas escaneadas (facturas, contratos, libros antigos, notas manuscritas) e recupere texto simple,.docx ou texto numerado.

Cerca de 500 tokens por páxina no noso OCR Tesseract autoaloxado (nivel libre). GOT- OCR2 custa ~800/ páxina e xestiona mellor os deseños complexos (múltiplas columnas, táboas, ecuacións). O OCR fal Premium executa ~2. 500/ páxina para a maior precisión en dixitalizacións degradadas. 800 tokens nos tres, polo que os envíos de 1 páxina non son pura sobrecarga.

Tesseract (por omisión, gratuíto) para dixitalizacións limpas. GOT- OCR2 (gratuito, máis lento) para artigos de investigación con varias columnas, ecuacións científicas ou documentos en lingua asiática - ten un modelo de disposición moito mellor. OCR fal Premium só para dixitalizacións degradadas, de baixa resolución ou históricas onde cada píxel é importante.

Tesseract soporta máis de 100 idiomas, incluíndo latín, chinés, xaponés, coreano, árabe, cirílico, hebreo, hindi, tailandés, vietnamita. Passe unha suxestión de idioma (eng/ spa/ fra/ deu/ jpn/ chi_ sim/ ara/ etc.) para unha precisión 30- 50% mellor - a detección automática funciona pero é máis lenta.

Tres:. txt (simple, un ficheiro para todo o documento),. docx (Word con saltos de páxina preservados), e. txt por páxina (===== Páxina N ===== cabeceiras entre as páxinas para que poida atopar unha páxina específica na saída).

En dixitalizacións limpas de 300 ppp, máis do 99% en escritura latina impresa. Diminue ao 90- 95% en dixitalizacións de 150 ppp, documentos descoloridos ou escrita a man. As escrituras non latinas (chinés, árabe, hindi) funcionan moito mellor con consellos de lingua e GOT- OCR2 en vez de Tesseract.

O OCR de escrita a man é moito máis difícil que o texto impreso - espere unha precisión do 70- 85% mesmo co OCR premium. Para formularios limpos impresos a man (non cursiva) en papel branco, Tesseract é usable. Para notas cursivas/ confusas, o OCR fal premium co modo de escrita a man é máis fiable.

Cerca de 1- 3 segundos por páxina en Tesseract, 3- 5 segundos en GOT- OCR2, 5- 10 segundos en fal premium. Un libro de 50 páxinas escaneado tarda 1- 3 minutos; o banner de tarefas pesadas permítelle pechar a páxina e recibir o resultado por correo cando remate.

Non. Os PDF enviados son rasterizados, OCRed páxina por páxina, e logo eliminados. O ficheiro de saída consérvase na nosa CDN durante 24 horas (7 días nun plan de pago) na ligazón de compartición.

Non directamente. Desbloquee primeiro en / pdf/ unlock/ (se ten o contrasinal) e logo volva. Detectamos o cifrado ao enviar e enlazámolo coa ferramenta de desbloqueo.

Free.ai é gratuíto, ofrece 3 motores OCR (escolla polo tipo de documento), soporta 99 linguas e inclúe unha API pública. Adobe Acrobat Pro ($19, 99/ mes, 1 motor), ABBYY FineReader ($199 por unha vez, sen API), Smallpdf ($9/ mes, 1 motor). A nosa calidade OCR en escaneos limpos iguala a de Adobe; en escaneos históricos, a calidade premium rivaliza con ABBYY.

Si - POST multipart a / v1/ pdf/ ocr/ con ficheiros + idioma + modelo + campos output_ format. Citar o punto final: / v1/ pdf/ ocr- quote/? pages=N& model=M. A receita completa de curl en / api /.

Sign up free: 30,000 tokens/day

Crear unha conta libre

Non se require tarxeta de crédito

Como valora esta ferramenta?

Amas a Free.ai?