PDF OCR

Uso comercial aceptado Máis de 380 modelos Sen marca de auga Non é preciso rexistrarse
Modelo:
+ GPT-5, Claude, Gemini
Converte un PDF dixitalizado en texto seleccionábel e pescudábel. Rasteriza cada páxina a 200 PPP e executa o OCR. Escolla Tesseract (rápido, gratuíto), GOT- OCR2 (mellor para táboas con varias columnas) ou fal OCR premium (mellor para dixitalizacións degradadas/ históricas). Saída como.txt,.docx ou texto etiquetado por páxina. Ten unha imaxe, non un PDF? Use / ocr / →

Arrastre aquí un PDF dixitalizado ou prema para enviar

PDF de ata 50 MB. Funciona con PDF dixitalizados + só imaxes. Xa pode seleccionar texto? Non precisa OCR.

·
Este PDF xa ten texto escollíbel; pode que non precise OCR. Probar o Resumidor →
Protexido por contrasinal — desbloquee primeiro. Desbloquear PDF →
Tesseract para dixitalizacións limpas. GOT- OCR2 para papel de varias columnas + escrituras asiáticas. Premium só cando cada píxel importa.
A axuda de linguaxe acelera Tesseract 2- 3 veces e aumenta a precisión nun 30- 50% en escrituras non latinas.
Estimación do token
Comprar fichas
Envíe un PDF para ver o custo exacto.
Resultado do OCR
Obter

        

Cando usar o OCR de PDF

Facturas + recibos

Converta unha pila de facturas dixitalizadas en texto editábel para contabilidade, reembolsos ou automatización de AP.

Libros antigos e arquivos

Dixitale libros esgotados, documentos históricos ou arquivos de bibliotecas en texto pesquisábel.

Registros legais e médicos

Desbloquee o texto dentro de arquivos de casos escaneados, informes médicos ou documentos enviados por fax para fluxos de traballo de descubrimento + eDiscovery.

Antes da tradución

Executar OCR para extraer texto e despois introducir o resultado en /pdf/translator/ para converter calquera idioma en calquera outro.

Free.ai PDF OCR vs as ferramentas de pago

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Prezo inicialLibre$19.99/mo$199 one-time$9/mo
Escoller o motor de OCR (3)
Linguas100+40+200+20+
API pública
Funciona sen rexistro
Opcións avanzadas
Resultado
A faltar fichas. Obter máis fichas
Queres mellores resultados? Modelos Premium (GPT-5, Claude, Gemini) ofrecen unha calidade superior. Ver os planos

❤️ Amas Free.ai?

Regístrese para obter unha ligazón de referencia e gañar 25.000 tokens por amigo.

Queres máis? Inscríbete gratis para 30K tokens/día + 10K de bonificación
Inscríbete gratis

A procesar o seu pedido...

Converta os PDF escaneados en texto seleccionábel e pescudábel. Tesseract, GOT-OCR2 e motores OCR premium. 99 linguas. Gratuito.

Como usar PDF OCR

1
Introduza a súa entrada

Escriba texto, envíe un ficheiro ou describa o que queira. Non se precisa conta.

2
Prema para xerar

A nosa IA procesa a túa solicitude en segundos empregando os mellores modelos de código aberto.

3
Obter e compartir

Obteña, copie ou comparta o seu resultado. Gratuito para uso persoal e comercial.

Empregar esta ferramenta mediante API

Automatice esta ferramenta a partir do seu propio código. Punto final REST compatíbel con OpenAI, autenticación por token de portador, non se require SDK adicional. Os custos dos tokens son iguais aos da interface web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Converta os PDF escaneados (só imaxes, texto non seleccionábel) en texto pescudábel, copiable e lexíbel por IA. Envíe un PDF de páxinas escaneadas — facturas, contratos, libros antigos, notas manuscritas — e recupere texto simple,.docx ou texto numerado.

Cerca de 500 tokens por páxina no noso OCR Tesseract autoaloxado (nivel libre). GOT- OCR2 custa ~800/ páxina e xestiona mellor os deseños complexos (múltiplas columnas, táboas, ecuacións). O OCR fal Premium executa ~2. 500/ páxina para a maior precisión en dixitalizacións degradadas. 800 tokens nos tres, polo que os envíos de 1 páxina non son pura sobrecarga.

Tesseract (predeterminado, gratuito) para dixitalizacións limpas. GOT- OCR2 (gratuito, máis lento) para artigos de investigación de varias columnas, ecuacións científicas ou documentos en linguas asiáticas, ten un modelo de disposición moito mellor. OCR fal Premium só para dixitalizacións degradadas/ de baixa resolución/ históricas onde cada píxel é importante.

Tesseract soporta máis de 100 idiomas, incluíndo latín, chinés, xaponés, coreano, árabe, cirílico, hebreo, hindi, tailandés, vietnamita. Pass a language hint (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) para unha precisión 30-50% mellor — a detección automática funciona pero é máis lenta.

Tres:. txt (simple, un ficheiro para todo o documento),. docx (Word con saltos de páxina preservados), e. txt por páxina (===== Páxina N ===== cabeceiras entre as páxinas para que poida atopar unha páxina específica na saída).

En dixitalizacións limpas de 300 ppp, máis do 99% en escritura latina impresa. Diminue ao 90- 95% en dixitalizacións de 150 ppp, documentos descoloridos ou escrita a man. As escrituras non latinas (chinés, árabe, hindi) funcionan moito mellor con consellos de lingua e GOT- OCR2 en vez de Tesseract.

O OCR de escrita a man é moito máis difícil que o texto impreso; espere unha precisión do 70- 85% mesmo co OCR premium. Para formularios limpos impresos a man (non cursiva) en papel branco, Tesseract é usable. Para notas cursivas / desordenadas, o OCR fal premium co modo de escrita a man é máis fiable.

Cerca de 1- 3 segundos por páxina en Tesseract, 3- 5 segundos en GOT- OCR2, 5- 10 segundos en fal premium. Un libro de 50 páxinas escaneado tarda 1- 3 minutos; o banner de tarefas pesadas permítelle pechar a lingüeta e recibir o resultado por correo electrónico cando remate.

Non. Os PDF enviados son rasterizados, OCRed páxina por páxina, e logo eliminados. O ficheiro de saída consérvase na nosa CDN durante 24 horas (7 días nun plan de pago) na ligazón de compartición.

Non directamente. Desbloquee primeiro en / pdf/ unlock/ (se ten o contrasinal) e logo volva. Detectamos o cifrado ao enviar e enlazámolo coa ferramenta de desbloqueo.

Free.ai é gratuíto, ofrece 3 motores OCR (escolla polo tipo de documento), soporta 99 linguas e inclúe unha API pública. Adobe Acrobat Pro ($19, 99/ mes, 1 motor), ABBYY FineReader ($199 por unha vez, sen API), Smallpdf ($9/ mes, 1 motor). A nosa calidade OCR en escaneos limpos iguala a de Adobe; en escaneos históricos, a calidade premium rivaliza con ABBYY.

Si — POST multipart a / v1/ pdf/ ocr/ con campos de ficheiro + linguaxe + modelo + formato_ de_ saída. Punto final da cita: / v1/ pdf/ ocr- quote/?pages=N&model=M. A receita completa do curl está en / api/.

Inscríbete gratis para obter 30.000 tokens

Crear unha conta libre

Non se require tarxeta de crédito

Como valora esta ferramenta?

Amas Free.ai?