PDF OCR

Utilização comercial OK 380+ modelos Sem marca de água Não é necessário inscrever
Modelo:
+ GPT-5, Claude, Gemini
Transforma um PDF digitalizado em texto selecionável e pesquisado. Rasteriza cada página em 200 DPI e executa OCR — pick Tesseract (rápido, livre), GOT-OCR2 (melhor para multi-coluna + tabelas), ou o OCR premium (melhor para scans degradados / históricos). Saída como.txt,.docx, ou texto marcado por páginas. Tem uma imagem, não um PDF? Use /ocr / →

Arraste um PDF digitalizado aqui ou clique para fazer upload

PDF até 50 MB. Funciona em PDF digitalizados + apenas imagens. Já selecionáveis por texto? Você não precisa de OCR.

·
Este PDF já tem texto selecionado — você pode não precisar do OCR. Tente Summarizador →
Protegido por senha — desbloqueá-lo primeiro. Desbloquear PDF →
Tesseract para exames impressos limpos. GOT-OCR2 para papéis multi-coluna + scripts asiáticos. Premium apenas quando cada pixel importa.
Linguagem dicas acelera Tesseract 2-3× e aumenta a precisão 30-50% em scripts não latinos.
Estimativa do token
Torneiras de compra
Envie um PDF para ver o custo exato.
Resultado do OCR
Baixar

        

Quando usar PDF OCR

Facturas + recibos

Transformar uma pilha de faturas escaneadas em texto editável para contabilidade, reembolsos ou automação AP.

Livros antigos + arquivos

Digitalize livros out-of-print, documentos históricos ou arquivos de biblioteca em texto pesquisado.

Registo legal + prontuário médico

Desbloquear texto dentro de arquivos de casos escaneados, relatórios médicos ou documentos faxados para descoberta + fluxos de trabalho eDescovery.

Antes da tradução

Execute o OCR para extrair texto, depois envie o resultado em /pdf/translator/ para qualquer conversão de qualquer idioma.

Free.ai PDF OCR vs as ferramentas pagas

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Preço inicialGrátis$19.99/mo$199 one-time$9/mo
Escolha o motor de OCR (3)
Línguas100+40+200+20+
API Pública
Funciona sem inscrição
Opções avançadas
Resultado
Os tokens estão a ficar baixos. Obter mais tokens
Queres melhores resultados? Modelos premium (GPT-5 Ver Planos

❤️ Love this tool? Share it!

Inscreva-se para obter um link de referência e ganhar 25 mil tokens por amigo.

Queres mais? Inscreva-se gratuitamente para 30K tokens/dia + 10K bônus
Inscreva-se gratuitamente

Processando o seu pedido...

Transforma os PDF digitalizados em texto selecionável. Tesseract, GOT-OCR2, e motores OCR premium. 99 idiomas. Gratuito.

Como Utilizar PDF OCR

1
Insira a sua entrada

Digite texto, carregue um arquivo ou descreva o que você quer. Nenhuma conta necessária.

2
Clique em gerar

Nossa IA processa seu pedido em segundos usando os melhores modelos de código aberto.

3
Baixar & compartilhar

Baixe, copie ou compartilhe seu resultado. Gratuito para uso pessoal e comercial.

Use esta ferramenta através da API

Automate esta ferramenta a partir do seu próprio código. Endpoint REST compatível com o OpenAI, Bearer-token auth, não é necessário SDK extra. Custos de token correspondem à interface web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Transforme PDFs digitalizados (só de imagem, texto inselecível) em texto pesquisável, copiável, legível por IA. Envie um PDF de páginas digitalizadas — faturas, contratos, livros antigos, notas manuscritas — e receba texto simples,.docx, ou texto numerado por páginas.

Cerca de 500 tokens por página em nosso auto-hosted Tesseract OCR (free-tier). GOT-OCR2 custa ~800/page e maneja layouts complexos (multi-coluna, tabelas, equações) melhor. Fal Premium OCR funciona ~2.500/page para a maior precisão em scans degradados. 800-token piso em todos os três para que os uploads de 1 página não são puro overhead.

Tesseract (por defeito, livre) para exames impressos limpos. GOT-OCR2 (gratuito, mais lento) para trabalhos de pesquisa multi-columnas, equações científicas ou documentos em língua asiática — tem um modelo de layout muito melhor. OCR premium apenas para exames degradados / de baixa resolução / históricos onde cada pixel importa.

Tesseract suporta 100+ línguas, incluindo latim, chinês, japonês, coreano, árabe, cirílico, hebraico, hindi, tailandês, vietnamita. Passar uma dica de língua (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) para 30-50% melhor precisão — auto-detecção de obras mas é mais lento.

Três:.txt (chave, um arquivo para todo o documento),.docx (Palavra com quebras de página preservadas), e page-wise.txt (== Página N = cabeçalhos entre páginas para que você possa encontrar uma página específica na saída).

Em varreduras limpas de 300-DPI, 99% + em scripts impressos em latim. Caia para 90-95% em varreduras de 150-DPI, documentos desvanecidos ou escrita em mão. Os scripts não latinos (Chinés, Árabe, Hindi) fazem muito melhor com uma dica de linguagem e GOT-OCR2 em vez de Teseract.

O OCR de escrita manual é muito mais difícil do que o texto impresso — espera a precisão de 70-85% mesmo no OCR premium. Para formas limpas impressas à mão (não curritivas) no papel branco, o Tesseract é utilizável. Para notas currivas / confusas, o OCR premium fal com o modo de escrita manual é mais confiável.

Cerca de 1-3 segundos por página em Teseract, 3-5 segundos em GOT-OCR2, 5-10 segundos em premium fal. Um livro digitalizado de 50 páginas leva 1-3 minutos — o banner de tarefa pesada permite fechar a aba e obter o resultado e-mail ao terminar.

Não. PDFs carregados são rasterizados, página OCR por página, e depois apagados. O arquivo de saída é mantido em nosso CDN por 24 horas (7 dias em um plano pago) no link de compartilhamento.

Não diretamente. Desbloquear em /pdf/desbloquear/ primeiro (se você tiver a senha), então voltar. Detectamos criptografia no upload e linká-lo para PDF OCR de desbloqueio.

Free.ai é livre, oferece 3 motores de OCR (colhendo por tipo doc), suporta 99 idiomas e envia uma API pública. Adobe Acrobat Pro (19.99 dólares/mo, 1 motor), ABBYY FineReader (199 dólares uma vez, sem API), Smallpdf (9/mo, 1 motor). Nossa qualidade de OCR em scans limpos coincide com o Adobe; em scans premium rivals históricos ABBYY.

Sim — POST multiparte para /v1/pdf/ocr/ com arquivo + linguagem + modelo + output_format campos. Citar endpoint: /v1/pdf/ocr-quote/?pages=N&model=M. Receita de curvo completa em /api /.

Inscreva-se gratuitamente para 30.000 tokens

Criar Conta Livre

Não é exigido o cartão de crédito

Como iria avaliar esta ferramenta?

Love this tool? Share it!