PDF OCR

Utilisation commerciale OK 380+ modèles Pas de filigrane Pas besoin d'inscription
Modèle:
+ GPT-5, Claude, Gemini
Transforme un PDF scanné en texte sélectionnable et consultable. Rasterize chaque page à 200 DPI et exécute OCR — cueillir Tesseract (rapide, gratuit), GOT-OCR2 (meilleur pour multi-colonne + tables), ou OCR fal premium (meilleur pour les scans dégradés / historiques). Sortie en.txt,.docx, ou texte marqué page. Vous avez une image, pas un PDF? Utilisez /ocr/ →

Faites glisser un PDF numérisé ici ou cliquez pour télécharger

PDF jusqu'à 50 Mo. Fonctionne sur des PDF numérisés + uniquement image. Déjà sélectable par texte? Vous n'avez pas besoin de OCR.

·
Ce PDF a déjà un texte sélectionnable — vous n'avez peut-être pas besoin de OCR. Essayez Summarizer →
Protégé par mot de passe — déverrouillez-le d'abord. Déverrouiller le fichier PDF →
Tisseract pour les scans imprimés propres. GOT-OCR2 pour les papiers multicolonnes + scripts asiatiques. Premium seulement quand chaque pixel compte.
L'indice de langue accélère Tesseract 2-3× et augmente la précision de 30 à 50% sur les scripts non latins.
Montant estimatif
Acheter des tokens
Téléchargez un PDF pour voir le coût exact.
Résultat de la ROC
Télécharger

        

Quand utiliser PDF OCR

Factures + reçus

Transformez une pile de factures numérisées en texte modifiable pour la tenue de livres, les remboursements ou l'automatisation AP.

Livres anciens + archives

Numériser les livres non imprimés, les documents historiques ou les archives de la bibliothèque en texte consultable.

Dossiers juridiques et médicaux

Déverrouillez le texte dans les fichiers de cas numérisés, les rapports médicaux ou les documents faxés pour découvrir + flux de travail eDiscovery.

Avant la traduction

Exécutez OCR pour extraire du texte, puis mettez le résultat dans /pdf/traducteur/ pour toute conversion de langue.

Free.ai PDF OCR vs les outils payants

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Prix de départGratuit$19.99/mo$199 one-time$9/mo
Choisir le moteur OCR (3)
Langues100+40+200+20+
API publique
Fonctions sans inscription
Options avancées
Résultat
Les tokens sont bas. Obtenez plus de tokens
Vous voulez de meilleurs résultats? Modèles premium (GPT-5, Claude, Gemini) offrent une qualité supérieure. Afficher les plans

❤️ Love this tool? Share it!

Inscrivez-vous pour obtenir un lien de référence et gagner 25 000 tokens par ami.

Tu en veux plus? Inscrivez-vous gratuitement pour 30K tokens/jour + 10K bonus
Inscription gratuite

Traitement de votre demande...

Transformez les PDF numérisés en texte sélectionnable et consultable. Tesseract, GOT-OCR2 et moteurs OCR haut de gamme. 99 langues. Gratuit.

Comment utiliser PDF OCR

1
Saisissez votre entrée

Tapez du texte, téléchargez un fichier ou décrivez ce que vous voulez. Aucun compte n'est nécessaire.

2
Cliquez sur générer

Notre IA traite votre demande en quelques secondes à l'aide des meilleurs modèles open-source.

3
Télécharger et partager

Téléchargez, copiez ou partagez votre résultat. Gratuit pour un usage personnel et commercial.

Utilisez cet outil via l'API

Automatisez cet outil à partir de votre propre code. Endpoint REST compatible OpenAI, Auth-token auth, pas de SDK supplémentaire requis.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Transformez les PDF numérisés (seulement image, texte non sélectionnable) en texte consultable, copiable, lisible par l'IA. Téléchargez un PDF de pages numérisées — factures, contrats, anciens livres, notes manuscrites — et revenez en texte simple, en.docx ou en texte numéroté par page.

Environ 500 tokens par page sur notre Tesseract OCR auto-installé (free-tier). GOT-OCR2 coûte ~800/page et gère les mises en page complexes (multi-colonne, tableaux, équations) mieux. Premium fal OCR fonctionne ~2 500/page pour la plus grande précision sur les scans dégradés.

GOT-OCR2 (libre, lent) pour les documents de recherche multicolonnes, les équations scientifiques ou les documents en langue asiatique — il a un modèle de mise en page beaucoup mieux. Premium fal OCR seulement pour les analyses dégradées / basse résolution / historiques où chaque pixel compte.

Tesseract prend en charge plus de 100 langues dont le latin, le chinois, le japonais, le coréen, l'arabe, le cyrillique, l'hébreu, le hindi, le thaï, le vietnamien. Passer un indice de langue (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) pour une meilleure précision de 30 à 50% – auto-détecter fonctionne mais est plus lent.

Trois :.txt (plain, un fichier pour l'ensemble du document),.docx (Word with page breaks conserved), et page-wise.txt (=== Page N ===En-têtes entre les pages afin que vous puissiez trouver une page spécifique dans la sortie).

Sur les scans propres 300-DPI, 99%+ sur le script latin imprimé. Drops à 90-95% sur 150-DPI scans, documents effacés, ou écriture à la main. Les scripts non latins (chinois, arabe, hindi) font beaucoup mieux avec un indice de langue et GOT-OCR2 plutôt que Tesseract.

L'écriture OCR est beaucoup plus difficile que le texte imprimé — attendez 70-85% de précision même sur l'OCR premium. Pour les formes imprimées à la main propres (pas cursive) sur le papier blanc, Tesseract est utilisable. Pour les notes cursive / désordonnée, l'OCR premium avec le mode écriture est plus fiable.

Environ 1-3 secondes par page sur Tesseract, 3-5 secondes sur GOT-OCR2, 5-10 secondes sur fal premium. Un livre scanné de 50 pages prend 1-3 minutes — la bannière à tâche lourde vous permet de fermer l'onglet et obtenir le résultat par courriel quand il se termine.

Non. Les PDF téléchargés sont rastérisés, page par page, puis supprimés. Le fichier de sortie est conservé sur notre CDN pendant 24 heures (7 jours sur un plan payé) sur le lien de partage.

Pas directement. Déverrouillez-le à /pdf/unlock/ d'abord (si vous avez le mot de passe), puis revenez. Nous détectons le chiffrement sur le téléchargement et vous lier à PDF OCR de déverrouillage.

Free.ai est gratuit, offre 3 moteurs OCR (pick by doc type), prend en charge 99 langues, et expédie une API publique. Adobe Acrobat Pro (19,99 $/mois, 1 moteur), ABBYY FineReader (199 $ une fois, pas d'API), Smallpdf (9/mois, 1 moteur). Notre qualité OCR sur scans propres correspond à Adobe; sur scans historiques prime fal rivales ABBYY.

Oui — POST multipart to /v1/pdf/ocr/ with file + language + model + output_format fields. Paramètre de la citation: /v1/pdf/ocr-quote/?pages=N&model=M. Recette pleine boucle à /api/.

Inscrivez-vous gratuitement pour 30 000 tokens

Créer un compte gratuit

Aucune carte de crédit requise

Comment évalueriez-vous cet outil?

Love this tool? Share it!