PaddleOCR

Free.ai (self-hosted) · ocr · ~300 jetons par page

Déposer un fichier ici ou cliquer pour parcourir

~300 jetons par page

PaddleOCR est a Modèle OCR construit par PaddlePaddle. Plus fort à Multi-language OCR, document layout extraction, receipts.. Self-hosted sur Free.ai GPUs — fonctionne gratuitement contre votre pool de tokens journaliers (300 tokens par page). Libéré sous Apache 2.0 - utilisation commerciale autorisée sur Free.ai.

Utiliser via l'API

API REST compatible OpenAI. Générez une clé et appelez ce modèle en quelques secondes.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"paddleocr","prompt":"your prompt here"}'
Documentation API Obtenir la clé API

Foire aux questions

PaddleOCR extrait du texte des images et des PDF. Téléchargez une page numérisée, une capture d'écran ou une photo d'un document et PaddleOCR retourne le texte - préservation des ruptures de ligne et (sur les moteurs capables) des tables, des formules et de la structure.

PaddleOCR gère des dizaines de scripts - latin, cyrillique, CJK, arabe, devanagari, et plus encore. L'atterrissage /ocr/ a la liste complète des langues par moteur.

Oui pour l'écriture propre de style imprimé; cursive et shorthand sont plus difficiles. TrOCR et les moteurs modernes à base de transformateur sont nettement mieux que l'héritage Tesseract sur l'écriture.

Les moteurs à disposition (GOT-OCR, Marker, Florence-2) retournent les tables Markdown/HTML et LaTeX pour les formules. Les moteurs à texte simple retournent le texte sans structure - vérifiez le mode de sortie de ce modèle.

PaddleOCR fonctionne sur nos GPUs de votre piscine gratuite quotidienne; $5 → 200 000 jetons payés après. ~300 jetons par page.

PNG, JPG, WebP, HEIC, BMP, plus des PDF à une page et à plusieurs pages jusqu'à 50 Mo. Les pages enroulées ou tournées sont corrigées automatiquement avant l'extraction.

La précision des caractères est généralement >98 % sur des pages imprimées propres, en chuteant sur des photos à faible résistance, des scans fortement biaisés ou des polices inhabituelles.

Oui - /batch/ accepte un dossier d'images/PDFs. Chaque extraction se trouve dans /account/?tab=history. Pour la préservation des arbres de dossiers, utilisez l'API.

Oui - POST votre fichier vers /v1/ocr/ avec model="PaddleOCR". Retourne JSON avec texte + (lorsqu'il est pris en charge) layout + word-level limiting boxs. /api/ a la référence complète.

Les modèles auto-organisés conservent votre fichier sur nos GPU; la prime passe avec un DPA. Les documents sont supprimés après la fenêtre de partage. Nous ne formons pas vos entrées.

Oui - Free.ai accorde l'utilisation commerciale du texte extrait. Vous avez besoin de droits sur le document source.

1-5 secondes par page en général. Les moteurs de mise en page (tables, maths) prennent plus de temps.

Aimez Free.ai? Dites à vos amis!

Évaluer cette page