PaddleOCR

Free.ai (self-hosted) · ocr · ~300 Anzahl der Token je page

Eine Datei hier ablegen oder zum Durchsuchen klicken

~300 Anzahl der Token je page

PaddleOCR ist an OCR-Modell, gebaut von PaddlePaddle. Am stärksten bei Multi-language OCR, document layout extraction, receipts.. Selbstgehostet auf Free.ai GPUs — läuft kostenlos gegen Ihren täglichen Tokenpool ({tpm__tokens} pro Seite). Veröffentlicht unter Apache 2.0 - kommerzielle Nutzung auf Free.ai erlaubt.

Verwendung über API

OpenAI-kompatible REST API. Generieren Sie einen Schlüssel und rufen Sie dieses Modell in Sekundenschnelle auf.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"paddleocr","prompt":"your prompt here"}'
API-Dokumentation API-Schlüssel abrufen

Häufig gestellte Fragen

PaddleOCR extrahiert Text aus Bildern und PDFs. Laden Sie eine gescannte Seite, einen Screenshot oder ein Foto eines Dokuments hoch und PaddleOCR gibt den Text zurück - Zeilenumbrüche und (auf fähigen Motoren) Tabellen, Formeln und Struktur.

PaddleOCR verarbeitet Dutzende von Skripten - Latein, Kyrillisch, CJK, Arabisch, Devanagari und mehr. Die /ocr/Landung hat die vollständige Sprachliste pro Motor.

Ja für saubere Druckschrift; kursive und kurze Schrift sind härter. TrOCR und moderne Transformatorenmotoren sind deutlich besser als bisherige Tesseract auf der Handschrift.

Layout-aware-Engines (GOT-OCR, Marker, Florence-2) geben Markdown/HTML-Tabellen und LaTeX für Formeln zurück. Plain-Text-Engines geben Text ohne Struktur zurück - überprüfen Sie den Ausgabemodus dieses Modells.

PaddleOCR läuft auf unseren GPUs von Ihrem täglichen kostenlosen Pool; $5 → 200.000 bezahlte Tokens nach. ~300 Tokens pro Seite.

PNG, JPG, WebP, HEIC, BMP, plus ein- und mehrseitige PDFs bis zu 50 MB. Gesket oder gedrehte Seiten werden vor der Extraktion automatisch korrigiert.

Charaktergenauigkeit ist typischerweise > 98% auf sauber gedruckten Seiten, fallen auf Low-Res-Fotos, stark verzerrt Scans oder ungewöhnliche Schriftarten. Vergleichen Sie Motoren auf /ocr/compare/ wenn Genauigkeit zählt.

Ja - /batch/ akzeptiert einen Ordner aus Bildern/PDFs. Jede Extraktion landet in /account/?tab=history. Für die Ordner-Baum-Konservierung verwenden Sie die API.

Ja - POST Ihre Datei auf /v1/ocr/ mit model="PaddleOCR". Gibt JSON mit Text + (wenn unterstützt) Layout + Wort-Level-Grenzen zurück. /api/ hat die vollständige Referenz.

Selbstgehostete Modelle behalten Ihre Datei auf unseren GPUs; Premium-Durchlauf mit einem DPA. Dokumente werden nach dem Freigabefenster gelöscht. Wir trainieren nicht auf Ihre Eingänge.

Ja - Free.ai gewährt kommerzielle Verwendung von extrahiertem Text. Sie benötigen Rechte an dem Quelldokument.

1-5 Sekunden pro Seite typischerweise. Layout-ware-Engines (Tische, Mathematik) länger. Mehrseitige PDFs skalieren grob linear.

Liebe Free.ai? Erzählen Sie Ihren Freunden!

Bewerten Sie diese Seite