Unlimited-OCR 3B

Free.ai (self-hosted) · ocr · ~300 1個あたりのトークン数 page

ファイルをここにドラッグまたはクリックしてブラウズします

~300 1個あたりのトークン数 page

Unlimited-OCR 3Bはan OCRモデルはBaiduが作ったものだ Strongest at Image / scan to structured Markdown, complex layouts, tables, multi-page documents.. Free.ai GPU でセルフホストされ、毎日のトークンプール(300トークン、ページ当たりの)に対してフリーで動作します。 ライセンスはMITでリリースされ、商用利用はFree.aiで許可されている。

API を使う

OpenAI 互換の REST API。鍵を生成し、数秒でこのモデルを呼び出す。

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"unlimited-ocr","prompt":"your prompt here"}'
API ドキュメント API キーを取得

よくある質問

Unlimited-OCR 3Bは画像や PDF からテキストを抽出します。スキャンしたページ、スクリーンショット、または文書の写真をアップロードすると、Unlimited-OCR 3B はテキストを返します。行末や (対応するエンジンでは) 表、式、構造を保存します。

Unlimited-OCR 3Bはラテン文字、キリル文字、CJK、アラビア文字、デヴァーナガリ文字など、数十の文字を扱います。 /ocr/ はエンジンごとの全ての言語のリストを持っています。

清潔な印刷スタイルの手書きには、イエローは有効です。イタリックと短文は難しいです。TrOCRと現代のトランスフォーマーベースのエンジンは、手書きに関して、伝統的な Tesseract よりも著しく優れている。

レイアウトを認識するエンジン (GOT-OCR, Marker, Florence-2) は Markdown/HTML テーブルと公式の LaTeX を返します。 単純テキストエンジンは構造なしのテキストを返します。このモデルの出力モードをチェックしてください。

Unlimited-OCR 3Bは、私たちのGPU上で、あなたの日々のフリープールから動作します。$5 → 200,000の有料トークンが次に追加されます。ページ当たり約300のトークンが追加されます。

PNG, JPG, WebP, HEIC, BMP, さらに 50 MB までの単ページと複数ページの PDF をサポートします。歪んだページや回転したページは、抽出前に自動的に修正されます。

文字の正確性は、清潔な印刷ページ、低解像度写真、非常に歪んだスキャン、あるいは異常なフォントで>98%です。正確性が重要な場合は、 /ocr/compare/ でエンジンを比較してください。

はい - /batch/ は画像/PDF のフォルダを受け入れます。抽出は /account/?tab=history に行われます。フォルダの木保存には API を使用してください。

はい — ファイルを /v1/ocr/ に POST します。 model="Unlimited-OCR 3B" を使用します。 テキスト + (サポートされている場合) レイアウト + ワードレベルのボウンドボックスを含む JSON を返します。 /api/ には完全なリファレンスがあります。

自己ホストモデルはファイルをGPUに保存します。プレミアムモデルは DPAを通して通過します。文書は共有ウィンドウの後に削除されます。私たちはあなたの入力を訓練しません。

はい - Free.ai は抽出されたテキストの商用利用を許可します。ソース文書の権利が必要です。

ページごとに1-5秒。レイアウトに注意するエンジン (テーブル、数学) はより長くかかります。多ページの PDF はほぼ線形にスケールします。

Love Free.ai? Tell your friends!

このページを評価