GOT-OCR v2

Free.ai · ocr · ~500 토큰당 page

파일을 여기에 드래그하거나 클릭하여 찾아보기

~500 토큰당 page
우리의 GPU에서 무료로 실행됩니다. 업그레이드 GOT-OCR v2 →

GOT-OCR v2는 an OCR 모델입니다. 외부 모델을 통해 라우팅 - ~500 토큰 페이지당 (업스트림 비용에 대한 50% 마킹).

API를 통해 사용

OpenAI 호환 REST API. 키를 생성하고 몇 초 만에 이 모델을 호출합니다.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
API 문서화 API 키 가져오기

자주 묻는 질문

GOT-OCR v2는 이미지와 PDF에서 텍스트를 추출합니다. 스캔 된 페이지, 스크린 샷 또는 문서의 사진을 업로드하면 GOT-OCR v2는 텍스트를 반환합니다. - 줄바꿈 및 (가능한 엔진에서) 테이블, 공식 및 구조를 보존합니다.

GOT-OCR v2는 수십개의 스크립트를 처리합니다 - 라틴어, 키릴 문자, CJK, 아랍어, 데바나가리, 그리고 더 많은 것들. /ocr/ 랜딩은 엔진별로 전체 언어 목록을 가지고 있습니다.

청결한 인쇄 스타일의 필기에 대한 예; 커시브와 짧은 손이 더 어렵다. TrOCR와 현대 변환기 기반 엔진은 손글씨에 레거시 Tesseract보다 눈에 띄게 더 나은.

레이아웃 인식 엔진(GOT-OCR, Marker, Florence-2)은 Markdown/HTML 테이블과 공식에 대한 LaTeX를 반환합니다. 일반 텍스트 엔진은 구조 없는 텍스트를 반환합니다. 이 모델의 출력 모드를 확인하십시오.

GOT-OCR v2는 프리미엄 OCR 엔진입니다. 페이지 당 약 ~ 500-1,500 토큰, 생성하기 전에 라이브로 표시됩니다. 자체 호스팅 OCR은 30,000 토큰 일일 풀에서 무료로 실행됩니다; 프리미엄 모델은 사용량에 따라 지불, $1에서 충전.

PNG, JPG, WebP, HEIC, BMP, 50MB까지의 단일 페이지 및 다중 페이지 PDF를 지원합니다. 편차 또는 회전된 페이지는 추출 전에 자동으로 수정됩니다.

문자 정확도는 일반적으로 깨끗한 인쇄된 페이지에서 >98%, 저해상도 사진에서 떨어지는, 심각하게 편향된 스캔, 또는 특이한 글꼴에서 98%입니다. 정확도가 중요할 때 /ocr/compare/에서 엔진을 비교하십시오.

예 - /batch/는 이미지/PDF 폴더를 받아들입니다. 각 추출은 /account/?tab=history에 착륙합니다. 폴더 트리 보존을 위해 API를 사용합니다.

예 - 파일을 /v1/ocr/에 POST하여 model="GOT-OCR v2"를 사용합니다. 텍스트 + (지원되는 경우) 레이아웃 + 단어 수준 경계 상자가 포함된 JSON을 반환합니다. /api/ 는 전체 참조를 가지고 있습니다.

자체 호스팅 모델은 파일을 GPU에 보관하며, 프리미엄 모델은 DPA를 통해 전송됩니다. 문서는 공유 창이 종료된 후 삭제됩니다.

예 - Free.ai는 추출된 텍스트의 상업적 사용을 허용합니다. 원본 문서에 대한 권리가 필요합니다.

일반적으로 페이지당 1-5초. 레이아웃 인식 엔진(표, 수학)은 더 오래 걸립니다. 다중 페이지 PDF는 대략 선형으로 확장됩니다.

Love Free.ai? Tell your friends!

이 페이지 평가하기