GOT-OCR v2
Free.ai
·
ocr
·
~500 ชิ้น page
GOT-OCR v2 คือ a โมเดล OCR ผ่านโมเดลภายนอก - ~500 โต๊กเกอร์ ต่อหน้า (50% ค่าใช้จ่ายสูงกว่าต้นทาง)
ใช้ผ่าน API
REST API รองรับ OpenAI สร้างกุญแจและเรียกโมเดลนี้ในไม่กี่วินาที
curl -X POST https://api.free.ai/v1/ocr/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
เอกสาร API
ดาวน์โหลดกุญแจ API
คำถามที่ถามบ่อย
GOT-OCR v2 ดึงข้อความจากภาพและ PDF โหลดหน้าที่สแกนแล้ว, ภาพหน้าจอ, หรือภาพถ่ายของเอกสาร และ GOT-OCR v2 จะคืนข้อความกลับมา - โดยรักษาการหยุดบรรทัด และ (บนเครื่องที่สามารถทำได้) ตาราง, สมการ และโครงสร้าง
GOT-OCR v2 จัดการสคริปต์หลายสิบตัว - ลาติน, ซิลิกัล, CJK, อาราบิก, เดวานาการี และอื่น ๆ อีกมากมาย ส่วน / ocr / มีรายการภาษาที่ครบถ้วนสำหรับแต่ละกลไก
ใช่สำหรับแบบเขียนด้วยมือแบบพิมพ์เรียบร้อย แบบคิร์ชและแบบสั้นๆ ยากกว่า TrOCR และเครื่องมือที่ใช้เทอร์มินัลสมัยใหม่ ดีกว่าเทสเซราคท์แบบเก่ามาก
กลไกที่รู้จักการจัดวางหน้า (GOT-OCR, Marker, Florence-2) จะคืนผลมาเป็นตาราง Markdown/ HTML และ LaTeX สำหรับสูตร กลไกที่แสดงข้อความธรรมดา จะคืนผลมาเป็นข้อความที่ไม่มีโครงสร้าง - ตรวจสอบโหมดผลลัพธ์ของแบบจำลองนี้
GOT-OCR v2 เป็นเครื่องมือ OCR ระดับพรีเมี่ยม ใช้ประมาณ ~500- 1,500 โต๊กเกอร์ต่อหน้า แสดงสดก่อนที่คุณจะสร้าง OCR ที่โฮสต์เอง ทำงานฟรีบนโฟลเดอร์ 30,000 โต๊กเกอร์ต่อวันของคุณ แบบพรีเมี่ยมจ่ายตามการใช้ เติมเงินเริ่มต้นที่ $1
รูปแบบ PNG, JPG, WebP, HEIC, BMP, PDF หน้าเดียวและหลายหน้า ขนาดสูงสุด 50 MB หน้าที่สั่นหรือหมุนจะถูกแก้ไขอัตโนมัติก่อนที่จะดึงออกมา
ความถูกต้องของตัวอักษรโดยทั่วไปจะ > 98% บนหน้าที่พิมพ์สะอาด, ตกลงบนภาพถ่ายความละเอียดต่ำ, สแกนที่บิดเบือนอย่างรุนแรง, หรือแบบอักษรที่ไม่ธรรมดา ลองเปรียบเทียบเครื่องมือบน / ocr / compare / เมื่อความถูกต้องเป็นเรื่องสำคัญ
ใช่ - / batch / รองรับโฟลเดอร์ของภาพ/ PDFs ทุกครั้งที่ดึงข้อมูลจะลงที่ / account /? tab=history สำหรับการเก็บรักษาต้นไม้โฟลเดอร์ ใช้ API
ใช่ - POST แฟ้มของคุณไปยัง / v1/ ocr / ด้วย model=" GOT-OCR v2 ". กลับมาเป็น JSON ด้วยข้อความ + (เมื่อรองรับ) รูปแบบ + กล่องกั้นระดับคำ. / api / มีอ้างอิงเต็ม
โมเดลที่ใช้ตัวมันเองเก็บแฟ้มของคุณไว้บน GPU ของพวกเรา โมเดลพิเศษใช้ DPA ในการส่งต่อเอกสารเอกสารจะถูกลบหลังจากเปิดหน้าต่างการแบ่งปัน เราจะไม่ฝึกการเข้าถึงข้อมูลของคุณ
ใช่ - Free.ai อนุมัติให้ใช้ข้อความที่ดึงออกมาเพื่อการค้า คุณต้องมีสิทธิ์ในการใช้เอกสารต้นฉบับ
โดยปกติจะใช้เวลา 1-5วินาทีต่อหน้า เครื่องจักรที่รู้จักการจัดวางหน้า (ตาราง, คณิตศาสตร์) จะใช้เวลานานกว่า PDF หลายหน้าจะปรับขนาดโดยประมาณเป็นเส้นตรง