BGE-M3

Free.ai (self-hosted) · embeddings · ~100 ชิ้น call
~100 ชิ้น call

BGE-M3 เป็น a แบบจำลอง สร้างโดย BAAI แข็งแกร่งที่สุดที่ Text embeddings, semantic search จัดเก็บข้อมูลด้วยตนเองบน Free.ai GPUs — ทำงานฟรีกับสระของโต๊ะประจำวันของคุณ (100 โต๊ะ ต่อการโทร) ปล่อยออกมาภายใต้ MIT - การใช้งานในเชิงพาณิชย์อนุญาตบน Free.ai

ใช้ผ่าน API

REST API รองรับ OpenAI สร้างกุญแจและเรียกโมเดลนี้ในไม่กี่วินาที

curl -X POST https://api.free.ai/v1/image/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"bge-m3","prompt":"your prompt here"}'
เอกสาร API ดาวน์โหลดกุญแจ API

คำถามที่ถามบ่อย

BGE-M3 เปลี่ยนข้อความเป็นเวกเตอร์ที่หนาแน่น (รายการตัวเลขฟลอยด์) ที่เก็บความหมายไว้ ใช้สำหรับค้นหาความหมาย การจัดกลุ่ม การแนะนำ การสร้างแบบเพิ่มการค้นหา (RAG) และงานอื่น ๆ ที่ "ข้อความนี้คล้ายกับข้อความนั้นหรือไม่" มีความสำคัญ

ขนาดโดยทั่วไปคือ 384, 768, 1024 หรือ 1536 ขึ้นอยู่กับรุ่น BGE-M3 จะส่งออก 1024-dim; OpenAI Ada จะส่งออก 1536 การตอบรับ API จะรวมถึงขนาด ดังนั้น ฐานข้อมูลเวกเตอร์ของคุณจะเลือกดัชนีที่ถูกต้อง

โมเดลการฝังแบบใหม่ (รวมถึงตัวเลือกส่วนใหญ่บน Free.ai) ถูกฝึกให้ใช้ภาษามากกว่า 100 ภาษา การค้นหาภาษาต่าง ๆ ทำงานได้ - ค้นหาภาษาอังกฤษ, ตรงกับเอกสารภาษาสเปน

512 to 8,192 tokens depending on the model. Longer inputs are truncated - chunk long documents into paragraphs before embedding.

BGE-M3 ทำงานบน GPU ของพวกเราเอง และเป็นหนึ่งในเครื่องมือที่ถูกที่สุด - ประมาณ ~ 100 โต๊กเกอร์ต่อการเรียก ดึงจากวันของคุณฟรี pool $5 = 200K โต๊กเกอร์

ใช่ - POST รายการข้อความไปยัง / v1/ embeddings / และ BGE-M3 จะคืนกลับรายการเวกเตอร์ในลำดับเดียวกัน ขนาดแบตสูงสุด 2048 ต่อคำร้อง

ปรับค่าเป็นค่าปกติ L2 โดยปริยาย - ความคล้ายคลึงของโคไซน = ผลรวมจุด ส่งค่า 'normalize=false' หากต้องการใช้เวกเตอร์ raw สำหรับเมตริกความห่างที่แตกต่างกัน

ทุกอย่าง - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. BGE-M3 คืนค่า JSON แบบฟลอยด์ธรรมดา; DB จะไม่เห็นโมเดล

ใช่ - POST ไปยัง /v1/ embeddings/ ด้วย model=" BGE-M3 ". รูปแบบการตอบสนองที่เข้ากันได้กับ OpenAI, ดังนั้นไลบรารีคลาวด์ที่ใช้อยู่จะทำงานโดยไม่เปลี่ยนแปลง /api/ มีอ้างอิงเต็ม

โมเดลที่ใช้ตัวมันเองเก็บข้อความของคุณไว้บน GPU และทิ้งมันไปหลังจากการเรียกกลับมา Premium ผ่านไปด้วย DPA เราไม่ฝึกการเข้าถึงของคุณ

ใต้ 100 มิลลิวินาทีสำหรับข้อความสั้น ๆ บนโฮสต์ตัวเดียว 100-500 มิลลิวินาทีบนแพ็คเกจพิเศษ การเรียกใช้แบตเตอรี่จะปรับขนาดได้โดยตรง - 1,000 ชิ้นเสร็จสมบูรณ์ใน 2-10 วินาที

ใช่ Free.ai อนุมัติการใช้เชิงพาณิชย์ของการฝัง สร้างการค้นหาการผลิต RAG ท่อระบายน้ำ ระบบแนะนำโดยไม่มีค่าใช้จ่ายต่อเวกเตอร์

รัก Free.ai บอกเพื่อนของคุณ

จัดอันดับหน้านี้