BGE-M3
Free.ai (self-hosted)
·
embeddings
·
~100 ቶኮን call
BGE-M3 a መተላለፊያ በ BAAI የተገነባ ነው. በጣም ጠንካራ በ Text embeddings, semantic search. በ Free.ai GPUs ላይ ራስ-ተስተናገደ - በዕለት ተዕለት ቶኬን ፑልዎ ላይ ነፃ ይሰራል (100 ቶኬኖች በጥሪ)። በ MIT ስር የተሰጠ - በ Free.ai ላይ የቢዝነስ ጥቅም የተፈቀደ
ብዙ ጊዜ የሚጠየቁ ጥያቄዎች
BGE-M3 ጽሑፉን ወደ ትርጉም የሚያገኝ የሞቃት ቬክተር (የሚንሸራተት ዝርዝር) ይለውጣል. ለሴማቲክ ፈልግ፣ ክለሳ፣ ምክር፣ ማግኘት-የተሻሻለ ማምረት (RAG)፣ እና "ይህ ጽሑፍ ከጽሑፉ ጋር ተመሳሳይ ነው" የሚል ነገር ካለ ማንኛውም ስራ ይጠቀሙት
Typical dimensions are 384, 768, 1024, or 1536 depending on the model. BGE-M3 emits 1024-dim; OpenAI Ada emits 1536. The API response includes the dimension so your vector DB picks the right index.
የቅርብ ጊዜውን ማስቀመጥ ሞዴሎች (በ Free.ai ላይ ብዙ ምርጫዎች ጨምሮ) በ 100+ ቋንቋዎች ላይ ተምረዋል. Cross- ቋንቋ ማግኛ ሥራዎች - በእንግሊዝኛ ፈልግ, ሰነዶች በ ስፓኒሽ ማጣመር.
512 እስከ 8,192 ቶኮኖች በሞዴል ላይ የተመሠረተ. ረጅም መዝገቦች ተቆርጠዋል - ረጅም ሰነዶች ከመግባት በፊት በቁራጭ ውስጥ ይጣሉ
BGE-M3 በግል ጂፒዩዎች ላይ ይሠራል እናም ከሚፈለጉት መሣሪያዎች መካከል ነው - ከዕለታዊ ነፃ ስብሰባዎ ውስጥ ለአንድ ጥሪ ~100 ቶኬኖች ይወጣሉ. $5 = 200K ቶኬኖች.
አዎ - ወደ /v1/embeddings/ የቃላት ዝርዝርን ላክ እና BGE-M3 በተመሳሳይ ርዕስ ውስጥ የቪክቶሮችን ዝርዝር ይመልሳል. የባች መጠን በየጠየቁት ላይ እስከ 2,048 ድረስ ነው.
L2-normalized በ default - cosine similarity = dot product. ለተለያዩ የርቀት ሜትሪክ የቀረቡ ቬክተሮችን ከፈለጉ `normalize=false`ን ይተዉ
ማንኛውም - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. BGE-M3 ቀላል JSON ፎላቶች ይመልሳል; DB ሞዴል አይታይም.
አዎ - ወደ /v1/embeddings/ ሞዴል="BGE-M3" ጋር POST. OpenAI-የተስማማ መልስ ቅርጽ, ስለዚህ የቀድሞው ክላሲክ ላብራቶሪዎች ያልተሻሻለ ሥራ. /api/ ሙሉ ማመልከት አለው.
የራስ-አስተናጋጅ ሞዴሎች ጽሑፍዎን በ GPUs ላይ ይይዛሉ እና ጥሪው ከተመለሰ በኋላ ይጥሉት. ፕሪሚየም በ DPA ውስጥ ይወጣል. በእርስዎ መሳሪያዎች ላይ አናስተምራም.
Sub-100ms ለጥቂት ጽሑፍ ላይ በራሱ-ተስተናገደ, 100-500ms ላይ premium. ቡት ጥሪዎች በቅርበት መስመር ይጨምራል - 1,000 ሹክቶች በ 2-10 ሰከንዶች ውስጥ የተሟላ.
አዎ - Free.ai የውስጥ መተግበሪያዎችን የቢዝነስ ጥቅም ይሰጣል. ምርት ፈልግ ፣ RAG ቧንቧዎች ፣ የምርመራ ስርዓቶች ያለ ቬክተር ሮያልቲ