BGE-M3

Free.ai (self-hosted) · embeddings · ~100 टोकन प्रति call
~100 टोकन प्रति call

BGE-M3 हे a आहे अंतर्भूतीत मॉडेल BAAI द्वारे बनवलेले आहे. Strongest at Text embeddings, semantic search. Free.ai GPUs वर स्व-होस्ट - आपल्या दैनंदिन टोकन पूल विरुद्ध मुक्तपणे चालते (100 टोकन प्रति कॉल). Released under MIT — commercial use permitted on Free.ai.

API द्वारे वापरा

OpenAI-सुसंगत REST API. किल्ली निर्माण करा व सेकंदांमध्ये हे मॉडेल कॉल करा.

curl -X POST https://api.free.ai/v1/image/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"bge-m3","prompt":"your prompt here"}'
API दस्तऐवजीकरण API कि प्राप्त करा

वारंवार विचारले जाणारे प्रश्न

BGE-M3 पाठ्य घन वेक्टर मध्ये रूपांतरित करते (फ्लोटची यादी) जे अर्थ प्राप्त करते. semantic शोध, clustering, सुचविणे, retrieval- augmented generation (RAG) करीता वापरा, व "हे पाठ्य त्या पाठ्यशी समान आहे का" हे महत्वाचे आहे अशा कोणत्याही कार्य करीता वापरा.

याचे आकारमान ३८४, ७६८, १०२४ किंवा १५३६ आहे. BGE-M3 emits 1024-dim; OpenAI Ada emits १५३६.

आधुनिक अंतर्भूतीत मॉडेल (Free.ai वरील बहुतेक पर्याय समाविष्टीत) 100+ भाषांवर प्रशिक्षण दिले गेले आहे. क्रॉस- भाषा पुनर्प्राप्ती कार्य करते - इंग्रजी मध्ये शोधा, स्पॅनिश मध्ये दस्तऐवज जुळवा.

512 ते 8,192 टोकन मॉडेलवर अवलंबून आहे. लांब इनपुट कापले जातात - अंतर्भूत करण्यापूर्वी लांब दस्तऐवजांना अनुच्छेद मध्ये विभागले जाते.

BGE-M3 runs on our own GPUs and is among the cheapest tools - about ~100 tokens per call drawn from your daily free pool. $5 = 200K tokens.

होय - POST /v1/embeddings/ कडे स्ट्रिंगची यादी पाठवा आणि BGE-M3 सारख्या क्रमाने व्हेक्टरची यादी परत करतो. प्रति विनंती 2,048 पर्यंत बॅच आकार.

L2-normalized मुलभूत - cosine similarity = dot product. जर तुम्हाला वेगळ्या अंतरासाठी raw vectors हवे असल्यास 'normalize=false' पास करा.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. BGE-M3 returns plain JSON floats; the DB never sees the model.

Yes - POST to /v1/embeddings/ with model="BGE-M3". OpenAI-compatible response shape, so existing client libraries work unchanged. /api/ has the full reference.

स्वतः-होस्ट केलेले मॉडेल आपल्या GPU वर तुमचे पाठ्य ठेवतात व कॉल परत आल्यावर ते रद्द करतात. प्रीमियम DPA सह पार पडते. आम्ही तुमच्या इनपुटवर प्रशिक्षण देत नाही.

स्वतः-होस्ट केलेल्या छोट्या पाठ्यसाठी सब-100ms, प्रीमियमवर 100-500ms. बॅच कॉल जवळजवळ रेखीयपणे वाढतात - 1,000 चक्क 2-10 सेकंदांमध्ये पूर्ण होतात.

होय - Free.ai अंतर्भूतीत वाणिज्य वापरासाठी परवानगी देते. उत्पादन शोध, RAG पाइपलाइन, प्रति- वेक्टर रॉयल्टीशिवाय शिफारस प्रणाली बनवा.

Free.ai ला आवडते? आपल्या मित्रांना सांगा!

या पानाचे गुणांकन करा