BGE-M3

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

BGE-M3 se an Embedded model ki te bati pa BAAI. Li se pi gwo nan Text embeddings, semantic search. Self-hosted sou Free.ai GPUs — kouri gratis kont chak jou ou a token pool (100 tokens pou chak apèl). Li libere anba MIT - itilize komèsyal ki pèmèt sou Free.ai.

Itilize via API

API REST ki konpatib ak OpenAI. Pwodui yon kle epi rele modèl sa a nan kèk segond.

curl -X POST https://api.free.ai/v1/image/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"bge-m3","prompt":"your prompt here"}'
Dokimantasyon API Obtenn kle API

Kesyon ki poze souvan

BGE-M3 konvèti tèks nan yon vektè dense (yon lis de float) ki pran sans. Itilize li pou rechèch semantik, klasman, rekòmandasyon, retrieval-augmented jenerasyon (RAG), ak nenpòt travay kote "se tèks sa a menm jan ak tèks la" enpòtan.

Dimansyon ki pi komen yo se 384, 768, 1024, oswa 1536 depann sou modèl la. BGE-M3 emits 1024-dim; OpenAI Ada emits 1536. Reponn API a gen ladan dimansyon an se konsa vektè DB ou a chwazi endèks la dwa.

Modèles intégration modèn (ki gen ladan pifò opsyon sou Free.ai) yo trete sou 100 + lang. Cross-lang travay rekiperasyon - rechèch nan lang angle, matche ak dokiman an Espay.

512 a 8,192 tokens depann sou modèl la. Enfòmasyon ki pi long yo tronke — chunk long dokiman nan paragraf anvan enkòporasyon.

BGE-M3 kouri sou GPUs nou menm ak se youn nan zouti ki pi bon mache - sou ~ 100 tokens pou chak apèl te tire soti nan chak jou gratis ou. $5 = 200K tokens.

Wi - POST yon lis strings nan /v1/embeddings/ ak BGE-M3 retounen yon lis vektè nan menm lòd. gwosè batch jiska 2,048 pou chak demann.

L2-normalized pa default - cosine similarity = dot product. Pass `normalize=false` si ou vle vektè a pou yon distans diferan.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. BGE-M3 retounen JSON floats; DB pa janm wè modèl la.

Wi - POST nan /v1/embeddings/ ak modèl "BGE-M3". OpenAI-kompatib fòme repons, se konsa bibliyotèk kliyan ki egziste yo travay san chanjman. /api/ gen referans konplè.

Self-hosted modèl kenbe tèks ou sou GPUs nou yo ak debarase m de li apre apèl la tounen. Premium pase pa yon DPA. Nou pa antrene sou enputs ou.

Sub-100ms pou tèks kout sou tèt-hosted, 100-500ms sou prim. Batch apèl skale alantou linètman - 1,000 moso konplè nan 2-10 segonn.

Wi - Free.ai bay dwa pou itilize komèsyal nan embeddings. Konstriksyon rechèch pwodiksyon, RAG pipelines, sistèm rekòmandasyon san royalty pou chak vektè.

Love Free.ai? Di zanmi ou yo!

Rapò paj sa a