BGE-M3

Free.ai (self-hosted) · embeddings · ~100 Semne de referință call
~100 Semne de referință call

BGE-M3 este a model de încorporare construit de BAAI. Cel mai puternic la Text embeddings, semantic search. Self-hosted pe Free.ai GPUs — rula gratuit împotriva poolului de token zilnic (100 tokens pe apel). Eliberat sub MIT - utilizarea comercială permisă pe Free.ai.

Utilizați prin API

API REST compatible cu OpenAI. Generați o cheie și apelați acest model în secunde.

curl -X POST https://api.free.ai/v1/image/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"bge-m3","prompt":"your prompt here"}'
Documentare API Obține cheie API

Întrebări frecvente

BGE-M3 transformă textul într-un vector dens (o listă de plutitori) care captă semnele. Utilizați-l pentru căutarea semantică, raglomerarea, recomandarea, generarea cu recuperare aglomerată (RAG), și orice sarcină în care "este acest text similar cu acel text" contează.

Dimensiunile tipice sunt 384, 768, 1024 sau 1536 în funcție de model. BGE-M3 emite 1024-dim; OpenAI Ada emite 1536. Răspunsul API include dimensiunea astfel încât vectorul DB alege indicele corect.

Modelele moderne de incrustare (inclusiv cele mai multe opțiuni pe Free.ai) sunt instruite pe 100 de limbi. Lucrări de recuperare în limba cross-ling - căuta în engleză, documente de meci în spaniol.

512 până la 8.192 jetonuri în funcție de model. Inputurile mai lungi sunt truncat - bucați documente lungi în paragrafele înainte de a încorpora.

BGE-M3 funcționează pe propriile noastre GPU și este printre cele mai ieftine instrumente - aproximativ ~100 jetonuri pe telefon trase de la piscina dvs. gratuit zilnic. $5 = jetonuri 200K.

Da - POST o listă de corzi la /v1/einclusiv/ și BGE-M3 returnează o listă de vectori în același ordin. Dimensiunea seriei până la 2.048 pe cerere.

L2-normalizat prin predefinire - similaritate cosineu = produs dot. Pass `normalize=false' dacă doriți vectori crud pentru o metrică diferită distanță.

Orice - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. BGE-M3 întoarce floaturile de JSON; DB nu vede niciodată modelul.

Da - POST la /v1/einclusiv/ cu model="BGE-M3". Forma de răspuns compatibile cu OpenAI, astfel încât bibliotecile client existente funcționează nemodificat. /api/ are referința completă.

Modelele auto-gazdă păstrează textul pe GPU-urile noastre și aruncă-l după apelul de returnare. Premium trece prin intermediul cu un DPA. Noi nu antrenăm pe intrarea dumneavoastră.

Sub-100ms pentru text scurt pe auto-gazdă, 100-500ms pe premium. Scala de loturi apeluri aproximativ linear - 1000 bucati complet în 2-10 secunde.

Da - Free.ai acordă utilizarea comercială a incrustațiilor. Construire de căutare de producție, conducte RAG, sisteme de recomandare fără redevență per-vector.

Love Free.ai? Tell your friends!

Ratați această pagină