BGE-M3

Free.ai (self-hosted) · embeddings · ~100 token/s call
~100 token/s call

BGE-M3 an embedding model da, BAAI-ek eraikia. Strongest at Text embeddings, semantic search. Free.ai GPUtan auto-ostatua — zure eguneroko token pool-aren aurka doan exekutatzen da (100 tokens dei bakoitzeko). MIT lizentziapean argitaratua - erabilera komertziala Free.ai lizentziapean baimenduta.

Erabili API bidez

OpenAI-rekin bateragarria den REST APIa. Sortu gako bat eta deitu eredu honi segundotan.

curl -X POST https://api.free.ai/v1/image/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"bge-m3","prompt":"your prompt here"}'
API dokumentazioa Eskuratu API gakoa

Maiz egiten diren galderak

BGE-M3-ek testua bektore dentso bihurtzen du (higikorrak dituen zerrenda), esanahia harrapatzen duena. Erabili bilaketa semantikoetarako, clustering-erako, gomendioetarako, berreskuratze-gehitutako sorkuntzarako (RAG), eta "testu hau testu horren antzekoa da" kontuan hartzen duen edozein zereginetarako.

Dimentsio tipikoak 384, 768, 1024 edo 1536 dira, modeloaren arabera. BGE-M3-ek 1024-dim igortzen du; OpenAI Ada-k 1536 igortzen du. API erantzunak dimentsioa barne hartzen du, zure bektore DB-k indize egokia hautatzeko.

Kapsulatutako eredu modernoak (Free.ai-eko aukera gehienak barne) 100 hizkuntza baino gehiagotan trebatzen dira. Hizkuntza arteko berreskurapena funtzionatzen du - bilatu ingelesez, parekatu dokumentuak gaztelaniaz.

512 eta 8.192 token artean, modeloaren arabera. Sarrera luzeagoak mozten dira - dokumentu luzeak paragrafoetan zatitu kapsulatu aurretik.

BGE-M3 gure GPU propioetan exekutatzen da eta tresna merkeenetako bat da - ~100 token inguru dei bakoitzeko zure eguneroko biltegi libretik aterata. $5 = 200K token.

Bai - POST kate-zerrenda bat /v1/embeddings/-era eta BGE-M3-ek ordena berean dauden bektore-zerrenda bat itzultzen du. Batch-en tamaina eskaera bakoitzeko 2.048 arte.

L2 normalizatua lehenespenez - kosinua antzekotasuna = puntuaren produktua. Pasatu 'normalize=false' distantzia metriko desberdinetarako bektore gordina nahi baduzu.

Edozein - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. BGE-M3 JSON mugikor soila itzultzen du; DB-k ez du inoiz modeloa ikusten.

Bai - POST /v1/embeddings/-era model="BGE-M3" erabiliz. OpenAI-rekin bateragarria den erantzun-forma, beraz, existitzen diren bezero-liburutegiak aldatu gabe funtzionatuko dute. /api/-k erreferentzia osoa du.

Auto-ostatutako modeloek zure testua gure GPUetan gordetzen dute eta baztertzen dute deialdia itzuli ondoren. Premium-ek DPA-rekin pasatzen du. Ez dugu zure sarrerak entrenatzen.

Testu laburretarako 100ms azpiko denbora autoostatuta, 100-500ms premium-en. Batch deiak gutxi gorabehera linealki eskalatzen dira - 1.000 zati 2-10 segundotan osatzen dira.

Bai - Free.ai-ek kapturatzeen erabilera komertziala onartzen du. Eraiki bilaketa ekoizpena, RAG hodiak, gomendio sistemak bektore bakoitzeko erregaldirik gabe.

Maite duzu Free.ai? Esan lagunei!

Balioetsi orrialde hau