mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 token/s call
~100 token/s call

mxbai-embed-large-v1 an embedding model da, mixedbread.ai-ek eraikia. Strongest at Semantic search, clustering, similarity.. Free.ai GPUtan auto-ostatua — zure eguneroko token pool-aren aurka doan exekutatzen da (100 tokens dei bakoitzeko). Apache 2.0 lizentziapean argitaratua - erabilera komertziala Free.ai lizentziapean baimenduta.

Maiz egiten diren galderak

mxbai-embed-large-v1-ek testua bektore dentso bihurtzen du (higikorrak dituen zerrenda), esanahia harrapatzen duena. Erabili bilaketa semantikoetarako, clustering-erako, gomendioetarako, berreskuratze-gehitutako sorkuntzarako (RAG), eta "testu hau testu horren antzekoa da" kontuan hartzen duen edozein zereginetarako.

Dimentsio tipikoak 384, 768, 1024 edo 1536 dira, modeloaren arabera. BGE-M3-ek 1024-dim igortzen du; OpenAI Ada-k 1536 igortzen du. API erantzunak dimentsioa barne hartzen du, zure bektore DB-k indize egokia hautatzeko.

Kapsulatutako eredu modernoak (Free.ai-eko aukera gehienak barne) 100 hizkuntza baino gehiagotan trebatzen dira. Hizkuntza arteko berreskurapena funtzionatzen du - bilatu ingelesez, parekatu dokumentuak gaztelaniaz.

512 eta 8.192 token artean, modeloaren arabera. Sarrera luzeagoak mozten dira - dokumentu luzeak paragrafoetan zatitu kapsulatu aurretik.

mxbai-embed-large-v1 gure GPU propioetan exekutatzen da eta tresna merkeenetako bat da - ~100 token inguru dei bakoitzeko zure eguneroko biltegi libretik aterata. $5 = 200K token.

Bai - POST kate-zerrenda bat /v1/embeddings/-era eta mxbai-embed-large-v1-ek ordena berean dauden bektore-zerrenda bat itzultzen du. Batch-en tamaina eskaera bakoitzeko 2.048 arte.

L2 normalizatua lehenespenez - kosinua antzekotasuna = puntuaren produktua. Pasatu 'normalize=false' distantzia metriko desberdinetarako bektore gordina nahi baduzu.

Edozein - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 JSON mugikor soila itzultzen du; DB-k ez du inoiz modeloa ikusten.

Bai - POST /v1/embeddings/-era model="mxbai-embed-large-v1" erabiliz. OpenAI-rekin bateragarria den erantzun-forma, beraz, existitzen diren bezero-liburutegiak aldatu gabe funtzionatuko dute. /api/-k erreferentzia osoa du.

Auto-ostatutako modeloek zure testua gure GPUetan gordetzen dute eta baztertzen dute deialdia itzuli ondoren. Premium-ek DPA-rekin pasatzen du. Ez dugu zure sarrerak entrenatzen.

Testu laburretarako 100ms azpiko denbora autoostatuta, 100-500ms premium-en. Batch deiak gutxi gorabehera linealki eskalatzen dira - 1.000 zati 2-10 segundotan osatzen dira.

Bai - Free.ai-ek kapturatzeen erabilera komertziala onartzen du. Eraiki bilaketa ekoizpena, RAG hodiak, gomendio sistemak bektore bakoitzeko erregaldirik gabe.

Maite duzu Free.ai? Esan lagunei!

Balioetsi orrialde hau