mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 Prometium call
~100 Prometium call

mxbai-embed-large-v1 is an embering model gebou deur mixedbread.ai. Sterkste by Semantic search, clustering, similarity.. Self-geëneer op Free.ai GPUs - hardloop vry teen jou daaglikse vormbad (100 Proformations per roep). Vrygestel onder Apache 2.0 - kommersiële gebruik wat op Free.ai toegelaat is.

Vrae wat dikwels gevra word

mxbai-embed-large-v1 converts text into a dense vector (a list of floats) that captures meaning. Use it for semantic search, clustering, recommendation, retrieval-augmented generation (RAG), and any task where "is this text similar to that text" matters.

Tipiese dimensies is 384, 768, 1024 of 1536 afhangende van die model. BGE-M3 stel 1024-dim vry; OpenAI Ada stel 1536 vry. Die API antwoord sluit die dimensie in sodat jou vektor DB die regte indeks kies.

Moderne embering modelle (insluitende mees opsies op Free.ai) word opgelei op 100+ tale. Kruis-taal terugsoektogswerk in Engels, ooreenstem dokumente in Spaans.

512 tot 8 192 inligting na gelang van die model. Lang dokumente word langer afgeknot in paragrawe voor opvou.

mxbai-embed-large-v1 loop op ons eie GPU's en is een van die goedkoopste gereedskap wat omstreeks ~100 seine per oproep van jou daaglikse vry poel getrek is. $5 = 200K ides.

Ja 98 POTT 'n lys stringe na /v1/embedings/ en mxbai-embed-large-v1 gee terug' n lys van vektore in dieselfde volgorde. Bochtch grootte na 2 048 per versoek.

L2-normalized by default - cosine similarity = dot product. Pass `normalize=false` if you want raw vectors for a different distance metric.

Enige ą Pinecone, Weiviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 keer terug gewone JSON dryf; die DB sien nooit die model nie.

Ja - POST na /v1/embedings/ met model="mxbai-embed-large-v1". OpenAI- versoenbaarte reaksie vorm, so bestaande kliënt biblioteke werk onveranderd. /api/ het die volledige verwysing.

Self-geënaarde modelle hou jou teks op ons GPUs en gooi dit weg na die oproep terug. Premium gaan deur met 'n DPA. Ons oefen nie op jou invoere nie.

Sub-100ms vir kort teks op self-hosted, 100- 500ms op premig. Batch noem skaal ongeveer lineêre - 1000 stukke volledige in 2-10 sekondes.

Ja - Free.ai gee kommersiële gebruik van ommedings te gebruik. Bou produksiesoektog, RG-pyplyne, aanbevelingstelsels sonder 'n familieregeerders.

Like this tool? Share it!

Tempo hierdie bladsy