mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 zsetononként call
~100 zsetononként call

mxbai-embed-large-v1 an a beágyazódó modell által épített mixedbread.ai. A legerősebb a Semantic search, clustering, similarity.-nél. Önálló, Free.ai GPU-n fut ingyenes ellen a napi token medence (100 tokens hívásonként). Apache 2.0 alatt jelent meg - a Free.ai-en engedélyezett kereskedelmi felhasználás.

Gyakran ismételt kérdések

mxbai-embed-large-v1 a szöveget sűrű vektorrá alakítja (a lebegők listája), amely elfogja a jelentést. Használja szemantikai keresésre, klaszterre, ajánlásra, visszakeresésre használt generációra (RAG), és minden feladatra, ahol "ez a szöveg hasonló" számít.

Typical dimensions are 384, 768, 1024, or 1536 depending on the model. BGE-M3 emits 1024-dim; OpenAI Ada emits 1536. The API response includes the dimension so your vector DB picks the right index.

Modern beágyazási modellek (beleértve a legtöbb opció Free.ai) képzett 100+ nyelvek. Keresztnyelvi visszakeresési munkák - keresés angolul, match dokumentumok spanyolul.

512-8,192 tokenek a modelltől függően. Hosszabb bemenetek csonkolt - darab hosszú dokumentumok bekezdéseket beágyazás előtt.

mxbai-embed-large-v1 saját GPU-kkal fut, és az egyik legolcsóbb eszköz - körülbelül ~100 token naponta ingyenes medencédből húzott hívásonként. $5 = 200K token.

Igen - A /v1/embeddings/ és mxbai-embed-large-v1 sztringek listáját küldjük vissza azonos sorrendben. A kötegek mérete kérésenként akár 2,048 is lehet.

L2-normalizált alapértelmezés szerint - kozin hasonlóság = pont termék. Pass Πnormalize=hamis how would raw vectors for a different distance metric.

Bármely - Pinekone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 visszatér sima JSON úszik; a DB soha nem látja a modellt.

Igen - POST to /v1/embeddings/ with model="mxbai-embed-large-v1." OpenAI-kompatibilis válaszforma, így a meglévő kliens könyvtárak változatlanul működnek. /api/ teljes hivatkozással rendelkezik.

Önálló modellek tartsa a szöveget a GPU-kon, és dobja el, miután a hívás visszatér. Premium átmegy egy DPA. Mi nem edzünk a bemeneteket.

100m alatti rövid szöveg öngazdálkodó, 100-500ms prémium. Batch hívások skála nagyjából lineárisan - 1000 darab 2-10 másodperc alatt teljes.

Igen - Free.ai ad kereskedelmi használatát beágyazások. Építse a termelési keresés, RTI csővezetékek, ajánlás rendszerek nélkül per-vector jogdíj.

Love Free.ai? Tell your friends!

Szavazz erre az oldalra