mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 tocynnau y eiliad call
~100 tocynnau y eiliad call

Mae mxbai-embed-large-v1 yn a model mewnadeiladu a adeiladwyd gan mixedbread.ai. Mwyaf gryf wrth Semantic search, clustering, similarity.. Hunan-gartrefedig ar Free.ai GPUs — rhedeg yn rhad ac am ddim yn erbyn eich pool tocynnau bob dydd (100 tokens ar gyfer pob galwad). Rhyddhawyd o dan Apache 2.0 - caniateir defnydd masnachol o dan Free.ai.

Cwestiynau a ofynnir yn aml

Mae mxbai-embed-large-v1 yn trosi testun i wektor dwys (rhestr o arfau) sy'n dal ystyr. Defnyddiwch ef ar gyfer chwilio ystyrol, clymu, argymhellion, creu wedi ei wella gan adfer (RAG), a phob tasg lle mae "a yw'r testun yma yn debyg i'r testun hwn" yn bwysig.

Mae dimensiynau arferol yn 384, 768, 1024, neu 1536 yn dibynnu ar y model. Mae BGE-M3 yn rhyddhau 1024-dim; mae OpenAI Ada yn rhyddhau 1536. Mae'r ymateb API yn cynnwys y dimensiwn fel bod eich DB vector yn dewis y mynegai cywir.

Mae modelau mewnosod modern (gan gynnwys y rhan fwyaf o ddewisiadau ar Free.ai) wedi eu hyfforddi ar gyfer mwy na 100 o ieithoedd. Mae adfer rhwng ieithoedd yn gweithio - chwilio yn Saesneg, cydweddu dogfennau yn Sbaeneg.

512 i 8,192 o tocynnau yn dibynnu ar y model. Trosir mewnbwn hirach - rhannu dogfennau hir i baragraffau cyn eu mewnosod.

Mae mxbai-embed-large-v1 yn rhedeg ar ein GPUs ein hunain ac mae'n un o'r offer mwyaf fforddiadwy - tua ~100 tocyn am bob galwad a ddarperir o'ch cronfa rhad ac am ddim bob dydd. $5 = 200K o tocynnau.

Ie - POST rhestr o linynnau i /v1/embeddings/ ac mae mxbai-embed-large-v1 yn dychwelyd rhestr o feicwyr yn yr un trefn. Maint batch hyd at 2,048 am bob cais.

L2-normalized by default - cosine similarity = dot product. Pass `normalize=false` if you want raw vectors for a different distance meter.

Unrhyw - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Mae mxbai-embed-large-v1 yn dychwelyd arnawf JSON plaen; ni welwyd y model gan y DB.

Ie - POST i /v1/embeddings/ gyda model="mxbai-embed-large-v1". Ffurf ymateb OpenAI-cydnaws, felly mae llyfrgelloedd cleientiaid presennol yn gweithio heb newid. Mae gan /api/ y cyfeiriad llawn.

Modelau hunan-westeiedig yn cadw eich testun ar ein GPUs a'i daflu ar ôl i'r galwad ddychwelyd. Premium yn mynd trwy gyda DPA. Ni ddysgwn ar eich mewnbwn.

Dan 100ms ar gyfer testun byr ar hunan-westeio, 100-500ms ar premiwm. Mae galwadau batch yn graddio'n lled-linear - 1,000 o ddarnau yn cwblhau mewn 2-10 eiliad.

Ie - mae Free.ai yn rhoi defnydd masnachol o fewnosodiadau. Adeiladu chwilio cynhyrchu, pibellau RAG, systemau argymhelliad heb unrhyw ffi am bob vector.

Hoff Free.ai? Meddwl eich ffrindiau!

Graddio'r dudalen hon