mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 Ցուցադրել call
~100 Ցուցադրել call

mxbai-embed-large-v1 is a ներկառուցված մոդել built by mixedbread.ai. Strongest at Semantic search, clustering, similarity.. Free.ai GPU-ների վրա ինքնուրույն տեղադրված — աշխատում է անվճար ձեր օրական token pool-ի դեմ (100 tokens Ընդամենը). Հրապարակված է Apache 2.0 - առևտրային օգտագործման թույլտվությամբ Free.ai.

Հաճախակի տրվող հարցեր

mxbai-embed-large-v1-ը փոխակերպում է տեքստը հաստ վեկտորի (հոսող թվերի ցանկ), որը գրավում է իմաստը։ Կիրառեք այն սեմատիկ որոնման, խմբավորման, խորհուրդների, վերցման-բարձրացրած ստեղծման (RAG) և ցանկացած գործողության համար, որտեղ «արդյոք այս տեքստն նման է այդ տեքստին» կարևոր է։

Տիպիկ չափերը 384, 768, 1024 կամ 1536 են՝ կախված մոդելից։ BGE-M3-ը թողարկում է 1024-dim; OpenAI Ada-ն թողարկում է 1536։ API-ի պատասխանը ներառում է չափը, որպեսզի ձեր վեկտորային DB-ն ճիշտ ինդեքս ընտրի։

Համակարգչային ներբեռնման նորագույն մոդելները (ներառյալ Free.ai- ի առավելագույն ընտրանքները) սովորեցված են 100+ լեզուների վրա։ Կրկնլեզու վերցման աշխատանքներ՝ որոնում անգլերենով, փաստաթղթերի համընկնում իսպաներենով։

512-ից 8,192 տոկոս՝ կախված մոդելից։ Ավելի երկար մուտքագրումները կտրվում են՝ երկար փաստաթղթերը ներառելուց առաջ բաժանելով պարբերությունների։

mxbai-embed-large-v1-ը աշխատում է մեր սեփական GPU-ների վրա և ամենաէժան գործիքներից մեկն է՝ մոտավորապես ~100 tokens յուրաքանչյուր զանգի համար, որը ստանալու եք ձեր օրական անվճար ռեսուրսներից։ $5 = 200K tokens.

Այո - POST /v1/embeddings/-ին ստորագրությունների ցանկ և mxbai-embed-large-v1-ը վերադարձնում է նույն կարգով վեկտորների ցանկ։ Բաժնի չափը մինչև 2048 մեկ խնդրանքի համար։

Լռելյայն L2-նորմալացված - կոսինի նմանությունը = կետային արտադրանքը: Տեղադրեք `normalize=false` եթե ցանկանում եք սկզբնական վեկտորները տարբեր հեռավորության մետրիկայի համար:

Յուրաքանչյուր - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 վերադարձնում է պարզ JSON floats; DB երբեք չի տեսնում մոդել.

Այո - POST to /v1/embeddings/ with model="mxbai-embed-large-v1" OpenAI-ի հետ համընկնող պատասխանի ձև, այնպես որ գոյություն ունեցող կրեդիտային գրադարանները աշխատում են անփոփոխ: /api/-ն ունի ամբողջական հղում.

Իրենց վրա աշխատող մոդելները պահում են ձեր տեքստերը մեր GPU- ներում և ջնջում են դրանք, երբ զանգը վերադառնում է։ Premium- ը DPA- ով անցնում է։ Մենք չենք սովորում ձեր մուտքագրումներից։

100-ից ցածր մսս-եր կարճ տեքստի համար ինքնուրույն ապահովված համակարգում, 100-500 մսս premium համակարգում։ Բեթային զանգերը մոտավորապես գծային են՝ 1000 հատվածները կատարվում են 2-10 վայրկյանում։

Այո - Free.ai- ը թույլ է տալիս ներառվածների առևտրային օգտագործումը։ Ընտրեք որոնման պրոդուկտը, RAG- ի խողովակները, խորհուրդների համակարգերը առանց վեկտորային արտոնագրի։

Սիրում ես Free.ai-ը, ասա ընկերներիդ։

Առաջարկել այս էջը