mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 žetony na žetony call
~100 žetony na žetony call

mxbai-embed-large-v1 je a Vkládání modelu postavený mixedbread.ai. Nejsilnější na Semantic search, clustering, similarity.. Self-hosted on Free.ai GPUs - zdarma běží proti vašemu každodennímu token bazénu (100 tokens za volání). Vydáno pod Apache 2.0 - komerční použití povoleno na Free.ai.

Často kladené otázky

mxbai-embed-large-v1 přeměňuje text na hustý vektor (seznam plováků), který zachycuje význam. Použijte jej pro sémantické vyhledávání, shlukování, doporučení, generování stahovaných zrestaurovaných dat (RAG) a jakýkoli úkol, kde "je tento text podobný tomuto textu" záleží.

Typické rozměry jsou 384, 768, 1024, nebo 1536 v závislosti na modelu. BGE-M3 emituje 1024-dim; OpenAI Ada emituje 1536. Odpověď API obsahuje rozměr, takže váš vektor DB vybere správný index.

Moderní vkládání modelů (včetně většiny možností na Free.ai) je vyškoleno na 100+ jazycích. Cross-language recruiding works - vyhledávání v angličtině, zápas dokumentů ve španělštině.

512 až 8 192 žetonů v závislosti na modelu. Delší vstupy jsou zkráceny - před vložením do odstavců jsou vloženo dlouhé dokumenty.

mxbai-embed-large-v1 běží na našich vlastních GPU a je jedním z nejlevnějších nástrojů - asi ~100 žetony na volání vytažené z vašeho denního bazénu zdarma. 5 dolarů = 200K žetony.

Ano - POST seznam řetězců /v1/embeddings/ a mxbai-embed-large-v1 vrací seznam vektorů ve stejném pořadí. Velikost šarže až 2,048 na vyžádání.

L2-normalizováno standardně - kosinus podobnost = tečka produkt. Pass?normalizovat=false? pokud chcete surové vektory pro jinou vzdálenost metriky.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 vrací obyčejné JSON plováky; DB model nikdy nevidí.

Ano - POST to /v1/embeddings/ with model="mxbai-embed-large-v1." OpenAI-kompatibilní reakční tvar, takže stávající klientské knihovny fungují beze změny. /api/ má plnou referenci.

Modely, které jsou v samoobslužném prostředí, si svůj text udržujte na našich GPU a po návratu hovoru jej vyhoďte. Premium projíždí s DPA. Na vstupy netrénujeme.

Sub-100ms pro krátký text na samohostované, 100-500ms na prémie. Dávkové hovory stupnice zhruba lineárně - 1000 kusů kompletní za 2-10 sekund.

Ano - Free.ai poskytuje komerční využití vkládání. Vybudovat výrobní vyhledávání, RAG potrubí, doporučovací systémy bez per-vektorové royalty.

Love Free.ai? Tell your friends!

Ohodnotit tuto stránku