mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 För varje call
~100 För varje call

mxbai-embed-large-v1 är an Inbäddningsmodell byggd av mixedbread.ai. Starkast i Semantic search, clustering, similarity.. Självvärdig på Free.ai GPUs – körs gratis mot din dagliga tokenpool (100 tokens per samtal). Släppt under Apache 2.0 - tillåten kommersiell användning på Free.ai.

Vanliga frågor

mxbai-embed-large-v1 konverterar text till en tät vektor (en lista över flottar) som fångar mening. Använd den för semantisk sökning, klusterbildning, rekommendation, hämtning-augmented generation (RAG), och alla uppgifter där "är denna text liknande den texten" spelar roll.

Typiska mått är 384, 768, 1024 eller 1536 beroende på modell. BGE-M3 släpper 1024-dim; OpenAI Ada släpper 1536. API-svaret inkluderar dimension så att din vektor DB väljer rätt index.

Moderna inbäddningsmodeller (inklusive de flesta alternativ på Free.ai) är utbildade på 100+ språk. Språksökning på flera språk - sök på engelska, matcha dokument på spanska.

512 till 8.192 polletter beroende på modell. Längre ingångar är trunkerade - bit långa dokument i stycken innan inbäddning.

mxbai-embed-large-v1 körs på våra egna GPU och är bland de billigaste verktygen - ca ~100 polletter per samtal dras från din dagliga gratis pool. $5 = 200K polletter.

Ja - POST en lista med strängar till /v1/ inbäddningar / och mxbai-embed-large-v1 returnerar en lista med vektorer i samma ordning. Batch storlek upp till 2 048 per begäran.

L2-normaliserad som standard - cosinus likhet = punkt produkt. Passera "normalize=false" om du vill råa vektorer för en annan avståndsmått.

Alla - Pinecone, Weaviate, Qdrant, Chroma, Pgvector, FAISS, LanceDB. mxbai-embed-large-v1 returnerar vanliga JSON flyter; DB aldrig ser modellen.

Ja - POST till /v1/ inbäddningar/ med modell="mxbai-embed-large-v1". OpenAI-kompatibel responsform, så befintliga klientbibliotek fungerar oförändrat. /api/ har den fullständiga referensen.

Självvärdiga modeller behåller din text på våra GPU och kasserar den efter samtalsåtergången. Premium passera genom med en DPA. Vi tränar inte på dina ingångar.

Under-100m för kort text på självvärd, 100-500m på premium. Batch samtal skala ungefär linjärt - 1000 bitar komplett på 2-10 sekunder.

Ja - Free.ai beviljar kommersiell användning av inbäddningar. Bygga produktionssökning, RAG rörledningar, rekommendationssystem utan per-vektor royalty.

Love Free.ai? Tell your friends!

Betygsätt denna sida