mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

mxbai-embed-large-v1 je an ugrađivanje modela izgrađen od mixedbread.ai. Najjača na Semantic search, clustering, similarity.. Free.ai GPU-a — radi besplatno protiv vašeg dnevnog token poola (100 tokens po pozivu). Objavljeno pod licencom Apache 2.0 - komercijalna upotreba dozvoljena pod licencom Free.ai.

Često postavljana pitanja

mxbai-embed-large-v1 pretvara tekst u gusti vektor (lista float-ova) koji hvata značenje. Koristite ga za semantičko pretraživanje, grupiranje, preporuke, generiranje poboljšano prikupljanjem (RAG), i bilo koji zadatak gdje je "je li ovaj tekst sličan tom tekstu" važno.

Tipična dimenzija je 384, 768, 1024 ili 1536 zavisno od modela. BGE-M3 emitira 1024-dim; OpenAI Ada emitira 1536. API odgovor uključuje dimenziju tako da vaš vektor DB izabire pravi indeks.

Moderni modeli ugrađivanja (uključujući većinu opcija na Free.ai) su obučeni na 100+ jezika. Cross-language retrieval works - search in English, match documents in Spanish.

512 do 8192 znakova zavisno od modela. Duži unosi su skraćeni - razdvajaju dugotrajne dokumente u paragrafe prije ugrađivanja.

mxbai-embed-large-v1 radi na našim vlastitim GPU-ovima i jedan je od najjeftinijih alata - oko ~100 žetona po pozivu izvlači se iz vašeg dnevnog besplatnog bazena. $5 = 200K žetona.

Da - POST lista nizova znakova u /v1/embeddings/ i mxbai-embed-large-v1 vraća listu vektora u istom redoslijedu. Veličina serije do 2048 po zahtjevu.

L2-normalizirano po defaultu - kosinus sličnost = proizvod tačaka. Proslijedite `normalize=false` ako želite sirove vektore za drugačiju udaljenost metrike.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 vraća običan JSON float; DB nikad ne vidi model.

Yes - POST to /v1/embeddings/ with model="mxbai-embed-large-v1". OpenAI-compatible response shape, so existing client libraries work unchanged. /api/ has the full reference.

Modeli koji su sami hostirani čuvaju vaš tekst na našim GPU-ovima i odbacuju ga nakon povratka poziva. Premium prolazi kroz DPA. Ne treniramo na vašim ulazima.

Sub-100ms za kratki tekst na self-hosted, 100-500ms na premium. Batch calls scale roughly linearly - 1,000 chunks complete in 2-10 seconds.

Da, Free.ai dozvoljava komercijalnu upotrebu ugradnji, izgradnju produkcijskih pretraga, RAG cjevovoda, sistema preporuka bez naknade po vektorima.

Volim Free.ai?

Ocijeni ovu stranicu