mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

mxbai-embed-large-v1 an embedding model tarafından mixedbread.ai tarafından inşa edildi. En güçlüsü Semantic search, clustering, similarity.. Free.ai GPU'da kendi başına konumlandırılmış — günlük token havuzunuza karşı ücretsiz çalışır (100 tokens Çağrı başına). Apache 2.0 altında yayınlanmıştır - ticari kullanım Free.ai üzerinde izin verilmiştir.

Sık Sorulan Sorular

mxbai-embed-large-v1 metinleri anlamları yakalayan yoğun bir vektöre (yüzen sayılar listesi) dönüştürür. Bunu anlamsal arama, kümeleme, tavsiye, geri alma-artırılmış üretim (RAG) ve "bu metin bu metne benzer mi"nin önem taşıdığı herhangi bir görev için kullanın.

Typical dimensions are 384, 768, 1024, or 1536 depending on the model. BGE-M3 emits 1024-dim; OpenAI Ada emits 1536. The API response includes the dimension so your vector DB picks the right index.

Modern entegre modelleri (Free.ai üzerindeki çoğu seçeneği içeren) 100'den fazla dilde eğitilmiştir. Diller arası geri alma çalışmaları - İngilizce arama, İspanyolca belgelerle eşleşir.

Modele bağlı olarak 512 ile 8192 token. Daha uzun girdiler kesilir - uzun belgeleri eklemeden önce paragraflara böl.

mxbai-embed-large-v1 kendi GPU'larımızda çalışır ve en ucuz araçlar arasındadır - günlük ücretsiz havuzunuzdan çekilen her çağrı için ~100 token. $5 = 200K token.

Evet - /v1/embeddings/'e bir dizi listesi POST eder ve mxbai-embed-large-v1 aynı sırayla bir vektör listesi geri verir. İhtiyaç başına 2048'e kadar parti büyüklüğü.

Önceden L2-normalize edilmiş - kosinüs benzerlik = nokta ürünü. Eğer farklı bir uzaklık metriği için ham vektörler istiyorsanız 'normalize=false'yi geçiniz.

Herhangi - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 plain JSON floats returns; DB model hiç görmez.

Evet - POST to /v1/embeddings/ with model="mxbai-embed-large-v1". OpenAI-uyumlu cevap şekli, böylece mevcut istemci kütüphaneleri değişmeden çalışır. /api/ tam referansa sahiptir.

Kendine hizmet veren modellerde metin GPU'da kalıyor ve çağrı geri geldiğinde atılır. Premium DPA ile geçiyor. Girişleriniz üzerine eğitim vermeyiz.

Kendine ait kısa metin için 100ms altında, premium için 100-500ms. Grup çağrıları yaklaşık doğrusal olarak ölçeklenir - 1000 parça 2-10 saniye içinde tamamlanır.

Evet, Free.ai ticari kullanım için izin veriyor. üretim arama, RAG boru hatları, öneri sistemleri vektör başına ücretsiz inşa.

Love Free.ai? Tell your friends!

Bu sayfayı değerlendir