mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 znaki na call
~100 znaki na call

mxbai-embed-large-v1 jest a model wbudowy zbudowany przez mixedbread.ai. Najsilniejsza w Semantic search, clustering, similarity.. Samodzielnie umieszczony na Free.ai GPU – biegnie wolny od codziennego zbiornika tokenów (100 žetonów na połączenie). Wydawane pod Apache 2.0 - użytkowanie handlowe dozwolone na Free.ai.

Często zadawane pytania

mxbai-embed-large-v1 przekształca tekst w gęsty wektor (listę płutaków), który przechwyca znaczenie. Użyj go do wyszukiwania semantycznego, klastrowania, rekomendacji, pozyskiwania pokolenia (RAG) i wszelkiego zadania, w którym "jest ten tekst podobny do tego tekstu" ma znaczenie.

Typowe wymiary to 384, 768, 1024 lub 1536 w zależności od modelu. BGE-M3 emituje 1024-dim; OpenAI Ada emituje 1536. Odpowiedź API obejmuje wymiar, tak że wektor DB wybiera odpowiedni indeks.

Nowoczesne modele wbudowy (w tym większość opcji na Free.ai) są szkolene na 100+ językach. Prace cross-jezykowe wyszukiwanie - wyszukiwanie w języku angielskim, dokumenty meczowe w języku hiszpańskim.

512 do 8 192 tonerów w zależności od modelu. Długiej wejściu obcięto - długie części dokumenty w paragrafach przed wbudowaniem.

mxbai-embed-large-v1 działa na własnych GPU i jest jednym z najtańszych narzędzi - około ~100 tokenów na połączenia wyciągnięte z codziennego bezpłatnego basenu. $5 = 200K tokenów.

Tak - POST lista strun do /v1/wkładów / i mxbai-embed-large-v1 zwraca listę wektorów w tym samym porządku. Wielkość partii do 2,048 na żądanie.

L2- znormalizowany domyślnie - cosinus podobieństwo = produkt kropki. Przepuść `normalize=false' jeśli chcesz surowe wektory dla innego metrycznego odległości.

Jakikolwiek - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 zwraca proste JSON płuta; DB nigdy nie widzi modelu.

Tak - POST do /v1/inwestycje / z modelem="mxbai-embed-large-v1". Form odpowiedzi kompatybilny z OpenAI, więc istniejące biblioteki klienta pracują niezmienione. /api / ma pełne odniesienie.

Samodomowe modele trzymaj tekst na naszych GPU i odrzuć go po powrocie połączenia. Premium przejść z DPA. Nie trenujemy na wejściach.

Pod-100m dla krótkiego tekstu na samo-hostingu, 100-500m na premię. Seria połączeń połączeń w przybliżeniu liniowo - 1000 kawałków zakończone w 2-10 sekund.

Tak - Free.ai przyznaje komercyjne wykorzystanie wbudowy. Budowa wyszukiwania produkcji, rurociągi RAG, systemy rekomendacyjne bez royalty per-verter.

Love Free.ai? Tell your friends!

Oceń tę stronę