Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 znaki na call
~100 znaki na call

Nomic Embed v2 jest a model wbudowy zbudowany przez Nomic AI. Najsilniejsza w Retrieval augmented generation with flexible vector sizes.. Samodzielnie umieszczony na Free.ai GPU – biegnie wolny od codziennego zbiornika tokenów (100 žetonów na połączenie). Wydawane pod Apache 2.0 - użytkowanie handlowe dozwolone na Free.ai.

Często zadawane pytania

Nomic Embed v2 przekształca tekst w gęsty wektor (listę płutaków), który przechwyca znaczenie. Użyj go do wyszukiwania semantycznego, klastrowania, rekomendacji, pozyskiwania pokolenia (RAG) i wszelkiego zadania, w którym "jest ten tekst podobny do tego tekstu" ma znaczenie.

Typowe wymiary to 384, 768, 1024 lub 1536 w zależności od modelu. BGE-M3 emituje 1024-dim; OpenAI Ada emituje 1536. Odpowiedź API obejmuje wymiar, tak że wektor DB wybiera odpowiedni indeks.

Nowoczesne modele wbudowy (w tym większość opcji na Free.ai) są szkolene na 100+ językach. Prace cross-jezykowe wyszukiwanie - wyszukiwanie w języku angielskim, dokumenty meczowe w języku hiszpańskim.

512 do 8 192 tonerów w zależności od modelu. Długiej wejściu obcięto - długie części dokumenty w paragrafach przed wbudowaniem.

Nomic Embed v2 działa na własnych GPU i jest jednym z najtańszych narzędzi - około ~100 tokenów na połączenia wyciągnięte z codziennego bezpłatnego basenu. $5 = 200K tokenów.

Tak - POST lista strun do /v1/wkładów / i Nomic Embed v2 zwraca listę wektorów w tym samym porządku. Wielkość partii do 2,048 na żądanie.

L2- znormalizowany domyślnie - cosinus podobieństwo = produkt kropki. Przepuść `normalize=false' jeśli chcesz surowe wektory dla innego metrycznego odległości.

Jakikolwiek - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 zwraca proste JSON płuta; DB nigdy nie widzi modelu.

Tak - POST do /v1/inwestycje / z modelem="Nomic Embed v2". Form odpowiedzi kompatybilny z OpenAI, więc istniejące biblioteki klienta pracują niezmienione. /api / ma pełne odniesienie.

Samodomowe modele trzymaj tekst na naszych GPU i odrzuć go po powrocie połączenia. Premium przejść z DPA. Nie trenujemy na wejściach.

Pod-100m dla krótkiego tekstu na samo-hostingu, 100-500m na premię. Seria połączeń połączeń w przybliżeniu liniowo - 1000 kawałków zakończone w 2-10 sekund.

Tak - Free.ai przyznaje komercyjne wykorzystanie wbudowy. Budowa wyszukiwania produkcji, rurociągi RAG, systemy rekomendacyjne bez royalty per-verter.

Love Free.ai? Tell your friends!

Oceń tę stronę