Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 Počet žetónov na call
~100 Počet žetónov na call

Nomic Embed v2 je a Vkladací model postavený Nomic AI. Najsilnejší na Retrieval augmented generation with flexible vector sizes.. Vlastné hosťovanie na Free.ai grafických procesoroch – beží bezplatne proti vášmu dennému fondu tokenov (100 tokenov Cena za hovor). Vydané pod licenciou Apache 2.0 - komerčné použitie povolené na Free.ai.

Často kladené otázky

Nomic Embed v2 konvertuje text do hustého vektora (zoznamu float), ktorý zachytáva význam.Používajte ho pre sémantické vyhľadávanie, zhlukovanie, odporúčanie, generovanie s vyhľadávaním (RAG) a akúkoľvek úlohu, kde "je tento text podobný tomuto textu" záleží.

Typické rozmery sú 384, 768, 1024 alebo 1536 v závislosti od modelu. BGE-M3 emituje 1024-dim; OpenAI Ada emituje 1536. API odpoveď obsahuje rozmer, takže váš vektor DB vyberie správny index.

Moderné vkladacie modely (vrátane väčšiny možností na Free.ai) sú vyškolení na 100 + jazykov.Cross-jazyk vyhľadávanie pracuje - vyhľadávanie v angličtine, zápas dokumenty v španielčine.

512 to 8,192 tokens depending on the model. Longer inputs are truncated - chunk long documents into paragraphs before embedding.

Nomic Embed v2 beží na našich vlastných GPU a je jedným z najlacnejších nástrojov - asi ~100 tokenov za hovor čerpaných z vášho denného voľného fondu. $5 = 200K tokenov.

Áno - POST zoznam reťazcov do /v1/embeddings/ a Nomic Embed v2 vráti zoznam vektorov v rovnakom poradí.Veľkosť dávky až 2,048 na požiadavku.

L2-normalizované štandardne — kosínusová podobnosť = bodový súčin.Predajte `normalize=false` ak chcete surové vektory pre inú vzdialenostnú metriku.

Akékoľvek - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 vracia obyčajné JSON floats; DB nikdy nevidí model.

Áno - POST do /v1/embeddings/ s modelom "Nomic Embed v2". OpenAI-kompatibilný tvar odpovede, takže existujúce klientske knižnice pracujú bez zmien. /api/ má úplný odkaz.

Self-hosted modely ukladajú text na naše GPU a po návrate hovoru ho vymažú. Premium pass cez DPA, netreníme na základe vašich vstupov.

Pod 100 ms pre krátky text na vlastnom hostiteľovi, 100-500 ms na prémiovom.Hromadné hovory sa škálujú približne lineárne - 1000 kusov sa dokončí za 2-10 sekúnd.

Áno - Free.ai udeľuje komerčné použitie vkladania.Budovať produkčné vyhľadávanie, RAG potrubia, odporúčacie systémy bez per-vektor royalty.

Milujete Free.ai? Povedzte svojim priateľom!

Ohodnoťte túto stránku