Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 біт call
~100 біт call

Nomic Embed v2 is a Убудаваныя built by Nomic AI. Strongest at Retrieval augmented generation with flexible vector sizes.. Самастойна на Free.ai GPU - працуе бясплатна з дапамогай вашага штодзённага рэсурснага фонду (100 рэсурсы за выклік). Released under Apache 2.0 — commercial use permitted on Free.ai.

Частыя пытанні

Nomic Embed v2 пераўтварае тэкст у шчыльны вектар (спіс з плаваючай кропкай), які захоплівае сэнс. Выкарыстоўвайце яго для семантычнага пошуку, кластэрызацыі, рэкамендацый, генерацыі з дапамогай пошуку і любой задачы, дзе важна "ці падобны гэты тэкст да таго тэкст".

Тыповыя памеры - 384, 768, 1024 або 1536 у залежнасці ад мадэлі. BGE-M3 выдае 1024-dim; OpenAI Ada выдае 1536. Адказ API ўключае памер, каб ваша база дадзеных вектараў выбірала правільны індэкс.

Сучасныя ўбудаваныя мадэлі (уключаючы большасць опцый на Free.ai) навучаны на 100+ мовах. Крос- моўны пошук працуе - пошук па- англійску, суадносіны дакументаў па- іспанску.

Ад 512 да 8192 знакаў у залежнасці ад мадэлі. Больш доўгія ўводзіны абрэзаныя - доўгія дакументы перад убудоўваннем падзяляюцца на параграфы.

Nomic Embed v2 runs on our own GPUs and is among the cheapest tools - about ~100 tokens per call drawn from your daily free pool. $5 = 200K tokens.

Так - POST спіс радкоў у / v1/ embeddings / і Nomic Embed v2 вяртае спіс вектараў у тым жа парадку. Памер партыі да 2048 за запыт.

Па змаўчанні L2- нарматываная - касіно падобнасць = кропкавы прадукт. Перадайце 'normalize=false', калі вы хочаце, каб звычайныя вектары для іншай метрыкі адлегласці.

Усе - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 вяртае просты JSON з плаваючымі значэннямі; база дадзеных ніколі не бачыць мадэль.

Yes - POST to /v1/embeddings/ with model="Nomic Embed v2". OpenAI-compatible response shape, so existing client libraries work unchanged. /api/ has the full reference.

Самастойныя мадэлі захоўваюць ваш тэкст на нашых GPU і адкідваюць яго пасля вяртання выкліку. Premium праходзіць праз DPA. Мы не трэніруемся на вашых уводах.

Пад 100 мільсекунд для кароткіх тэкстаў на самаабслугоўванні, 100- 500 мільсекунд на прэміум- абслугоўванні. Пакетныя выклікі скаляруюцца лінейна - 1000 блокаў завяршаюцца за 2- 10 секунд.

Так - Free.ai дазваляе выкарыстанне ўбудаваных файлаў у камерцыйных мэтах. Збудоўваць пошук, канвееры RAG, рэкамендацыйныя сістэмы без аплаты за вектар.

Любіце Free.ai? Раскажыце сваім сябрам!

Ацэнка гэтай старонкі