Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 tokens တစ်ဦးချင်းစီ call
~100 tokens တစ်ဦးချင်းစီ call

Nomic Embed v2 သည် a ထည့်သွင်းထားသော မော်ဒယ် ကို Nomic AI မှတည်ဆောက်ထားသည်။ Retrieval augmented generation with flexible vector sizes. မှာအခိုင်အမာဆုံး. Free.ai GPUs အပေါ် Self-hosted - သင်၏နေ့စဉ် token ကိုရေကန် (100 tokens ခေါ်ဆိုမှုတိုင်း) ကိုတိုက်ခိုက်အခမဲ့ runs ။ အောက်တွင်ထုတ်ဝေ Apache 2.0 - စီးပွားရေးလုပ်ငန်းအသုံးပြုခွင့်အပေါ် Free.ai.

မေးလေ့ရှိသောမေးခွန်းများ

Nomic Embed v2 အဓိပ္ပါယ်ကိုဖမ်းယူသောအထူ vector (floats များ၏စာရင်း) တစ်ခုသို့စာသားကိုပြောင်း. semantic ရှာဖွေရေးအတွက်အသုံးပြု, clustering, အကြံပြုချက်, retrieval-augmented generation (RAG) နှင့် "ဒီစာသားကိုထိုစာသားနှင့်တူသည်" ကိစ္စရပ်များရှိရာမည်သည့်အလုပ်.

ယေဘုယျအတိုင်းအတာများ 384, 768, 1024, သို့မဟုတ် 1536 မော်ဒယ်ပေါ် မူတည်. BGE-M3 ထုတ်လွှင့် 1024-dim; OpenAI Ada ထုတ်လွှင့် 1536. အဆိုပါ API ကိုတုံ့ပြန်မှုသင့်ရဲ့ vector DB ကိုမှန်ကန်သောညွှန်းကိန်း picks စေရန်ဒီတော့အရွယ်အစားပါဝင်သည်.

ခေတ်မီ embedding ပုံစံများ (Free.ai အပေါ်အများဆုံး options များကိုအပါအဝင်) အပေါ်လေ့ကျင့် 100+ ဘာသာစကားများ. Cross-ဘာသာစကား retrieval အလုပ် - အင်္ဂလိပ်ဘာသာဖြင့်ရှာဖွေ, စပိန်ဘာသာစကားဖြင့်စာရွက်စာတမ်းများကိုချိန်းတွေ့.

512 မှ 8,192 တန်ဖိုးများမော်ဒယ်ပေါ် မူတည်. ပိုမိုကြာရှည် inputs များကို truncated နေကြသည် - embedding မတိုင်မီပုဒ်မများထဲသို့ရှည်လျားသောစာရွက်စာတမ်းများကိုတုံး.

Nomic Embed v2 ကျွန်တော်တို့ရဲ့ကိုယ်ပိုင် GPUs ပေါ်မှာ run ပြီးစျေးအသက်သာဆုံး tools များအကြားဖြစ်ပါသည် - အကြောင်း ~100 သင့်ရဲ့နေ့စဉ်အခမဲ့ရေကန်မှ drawn call တစ်ဦးလျှင် tokens တွေကို. $5 = 200K tokens တွေကို.

ဟုတ်ကဲ့ - POST /v1/embeddings/ နှင့် Nomic Embed v2 တူညီသောအမိန့်တွင် vector များ၏စာရင်းကိုပြန်ပေးပို့ strings များ၏စာရင်းတစ်ခု. အထိ batch အရွယ်အစား 2,048 တောင်းဆိုမှုတစ်ဦးလျှင်.

L2-normalized by default - cosine တူညီမှု= dot product. သင်ကွဲပြားခြားနားသောအကွာအဝေးမီတာများအတွက် raw vector များလိုပါက pass `normalize=false`.

မည်သည့် - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 ရိုးရှင်းတဲ့ JSON floats ပြန်လာ; DB ကမော်ဒယ်ကိုမမြင်ရပါဘူး။

ဟုတ်ကဲ့ - POST ကို /v1/embeddings / နှင့်အတူ model ကို "Nomic Embed v2" ။ OpenAI-အဆင်ပြေတုံ့ပြန်မှုပုံစံ, ထိုသို့ရှိပြီးသား client ကိုစာအုပ်ဆိုင်အလုပ်အပြောင်းအလဲမရှိ။ /api/ ပြည့်စုံသောအညွှန်းရှိသည်။

Self-hosted ပုံစံများကျွန်တော်တို့ရဲ့ GPUs အပေါ်သင်၏စာသားကိုထိန်းသိမ်းထားပြီးခေါ်ဆိုမှုပြန်လာပြီးနောက်စွန့်ပစ်. Premium ကိုတစ်ဦး DPA နှင့်အတူဖြတ်သန်း. ကျွန်တော်တို့ဟာသင်၏ inputs တွေကိုအပေါ်လေ့ကျင့်သင်ကြားမထား.

Sub-100ms for short text on self-hosted, 100-500ms on premium. Batch calls scale roughly linearly - 1,000 chunks complete in 2-10 seconds.

ဟုတ်ကဲ့ - Free.ai embeddings ၏စီးပွားရေးလုပ်ငန်းအသုံးပြုမှုခွင့်ပြုချက်. ထုတ်လုပ်မှုရှာဖွေရေးတည်ဆောက်, RAG pipelines, မ per-vector royalty နဲ့အကြံပြုချက်စနစ်များ.

ချစ်ခြင်းမေတ္တာ Free.ai? သင့်ရဲ့မိတ်ဆွေများကိုပြောပါ!

ဒီစာမျက်နှာကိုရမှတ်