Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

Nomic Embed v2 se an Embedded model ki te bati pa Nomic AI. Li se pi gwo nan Retrieval augmented generation with flexible vector sizes.. Self-hosted sou Free.ai GPUs — kouri gratis kont chak jou ou a token pool (100 tokens pou chak apèl). Li libere anba Apache 2.0 - itilize komèsyal ki pèmèt sou Free.ai.

Kesyon ki poze souvan

Nomic Embed v2 konvèti tèks nan yon vektè dense (yon lis de float) ki pran sans. Itilize li pou rechèch semantik, klasman, rekòmandasyon, retrieval-augmented jenerasyon (RAG), ak nenpòt travay kote "se tèks sa a menm jan ak tèks la" enpòtan.

Dimansyon ki pi komen yo se 384, 768, 1024, oswa 1536 depann sou modèl la. BGE-M3 emits 1024-dim; OpenAI Ada emits 1536. Reponn API a gen ladan dimansyon an se konsa vektè DB ou a chwazi endèks la dwa.

Modèles intégration modèn (ki gen ladan pifò opsyon sou Free.ai) yo trete sou 100 + lang. Cross-lang travay rekiperasyon - rechèch nan lang angle, matche ak dokiman an Espay.

512 a 8,192 tokens depann sou modèl la. Enfòmasyon ki pi long yo tronke — chunk long dokiman nan paragraf anvan enkòporasyon.

Nomic Embed v2 kouri sou GPUs nou menm ak se youn nan zouti ki pi bon mache - sou ~ 100 tokens pou chak apèl te tire soti nan chak jou gratis ou. $5 = 200K tokens.

Wi - POST yon lis strings nan /v1/embeddings/ ak Nomic Embed v2 retounen yon lis vektè nan menm lòd. gwosè batch jiska 2,048 pou chak demann.

L2-normalized pa default - cosine similarity = dot product. Pass `normalize=false` si ou vle vektè a pou yon distans diferan.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 retounen JSON floats; DB pa janm wè modèl la.

Wi - POST nan /v1/embeddings/ ak modèl "Nomic Embed v2". OpenAI-kompatib fòme repons, se konsa bibliyotèk kliyan ki egziste yo travay san chanjman. /api/ gen referans konplè.

Self-hosted modèl kenbe tèks ou sou GPUs nou yo ak debarase m de li apre apèl la tounen. Premium pase pa yon DPA. Nou pa antrene sou enputs ou.

Sub-100ms pou tèks kout sou tèt-hosted, 100-500ms sou prim. Batch apèl skale alantou linètman - 1,000 moso konplè nan 2-10 segonn.

Wi - Free.ai bay dwa pou itilize komèsyal nan embeddings. Konstriksyon rechèch pwodiksyon, RAG pipelines, sistèm rekòmandasyon san royalty pou chak vektè.

Love Free.ai? Di zanmi ou yo!

Rapò paj sa a