Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 fitxes per call
~100 fitxes per call

Nomic Embed v2 és a Model d' incrustació construït per Nomic AI. Més fort a Retrieval augmented generation with flexible vector sizes.. Auto- màquina en les GPUs Free.ai - executades en contra de la vostra piscina diària (100 fitxes per crida). Publicat sota Apache 2.0 - Ús comercial permès en Free.ai.

Preguntes més freqüents

Nomic Embed v2 converteix text en un vector dens (una llista de flotants) que captura. Useu- lo per a cercar, clústeritzar, recomanació, generació de recuperació (RAG), i qualsevol tasca on "és similar a aquest text" importa.

Les dimensions típics són 384, 768, 1024, o 1536 depenent del model. BGE-M3 emet 1024- idem; OpenAIda emet 1536. La resposta de l' API inclou la dimensió de manera que la vostra divipella vectorial escull l' índex correcte.

Models d' encastats moderns (incloent- hi la majoria d' opcions a Free.ai) estan entrenats en 100+ llengües. La recuperació de l' idioma funciona - cerca en anglès, coincideix amb documents en castellà.

512 a 8192 fitxes depenent del model. Els valors d' entrada Longer es truncat - un tros de documents llargs en paràgrafs abans d' encastar- lo.

Nomic Embed v2 s'executen a les nostres pròpies GPUs i és entre les eines més barates - sobre ~100 fitxes per cridades a la teva piscina diària. 5 dòlars = 200K fitxes.

Yes - POST a list of strings to /v1/embeddings/ and Nomic Embed v2 returns a list of vectors in the same order. Batch size up to 2,048 per request.

L2- normalitzat per omissió - cosinus similaritat = punt producte. Passat Mrxotnormalize=false si voleu vectors crus per a una mètriques diferent de distància.

Qualsevol - Pinecne, Wevite, Qdrant, Chromoma, pgvector, FAISS, LanceDB. Nomic Embed v2 retorna pla JSON flotacions; la víctima mai veu el model.

Sí - POST a / v1/ embedings / amb model=" Nomic Embed v2 ". Forma de resposta compatible amb l' OpenAI, de manera que les biblioteques de client existents no es canvien. / api/ té la referència completa.

Els models auto-ordinadors mantenen el text a les nostres GPUs i el descarreguem després de que la trucada torni. Premium passa amb una DPA. No entren a les vostres entrades.

Sub-100ms per text curt en auto- màquina, 100- 500 ms en una corda. Escala de crides per lots - 1.000 trossos complets en 2- 10 segons.

Sí, Free.ai concedeix ús comercial d'insercions. Genera recerca de producció, canonades de producció ARG, sistemes de recomanació sense cap recurs reial.

Like this tool? Share it!

Valora aquesta pàgina