Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 För varje call
~100 För varje call

Nomic Embed v2 är an Inbäddningsmodell byggd av Nomic AI. Starkast i Retrieval augmented generation with flexible vector sizes.. Självvärdig på Free.ai GPUs – körs gratis mot din dagliga tokenpool (100 tokens per samtal). Släppt under Apache 2.0 - tillåten kommersiell användning på Free.ai.

Vanliga frågor

Nomic Embed v2 konverterar text till en tät vektor (en lista över flottar) som fångar mening. Använd den för semantisk sökning, klusterbildning, rekommendation, hämtning-augmented generation (RAG), och alla uppgifter där "är denna text liknande den texten" spelar roll.

Typiska mått är 384, 768, 1024 eller 1536 beroende på modell. BGE-M3 släpper 1024-dim; OpenAI Ada släpper 1536. API-svaret inkluderar dimension så att din vektor DB väljer rätt index.

Moderna inbäddningsmodeller (inklusive de flesta alternativ på Free.ai) är utbildade på 100+ språk. Språksökning på flera språk - sök på engelska, matcha dokument på spanska.

512 till 8.192 polletter beroende på modell. Längre ingångar är trunkerade - bit långa dokument i stycken innan inbäddning.

Nomic Embed v2 körs på våra egna GPU och är bland de billigaste verktygen - ca ~100 polletter per samtal dras från din dagliga gratis pool. $5 = 200K polletter.

Ja - POST en lista med strängar till /v1/ inbäddningar / och Nomic Embed v2 returnerar en lista med vektorer i samma ordning. Batch storlek upp till 2 048 per begäran.

L2-normaliserad som standard - cosinus likhet = punkt produkt. Passera "normalize=false" om du vill råa vektorer för en annan avståndsmått.

Alla - Pinecone, Weaviate, Qdrant, Chroma, Pgvector, FAISS, LanceDB. Nomic Embed v2 returnerar vanliga JSON flyter; DB aldrig ser modellen.

Ja - POST till /v1/ inbäddningar/ med modell="Nomic Embed v2". OpenAI-kompatibel responsform, så befintliga klientbibliotek fungerar oförändrat. /api/ har den fullständiga referensen.

Självvärdiga modeller behåller din text på våra GPU och kasserar den efter samtalsåtergången. Premium passera genom med en DPA. Vi tränar inte på dina ingångar.

Under-100m för kort text på självvärd, 100-500m på premium. Batch samtal skala ungefär linjärt - 1000 bitar komplett på 2-10 sekunder.

Ja - Free.ai beviljar kommersiell användning av inbäddningar. Bygga produktionssökning, RAG rörledningar, rekommendationssystem utan per-vektor royalty.

Love Free.ai? Tell your friends!

Betygsätt denna sida