Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 žetony na žetony call
~100 žetony na žetony call

Nomic Embed v2 je a Vkládání modelu postavený Nomic AI. Nejsilnější na Retrieval augmented generation with flexible vector sizes.. Self-hosted on Free.ai GPUs - zdarma běží proti vašemu každodennímu token bazénu (100 tokens za volání). Vydáno pod Apache 2.0 - komerční použití povoleno na Free.ai.

Často kladené otázky

Nomic Embed v2 přeměňuje text na hustý vektor (seznam plováků), který zachycuje význam. Použijte jej pro sémantické vyhledávání, shlukování, doporučení, generování stahovaných zrestaurovaných dat (RAG) a jakýkoli úkol, kde "je tento text podobný tomuto textu" záleží.

Typické rozměry jsou 384, 768, 1024, nebo 1536 v závislosti na modelu. BGE-M3 emituje 1024-dim; OpenAI Ada emituje 1536. Odpověď API obsahuje rozměr, takže váš vektor DB vybere správný index.

Moderní vkládání modelů (včetně většiny možností na Free.ai) je vyškoleno na 100+ jazycích. Cross-language recruiding works - vyhledávání v angličtině, zápas dokumentů ve španělštině.

512 až 8 192 žetonů v závislosti na modelu. Delší vstupy jsou zkráceny - před vložením do odstavců jsou vloženo dlouhé dokumenty.

Nomic Embed v2 běží na našich vlastních GPU a je jedním z nejlevnějších nástrojů - asi ~100 žetony na volání vytažené z vašeho denního bazénu zdarma. 5 dolarů = 200K žetony.

Ano - POST seznam řetězců /v1/embeddings/ a Nomic Embed v2 vrací seznam vektorů ve stejném pořadí. Velikost šarže až 2,048 na vyžádání.

L2-normalizováno standardně - kosinus podobnost = tečka produkt. Pass?normalizovat=false? pokud chcete surové vektory pro jinou vzdálenost metriky.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 vrací obyčejné JSON plováky; DB model nikdy nevidí.

Ano - POST to /v1/embeddings/ with model="Nomic Embed v2." OpenAI-kompatibilní reakční tvar, takže stávající klientské knihovny fungují beze změny. /api/ má plnou referenci.

Modely, které jsou v samoobslužném prostředí, si svůj text udržujte na našich GPU a po návratu hovoru jej vyhoďte. Premium projíždí s DPA. Na vstupy netrénujeme.

Sub-100ms pro krátký text na samohostované, 100-500ms na prémie. Dávkové hovory stupnice zhruba lineárně - 1000 kusů kompletní za 2-10 sekund.

Ano - Free.ai poskytuje komerční využití vkládání. Vybudovat výrobní vyhledávání, RAG potrubí, doporučovací systémy bez per-vektorové royalty.

Love Free.ai? Tell your friends!

Ohodnotit tuto stránku