Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 жетони по call
~100 жетони по call

Nomic Embed v2 е a модел на вградување изграден од Nomic AI. Најсилно во Retrieval augmented generation with flexible vector sizes.. Само домаќин на Free.ai ГПУ — трча бесплатно против вашиот дневен жетонски базен (100 žeтони по повик). Ослободен под Apache 2.0 - комерцијална употреба дозволена на Free.ai.

Често поставувани прашања

Nomic Embed v2 го конвертира текстот во густ вектор (листа на пловци) кој запишува значење. Користете го за семантичко пребарување, групирање, препорака, генерација на пребарување (RAG) и за секоја задача каде што „ е овој текст сличен на овој текст“ важно.

Типични димензии се 384, 768, 1024 или 1536, во зависност од моделот. BGE-M3 емитува 1024- димензии; OpenAI Ada емитува 1536. Одговорот на API ја вклучува димензијата за вашиот вектор DB да го избере вистинскиот индекс.

Модерните модели на вградување (вклучувајќи ги и повеќето опции за Free.ai) се обучуваат на 100+ јазици. Пребарување на прекујазик - пребарување на англиски јазик, споредба со документи на шпански.

Во зависност од моделот, 512 до 8.192 жетони се скратени подолги влогови — долги делови документи во пасуси пред да се вградат.

Nomic Embed v2 работи на нашите ГПУ и е меѓу најевтините алатки - околу ~100 жетони за повикот извлечен од вашиот дневен бесплатни базен. $5 = 200K жетони.

Yes - POST a list of strings to /v1/embeddings/ and Nomic Embed v2 returns a list of vectors in the same order. Batch size up to 2,048 per request.

L2- нормализирано според стандардно - косинус сличност = тачка производ. Подај „ нормализирај=false “ ако сакате сирови вектори за различна метричка далечина.

Секој - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 враќа обични JSON плови; DB никогаш не го гледа моделот.

Да - POST до / v1/проневерување/ со модел=" Nomic Embed v2". Облик на одговорот соодветен за OpenAI, па постојат библиотеки на клиентот работат непроменета. /api/ ја има целосната референца.

Самодомашните модели го чуваат текстот на нашите ГПУ и го отфрлаат откако ќе се врати повикот.

Sub-100ms for short text on self-hosted, 100-500ms on premium. Batch calls scale roughly linearly - 1,000 chunks complete in 2-10 seconds.

Да - зFree.ai доделува комерцијална употреба на вградените вграденици.

Like this tool? Share it!

Оцени ја оваа страница