Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 Токендер call
~100 Токендер call

Nomic Embed v2 - an embedding model, Nomic AI тарабынан курулган. Retrieval augmented generation with flexible vector sizes. боюнча эң күчтүү. Free.ai ГПУда өзүнчө жайгаштырылган — сиздин күн сайынгы токендердин пулу менен акысыз иштей алат (100 токендер чалуу үчүн). Apache 2.0 лицензиясы менен чыгарылган - коммерциялык колдонууга Free.ai лицензиясы менен уруксат берилген.

Кайра-кайра берилүүчү суроолор

Nomic Embed v2 текстти маанини камтыган нымдуу векторго (жалпы сандардын тизмесине) айландырат. Аны семантикалык издөө, кластерлөө, сунуштоо, издөө-кеңейтилген генерация (RAG) жана "бул текст бул текстке окшошпу" деген маселени чечүү үчүн колдонсо болот.

Типтүү өлчөмдөр моделге жараша 384, 768, 1024 же 1536. BGE-M3 издает 1024-dim; OpenAI Ada издает 1536. API ответ включает размер, так что ваш векторный ДБ выбирает правильный индекс.

Жаңы уюштуруучу моделдер (Free.ai'тин көпчүлүк параметрлери менен) 100дөн ашык тилдер үчүн даярдалган. Тилдер аралык издөө - англис тилинде издөө, испан тилиндеги документтерге окшош.

Модельдөн көз каранды 512ден 8192ге чейинки символдор. Узак киргизүүлөр кыскартылат - документтерди киргизүүдөн мурун абзацтарга бөлүү.

Nomic Embed v2 биздин GPU'лорубузда иштей алат жана эң арзан аспаптардын бири - ~100 токен бир чакыруу үчүн сиздин күн сайын акысыз топтогуңуздан алынат. $5 = 200K токен.

Да - POST строктардын тизмесин /v1/embeddings/ге жөнөтөт жана Nomic Embed v2 ошол эле тартипте векторлордун тизмесин кайтарат. Батареянын көлөмү бир суроо үчүн 2048ге чейин.

L2-нормализация по умолчанию - косинус сходства = точка произведения. Если вы хотите получить необработанные векторы для другой метрики расстояния, передайте 'normalize=false'.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 returns plain JSON floats; DB never sees the model.

Да - POST to /v1/embeddings/ with model="Nomic Embed v2". OpenAI-compatible response shape, so existing client libraries work unchanged. /api/ has the full reference.

Өзүн-өзү тейлеген моделдер текстти графикалык процессордо сактап, чакыруу келгенде аны жокко чыгарат. Premium DPA менен өтүп кетет. Биз сиздин киргизүүңүздү үйрөнбөйбүз.

Short text under-100ms on self-hosted, 100-500ms on premium. Batch calls scale roughly linearly - 1,000 chunks complete in 2-10 seconds.

Да - Free.ai коммерциялык максатта көмүлгөн файлдарды колдонууга уруксат берет. Продукциялык издөө, RAG конвейерлери, сунуштар системаларын түзүү үчүн вектордук автордук төлөмсүз.

Free.ai жактырган? Досторуңузга айтыңыз!

Бул барактын баасын баалоо