mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 жетони по call
~100 жетони по call

mxbai-embed-large-v1 е a модел на вградување изграден од mixedbread.ai. Најсилно во Semantic search, clustering, similarity.. Само домаќин на Free.ai ГПУ — трча бесплатно против вашиот дневен жетонски базен (100 žeтони по повик). Ослободен под Apache 2.0 - комерцијална употреба дозволена на Free.ai.

Често поставувани прашања

mxbai-embed-large-v1 го конвертира текстот во густ вектор (листа на пловци) кој запишува значење. Користете го за семантичко пребарување, групирање, препорака, генерација на пребарување (RAG) и за секоја задача каде што „ е овој текст сличен на овој текст“ важно.

Типични димензии се 384, 768, 1024 или 1536, во зависност од моделот. BGE-M3 емитува 1024- димензии; OpenAI Ada емитува 1536. Одговорот на API ја вклучува димензијата за вашиот вектор DB да го избере вистинскиот индекс.

Модерните модели на вградување (вклучувајќи ги и повеќето опции за Free.ai) се обучуваат на 100+ јазици. Пребарување на прекујазик - пребарување на англиски јазик, споредба со документи на шпански.

Во зависност од моделот, 512 до 8.192 жетони се скратени подолги влогови — долги делови документи во пасуси пред да се вградат.

mxbai-embed-large-v1 работи на нашите ГПУ и е меѓу најевтините алатки - околу ~100 жетони за повикот извлечен од вашиот дневен бесплатни базен. $5 = 200K жетони.

Yes - POST a list of strings to /v1/embeddings/ and mxbai-embed-large-v1 returns a list of vectors in the same order. Batch size up to 2,048 per request.

L2- нормализирано според стандардно - косинус сличност = тачка производ. Подај „ нормализирај=false “ ако сакате сирови вектори за различна метричка далечина.

Секој - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 враќа обични JSON плови; DB никогаш не го гледа моделот.

Да - POST до / v1/проневерување/ со модел=" mxbai-embed-large-v1". Облик на одговорот соодветен за OpenAI, па постојат библиотеки на клиентот работат непроменета. /api/ ја има целосната референца.

Самодомашните модели го чуваат текстот на нашите ГПУ и го отфрлаат откако ќе се врати повикот.

Sub-100ms for short text on self-hosted, 100-500ms on premium. Batch calls scale roughly linearly - 1,000 chunks complete in 2-10 seconds.

Да - зFree.ai доделува комерцијална употреба на вградените вграденици.

Like this tool? Share it!

Оцени ја оваа страница