mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 توکنها در هر call
~100 توکنها در هر call

. mxbai-embed-large-v1 a مدل درون‌سازی ساخته شده توسط mixedbread.ai Strongest at Semantic search, clustering, similarity.. Free.ai GPUs self-hosted — freely runs against your daily token pool (100 tokens در هر تماس). انتشار تحت Apache 2.0 - استفاده تجاری اجازه داده شده در Free.ai.

پرسشهای متداول

mxbai-embed-large-v1 متن را به یک بردار متراکم (یک فهرست از شناورها) تبدیل می‌کند که معنا را دریافت می‌کند. از آن برای جستجو معنایی، خوشه بندی، توصیه، تولید بازیابی-افزایش یافته (RAG) و هر کاری که «این متن شبیه آن متن است» اهمیت دارد استفاده کنید.

Typical dimensions are 384, 768, 1024, or 1536 depending on the model. BGE-M3 emits 1024-dim; OpenAI Ada emits 1536. The API response includes the dimension so your vector DB picks the right index.

مدل‌های جاسازی مدرن (از جمله بیشتر گزینه‌ها در Free.ai) در بیش از ۱۰۰ زبان آموزش داده می‌شوند. بازیابی بین زبانی کار می‌کند - جستجو در انگلیسی، مطابقت سندها در اسپانیایی.

۵۱۲ تا ۸۱۹۲ نشانه بستگی به مدل دارد. ورودیهای طولانی تر قطع می‌شوند - سندهای طولانی را قبل از جاسازی به پاراگرافها تقسیم کنید.

mxbai-embed-large-v1 روی GPUهای خودمان اجرا می‌شود و یکی از ارزان‌ترین ابزارها است - حدود ~100 توکن در هر تماس که از pool روزانه رایگان شما کشیده می‌شود. $5 = 200K tokens.

بله - POST یک لیست از رشته‌ها به /v1/embeddings/ و mxbai-embed-large-v1 بازگرداندن یک لیست از بردارها در همان ترتیب. اندازه بسته تا 2,048 در هر درخواست.

به صورت پیش‌فرض L2- نرمال‌شده - شباهت کوسین = حاصل نقطه. اگر بردارهای خام را برای متریک فاصله متفاوت می‌خواهید ، « normalize=false » را منتقل کنید.

هر - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 returns plain JSON floats; DB never sees the model.

بله - POST به /v1/embeddings/ با model="mxbai-embed-large-v1". OpenAI-compatible response shape، بنابراین کتابخانه‌های مشتری موجود بدون تغییر کار می‌کنند. /api/ دارای مرجع کامل است.

مدلهای خود میزبانی متن شما را در GPUهای ما نگه می‌دارند و پس از بازگشت تماس آن را دور می‌اندازند. Premium با DPA از میان می‌گذرد. ما ورودی‌های شما را آموزش نمی‌دهیم.

زیر-۱۰۰ میلی‌ثانیه برای متن کوتاه در خود-میزبان، ۱۰۰-۵۰۰ میلی‌ثانیه در پریمیوم. تماس‌های دسته تقریباً خطی مقیاس‌پذیر هستند - ۱۰۰۰ قطعه در ۲-۱۰ ثانیه کامل می‌شوند.

بله - Free.ai اجازه استفاده تجاری از توکارها را می دهد. ساخت جستجوی تولید، لوله های RAG، سیستم های توصیه بدون حق امتیاز بردار.

دوست Free.ai رو به دوستانت بگو

رتبه این صفحه