mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

mxbai-embed-large-v1 là a mô hình embedding được xây bởi mixedbread.ai. Đứng đầu là Semantic search, clustering, similarity.. Tự lưu trữ trên Free.ai GPU — chạy miễn phí đối với hồ token hàng ngày của bạn (100 tokens mỗi cuộc gọi). Phát hành dưới Apache 2.0 - sử dụng thương mại được phép trên Free.ai.

Câu hỏi thường gặp

mxbai-embed-large-v1 chuyển đổi văn bản thành một vectơ dày (danh sách các số phình) để ghi lại ý nghĩa. Dùng nó cho tìm kiếm ngữ nghĩa, tập hợp, khuyến nghị, tạo tăng cường lấy lại (RAG), và bất kỳ công việc nào mà "đoạn văn này có giống với đoạn văn đó" là quan trọng.

Các chiều thường là 384, 768, 1024, hoặc 1536 tùy thuộc vào mô hình. BGE-M3 phát ra 1024-dim; OpenAI Ada phát ra 1536. Phản ứng API bao gồm chiều để vector DB của bạn chọn chỉ số đúng.

Các mô hình nhúng hiện đại (bao gồm hầu hết các tùy chọn trên Free.ai) được huấn luyện trên hơn 100 ngôn ngữ. Việc lấy lại từ nhiều ngôn ngữ - tìm kiếm bằng tiếng Anh, kết hợp tài liệu bằng tiếng Tây Ban Nha.

512 to 8,192 tokens depending on the model. Longer inputs are truncated - chunk long documents into paragraphs before embedding.

mxbai-embed-large-v1 chạy trên GPU của chúng tôi và là một trong những công cụ rẻ nhất - khoảng ~100 token mỗi cuộc gọi được rút ra từ hồ bơi miễn phí hàng ngày của bạn. $5 = 200K token.

Có - POST một danh sách các chuỗi vào /v1/embeddings/ và mxbai-embed-large-v1 trả lại một danh sách các vectơ theo thứ tự tương tự. Cỡ gói lên đến 2,048 mỗi yêu cầu.

Mặc định là L2- chuẩn hóa - tương đồng cos = tích điểm. Gửi « normalize=false » nếu bạn muốn vectơ nguyên cho một đo khoảng cách khác.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 trả về float JSON bình thường; DB không bao giờ thấy mô hình.

Có - POST to /v1/embeddings/ with model="mxbai-embed-large-v1". OpenAI-compatible response shape, so existing client libraries work unchanged. /api/ has the full reference.

Các mô hình tự chủ giữ văn bản của bạn trên GPU của chúng tôi và bỏ nó sau khi cuộc gọi trở lại. Premium truyền qua với DPA. Chúng tôi không huấn luyện vào đầu vào của bạn.

Sub-100ms for short text on self-hosted, 100-500ms on premium. Batch calls scale roughly linearly - 1,000 chunks complete in 2-10 seconds.

Có - Free.ai cho phép sử dụng thương mại các bản nhúng. xây dựng tìm kiếm sản xuất, đường ống RAG, hệ thống khuyến nghị không có bản quyền trên mỗi vector.

Cậu yêu Free.ai?

Đánh giá trang này