mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

mxbai-embed-large-v1 es a modelo de incrustaciones construido por mixedbread.ai. Más fuerte en Semantic search, clustering, similarity.. Auto-alojado en Free.ai GPUs — funciona gratis contra su piscina diaria de tokens (100 tokens por llamada). Liberado bajo Apache 2.0 - uso comercial permitido en Free.ai.

Preguntas frecuentes

mxbai-embed-large-v1 convierte texto en un vector denso (una lista de flotadores) que captura el significado. Utilícelo para búsqueda semántica, agrupación, recomendación, generación aumentada de recuperación (RAG), y cualquier tarea en la que "es este texto similar a ese texto" importa.

Las dimensiones típicas son 384, 768, 1024, o 1536 dependiendo del modelo. BGE-M3 emite 1024-dim; OpenAI Ada emite 1536. La respuesta API incluye la dimensión para que su vector DB elija el índice correcto.

Los modelos modernos de incrustación (incluyendo la mayoría de las opciones en Free.ai) están capacitados en más de 100 idiomas.

512 tokens a 8.192 dependiendo del modelo. Las entradas más largas son truncadas - trocear documentos largos en párrafos antes de incrustar.

mxbai-embed-large-v1 se ejecuta en nuestras propias GPU y está entre las herramientas más baratas - alrededor de ~100 tokens por llamada sorteada de su piscina gratuita diaria. $5 = 200K tokens.

Sí - Publicar una lista de cadenas a /v1/embeddings/ y mxbai-embed-large-v1 devuelve una lista de vectores en el mismo orden. Tamaño de lote hasta 2,048 por solicitud.

L2-normalizado por defecto - semejanza coseno = producto punto. Pase `normalizar = falso` si desea vectores en bruto para una métrica de distancia diferente.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 devuelve flotadores JSON planos; la DB nunca ve el modelo.

Sí - POST to /v1/embeddings/ with model="mxbai-embed-large-v1". Forma de respuesta compatible con OpenAI, por lo que las bibliotecas cliente existentes funcionan sin cambios. /api/ tiene la referencia completa.

Los modelos auto-alojados guardan su texto en nuestras GPUs y lo descartan después de que la llamada regrese. Pase Premium con un DPA. No entrenamos en sus entradas.

Sub-100ms para texto corto en auto-anfitrión, 100-500ms en prima. Escala de llamadas por lotes aproximadamente lineal - 1.000 pedazos completos en 2-10 segundos.

Sí - Free.ai concede el uso comercial de incrustaciones. Construir búsqueda de producción, tuberías RAG, sistemas de recomendación sin regalías por vector.

¿Ama a Free.ai? ¡Dile a tus amigos!

Calificar esta página