mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

mxbai-embed-large-v1 is an inbeddingsmodel gebouwd door mixedbread.ai. Sterkste bij Semantic search, clustering, similarity.. Zelf gehost op Free.ai GPU's loopt gratis tegen uw dagelijkse token pool (100 tokens per oproep). Vrijgegeven onder Apache 2.0 - commercieel gebruik toegestaan op Free.ai.

Veelgestelde vragen

mxbai-embed-large-v1 zet tekst om in een dichte vector (een lijst van praalwagens) die betekenis vangt. Gebruik het voor semantische zoekopdracht, clustering, aanbeveling, ophaal-augmented generatie (RAG), en elke taak waar "is deze tekst vergelijkbaar met die tekst" zaken.

Typische afmetingen zijn 384, 768, 1024, of 1536 afhankelijk van het model. BGE-M3 zendt 1024-dim uit; OpenAI Ada zendt 1536 uit. De API response bevat de dimensie zodat je vector DB de juiste index kiest.

Moderne inbedden modellen (inclusief de meeste opties op Free.ai) zijn opgeleid op 100+ talen. Kruistalige ophalen - zoek in Engels, wedstrijd documenten in het Spaans.

512 tot 8.192 tokens afhankelijk van het model. Langere ingangen worden afgekapt - lange documenten in de alinea's voor inbedding.

mxbai-embed-large-v1 draait op onze eigen GPU's en is een van de goedkoopste tools - ongeveer ~ 100 tokens per oproep getrokken uit uw dagelijkse gratis zwembad. $5 = 200K tokens.

Ja - POST een lijst van tekenreeksen naar /v1/embeddings/ en mxbai-embed-large-v1 geeft een lijst van vectoren in dezelfde volgorde terug. Batchgrootte tot 2.048 per aanvraag.

L2-normaliseerd standaard - cosinus overeenkomst = punt product. Pass

Alle - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 geeft effen JSON praalwagens terug; de DB ziet nooit het model.

Ja - POST naar /v1/embedden/ met model="mxbai-embed-large-v1." OpenAI-compatibele responsvorm, zodat bestaande clientbibliotheken niet veranderen. /api/ heeft de volledige referentie.

Zelfgehoste modellen houden uw tekst op onze GPU's en gooien deze weg na de oproep terug. Premium passeren met een DPA. Wij trainen niet op uw ingangen.

Sub-100ms voor korte tekst op zelf-gehoste, 100-500ms op premium. Batch oproepen schaal ruwweg lineair - 1.000 brokken voltooid in 2-10 seconden.

Ja - Free.ai verleent commercieel gebruik van inbeddingen. Bouwproductie zoeken, RAG pijpleidingen, aanbeveling systemen zonder per-vector royalty.

Love Free.ai? Vertel het uw vrienden!

Beoordeel deze pagina