BGE-M3

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

BGE-M3 er an indlejringsmodel bygget af BAAI. Stærkeste på Text embeddings, semantic search. Self-hostet på Free.ai GPU'er kører gratis mod din daglige token pool (100 tokens pr. opkald). Udgivelse under MIT - kommerciel brug tilladt på Free.ai.

Brug via API

OpenAI-kompatibel REST API. Generer en nøgle og ring til denne model på få sekunder.

curl -X POST https://api.free.ai/v1/image/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"bge-m3","prompt":"your prompt here"}'
API- dokumentation Hent API- nøgle

Ofte stillede spørgsmål

BGE-M3 konverterer tekst til en tæt vektor (en liste over flyder), der fanger betydning. Brug den til semantisk søgning, klyngedannelse, anbefaling, hentning-augmented generation (RAG), og enhver opgave, hvor "er denne tekst ligner denne tekst" betyder noget.

Typiske dimensioner er 384, 768, 1024, eller 1536 afhængigt af modellen. BGE-M3 udsender 1024-dim; OpenAI Ada udsender 1536. API-svaret inkluderer dimensionen, så din vektor DB vælger det rigtige indeks.

Moderne indlejringsmodeller (herunder de fleste muligheder på Free.ai) er uddannet på 100+ sprog. Tværsprogssøgning - søgning på engelsk, matche dokumenter på spansk.

512 til 8.192 tokens afhængigt af modellen. Længere indgange er trunkerede - stykke lange dokumenter i afsnit før indlejring.

BGE-M3 kører på vores egne GPU'er og er blandt de billigste værktøjer - omkring ~ 100 poletter per opkald trukket fra din daglige gratis pool. $ 5 = 200K poletter.

Ja - POST en liste over strenge til /v1/embeddings/ og BGE-M3 giver en liste over vektorer i samme rækkefølge. Batchstørrelse op til 2,048 pr. forespørgsel.

L2-normaliseret som standard - cosin lighed = dot produkt. Pass ~normalize=falsk! hvis du ønsker rå vektorer for en anden afstand metriske.

Alle - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FISS, LanceDB. BGE-M3 returnerer almindelig JSON flyder; DB ser aldrig modellen.

Ja - POST til /v1/embeddings/ med model="BGE-M3". OpenAI-kompatibel responsform, så eksisterende klientbiblioteker fungerer uændret. /api/ har den fulde reference.

Selvværd modeller holde din tekst på vores GPU'er og kassere den efter opkaldet returnerer. Premium passere igennem med en DPA. Vi træner ikke på dine indgange.

Under 100ms for kort tekst på selvværd, 100-500ms på præmie. Batch opkald skala omtrent lineært - 1.000 stykker komplet i 2-10 sekunder.

Ja - Free.ai giver kommerciel brug af indlejringer. Byg produktionssøgning, RAG rørledninger, anbefaling systemer uden per-vektor royalty.

Love Free.ai? Tell your friends!

Bedøm denne side