BGE-M3

Free.ai (self-hosted) · embeddings · ~100 žetony na žetony call
~100 žetony na žetony call

BGE-M3 je a Vkládání modelu postavený BAAI. Nejsilnější na Text embeddings, semantic search. Self-hosted on Free.ai GPUs - zdarma běží proti vašemu každodennímu token bazénu (100 tokens za volání). Vydáno pod MIT - komerční použití povoleno na Free.ai.

Použití přes API

OpenAI kompatibilní REST API. Generovat klíč a zavolat tento model v sekundách.

curl -X POST https://api.free.ai/v1/image/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"bge-m3","prompt":"your prompt here"}'
Dokumentace API Získat API klíč

Často kladené otázky

BGE-M3 přeměňuje text na hustý vektor (seznam plováků), který zachycuje význam. Použijte jej pro sémantické vyhledávání, shlukování, doporučení, generování stahovaných zrestaurovaných dat (RAG) a jakýkoli úkol, kde "je tento text podobný tomuto textu" záleží.

Typické rozměry jsou 384, 768, 1024, nebo 1536 v závislosti na modelu. BGE-M3 emituje 1024-dim; OpenAI Ada emituje 1536. Odpověď API obsahuje rozměr, takže váš vektor DB vybere správný index.

Moderní vkládání modelů (včetně většiny možností na Free.ai) je vyškoleno na 100+ jazycích. Cross-language recruiding works - vyhledávání v angličtině, zápas dokumentů ve španělštině.

512 až 8 192 žetonů v závislosti na modelu. Delší vstupy jsou zkráceny - před vložením do odstavců jsou vloženo dlouhé dokumenty.

BGE-M3 běží na našich vlastních GPU a je jedním z nejlevnějších nástrojů - asi ~100 žetony na volání vytažené z vašeho denního bazénu zdarma. 5 dolarů = 200K žetony.

Ano - POST seznam řetězců /v1/embeddings/ a BGE-M3 vrací seznam vektorů ve stejném pořadí. Velikost šarže až 2,048 na vyžádání.

L2-normalizováno standardně - kosinus podobnost = tečka produkt. Pass?normalizovat=false? pokud chcete surové vektory pro jinou vzdálenost metriky.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. BGE-M3 vrací obyčejné JSON plováky; DB model nikdy nevidí.

Ano - POST to /v1/embeddings/ with model="BGE-M3." OpenAI-kompatibilní reakční tvar, takže stávající klientské knihovny fungují beze změny. /api/ má plnou referenci.

Modely, které jsou v samoobslužném prostředí, si svůj text udržujte na našich GPU a po návratu hovoru jej vyhoďte. Premium projíždí s DPA. Na vstupy netrénujeme.

Sub-100ms pro krátký text na samohostované, 100-500ms na prémie. Dávkové hovory stupnice zhruba lineárně - 1000 kusů kompletní za 2-10 sekund.

Ano - Free.ai poskytuje komerční využití vkládání. Vybudovat výrobní vyhledávání, RAG potrubí, doporučovací systémy bez per-vektorové royalty.

Love Free.ai? Tell your friends!

Ohodnotit tuto stránku