BGE-M3

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

BGE-M3 iku an embedding model dibangun déning BAAI. Strongest at Text embeddings, semantic search. Self-hosted on Free.ai GPUs — runs free against your daily token pool (100 tokens saben telpon). Released under MIT — commercial use permitted on Free.ai.

Nganggo liwat API

REST API kang kompatibel karo OpenAI. Janji kunci lan waca model iki ing sekon.

curl -X POST https://api.free.ai/v1/image/generate/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"bge-m3","prompt":"your prompt here"}'
Dokumen Njupuk Kunci API

Takon kang asring diajukake

BGE-M3 ngowahi teks dadi vektor kang padat (daftar angka kang ajeg) kang nyekel makna. Gunakaké kanggo pencarian semantik, clustering, rekomendasi, retrieval-augmented generation (RAG), lan tugas apa wae kang "apa teks iki padha karo teks iku" penting.

Dimènsi ingkang umum inggih punika 384, 768, 1024, utawi 1536 gumantung saking modélipun. BGE-M3 ngetokaken 1024-dim; OpenAI Ada ngetokaken 1536.

Model embedding modern (kajaba pilihan paling ing Free.ai) dilatih ing 100+ basa. Cross-basa retrieval karya - goleki ing Inggris, match dokumen ing Spanyol.

512 nganti 8,192 token gumantung karo modél. Input kang luwih dawa bakal dipotong - chunk dokumen dawa dadi paragraf sadurunge ngembang.

BGE-M3 runs on our own GPUs and is among the cheapest tools - about ~100 tokens per call drawn from your daily free pool. $5 = 200K tokens.

Ya - POST dhaptar strings ka /v1/embeddings/ lan BGE-M3 ngembali dhaptar vektor ing urutan kang padha. Ukuran batch nganti 2,048 saben pitakon.

L2-normalisasi déning pigura pigura - cosinus similarity = titik produk. Ngetokaken 'normalize=false' yèn sampeyan pengin vektor raw kanggo jarak metrik sing beda.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. BGE-M3 returns plain JSON floats; the DB never sees the model.

Yes - POST to /v1/embeddings/ with model="BGE-M3". OpenAI-compatible response shape, so existing client libraries work unchanged. /api/ has the full reference.

Model self-hosted nyimpen teks ing GPU kita lan mbusak sawisé panjaluk balik. Premium ngliwati karo DPA. Kita ora latihan ing input sampeyan.

Sub-100ms kanggé teks cekak ing self-hosted, 100-500ms ing premium. Batch panjaluk skala kira-kira linear - 1,000 chunks rampung ing 2-10 detik.

Ya - Free.ai nyedhiyani panggunaan komersial ing ngembang. Ngwangun panjaluk produksi, pipa RAG, sistem rekomendasi tanpa royalti per-vektor.

Love Free.ai? Nyathet kanca-kancamu!

Rangking kaca iki