Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 tokens per call
~100 tokens per call

Nomic Embed v2 iku an embedding model kang dibangun déning Nomic AI. Strongest at Retrieval augmented generation with flexible vector sizes.. Free.ai GPUs — dioperasikeun gratis ngalawan pool token anjeun saben dinten (100 tokens per call). Dirilis ing Apache 2.0 - panggunaan komersial diijini ing Free.ai.

Takon-takon sing asring diajukake

Nomic Embed v2 ngarobah teks jadi vektor padat (daptar angka apung) nu ngawengku harti. Digunakeun pikeun milarian semantik, clustering, rekomendasi, retrieval-augmented generation (RAG), jeung sagala tugas dimana "naon teks ieu sarua jeung teks éta" penting.

Dimensi umumna 384, 768, 1024, atawa 1536 gumantung kana model. BGE-M3 emits 1024-dim; OpenAI Ada emits 1536. Balapan API ngawengku dimensi supados vektor DB anjeun milih indeks anu leres.

Modern embedding model (kaasup pilihan paling loba dina Free.ai) dilatih dina 100 + basa. Cross-basa karya retrieval - milarian dina basa Inggris, dokumen match dina basa Spanyol.

512 nepi ka 8,192 token gumantung kana model. Input anu leuwih panjang dipotong - motong dokumen panjang kana paragraf saméméh ngandung.

Nomic Embed v2 dijalankeun dina GPU urang sorangan sarta salah sahiji alat anu paling murah — sakitar ~100 token per panggilan ditarik tina kolam renang gratis anjeun unggal dinten. $5 = 200K token.

Ya - POST daftar string ka /v1/embeddings/ sarta Nomic Embed v2 balikkeun daftar vektor dina urutan anu sami. Ukuran batch nepi ka 2,048 per panyungsi.

L2-normalisasi ku pigura - cosinus kasama = produk titik. Laksanakeun 'normalize=false' lamun hayang vektor kasar pikeun metrik jarak anu béda.

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 returns plain JSON floats; the DB never sees the model.

Ya - POST ka /v1/embeddings/ kalawan model="Nomic Embed v2". OpenAI-kompatibel jawaban bentuk, jadi klien library anu aya digawé tanpa dirobah. /api/ boga referensi pinuh.

Model self-hosted nyimpen teks anjeun dina GPU urang sarta ngaleupaskeun éta saatos panggilan balik. Premium ngaliwatan DPA. Kami henteu latihan dina input anjeun.

Sub-100ms pikeun teks pondok dina self-hosted, 100-500ms on premium. Panggero batch skala kira-kira linearly - 1,000 chunks réngsé dina 2-10 detik.

Ya - Free.ai ngayakeun panggunaan komersial tina ngawengku. Bangunan pencarian produksi, pipa RAG, sistem rekomendasi tanpa royalti per-vektor.

Love Free.ai? Nyathet kanca-kancamu!

Nilai kaca iki