Nomic Embed v2

Free.ai (self-hosted) · embeddings · ~100 Μάρκες ανά call
~100 Μάρκες ανά call

Nomic Embed v2 είναι a Υπόδειγμα προσθήκης κατασκευής από Nomic AI. Πιο δυνατό στο Retrieval augmented generation with flexible vector sizes.. Αυτό-φιλοξενούνται σε Free.ai GPUs ~ τρέχει δωρεάν ενάντια σας καθημερινή πισίνα μάρκα (100 μάρκες ανά κλήση). Κυκλοφόρησε στο πλαίσιο Apache 2.0 - εμπορική χρήση επιτρέπεται στο Free.ai.

Συχνές Ερωτήσεις

Nomic Embed v2 μετατρέπει το κείμενο σε ένα πυκνό διάνυσμα (μια λίστα των άρματα) που συλλαμβάνει νόημα. Χρησιμοποιήστε το για σημασιολογική αναζήτηση, συστάδες, συστάσεις, ανάκτηση-αυξανόμενη γενιά (RAG), και κάθε εργασία όπου "είναι αυτό το κείμενο παρόμοιο με αυτό το κείμενο" μετράει.

Τυπικές διαστάσεις είναι 384, 768, 1024, ή 1536 ανάλογα με το μοντέλο. BGE-M3 εκπέμπει 1024-dim; OpenAI Ada εκπέμπει 1536. Η απόκριση API περιλαμβάνει τη διάσταση έτσι ώστε το διάνυσμα σας DB επιλέγει το σωστό δείκτη.

Μοντέρνα μοντέλα ενσωμάτωσης (συμπεριλαμβανομένων των περισσότερων επιλογών για Free.ai) εκπαιδεύονται σε 100+ γλώσσες. Διαγλωσσικά έργα ανάκτησης - αναζήτηση στα αγγλικά, τα έγγραφα αγώνα στα ισπανικά.

512 έως 8.192 μάρκες ανάλογα με το μοντέλο. Μεγαλύτερες εισόδους είναι trunnated ~ chunk μακριά έγγραφα σε παραγράφους πριν από την ενσωμάτωση.

Nomic Embed v2 τρέχει με δικά μας GPUs και είναι μεταξύ των φθηνότερα εργαλεία - περίπου ~100 μάρκες ανά κλήση που λαμβάνονται από την καθημερινή δωρεάν πισίνα σας. $ 5 = 200K μάρκες.

Ναι - ΠΩΜΑ μια λίστα συμβολοσειρών /v1/embeddings / και Nomic Embed v2 επιστρέφει μια λίστα των διανυσματικών φορέων με την ίδια σειρά. Μέγεθος παρτίδας μέχρι 2.048 ανά αίτημα.

L2-κανονίστηκε από προεπιλογή - ομοιότητα συνημίτονου = προϊόν κουκκίδα. Pass

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. Nomic Embed v2 επιστρέφει απλό JSON επιπλέει? η DB ποτέ δεν βλέπει το μοντέλο.

Ναι - POST to /v1/embeddings/ with model="Nomic Embed v2". OpenAI-συμβατό σχήμα απόκρισης, έτσι ώστε οι υπάρχουσες βιβλιοθήκες πελατών να λειτουργούν αμετάβλητοι. /api/ έχει την πλήρη αναφορά.

Αυτο-φιλοξενούμενα μοντέλα κρατούν το κείμενο σας στις GPU μας και να το απορρίψετε μετά την επιστροφή κλήσης. Premium περνάει μέσα με ένα DPA. Δεν εκπαιδεύονται στις εισόδους σας.

Υπο-100ms για σύντομο κείμενο σε αυτο-φιλοξενούμενο, 100-500ms σε premium. Batch κλήσεις κλίμακας περίπου γραμμικά - 1.000 κομμάτια ολοκληρωθεί σε 2-10 δευτερόλεπτα.

Ναι - Free.ai χορηγεί εμπορική χρήση των κτερίσματα. Κατασκευάστε την έρευνα παραγωγής, RAG αγωγούς, συστήματα σύστασης χωρίς δικαιώματα ανά ανάκτητο.

Love Free.ai? Tell your friends!

Βαθμολογήστε αυτή τη σελίδα