mxbai-embed-large-v1

Free.ai (self-hosted) · embeddings · ~100 Μάρκες ανά call
~100 Μάρκες ανά call

mxbai-embed-large-v1 είναι a Υπόδειγμα προσθήκης κατασκευής από mixedbread.ai. Πιο δυνατό στο Semantic search, clustering, similarity.. Αυτό-φιλοξενούνται σε Free.ai GPUs ~ τρέχει δωρεάν ενάντια σας καθημερινή πισίνα μάρκα (100 μάρκες ανά κλήση). Κυκλοφόρησε στο πλαίσιο Apache 2.0 - εμπορική χρήση επιτρέπεται στο Free.ai.

Συχνές Ερωτήσεις

mxbai-embed-large-v1 μετατρέπει το κείμενο σε ένα πυκνό διάνυσμα (μια λίστα των άρματα) που συλλαμβάνει νόημα. Χρησιμοποιήστε το για σημασιολογική αναζήτηση, συστάδες, συστάσεις, ανάκτηση-αυξανόμενη γενιά (RAG), και κάθε εργασία όπου "είναι αυτό το κείμενο παρόμοιο με αυτό το κείμενο" μετράει.

Τυπικές διαστάσεις είναι 384, 768, 1024, ή 1536 ανάλογα με το μοντέλο. BGE-M3 εκπέμπει 1024-dim; OpenAI Ada εκπέμπει 1536. Η απόκριση API περιλαμβάνει τη διάσταση έτσι ώστε το διάνυσμα σας DB επιλέγει το σωστό δείκτη.

Μοντέρνα μοντέλα ενσωμάτωσης (συμπεριλαμβανομένων των περισσότερων επιλογών για Free.ai) εκπαιδεύονται σε 100+ γλώσσες. Διαγλωσσικά έργα ανάκτησης - αναζήτηση στα αγγλικά, τα έγγραφα αγώνα στα ισπανικά.

512 έως 8.192 μάρκες ανάλογα με το μοντέλο. Μεγαλύτερες εισόδους είναι trunnated ~ chunk μακριά έγγραφα σε παραγράφους πριν από την ενσωμάτωση.

mxbai-embed-large-v1 τρέχει με δικά μας GPUs και είναι μεταξύ των φθηνότερα εργαλεία - περίπου ~100 μάρκες ανά κλήση που λαμβάνονται από την καθημερινή δωρεάν πισίνα σας. $ 5 = 200K μάρκες.

Ναι - ΠΩΜΑ μια λίστα συμβολοσειρών /v1/embeddings / και mxbai-embed-large-v1 επιστρέφει μια λίστα των διανυσματικών φορέων με την ίδια σειρά. Μέγεθος παρτίδας μέχρι 2.048 ανά αίτημα.

L2-κανονίστηκε από προεπιλογή - ομοιότητα συνημίτονου = προϊόν κουκκίδα. Pass

Any - Pinecone, Weaviate, Qdrant, Chroma, pgvector, FAISS, LanceDB. mxbai-embed-large-v1 επιστρέφει απλό JSON επιπλέει? η DB ποτέ δεν βλέπει το μοντέλο.

Ναι - POST to /v1/embeddings/ with model="mxbai-embed-large-v1". OpenAI-συμβατό σχήμα απόκρισης, έτσι ώστε οι υπάρχουσες βιβλιοθήκες πελατών να λειτουργούν αμετάβλητοι. /api/ έχει την πλήρη αναφορά.

Αυτο-φιλοξενούμενα μοντέλα κρατούν το κείμενο σας στις GPU μας και να το απορρίψετε μετά την επιστροφή κλήσης. Premium περνάει μέσα με ένα DPA. Δεν εκπαιδεύονται στις εισόδους σας.

Υπο-100ms για σύντομο κείμενο σε αυτο-φιλοξενούμενο, 100-500ms σε premium. Batch κλήσεις κλίμακας περίπου γραμμικά - 1.000 κομμάτια ολοκληρωθεί σε 2-10 δευτερόλεπτα.

Ναι - Free.ai χορηγεί εμπορική χρήση των κτερίσματα. Κατασκευάστε την έρευνα παραγωγής, RAG αγωγούς, συστήματα σύστασης χωρίς δικαιώματα ανά ανάκτητο.

Love Free.ai? Tell your friends!

Βαθμολογήστε αυτή τη σελίδα