Προηγούμενη μάχη · 2025-03-05 UTC
AI Model Serving Platforms Αναμέτρηση — 5 Μαρτίου 2025
Από την κατηγορία AI Model Serving Platforms. 13 βαθμοί τοποθετήθηκαν σε 3 μαχητές. Το New API πήρε το στέμμα.
Τελική κατάταξη
Η σύνθεση
Οι μαχητές
Προφίλ κάθε εργαλείου που διαγωνίστηκε σε αυτή τη μάχη, καταταγμένα με βάση την τελική τους βαθμολογία.

New API
Πύλη ανοικτού κώδικα LLM που ενώνει πολλαπλές API παρόχων AI με δρομολόγηση, χρέωση και ανάλυση

Το New API είναι μια ανοιχτού κώδικα πύλη LLM που παρέχει μια ενιαία διεπαφή για σύνδεση με πολλαπλούς παρόχους μοντέλων AI, συμπεριλαμβανομένων των API του OpenAI, Anthropic Claude και Google Gemini. Λειτουργεί ως κεντρικό επίπεδο διαχείρισης που επιτρέπει στις ομάδες να κατευθύνουν αιτήματα μεταξύ παρόχων, να ελέγχουν την πρόσβαση και να παρακολουθούν τη χρήση από ένα μέρος. Το έργο απευθύνεται σε προγραμματιστές, ομάδες πλατφόρμας και οργανισμούς που καταναλώνουν AI API σε μεγάλη κλίμακα και επιθυμούν μια ενιαία πύλη αντί για την ενσωμάτωση κάθε παρόχου ξεχωριστά. Με την αποκάλυψη endpoints συμβατών με το OpenAI, επιτρέπει υπάρχουσες εφαρμογές και SDKs να λειτουργούν με πολλούς backend χωρίς να αναδιαγράψουν τον κώδικα του πελάτη. Πέρα από την βασική διαμεσολάβηση, το New API εστιάζει σε επιχειρησιακές ανησυχίες όπως token-based quotas, billing και credit management, request auditing και usage analytics. Αυτές οι λειτουργίες το καθιστούν κατάλληλο για την κατασκευή εσωτερικών AI πλατφορμών ή για την πώληση/μετρία πρόσβασης σε πολλαπλούς χρήστες ή ομάδες. Ως εργαλείο ανοιχτού κώδικα, αυτοεγκατάστατο, δίνει στους διαχειριστές τον έλεγχο της ανάπτυξης και της ροής δεδομένων, κάτι που μπορεί να είναι σημαντικό για τη διαχείριση κόστους και την τήρηση κανονισμών. Τοποθετείται στον ίδιο χώρο με άλλες πύλες και συγκεντρωτές API όπως το LiteLLM και το One API, από τα οποία προέρχεται. Όπως με τις περισσότερες self-hosted gateways, η υιοθέτηση του New API απαιτεί εγκατάσταση υποδομών και συνεχή συντήρηση, ενώ η έκταση της υποστήριξης των παρόχων και η σταθερότητα εξαρτώνται από τις συνεισφορές της κοινότητας.
Κατανομή κριτηρίων
- Ενοποιημένη API πύλη πολλαπλών παρόχων
- Τελειώματα συμβατά με OpenAI
- Δρομολόγηση αιτημάτων μεταξύ προμηθευτών μοντέλων
- Διαχείριση ποσοτήτων token και χρεώσεων
- Αναλύσεις χρήσης και ελέγχους συμμόρφωσης

GLM‑4.5
Ανοιχτού κώδικα μοντέλο βάσης MoE με υβριδική λογική, σχεδιασμένο για πράκτορες, προγραμματισμό και χρήση εργαλείων

Το GLM-4.5 είναι ένα ανοιχτού κώδικα μεγάλο γλωσσικό μοντέλο (LLM) που αναπτύχθηκε από τη Zhipu AI (Z.ai) ως μέρος της οικογένειας μοντέλων GLM. Χρησιμοποιεί αρχιτεκτονική Mixture-of-Experts (MoE) και έναν υβριδικό σχεδιασμό λογικής που επιτρέπει στο μοντέλο είτε να «σκεφτεί» πριν απαντήσει, είτε να απαντήσει άμεσα, στοχεύοντας σε agentic workflows, προγραμματισμό και χρήση εργαλείων. Το μοντέλο υποστηρίζει παράθυρο περιεχομένου 128K-token και εγγενή κλήση εργαλείων. Το μοντέλο απευθύνεται σε προγραμματιστές που δημιουργούν AI agents και βοηθούς κώδικα. Εισήγαγε το «Interleaved Thinking», όπου το μοντέλο συλλογίζεται πριν από κάθε απόκριση και κλήση εργαλείου, και οι μεταγενέστερες εκδόσεις του GLM (GLM‑4.6 και GLM‑4.7) επέκτειναν αυτό με δυνατότητες όπως Preserved Thinking και Turn-level Thinking. Το GLM‑4.5 δίνει έμφαση στον agentic coding, ενσωματώνοντας τα κυρίαρχα πλαίσια agents και εργαλεία προγραμματισμού όπως Claude Code, Cline, Roo Code και Kilo Code. Το αποθετήριο στο GitHub φιλοξενεί πόρους μοντέλου, κώδικα inferencing και παραδείγματα, ενώ τα βάρη κυκλοφορούν ανοιχτά για αυτο‑φιλοξενία και το API παρέχεται μέσω της πλατφόρμας Z.ai API Platform. Το αποθετήριο τώρα τεκμηριώνει επίσης τα επόμενα μοντέλα GLM-4.6 (που επεκτείνει το πλαίσιο σε 200 K tokens) και GLM-4.7, μαζί με μια ελαφριά παραλλαγή 30B‑A3B (GLM-4.7-Flash) για πιο αποδοτική ανάπτυξη. Ως έκδοση ανοιχτού βάρους, το GLM‑4.5 ανταγωνίζεται άλλα ανοικτά μοντέλα που στοχεύουν σε περιπτώσεις χρήσης με πράκτορες και προγραμματισμό. Οι δυνατότητές του έγκεινται στη χρήση εργαλείων, τον έλεγχο της λογικής και την ανοικτότητα, αν και η εκτέλεση ενός μεγάλου μοντέλου MoE τοπικά απαιτεί σημαντικό υλικό, και νεότερες εκδόσεις του GLM το έχουν υπερισχύσει στα benchmarks.
Κατανομή κριτηρίων
- Αρχιτεκτονική Mixture-of-Experts (MoE)
- Υβριδική λογική με λειτουργίες σκέψης/μη σκέψης
- Εγγενής κλήση εργαλείων για πράκτορες
- Διαπλεκόμενη σκέψη πριν από απαντήσεις και κλήσεις εργαλείων
- Παράθυρο περιεχομένου 128K
- Βελτιστοποίηση κώδικα για πράκτορες


Η Jina AI παρέχει μια σουίτα μοντέλων βάσης και APIs που έχουν σχεδιαστεί γύρω από την αναζήτηση, την ανάκτηση και την πολυμορφική κατανόηση. Τα βασικά της προσφερόμενα περιλαμβάνουν text και image embeddings, neural rerankers, zero-shot classifiers, και εργαλεία για την κατασκευή retrieval-augmented generation (RAG) workflows σε μεγάλη κλίμακα. Η πλατφόρμα σχεδιάζεται για προγραμματιστές και ομάδες που δημιουργούν μηχανές αναζήτησης, συστήματα προτάσεων και AI βοηθούς που χρειάζονται λογική σε κείμενα, εικόνες και δομημένα δεδομένα. Τα μοντέλα είναι διαθέσιμα μέσω φιλοξενημένων APIs και open-source releases, με multilingual support και long-context capabilities για την επεξεργασία μεγάλων εγγράφων. Το Jina AI ενσωματώνεται με κοινά vector databases και LLM frameworks, κάνοντας το ένα πρακτικό building block για production-grade semantic search και knowledge retrieval systems.
Κατανομή κριτηρίων
- Μοντέλα embedding κειμένου και εικόνας
- Neural reranker APIs
- Zero-shot classification
- Long-context document support
- Multilingual retrieval
- RAG and vector database integrations


