Προηγούμενη μάχη · 2026-02-20 UTC
LLM Αναμέτρηση — 20 Φεβρουαρίου 2026
Από την κατηγορία LLM. 14 βαθμοί τοποθετήθηκαν σε 3 μαχητές. Το DeepSeek R1 πήρε το στέμμα.
Τελική κατάταξη
Η σύνθεση
Οι μαχητές
Προφίλ κάθε εργαλείου που διαγωνίστηκε σε αυτή τη μάχη, καταταγμένα με βάση την τελική τους βαθμολογία.

DeepSeek R1
Μια ανοιχτή πηγαία γλώσσα μεγάλων μοντέλων, το οποίο ξεχωρίζει σε θέματα απόψεως, μαθηματικών υπολογισμών, και κώδικα με άδεια MIT για δωρεάν χρήση και τροποποίηση.

Το DeepSeek R1 είναι ανοιχτό πηγαίο μεγάλος γλωσσικός μοντέλος που επιτυγχάνει εξαιρετικές επιδόσεις στις συναρτήσεις λόγου, τα μαθηματικά και την προγραμματισμό. Είναι επεισκόπησης ενός συστήματος Εμπειρίας (MoE) με 37 δισεκατομμύρια ενεργά διανύσματα και 671 δισεκατομμύρια συνολικά διανύσματα, υποστηρίζοντας μήκος κειμένου έως και 128.000 χαρακτήρες. Το μοντέλο ενσωματώνει προηγμένες τεχνικές εκπαίδευσης ενισχύσεως για να επιτύχει αυτοπιστοποίηση, πολλαπλή ανύψωση και αληνίσκευση οριζόντιας ανδρικής ουσίας. Το DeepSeek R1 έχει επιτύχει εξαιρετικές εκτεταμένες απόδοσες στα διάφορα β Benchmarks, μεταξύ των οποίων 97,3% ακρίβειας στο ΜΑΘ-500, τα 79,8% ρυθμού επιτυχίας στο AIME 2024, και υπερέχει από την απόδοση 96,3% των συμμετεχόντων στο Codeforces. Το μοντέλο είναι διαθέσιμο σε ποικίλες παραλλαγές, από 1,5B έως 70B διανύσματα, και είναι αδειοδοτήσιμο υπό την άδεια MIT για ελεύθερη χρήση και τροποποίηση. Το DeepSeek R1 μπορεί να χρησιμοποιηθεί online δωρεάν, και μια εκδοση εξολομενούς WebGPU μπορεί να τρέξει.local σε ένα π瀏ήματος. Το μώδιο σχεδιασμένο για την επίλυση σύνθετων προβλημάτων, την πανlingual επίγνωση και την παραγωγή προδιαγραμμένων κωδικών. Τα πλεονεκτήματα του περιλαμβάνουν εξαιρετική μαθηματική διανοητική ικανότητα, ανάπτυξη κωδικών και δυνατότητες κατανόησης φυσικής γλώσσας. Ωστόσο, ως ανοιχτού κώδικα μώδιο, μπορεί να απαιτεί επαγγελματική εξειδίκευση για την υλοποίηση και τυποποίηση για συγκεκριμένες用επιστήμονες μελέτη . Το DeepSeek R1 βρίσκεται μεταξύ των επτάχων AI μοντέλων παγκοσμίως, με δυνατότητες που μπορούν να συγκριθούν με τις πρωτοποριακές ιδιόκτητες λύσεις. Η ανοιχτή πηγή του επιτρέπει την ενομοσύνη οδηγούμενη ανάπτυξη και συνεχείς αναβαθμίσεις, συμπεριλαμβανομένης της σχεδιαστικής υποστήριξης του πολυμόδας, της βελτίωσης της συζήτησης και της προώθησης της επανεκτίμησης στην κατανομή. Το μοντέλο έχει αναπτυγμένη με απόλυτη εκπαίδευση αναγκαιότητας, η οποία του επιτρέπει να εξασφαλίσει επίπεδο μαθηματικών επιδόσεων GPT-4 με σημαντικά χαμηλότερη χρέωση. Η ικανότητα αναπαράστασης της σκέψης-σειράς αντιμετωπίζει τις προκλήσεις του " Schwartz-ασβήστου καλούμπιου" της IA, παρέχοντας στοιχειώδεις απόψεις για το τρόπο διαλογισμού του μοντέλου. Η API της_deepseek R1 παρέχει έναν πύλες εξόδου συμβατό με την OpenAI για την ενσωμάτωση, με κόστος $0.14 ανά εκατομμύριο τokens. Τα βάρδια του μοντέλου είναι ανοιχτού κώδικα, επιτρέποντας τη διαδικασία και την τροποποίηση για εμπορική χρήση.
Κατανομή κριτηρίων
- Μίγμα εξπέρτολων αρχιτεκτονικής
- Προηγμένοι τεχνικές μάθησης αντενδείξεων
- Επιβεβαίωση με την υποστήρωση επανεξέλεγκτα
- Ανθρώπινα προσαρμοσμένη απόφαση
- 支持 πλήρης μήκος κειμένου 128Κ
- Ανοιχτό API endpoint compatible με το OpenAI

Pixtral 12B 24.09
Ανοιχτό πολυμορφικό μοντέλο 12B που χειρίζεται αλληλοεναλλασσόμενες εικόνες και κείμενο με παράθυρο συμφραζομένων 128K.

Το Pixtral 12B 24.09 είναι ένα πολυμορφικό μοντέλο της Mistral AI που επεξεργάζεται τόσο εικόνες όσο και κείμενα μέσα σε μια ενιαία ακολουθία, υποστηρίζοντας μεταβλητά μεγέθη εικόνας και αναλογίες διαστάσεων. Χρησιμοποιεί έναν 12‑billion‑parameter language decoder σε συνδυασμό με έναν vision encoder, επιτρέποντας εργασίες όπως visual question answering, document understanding, chart interpretation και image captioning. Το μοντέλο υποστηρίζει έως 128K token context, επιτρέποντας τη διασπορά πολλαπλών εικόνων με μακρά κείμενα σε ένα prompt. Κυκλοφορεί υπό ανοιχτή άδεια και μπορεί να προσαρμοστεί τοπικά ή μέσω inference providers, καθιστώντας το κατάλληλο για προγραμματιστές που δημιουργούν vision‑language applications, research workflows και multimodal agents.
Κατανομή κριτηρίων
- Μοντέλο όρασης-γλώσσας με 12B παραμέτρους
- Είσοδοι εικόνας και κειμένου αλληλοεναλλασσόμενα
- Μήκος συμφραζομένων 128K token
- Υποστήριξη μεταβλητού μεγέθους εικόνας
- Διανομή ανοιχτού βάρους
- Ικανοποιεί OCR, VQA και περιγραφή εικόνων

DeepSeek V3
Μικτός ανοιχτός κώδικας από.experten πρότυπο που διασφαλίζει επεξέρτηση GPT-4 επιπέδου λογιστικού στην εξαίρεση του κόστους.

Ο DeepSeek V3 είναι μια μεγάλη κλίμακα ικανότητα-έξυπνων-μελετών (MoE) γλωσσική μοντέλο που αναπτύσξετε από την DeepSeek AI. Είναι ενεργό μόνο για ένα σύνολο από τις συνολικές του παράμετρων ανά συμβόλο, επιτρέποντάς του να παρέχει δυνατή απόδοση σε αναλυτικά, μαθηματικά και κατοχυρωμένα έργα ενώ διατηρεί τις έξοδες από τις παραπομπές σημαντικά χαμηλότερες από τις συγκρίσιμες συνεχή 모델. Συσκευάστηκε με ανοικτούς βαρύτερους, το DeepSeek V3 έγινε δημοφιλής επιλογή για dévelopers και ερευνητές που χρειάζονται ένα ικανό μοντέλο βάσης που μπορούν να τρέξουν εαυτό τους, να καλλιεργήσουν ή να ενσωματώσουν μέσω API. Οι μετρικοί το τοποθετούν ανταγωνιστικά ενάντια σε οδηγεί παραπροίητητα μοντέλα σαν το GPT-4o, ιδιαίτερα όταν περιλαμβάνει τις εκτιμήσεις μαθηματικών και λόγου λογικής. Ο.model είναι κατάλληλος για τεχνικούς συνεργάτες, δέσμες κωδικούς-παραγωγής, ροές έρευνας, και οποιαδήποτε εφαρμογή όπου θεωρούνται σημαντικά η ποιότητα της 논τικής ικανότητας και η εξοικονόμηση πόρων.
Κατανομή κριτηρίων
- Μικτό-εξουσιοδότηση αρχιτεκτονική
- Αγοραίες αναλύσεις λογισμού και μαθηματικών
- Ανοιχτά βάρη μοντέλου
- Επέκταση API μέσω εκάστοτε DeepSeek πλαίσιο
- Υποστήριξη ευρείας περιγραφής πρός
- Φιλική εύρεση προσαρμογής


