Προηγούμενη μάχη · 2025-08-08 UTC
LLM Αναμέτρηση — 8 Αυγούστου 2025
Από την κατηγορία LLM. 28 βαθμοί τοποθετήθηκαν σε 6 μαχητές. Το DeepSeek V3 πήρε το στέμμα.
Τελική κατάταξη
Η σύνθεση
Οι μαχητές
Προφίλ κάθε εργαλείου που διαγωνίστηκε σε αυτή τη μάχη, καταταγμένα με βάση την τελική τους βαθμολογία.

DeepSeek V3
Μικτός ανοιχτός κώδικας από.experten πρότυπο που διασφαλίζει επεξέρτηση GPT-4 επιπέδου λογιστικού στην εξαίρεση του κόστους.

Ο DeepSeek V3 είναι μια μεγάλη κλίμακα ικανότητα-έξυπνων-μελετών (MoE) γλωσσική μοντέλο που αναπτύσξετε από την DeepSeek AI. Είναι ενεργό μόνο για ένα σύνολο από τις συνολικές του παράμετρων ανά συμβόλο, επιτρέποντάς του να παρέχει δυνατή απόδοση σε αναλυτικά, μαθηματικά και κατοχυρωμένα έργα ενώ διατηρεί τις έξοδες από τις παραπομπές σημαντικά χαμηλότερες από τις συγκρίσιμες συνεχή 모델. Συσκευάστηκε με ανοικτούς βαρύτερους, το DeepSeek V3 έγινε δημοφιλής επιλογή για dévelopers και ερευνητές που χρειάζονται ένα ικανό μοντέλο βάσης που μπορούν να τρέξουν εαυτό τους, να καλλιεργήσουν ή να ενσωματώσουν μέσω API. Οι μετρικοί το τοποθετούν ανταγωνιστικά ενάντια σε οδηγεί παραπροίητητα μοντέλα σαν το GPT-4o, ιδιαίτερα όταν περιλαμβάνει τις εκτιμήσεις μαθηματικών και λόγου λογικής. Ο.model είναι κατάλληλος για τεχνικούς συνεργάτες, δέσμες κωδικούς-παραγωγής, ροές έρευνας, και οποιαδήποτε εφαρμογή όπου θεωρούνται σημαντικά η ποιότητα της 논τικής ικανότητας και η εξοικονόμηση πόρων.
Κατανομή κριτηρίων
- Μικτό-εξουσιοδότηση αρχιτεκτονική
- Αγοραίες αναλύσεις λογισμού και μαθηματικών
- Ανοιχτά βάρη μοντέλου
- Επέκταση API μέσω εκάστοτε DeepSeek πλαίσιο
- Υποστήριξη ευρείας περιγραφής πρός
- Φιλική εύρεση προσαρμογής

Janus pro
Το ανοιχτό πολυμορφικό μοντέλο της DeepSeek για την δημιουργία εικόνας και την οπτική κατανόηση σε μια ενιαία αρχιτεκτονική.

Janus Pro είναι ένα ανοιχτού κώδικα πολυμορφικό μοντέλο ΤΝ από την DeepSeek, διαθέσιμο σε εκδόσεις 1B και 7B παραμέτρων. Ενοποιεί την οπτική κατανόηση και τη δημιουργία εικόνων σε ένα ενιαίο πλαίσιο, αποσυνδέοντας τις οπτικές διαδρομές κωδικοποίησης, επιτρέποντας στο μοντέλο να ερμηνεύει εικόνες και να τις δημιουργεί από κείμενα. Η παραλλαγή 7B παρέχει ανταγωνιστικά αποτελέσματα στα benchmarks για σύνθεση κειμένου‑εικόνας και απάντηση σε οπτικές ερωτήσεις, συχνά αντιστοιχώντας ή ξεπερνώντας μεγαλύτερα εξειδικευμένα μοντέλα. Δημοσιευμένο με άδεια MIT, το Janus Pro μπορεί να φιλοξενηθεί τοπικά, να προσαρμοστεί (fine‑tuned) και να ενσωματωθεί σε ερευνητικές ή παραγωγικές αλυσίδες εργασίας χωρίς περιορισμούς χρήσης. Ευθυμητείται για προγραμματιστές, ερευνητές και ερασιτέχνες που χρειάζονται ένα ευέλικτο πολυμορφικό μοντέλο βάσης για πειράματα, πρωτοτυπία ή κατασκευή εφαρμογών που συνδυάζουν τη δημιουργία εικόνας με την κατανόηση εικόνας.
Κατανομή κριτηρίων
- Δημιουργία εικόνας από κείμενο
- Απάντηση ερωτήσεων μέσω εικόνας και ανάλυση εικόνας
- Ενιαία αρχιτεκτονική μετασχηματιστή
- Επιλογές με 1B και 7B παραμέτρους
- Ανοιχτά βάρη με άδεια MIT
- Υποστήριξη πολυμορφικών εισόδων και εξόδων

DeepSeek R1
Μια ανοιχτή πηγαία γλώσσα μεγάλων μοντέλων, το οποίο ξεχωρίζει σε θέματα απόψεως, μαθηματικών υπολογισμών, και κώδικα με άδεια MIT για δωρεάν χρήση και τροποποίηση.

Το DeepSeek R1 είναι ανοιχτό πηγαίο μεγάλος γλωσσικός μοντέλος που επιτυγχάνει εξαιρετικές επιδόσεις στις συναρτήσεις λόγου, τα μαθηματικά και την προγραμματισμό. Είναι επεισκόπησης ενός συστήματος Εμπειρίας (MoE) με 37 δισεκατομμύρια ενεργά διανύσματα και 671 δισεκατομμύρια συνολικά διανύσματα, υποστηρίζοντας μήκος κειμένου έως και 128.000 χαρακτήρες. Το μοντέλο ενσωματώνει προηγμένες τεχνικές εκπαίδευσης ενισχύσεως για να επιτύχει αυτοπιστοποίηση, πολλαπλή ανύψωση και αληνίσκευση οριζόντιας ανδρικής ουσίας. Το DeepSeek R1 έχει επιτύχει εξαιρετικές εκτεταμένες απόδοσες στα διάφορα β Benchmarks, μεταξύ των οποίων 97,3% ακρίβειας στο ΜΑΘ-500, τα 79,8% ρυθμού επιτυχίας στο AIME 2024, και υπερέχει από την απόδοση 96,3% των συμμετεχόντων στο Codeforces. Το μοντέλο είναι διαθέσιμο σε ποικίλες παραλλαγές, από 1,5B έως 70B διανύσματα, και είναι αδειοδοτήσιμο υπό την άδεια MIT για ελεύθερη χρήση και τροποποίηση. Το DeepSeek R1 μπορεί να χρησιμοποιηθεί online δωρεάν, και μια εκδοση εξολομενούς WebGPU μπορεί να τρέξει.local σε ένα π瀏ήματος. Το μώδιο σχεδιασμένο για την επίλυση σύνθετων προβλημάτων, την πανlingual επίγνωση και την παραγωγή προδιαγραμμένων κωδικών. Τα πλεονεκτήματα του περιλαμβάνουν εξαιρετική μαθηματική διανοητική ικανότητα, ανάπτυξη κωδικών και δυνατότητες κατανόησης φυσικής γλώσσας. Ωστόσο, ως ανοιχτού κώδικα μώδιο, μπορεί να απαιτεί επαγγελματική εξειδίκευση για την υλοποίηση και τυποποίηση για συγκεκριμένες用επιστήμονες μελέτη . Το DeepSeek R1 βρίσκεται μεταξύ των επτάχων AI μοντέλων παγκοσμίως, με δυνατότητες που μπορούν να συγκριθούν με τις πρωτοποριακές ιδιόκτητες λύσεις. Η ανοιχτή πηγή του επιτρέπει την ενομοσύνη οδηγούμενη ανάπτυξη και συνεχείς αναβαθμίσεις, συμπεριλαμβανομένης της σχεδιαστικής υποστήριξης του πολυμόδας, της βελτίωσης της συζήτησης και της προώθησης της επανεκτίμησης στην κατανομή. Το μοντέλο έχει αναπτυγμένη με απόλυτη εκπαίδευση αναγκαιότητας, η οποία του επιτρέπει να εξασφαλίσει επίπεδο μαθηματικών επιδόσεων GPT-4 με σημαντικά χαμηλότερη χρέωση. Η ικανότητα αναπαράστασης της σκέψης-σειράς αντιμετωπίζει τις προκλήσεις του " Schwartz-ασβήστου καλούμπιου" της IA, παρέχοντας στοιχειώδεις απόψεις για το τρόπο διαλογισμού του μοντέλου. Η API της_deepseek R1 παρέχει έναν πύλες εξόδου συμβατό με την OpenAI για την ενσωμάτωση, με κόστος $0.14 ανά εκατομμύριο τokens. Τα βάρδια του μοντέλου είναι ανοιχτού κώδικα, επιτρέποντας τη διαδικασία και την τροποποίηση για εμπορική χρήση.
Κατανομή κριτηρίων
- Μίγμα εξπέρτολων αρχιτεκτονικής
- Προηγμένοι τεχνικές μάθησης αντενδείξεων
- Επιβεβαίωση με την υποστήρωση επανεξέλεγκτα
- Ανθρώπινα προσαρμοσμένη απόφαση
- 支持 πλήρης μήκος κειμένου 128Κ
- Ανοιχτό API endpoint compatible με το OpenAI

ASI:One
Η διεργαστική βοηθός AI που συντονίζει ανεξάρτητους πράκτορες για την αποπεράτωση πολυβήματων εργαστημάτων.

ASI:One είναι μια μηχανή ανάλυσης τεχνολογίας (AI) βοηθός κτισμένη γύρω από την ιδέα της αιτησιακής διανοητικής ικανότητας, όπου μια συμβουλευτική διεπαφή μπορεί να εκπέμπει και να συντονίζει ειδικευμένα αυτόνομα πράγματα-αυτόματα (agents) για να διαχειριστούν σύνθετες αιτήσεις. Μη επαναλαμβανόμενη την επιστροφή μόνο κειμένου, μπορεί να προγραμματίσει, να προκαλέσει εργαλεία και να εκτελέσει περιεχόμενο-μεθοδολογία (workflows) κατά τη διάρκεια της χρήσης του χρηστών. Σχεδιασμένο εντός του οικοσυστήματος της Συμμαχίας Επαγόμενης Πολυεθνικής Νοημοσύνης, το ASI:One είναι τοποθετημένο ως προσωπικός πράκτορας AI που συνεργάζεται με δέσμες διακεκριμένων πράκτων. Οι χρήστες μπορούν να επικοινωνούν μαζί του για καθημερινές ερωτήσεις ή να παραχωρούν μεγαλύτερες εργασίες, όπως την έρευνα, τις σύγκρισες, τη διοργάνωση και τις αναζητήσεις δεδομένων σε συνδεδεμένους υπηρεσία.
Κατανομή κριτηρίων
- Επαυξημένο χελιδονοειδές πυλώνα διεπαφής
- Συντονισμός ανεξάρτητων πράκτορες
- Πλάνωση και εκτέλεση πολυβήματων εργασιών
- Επαφή προς εξωτερικούς πράκτορες και υπηρεσίες
- Στυλ βοηθητή ατομικής σιγουριά και περιβάλλον
- Κόκκινη πάνω στην ASI Συμμαχία πράκτορες πύλων

Latest DeepSeek R2
Το μοντέλο AI της επόμενης γενιάς με επίκεντρο την λογική από τη DeepSeek

Η πιο πρόσφατη έκδοση DeepSeek R2 είναι ο κληρονόμος του μοντέλου reasoning R1 της DeepSeek, σχεδιασμένο να προσφέρει ισχυρότερη βήμα-προς-βήμα επίλυση προβλημάτων σε μαθηματικά, προγραμματισμό και αναλυτικές εργασίες. Στοχεύει να επεκτείνει την ανοικτή προσέγγιση έρευνας που έκανε τις προηγούμενες κυκλοφορίες της DeepSeek δημοφιλείς στους προγραμματιστές και ερευνητές. Το μοντέλο στοχεύει σε βελτιωμένη ακρίβεια, μεγαλύτερη διαχείριση συμφραζομένων και πιο αποδοτική εκτέλεση σε σύγκριση με τον προγείοντα, καθιστώντας το κατάλληλο για τεχνικούς βοηθούς, agentic workflows, και ενσωμάτωση σε custom applications. Η διαθεσιμότητα και οι ακριβείς προδιαγραφές εξαρτώνται από τα επίσημα κανάλια κυκλοφορίας της DeepSeek. Οι χρήστες συνήθως έχουν πρόσβαση στο μοντέλο μέσω API, διεπαφής συνομιλίας ή εκτελώντας ανοιχτά βάρη, όταν αυτά παρέχονται, δίνοντας ευελιξία τόσο για ατομική πειραματική χρήση όσο και για παραγωγική υλοποίηση.
Κατανομή κριτηρίων
- Προηγμένη λογική αλυσίδας σκέψης
- Παράθυρο επεκταμένης έκτασης συμφραζομένων
- Υποστήριξη παραγωγής κώδικα και εντοπισμού σφαλμάτων
- Κατανόηση πολυγλωσσική
- Πρόσβαση μέσω API και chat
- Κατάλληλο για agentic εφαρμογές
Pronoia
Μεγαλόγλωσσικό μοντέλο πρώτα για τα Αραβικά, βελτιστοποιημένο για κατανόηση και παραγωγή εγγενής ποιότητας.
Η Pronoia είναι ένα μεγάλο γλωσσικό μοντέλο που έχει ειδικά βελτιστοποιηθεί για τα αραβικά, με στόχο να προσφέρει πιο ακριβή κατανόηση, παραγωγή και λογική στη γλώσσα σε σύγκριση με τα γενικά πολυγλωσσικά μοντέλα. Τοποθετείται ως κορυφαίο LLM με έμφαση στα αραβικά, με βελτιώσεις για διαλέκτους, κλασικές μορφές και τη σύγχρονη τυπική αραβική. Το μοντέλο μπορεί να χρησιμοποιηθεί για εργασίες όπως δημιουργία περιεχομένου, περίληψη, μετάφραση, υποστήριξη πελατών και συνομιλιακή AI σε αγορές που μιλούν αραβικά. Συγκεντρώνοντας την εκπαίδευσή του σε αραβικά δεδομένα, το Pronoia στοχεύει σε λεπτομέρειες όπως η μορφολογία, τα διακριτικά και το πολιτιστικό πλαίσιο, τα οποία τα ευρύτερα μοντέλα συχνά χειρίζονται ασταθώς.
Κατανομή κριτηρίων
- Γλωσσικό μοντέλο βελτιστοποιημένο για τα Αραβικά
- Δημιουργία κειμένου και περίληψη
- Υποστήριξη μετάφρασης
- Δυνατότητες συνομιλίας και chatbot
- Κατάλληλο για επιχειρηματικό NLP στα Αραβικά
- Κάλυψη της MSA και των διαλέκτων




