Προηγούμενη μάχη · 2025-08-08 UTC

LLM Αναμέτρηση — 8 Αυγούστου 2025

Από την κατηγορία LLM. 28 βαθμοί τοποθετήθηκαν σε 6 μαχητές. Το DeepSeek V3 πήρε το στέμμα.

Τελική κατάταξη

Η σύνθεση

Οι μαχητές

Προφίλ κάθε εργαλείου που διαγωνίστηκε σε αυτή τη μάχη, καταταγμένα με βάση την τελική τους βαθμολογία.

1DeepSeek V3 logo

DeepSeek V3

Μικτός ανοιχτός κώδικας από.experten πρότυπο που διασφαλίζει επεξέρτηση GPT-4 επιπέδου λογιστικού στην εξαίρεση του κόστους.

4.8 (6)
Δωρεάν
Στιγμιότυπο οθόνης για το DeepSeek V3

Ο DeepSeek V3 είναι μια μεγάλη κλίμακα ικανότητα-έξυπνων-μελετών (MoE) γλωσσική μοντέλο που αναπτύσξετε από την DeepSeek AI. Είναι ενεργό μόνο για ένα σύνολο από τις συνολικές του παράμετρων ανά συμβόλο, επιτρέποντάς του να παρέχει δυνατή απόδοση σε αναλυτικά, μαθηματικά και κατοχυρωμένα έργα ενώ διατηρεί τις έξοδες από τις παραπομπές σημαντικά χαμηλότερες από τις συγκρίσιμες συνεχή 모델. Συσκευάστηκε με ανοικτούς βαρύτερους, το DeepSeek V3 έγινε δημοφιλής επιλογή για dévelopers και ερευνητές που χρειάζονται ένα ικανό μοντέλο βάσης που μπορούν να τρέξουν εαυτό τους, να καλλιεργήσουν ή να ενσωματώσουν μέσω API. Οι μετρικοί το τοποθετούν ανταγωνιστικά ενάντια σε οδηγεί παραπροίητητα μοντέλα σαν το GPT-4o, ιδιαίτερα όταν περιλαμβάνει τις εκτιμήσεις μαθηματικών και λόγου λογικής. Ο.model είναι κατάλληλος για τεχνικούς συνεργάτες, δέσμες κωδικούς-παραγωγής, ροές έρευνας, και οποιαδήποτε εφαρμογή όπου θεωρούνται σημαντικά η ποιότητα της 논τικής ικανότητας και η εξοικονόμηση πόρων.

Κατανομή κριτηρίων

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Μικτό-εξουσιοδότηση αρχιτεκτονική
  • Αγοραίες αναλύσεις λογισμού και μαθηματικών
  • Ανοιχτά βάρη μοντέλου
  • Επέκταση API μέσω εκάστοτε DeepSeek πλαίσιο
  • Υποστήριξη ευρείας περιγραφής πρός
  • Φιλική εύρεση προσαρμογής
2Janus pro logo

Janus pro

Το ανοιχτό πολυμορφικό μοντέλο της DeepSeek για την δημιουργία εικόνας και την οπτική κατανόηση σε μια ενιαία αρχιτεκτονική.

4.8 (4)
Δωρεάν
Στιγμιότυπο οθόνης για το Janus pro

Janus Pro είναι ένα ανοιχτού κώδικα πολυμορφικό μοντέλο ΤΝ από την DeepSeek, διαθέσιμο σε εκδόσεις 1B και 7B παραμέτρων. Ενοποιεί την οπτική κατανόηση και τη δημιουργία εικόνων σε ένα ενιαίο πλαίσιο, αποσυνδέοντας τις οπτικές διαδρομές κωδικοποίησης, επιτρέποντας στο μοντέλο να ερμηνεύει εικόνες και να τις δημιουργεί από κείμενα. Η παραλλαγή 7B παρέχει ανταγωνιστικά αποτελέσματα στα benchmarks για σύνθεση κειμένου‑εικόνας και απάντηση σε οπτικές ερωτήσεις, συχνά αντιστοιχώντας ή ξεπερνώντας μεγαλύτερα εξειδικευμένα μοντέλα. Δημοσιευμένο με άδεια MIT, το Janus Pro μπορεί να φιλοξενηθεί τοπικά, να προσαρμοστεί (fine‑tuned) και να ενσωματωθεί σε ερευνητικές ή παραγωγικές αλυσίδες εργασίας χωρίς περιορισμούς χρήσης. Ευθυμητείται για προγραμματιστές, ερευνητές και ερασιτέχνες που χρειάζονται ένα ευέλικτο πολυμορφικό μοντέλο βάσης για πειράματα, πρωτοτυπία ή κατασκευή εφαρμογών που συνδυάζουν τη δημιουργία εικόνας με την κατανόηση εικόνας.

Κατανομή κριτηρίων

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Δημιουργία εικόνας από κείμενο
  • Απάντηση ερωτήσεων μέσω εικόνας και ανάλυση εικόνας
  • Ενιαία αρχιτεκτονική μετασχηματιστή
  • Επιλογές με 1B και 7B παραμέτρους
  • Ανοιχτά βάρη με άδεια MIT
  • Υποστήριξη πολυμορφικών εισόδων και εξόδων
3DeepSeek R1 logo

DeepSeek R1

Μια ανοιχτή πηγαία γλώσσα μεγάλων μοντέλων, το οποίο ξεχωρίζει σε θέματα απόψεως, μαθηματικών υπολογισμών, και κώδικα με άδεια MIT για δωρεάν χρήση και τροποποίηση.

4.8 (4)
Δωρεάν
Στιγμιότυπο οθόνης για το DeepSeek R1

Το DeepSeek R1 είναι ανοιχτό πηγαίο μεγάλος γλωσσικός μοντέλος που επιτυγχάνει εξαιρετικές επιδόσεις στις συναρτήσεις λόγου, τα μαθηματικά και την προγραμματισμό. Είναι επεισκόπησης ενός συστήματος Εμπειρίας (MoE) με 37 δισεκατομμύρια ενεργά διανύσματα και 671 δισεκατομμύρια συνολικά διανύσματα, υποστηρίζοντας μήκος κειμένου έως και 128.000 χαρακτήρες. Το μοντέλο ενσωματώνει προηγμένες τεχνικές εκπαίδευσης ενισχύσεως για να επιτύχει αυτοπιστοποίηση, πολλαπλή ανύψωση και αληνίσκευση οριζόντιας ανδρικής ουσίας. Το DeepSeek R1 έχει επιτύχει εξαιρετικές εκτεταμένες απόδοσες στα διάφορα β Benchmarks, μεταξύ των οποίων 97,3% ακρίβειας στο ΜΑΘ-500, τα 79,8% ρυθμού επιτυχίας στο AIME 2024, και υπερέχει από την απόδοση 96,3% των συμμετεχόντων στο Codeforces. Το μοντέλο είναι διαθέσιμο σε ποικίλες παραλλαγές, από 1,5B έως 70B διανύσματα, και είναι αδειοδοτήσιμο υπό την άδεια MIT για ελεύθερη χρήση και τροποποίηση. Το DeepSeek R1 μπορεί να χρησιμοποιηθεί online δωρεάν, και μια εκδοση εξολομενούς WebGPU μπορεί να τρέξει.local σε ένα π瀏ήματος. Το μώδιο σχεδιασμένο για την επίλυση σύνθετων προβλημάτων, την πανlingual επίγνωση και την παραγωγή προδιαγραμμένων κωδικών. Τα πλεονεκτήματα του περιλαμβάνουν εξαιρετική μαθηματική διανοητική ικανότητα, ανάπτυξη κωδικών και δυνατότητες κατανόησης φυσικής γλώσσας. Ωστόσο, ως ανοιχτού κώδικα μώδιο, μπορεί να απαιτεί επαγγελματική εξειδίκευση για την υλοποίηση και τυποποίηση για συγκεκριμένες用επιστήμονες μελέτη . Το DeepSeek R1 βρίσκεται μεταξύ των επτάχων AI μοντέλων παγκοσμίως, με δυνατότητες που μπορούν να συγκριθούν με τις πρωτοποριακές ιδιόκτητες λύσεις. Η ανοιχτή πηγή του επιτρέπει την ενομοσύνη οδηγούμενη ανάπτυξη και συνεχείς αναβαθμίσεις, συμπεριλαμβανομένης της σχεδιαστικής υποστήριξης του πολυμόδας, της βελτίωσης της συζήτησης και της προώθησης της επανεκτίμησης στην κατανομή. Το μοντέλο έχει αναπτυγμένη με απόλυτη εκπαίδευση αναγκαιότητας, η οποία του επιτρέπει να εξασφαλίσει επίπεδο μαθηματικών επιδόσεων GPT-4 με σημαντικά χαμηλότερη χρέωση. Η ικανότητα αναπαράστασης της σκέψης-σειράς αντιμετωπίζει τις προκλήσεις του " Schwartz-ασβήστου καλούμπιου" της IA, παρέχοντας στοιχειώδεις απόψεις για το τρόπο διαλογισμού του μοντέλου. Η API της_deepseek R1 παρέχει έναν πύλες εξόδου συμβατό με την OpenAI για την ενσωμάτωση, με κόστος $0.14 ανά εκατομμύριο τokens. Τα βάρδια του μοντέλου είναι ανοιχτού κώδικα, επιτρέποντας τη διαδικασία και την τροποποίηση για εμπορική χρήση.

Κατανομή κριτηρίων

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability0
  • Μίγμα εξπέρτολων αρχιτεκτονικής
  • Προηγμένοι τεχνικές μάθησης αντενδείξεων
  • Επιβεβαίωση με την υποστήρωση επανεξέλεγκτα
  • Ανθρώπινα προσαρμοσμένη απόφαση
  • 支持 πλήρης μήκος κειμένου 128Κ
  • Ανοιχτό API endpoint compatible με το OpenAI
4ASI:One logo

ASI:One

Η διεργαστική βοηθός AI που συντονίζει ανεξάρτητους πράκτορες για την αποπεράτωση πολυβήματων εργαστημάτων.

4.5 (4)
Δωρεάν
Στιγμιότυπο οθόνης για το ASI:One

ASI:One είναι μια μηχανή ανάλυσης τεχνολογίας (AI) βοηθός κτισμένη γύρω από την ιδέα της αιτησιακής διανοητικής ικανότητας, όπου μια συμβουλευτική διεπαφή μπορεί να εκπέμπει και να συντονίζει ειδικευμένα αυτόνομα πράγματα-αυτόματα (agents) για να διαχειριστούν σύνθετες αιτήσεις. Μη επαναλαμβανόμενη την επιστροφή μόνο κειμένου, μπορεί να προγραμματίσει, να προκαλέσει εργαλεία και να εκτελέσει περιεχόμενο-μεθοδολογία (workflows) κατά τη διάρκεια της χρήσης του χρηστών. Σχεδιασμένο εντός του οικοσυστήματος της Συμμαχίας Επαγόμενης Πολυεθνικής Νοημοσύνης, το ASI:One είναι τοποθετημένο ως προσωπικός πράκτορας AI που συνεργάζεται με δέσμες διακεκριμένων πράκτων. Οι χρήστες μπορούν να επικοινωνούν μαζί του για καθημερινές ερωτήσεις ή να παραχωρούν μεγαλύτερες εργασίες, όπως την έρευνα, τις σύγκρισες, τη διοργάνωση και τις αναζητήσεις δεδομένων σε συνδεδεμένους υπηρεσία.

Κατανομή κριτηρίων

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability1
  • Επαυξημένο χελιδονοειδές πυλώνα διεπαφής
  • Συντονισμός ανεξάρτητων πράκτορες
  • Πλάνωση και εκτέλεση πολυβήματων εργασιών
  • Επαφή προς εξωτερικούς πράκτορες και υπηρεσίες
  • Στυλ βοηθητή ατομικής σιγουριά και περιβάλλον
  • Κόκκινη πάνω στην ASI Συμμαχία πράκτορες πύλων
5Latest DeepSeek R2 logo

Latest DeepSeek R2

Το μοντέλο AI της επόμενης γενιάς με επίκεντρο την λογική από τη DeepSeek

4.8 (6)
Δωρεάν
Στιγμιότυπο οθόνης για το Latest DeepSeek R2

Η πιο πρόσφατη έκδοση DeepSeek R2 είναι ο κληρονόμος του μοντέλου reasoning R1 της DeepSeek, σχεδιασμένο να προσφέρει ισχυρότερη βήμα-προς-βήμα επίλυση προβλημάτων σε μαθηματικά, προγραμματισμό και αναλυτικές εργασίες. Στοχεύει να επεκτείνει την ανοικτή προσέγγιση έρευνας που έκανε τις προηγούμενες κυκλοφορίες της DeepSeek δημοφιλείς στους προγραμματιστές και ερευνητές. Το μοντέλο στοχεύει σε βελτιωμένη ακρίβεια, μεγαλύτερη διαχείριση συμφραζομένων και πιο αποδοτική εκτέλεση σε σύγκριση με τον προγείοντα, καθιστώντας το κατάλληλο για τεχνικούς βοηθούς, agentic workflows, και ενσωμάτωση σε custom applications. Η διαθεσιμότητα και οι ακριβείς προδιαγραφές εξαρτώνται από τα επίσημα κανάλια κυκλοφορίας της DeepSeek. Οι χρήστες συνήθως έχουν πρόσβαση στο μοντέλο μέσω API, διεπαφής συνομιλίας ή εκτελώντας ανοιχτά βάρη, όταν αυτά παρέχονται, δίνοντας ευελιξία τόσο για ατομική πειραματική χρήση όσο και για παραγωγική υλοποίηση.

Κατανομή κριτηρίων

Ease of use1
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability1
  • Προηγμένη λογική αλυσίδας σκέψης
  • Παράθυρο επεκταμένης έκτασης συμφραζομένων
  • Υποστήριξη παραγωγής κώδικα και εντοπισμού σφαλμάτων
  • Κατανόηση πολυγλωσσική
  • Πρόσβαση μέσω API και chat
  • Κατάλληλο για agentic εφαρμογές
6Pronoia logo

Pronoia

Μεγαλόγλωσσικό μοντέλο πρώτα για τα Αραβικά, βελτιστοποιημένο για κατανόηση και παραγωγή εγγενής ποιότητας.

4.7 (6)
Δωρεάν

Η Pronoia είναι ένα μεγάλο γλωσσικό μοντέλο που έχει ειδικά βελτιστοποιηθεί για τα αραβικά, με στόχο να προσφέρει πιο ακριβή κατανόηση, παραγωγή και λογική στη γλώσσα σε σύγκριση με τα γενικά πολυγλωσσικά μοντέλα. Τοποθετείται ως κορυφαίο LLM με έμφαση στα αραβικά, με βελτιώσεις για διαλέκτους, κλασικές μορφές και τη σύγχρονη τυπική αραβική. Το μοντέλο μπορεί να χρησιμοποιηθεί για εργασίες όπως δημιουργία περιεχομένου, περίληψη, μετάφραση, υποστήριξη πελατών και συνομιλιακή AI σε αγορές που μιλούν αραβικά. Συγκεντρώνοντας την εκπαίδευσή του σε αραβικά δεδομένα, το Pronoia στοχεύει σε λεπτομέρειες όπως η μορφολογία, τα διακριτικά και το πολιτιστικό πλαίσιο, τα οποία τα ευρύτερα μοντέλα συχνά χειρίζονται ασταθώς.

Κατανομή κριτηρίων

Ease of use1
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • Γλωσσικό μοντέλο βελτιστοποιημένο για τα Αραβικά
  • Δημιουργία κειμένου και περίληψη
  • Υποστήριξη μετάφρασης
  • Δυνατότητες συνομιλίας και chatbot
  • Κατάλληλο για επιχειρηματικό NLP στα Αραβικά
  • Κάλυψη της MSA και των διαλέκτων