Korábbi csata · 2026-02-20 UTC
LLM Leszámolás — 2026. február 20.
A(z) LLM kategóriából. 14 jelölés elhelyezve 3 versenyző között. DeepSeek R1 szerezte meg a koronát.
Végeredmény
A felállás
A versenyzők
Minden eszköz profilja, amely ebben a csatában versenyzett, a végső pontszámuk szerint rangsorolva.

DeepSeek R1
Nyílt forráskódú nagy nyelvi modell, amely kiemelkedően teljesíti a logikai, számítástechnikai és kódolási feladatokat az MIT-licenc segítségével ingyenesen használható és módosítható.

A DeepSeek R1 egy nyílt forráskódú, nagy nyelvi modell, amely kiválóan teljesít az érvelési, matematikai és kódolási feladatokban. Egy szakértők kombinációját (MoE) használó architektúrával rendelkezik 37MILLIÁRD aktív paraméterrel és 671MILLIÁRD összes paraméterrel, támogatva a 128E context hosszát. A modell fejlett megerősítési tanulási technikákat alkalmaz az önmegvédés, a többlépes reflexió és az emberközpontú érvelési képességek eléréséhez. A DeepSeek R1 csúcskategóriás teljesítményt ért el számos benchmarkban, beleértve a 97,3%-os pontosságot az MATH-500-on, 79,8%-os átmeneti rátát az AIME 2024-ben, és felülmúlja a Codeforces résztvevők 96,3%-át. A modell több változatban is elérhető, 1,5MILLIÁRD-tól 70MILLIÁRD paraméterig terjed, és az MIT licensz alatt ingyenesen használható és módosítható. A DeepSeek R1 ingyenesen használható online, és egy WebGPU-gyorsított verzió helyileg is futtatható egy böngészőben. A modell összetett problémamegoldásra, többnyelvű megértésre és termelési szintű kódgenerálásra készült. Erősségei közé tartozik a kiváló matematikai okoskodás, kódgenerálás és természetes nyelvi megértési képességek. Mivel nyílt forráskódú modell, technikal expertízét igényelheti a telepítése és finomhangolása specifikus használati esetekhez. A DeepSeek R1 a világ legjobb teljesítményű AI modellei közé tartozik, képességei összehasonlíthatóak a vezető, Tulajdonosi megoldásokkal. Nyílt forráskódja lehetővé teszi a közösség által vezérelt fejlesztést és a folyamatos frissítéseket, beleértve a tervezett multimodális támogatást, a beszélgetésfejlesztést és a distribuált inference optimalizálást. A modell tisztán megerősítés-alapú tanulással készült, amely lehetővé teszi, hogy GPT-4 szintű matematikai teljesítményt érjen el lényegesen alacsonyabb költségek mellett. A gondolkodási láncok vizualizációs képessége megoldja a mesterséges intelligencia "fekete doboz" kihívásait, betekintést nyújtva a modell okgondolkodási folyamatába. A DeepSeek R1 API egy OpenAI-kompatibilis végpontot kínál integrációhoz, $0,14-es árral milliónkénti tokenenként. A modell súlyai nyílt forráskódúak, ami lehetővé teszi a kereskedelmi felhasználást és módosítást.
Kritériumok szétosztása
- Mixture of Experts (MoE) architektúrá
- Magasabb szintű erősítési tanulási technikák
- Saját ellenőrzés és többszintű visszavérzés
- Ember-célú logika
- 128 K kontext hossz támogatás
- OpenAI kompatibilis végpont API

Pixtral 12B 24.09
Nyílt multimodális 12B modell, amely kezeli a szöveget és a képet váltakozva, 128K kontextusablakkal.

A Pixtral 12B 24.09 egy olyan multimodális modellel rendelkezik, amely egyetlen szekvenciában dolgozhatott bele képeket és szövegeket, támogatva a változó képméreteket és az arányokat. Ez egy 12 milliárd paraméteres nyelvfeldolgozó dekódert egy vizuális dekóderral párosít, lehetővé téve feladatokat, mint a vizuális kérdés-felelet, a dokumentumértelmezés, a táblázatértelmezés és a képkapcsolás. A modell 128K jelölésű kontextust fogadhat, ami lehetővé teszi több kép összekapcsolását hosszú szövegekkel egyetlen parancsban. Nyílt licensz alatt fejlesztették ki, így a helyi fájl vagy inerciakereső szolgáltatók segítségével is elindítható ez a technológia, ezzel fejlesztőknek, kutatási folyamatoknak és multimédiás ügynököknek is alkalmas, akik személy- és objekt-érzékelésben dolgoznak.
Kritériumok szétosztása
- 12B paraméteres látász-nyelv modell
- Képek és szövegek váltakozó bemenetei
- 128K token kontextus hosszúság
- Natyív változó képméret támogatás
- Nyílt súlyú kiadás
- Alkalmas OCR, VQA és feliratkozásra

DeepSeek V3
Nyílt forráskódú szakértők összetétele egy modell, amely az árarányos mértékű GPT-4 szintű érvelést kínál.

A DeepSeek V3 egy nagy méretű mixture-of-experts (MoE) nyelvi modell, amelyet a DeepSeek AI fejlesztett ki. Csak paramétereinek egy részét активálja minden egyes tokenhez, ami lehetővé teszi, hogy erős teljesítményt nyújtson az érvelésben, a matematikában és a kódolási feladatokban, miközben lényegesen alacsonyabb inferencia költségeket tart fenn, mint a hasonló sűrű modellek. Nyílt súlyokkal kiadva a DeepSeek V3 népszerű választás lett azoknak a fejlesztőknek és kutatóknak, akik olyan képes alapmodellt keresnek, amelyet saját környezetben üzemeltethetnek, finomíthatnak vagy API-n keresztül integrálhatnak. A benchmark tesztek azt mutatják, hogy versenyképes a vezető licenszelt modellekkel szemben, mint például a GPT-4o, különösen a matematikai és logikai érvelési értékelések terén. A modell jól használható técnai asszisztenseknek, kódgeneráló pipeline-oknak, kutatási munkafolyamoknak és minden olyan alkalmazásnak, ahol a következtetés minősége és a költséghatékonyság is számít.
Kritériumok szétosztása
- Szakértők összetétele
- Versenyképes érvelési és matematikai teljesítmény
- Nyílt modell súlyok
- API hozzáférés a DeepSeek platformon keresztül
- Hosszú kontextusablak támogatás
- Fine-tuning barátó


