Minulý súboj · 2026-02-20 UTC
LLM Súboj — 20. februára 2026
Z kategórie LLM. 14 body udelených medzi 3 bojovníkov. DeepSeek R1 získal korunu.
Konečné poradie
Zostava
Bojovníci
Profily každého nástroja, ktorý súťažil v tomto súboji, zoradené podľa ich konečného skóre.

DeepSeek R1
Open-source veľký jazykový model excelujúci v úsudku, matematike a kódovacích úlohách s licenciou MIT pre bezplatné použitie a úpravu.

DeepSeek R1 je open-source veľký jazykový model, ktorý vyniká v úlohách uvažovania, matematiky a kódovania. Využíva architektúru Mixture of Experts (MoE) s 37B aktívnymi parametrami a 671B celkovými parametrami, podporujúc dĺžku kontextu 128K. Model využíva pokročilé techniky posilňovania učenia pre dosiahnutie samooverenia, viacstupňovej reflexie a ľudsky zosúladených schopností uvažovania. DeepSeek R1 dosiahol najmodernejší výkon v rôznych benchmarkoch, vrátane 97,3% presnosti na MATH-500, 79,8% miery úspešnosti na AIME 2024 a prekonaní 96,3% účastníkov Codeforces. Model je dostupný v niekoľkých variantoch, od 1,5B do 70B parametrov, a je licencovaný pod MIT pre bezplatné použitie a úpravy. DeepSeek R1 možno používať online zadarmo a WebGPU-urýchlená verzia môže bežať lokálne v prehliadači. Model je navrhnutý pre komplexné riešenie problémov, viacjazyčné porozumenie a generovanie kódu na produkčnej úrovni. Jeho silné stránky zahŕňajú výnimočné matematické uvažovanie, schopnosti generovania kódu a porozumenia prirodzenému jazyku. Avšak ako open-source model môže vyžadovať technické znalosti na nasadenie a dolaďovanie pre konkrétne prípady použitia. DeepSeek R1 sa umiestňuje medzi najlepšie výkonné modely umelej inteligencie na celom svete, s možnosťami porovnateľnými s poprednými proprietárnymi riešeniami. Jeho otvorený zdrojový kód umožňuje vývoj komunitou a neustále vylepšovanie, vrátane plánovanej multimodálnej podpory, konverzačného vylepšenia a optimalizácie distribuovaného odvodenia. Model má čistý vývoj založený na posilňovacom učení, čo mu umožňuje dosiahnuť výkonnosť úrovne GPT-4 v matematike za výrazne nižšie náklady. Funkcia vizualizácie reťazca myšlienok rieši výzvy AI „čiernej skrinky“ a poskytuje informácie o procese uvažovania modelu. API služby DeepSeek R1 ponúka OpenAI-kompatibilný endpoint pre integráciu, ktorý je ocenený na 0,14 dolárov za milión tokenov. Hmotnosti modelu sú open-source, čo umožňuje komerčné využitie a úpravy.
Rozdelenie kritérií
- Architektúra Mixture of Experts (MoE)
- Pokročilé techniky posilňovania učenia
- Schopnosti samo-verifikácie a viac-krokových úvah
- Ludzky zhodou zameraný úsudok
- Podpora pre 128K dĺžku kontextu
- OpenAI-kompatibilný API endpoint

Pixtral 12B 24.09
Open multimodálny 12B model, ktorý spracováva prekladané obrázky a text s 128 K kontextovým oknom.

Pixtral 12B 24.09 je multimodálny model od Mistral AI, ktorý spracováva obrázky aj text v jednej sekvencii a podporuje rôzne veľkosti a pomery strán obrázkov. Používa 12‑miliardový jazykový dekodér spárovaný s vizuálnym enkóderom, čo umožňuje úlohy ako vizuálne otázky a odpovede, porozumenie dokumentom, interpretáciu grafov a popisovanie obrázkov. Model akceptuje kontext až do 128 K tokenov, čo umožňuje prekladať viaceré obrázky s dlhým textom v jednej výzve. Vydaný pod otvorenou licenciou, môže byť nasadený lokálne alebo prostredníctvom poskytovateľov inferencie, čo ho robí vhodným pre vývojárov budujúcich aplikácie vision‑language, výskumné pracovné toky a multimodálne agenty.
Rozdelenie kritérií
- 12B parametrový model vision‑language
- Prekladané vstupy obrázkov a textu
- Dĺžka kontextu 128 K tokenov
- Natívna podpora premenlivých veľkostí obrázkov
- Otvorená váha
- Vhodný pre OCR, VQA a popisovanie obrázkov

DeepSeek V3
DeepSeek V3 - Open zahájanie, zvyšenie kvality obmedzenia a výhradne náročných též aplikácií.

DeepSeek V3 je rozsiahly jazykový model typu zmes expertov (MoE) vyvinutý spoločnosťou DeepSeek AI. Aktivuje len podmnožinu svojich celkových parametrov na token, čo mu umožňuje dosiahnuť vysoký výkon v úlohách uvažovania, matematiky a kódovania, zatiaľ čo náklady na inferenciu sú výrazne nižšie ako pri porovnateľných hustých modeloch. Vydaný s otvorenými váhami, DeepSeek V3 sa stal populárnou voľbou pre vývojárov a výskumníkov, ktorí potrebujú schopný základný model, ktorý môžu sami hostiť, dolaďovať alebo integrovať cez API. Benchmarky ho umiestňujú súťaživo proti popredným proprietárnym modelom ako GPT-4o, najmä pri hodnoteniach matematiky a logického uvažovania. Model je vhodný pre technických asistentov, potrubia generovania kódu, výskumné pracovné postupy a všetky aplikácie, kde záleží na kvalite uvažovania a efektivite rozpočtu.
Rozdelenie kritérií
- Architektúra Mixture-of-experts
- Konkurenčné benchmarky uvažovania a matematiky
- Open-source modelové váhy
- Prístup k API cez platformu DeepSeek
- Podpora dlhého kontextového okna
- Priateľské k jemnému ladeniu


