Minulý súboj · 2026-02-20 UTC

LLM Súboj — 20. februára 2026

Z kategórie LLM. 14 body udelených medzi 3 bojovníkov. DeepSeek R1 získal korunu.

Konečné poradie

Zostava

Bojovníci

Profily každého nástroja, ktorý súťažil v tomto súboji, zoradené podľa ich konečného skóre.

1DeepSeek R1 logo

DeepSeek R1

Open-source veľký jazykový model excelujúci v úsudku, matematike a kódovacích úlohách s licenciou MIT pre bezplatné použitie a úpravu.

4.8 (4)
Zadarmo
Snímka obrazovky DeepSeek R1

DeepSeek R1 je open-source veľký jazykový model, ktorý vyniká v úlohách uvažovania, matematiky a kódovania. Využíva architektúru Mixture of Experts (MoE) s 37B aktívnymi parametrami a 671B celkovými parametrami, podporujúc dĺžku kontextu 128K. Model využíva pokročilé techniky posilňovania učenia pre dosiahnutie samooverenia, viacstupňovej reflexie a ľudsky zosúladených schopností uvažovania. DeepSeek R1 dosiahol najmodernejší výkon v rôznych benchmarkoch, vrátane 97,3% presnosti na MATH-500, 79,8% miery úspešnosti na AIME 2024 a prekonaní 96,3% účastníkov Codeforces. Model je dostupný v niekoľkých variantoch, od 1,5B do 70B parametrov, a je licencovaný pod MIT pre bezplatné použitie a úpravy. DeepSeek R1 možno používať online zadarmo a WebGPU-urýchlená verzia môže bežať lokálne v prehliadači. Model je navrhnutý pre komplexné riešenie problémov, viacjazyčné porozumenie a generovanie kódu na produkčnej úrovni. Jeho silné stránky zahŕňajú výnimočné matematické uvažovanie, schopnosti generovania kódu a porozumenia prirodzenému jazyku. Avšak ako open-source model môže vyžadovať technické znalosti na nasadenie a dolaďovanie pre konkrétne prípady použitia. DeepSeek R1 sa umiestňuje medzi najlepšie výkonné modely umelej inteligencie na celom svete, s možnosťami porovnateľnými s poprednými proprietárnymi riešeniami. Jeho otvorený zdrojový kód umožňuje vývoj komunitou a neustále vylepšovanie, vrátane plánovanej multimodálnej podpory, konverzačného vylepšenia a optimalizácie distribuovaného odvodenia. Model má čistý vývoj založený na posilňovacom učení, čo mu umožňuje dosiahnuť výkonnosť úrovne GPT-4 v matematike za výrazne nižšie náklady. Funkcia vizualizácie reťazca myšlienok rieši výzvy AI „čiernej skrinky“ a poskytuje informácie o procese uvažovania modelu. API služby DeepSeek R1 ponúka OpenAI-kompatibilný endpoint pre integráciu, ktorý je ocenený na 0,14 dolárov za milión tokenov. Hmotnosti modelu sú open-source, čo umožňuje komerčné využitie a úpravy.

Rozdelenie kritérií

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Architektúra Mixture of Experts (MoE)
  • Pokročilé techniky posilňovania učenia
  • Schopnosti samo-verifikácie a viac-krokových úvah
  • Ludzky zhodou zameraný úsudok
  • Podpora pre 128K dĺžku kontextu
  • OpenAI-kompatibilný API endpoint
2Pixtral 12B 24.09 logo

Pixtral 12B 24.09

Open multimodálny 12B model, ktorý spracováva prekladané obrázky a text s 128 K kontextovým oknom.

4.6 (5)
Zadarmo
Snímka obrazovky Pixtral 12B 24.09

Pixtral 12B 24.09 je multimodálny model od Mistral AI, ktorý spracováva obrázky aj text v jednej sekvencii a podporuje rôzne veľkosti a pomery strán obrázkov. Používa 12‑miliardový jazykový dekodér spárovaný s vizuálnym enkóderom, čo umožňuje úlohy ako vizuálne otázky a odpovede, porozumenie dokumentom, interpretáciu grafov a popisovanie obrázkov. Model akceptuje kontext až do 128 K tokenov, čo umožňuje prekladať viaceré obrázky s dlhým textom v jednej výzve. Vydaný pod otvorenou licenciou, môže byť nasadený lokálne alebo prostredníctvom poskytovateľov inferencie, čo ho robí vhodným pre vývojárov budujúcich aplikácie vision‑language, výskumné pracovné toky a multimodálne agenty.

Rozdelenie kritérií

Ease of use1
Value for money1
Features & power0
Integrations1
Support & docs1
Reliability1
  • 12B parametrový model vision‑language
  • Prekladané vstupy obrázkov a textu
  • Dĺžka kontextu 128 K tokenov
  • Natívna podpora premenlivých veľkostí obrázkov
  • Otvorená váha
  • Vhodný pre OCR, VQA a popisovanie obrázkov
3DeepSeek V3 logo

DeepSeek V3

DeepSeek V3 - Open zahájanie, zvyšenie kvality obmedzenia a výhradne náročných též aplikácií.

4.8 (6)
Zadarmo
Snímka obrazovky DeepSeek V3

DeepSeek V3 je rozsiahly jazykový model typu zmes expertov (MoE) vyvinutý spoločnosťou DeepSeek AI. Aktivuje len podmnožinu svojich celkových parametrov na token, čo mu umožňuje dosiahnuť vysoký výkon v úlohách uvažovania, matematiky a kódovania, zatiaľ čo náklady na inferenciu sú výrazne nižšie ako pri porovnateľných hustých modeloch. Vydaný s otvorenými váhami, DeepSeek V3 sa stal populárnou voľbou pre vývojárov a výskumníkov, ktorí potrebujú schopný základný model, ktorý môžu sami hostiť, dolaďovať alebo integrovať cez API. Benchmarky ho umiestňujú súťaživo proti popredným proprietárnym modelom ako GPT-4o, najmä pri hodnoteniach matematiky a logického uvažovania. Model je vhodný pre technických asistentov, potrubia generovania kódu, výskumné pracovné postupy a všetky aplikácie, kde záleží na kvalite uvažovania a efektivite rozpočtu.

Rozdelenie kritérií

Ease of use0
Value for money0
Features & power0
Integrations1
Support & docs1
Reliability1
  • Architektúra Mixture-of-experts
  • Konkurenčné benchmarky uvažovania a matematiky
  • Open-source modelové váhy
  • Prístup k API cez platformu DeepSeek
  • Podpora dlhého kontextového okna
  • Priateľské k jemnému ladeniu