Minulá bitva · 2026-02-20 UTC

LLM Souboj — 20. února 2026

Z kategorie LLM. 14 hlasů umístěno napříč 3 bojovníky. DeepSeek R1 získal korunu.

Konečné pořadí

Sestava

Bojovníci

Profily každého nástroje, který soutěžil v této bitvě, seřazené podle jejich konečného skóre.

1DeepSeek R1 logo

DeepSeek R1

Otevřený zdroj velkého jazykového modelu excelujícího v logických úlohách, matematice a kódování s MIT licencí pro bezplatné použití a modifikace.

4.8 (4)
Zdarma
Snímek obrazovky pro DeepSeek R1

DeepSeek R1 je open-source velký jazykový model, který vyniká v úlohách uvažování, matematiky a kódování. Využívá architekturu Mixture of Experts (MoE) s 37B aktivními parametry a 671B celkovými parametry, podporující délku kontextu 128K. Model zahrnuje pokročilé techniky posilujícího učení pro dosažení samo-verifikace, vícekrokového odrazu a lidmi- zarovnaných schopností uvažování. DeepSeek R1 dosáhl nejmodernějšího výkonu v různých benchmarcích, včetně 97,3% přesnosti na MATH-500, 79,8% úspěšnosti na AIME 2024 a překonání 96,3% účastníků Codeforces. Model je dostupný v několika variantách, od 1,5B do 70B parametrů, a je licencován pod MIT pro bezplatné použití a úpravy. DeepSeek R1 lze používat online zdarma a verze urychlená WebGPU může běžet lokálně v prohlížeči. Model je navržen pro řešení složitých problémů, vícejazyčné porozumění a generování kódu na produkční úrovni. Jeho silné stránky zahrnují výjimečné matematické uvažování, schopnosti generování kódu a porozumění přirozenému jazyku. Nicméně jako open-source model může vyžadovat technické znalosti pro nasazení a dolaďování pro specifické případy použití. DeepSeek R1 je řazen mezi nejlepší výkonné AI modely na celém světě, s možnostmi srovnatelnými s předními proprietárními řešeními. Jeho open-source povaha umožňuje vývoj poháněný komunitou a neustálé vylepšování, včetně plánované multimodální podpory, konverzačního vylepšení a optimalizace distribuovaného inference. Model má čistě vývoj založený na posilovacím učení, což mu umožňuje dosáhnout úrovně matematického výkonu GPT-4 při výrazně nižších nákladech. Schopnost vizualizace řetězce myšlení řeší problémy AI "černé skříňky", poskytuje vhled do procesu uvažování modelu. API nástroje DeepSeek R1 nabízí OpenAI-kompatibilní endpoint pro integraci, a to za cenu 0,14 dolaru za milion tokenů. Hmotnosti modelu jsou open-source, což umožňuje komerční využití a úpravy.

Розбивка критеріїв

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Architektura Mixture of Experts (MoE)
  • Pokročilé techniky vzdělání s poučením
  • Sebe-potvrzení a multi-krokové reflexe
  • Lidsky alineované logické schopnosti
  • Podpora kontextuální délky 128K
  • Otevřený zdroj API endpoint v kompatibilitě s OpenAI
2Pixtral 12B 24.09 logo

Pixtral 12B 24.09

Otevřený multimodalní model 12B s 128K kontextovým oknem pro zpracování rozebraných obrazů a textů.

4.6 (5)
Zdarma
Snímek obrazovky pro Pixtral 12B 24.09

Pixtral 12B 24.09 je multimodální model od společnosti Mistral AI, který zpracovává obrázky i text v jedné sekvenci a podporuje různé velikosti a poměry stran obrázků. Využívá 12miliardový jazykový dekodér spojený s vizuálním enkodérem, což umožňuje úlohy, jako je vizuální otázková odpověď, porozumění dokumentům, interpretace grafů a popis obrázků. Model přijímá kontext až 128K tokenů, což umožňuje prokládat více obrázků s dlouhým textem v jednom příkazu. Vydáno pod otevřenou licencí, lze jej nasadit lokálně nebo prostřednictvím poskytovatelů inference, což jej činí vhodným pro vývojáře budující aplikace pro zpracování obrazu a jazyka, výzkumné workflow a multimodální agenty.

Розбивка критеріїв

Ease of use1
Value for money1
Features & power0
Integrations1
Support & docs1
Reliability1
  • 12B parametrní model vizíon-langsou
  • Rozebrané obraz a text vstupy
  • 128K token kontextová délka
  • Nativní podpora variabilních rozměrů obrazu
  • Otevřený weight release
  • Použitelnost pro OCR, VQA a kapce
3DeepSeek V3 logo

DeepSeek V3

Otevřený mixture-of-experts model oferející GPT-4 úroveň rozumnosti za fraction ceny.

4.8 (6)
Zdarma
Snímek obrazovky pro DeepSeek V3

DeepSeek V3 je rozsáhlý jazykový model se směsí expertů (MoE) vyvinutý společností DeepSeek AI. Aktivuje pouze podmnožinu svých celkových parametrů na token, což mu umožňuje vykazovat vysoké výkony v úlohách uvažování, matematiky a kódování, přičemž náklady na inference jsou výrazně nižší než u srovnatelných hustých modelů. Vydaný s otevřenými váhami se DeepSeek V3 stal oblíbenou volbou pro vývojáře a výzkumníky, kteří potřebují schopný základní model, který mohou sami hostovat, dolaďovat nebo integrovat pomocí rozhraní API. Benchmarky jej řadí soutěživě proti předním proprietárním modelům, jako je GPT-4o, zejména u matematických a logických úloh. Model je vhodný pro technické asistenty, potrubí pro generování kódu, výzkumné pracovní postupy a jakoukoli aplikaci, kde záleží jak na kvalitě uvažování, tak na rozpočtové efektivitě.

Розбивка критеріїв

Ease of use0
Value for money0
Features & power0
Integrations1
Support & docs1
Reliability1
  • Architektura mixture-of-experts
  • Úroveň výkonnosti v logickém rozumu a matematice odpovídající konkurenci
  • Otevřené modelové váhy
  • Přístup prostřednictvím rozhraní API na platformě DeepSeek
  • Podpora velkého okna kontextu
  • Přátelská fine-tuningu