Pretekla bitka · 2026-02-20 UTC
LLM Obračun — 20. februar 2026
Iz kategorije LLM. 14 oznake postavljenih med 3 borci. DeepSeek R1 je osvojil krono.
Končna razvrstitev
Postava
Borci
Profili vsakega orodja, ki je tekmovalo v tej bitki, razvrščeni po končnem rezultatu.

DeepSeek R1
Odprtokodni veliki jezikovni model, ki izstopa pri razmišljanju, matematiki in programiranju, z licenco MIT za brezplačno uporabo in spreminjanje.

DeepSeek R1 je odprtokodni veliki jezikovni model, ki izstopa pri razmišljanju, matematiki in programiranju. Uporablja arhitekturo Mixture of Experts (MoE) s 37 B aktivnimi parametri in 671 B skupnimi parametri, podpora za 128 K dolžino konteksta. Model vključuje napredne tehnike okrepitvenega učenja, da doseže samoverifikacijo, večkorakovno refleksijo in razmišljanje usklajeno s človekom. DeepSeek R1 je dosegel state-of-the-art zmogljivost v različnih benchmarkih, vključno s 97,3 % natančnostjo na MATH‑500, 79,8 % stopnjo uspešnosti na AIME 2024 ter prehitel 96,3 % udeležencev Codeforces. Model je na voljo v več različicah, od 1,5 B do 70 B parametrov, in je licenciran pod MIT za brezplačno uporabo in spreminjanje. DeepSeek R1 lahko uporabljate brezplačno na spletu, različica, ki izkorišča WebGPU, pa lahko teče lokalno v brskalniku. Model je zasnovan za reševanje kompleksnih problemov, večjezično razumevanje in generiranje kode proizvodne kakovosti. Njegove prednosti vključujejo izjemno matematično razmišljanje, generiranje kode ter sposobnosti naravnega jezikovnega razumevanja. Vendar pa kot odprtokodni model lahko zahteva tehnično strokovnost za njegovo namestitev in fino nastavljanje za specifične primere uporabe. DeepSeek R1 se uvršča med vrhunske AI modele po vsem svetu, s sposobnostmi, ki so primerljive z vodilnimi lastniškimi rešitvami. Njegova open‑source narava omogoča razvoj, ki ga poganja skupnost, in stalne nadgradnje, vključno s načrtovano multimodalno podporo, izboljšanjem konverzacijskih zmogljivosti ter optimizacijo porazdeljene inferenčne. Model ima čisto reinforcement learning razvoj, kar mu omogoča doseganje matematične zmogljivosti na nivoju GPT-4 po precej nižjih stroških. Možnost vizualizacije chain-of-thought naslavlja izzive AI "black box" in zagotavlja vpogled v proces razmišljanja modela. DeepSeek R1-jev API ponuja OpenAI‑kompatibilno končno točko za integracijo po ceni $0.14 na milijon žetonov. Teže modela so odprtokodne, kar omogoča komercialno uporabo in spreminjanje.
Razdelitev kriterijev
- Arhitektura Mešanice strokovnjakov (MoE)
- Napredne tehnike okrepljenega učenja
- Samospreverjanje in večkorakovne refleksijske zmožnosti
- Razmišljanje usklajeno z ljudmi
- Podpora za dolžino konteksta 128 K
- API končna točka, združljiva z OpenAI

Pixtral 12B 24.09
Odprti multimodalni 12B model, ki obravnava mešane slike in besedilo z oknom konteksta 128K.

Pixtral 12B 24.09 je multimodalni model podjetja Mistral AI, ki znotraj enega zaporedja obdeluje tako slike kot besedilo, pri čemer podpira različne velikosti in razmerje stranic slik. Uporablja dekodirnik jezika z 12 milijardami parametrov, povezan z vizualnim enkoderjem, kar omogoča naloge, kot so vizualno odgovarjanje na vprašanja, razumevanje dokumentov, interpretacija grafov in opisovanje slik. Model sprejme kontekst do 128 K tokenov, kar omogoča, da se več slik prepletajo z dolgim tekstom v enem promptu. Izdan je pod odprto licenco, zato se lahko namešča lokalno ali preko ponudnikov inferencije, kar ga naredi primernega za razvijalce, ki gradijo vizualno-jezikovne aplikacije, raziskovalne delovne tokove in multimodalne agente.
Razdelitev kriterijev
- 12B parametriški vizualno-jezikovni model
- Mešani vnos slik in besedila
- 128K tokenov dolžine konteksta
- Nativna podpora za spremenljiv velikost slike
- Izdaja z odprtimi težami
- Primeren za OCR, VQA in opisovanje slik.

DeepSeek V3
Odprtokodni model mešanice strokovnjakov, ki ponuja razmišljanje na nivoju GPT‑4o po delčku stroškov.

DeepSeek V3 je obsežen mixture-of-experts (MoE) jezikovni model, ki ga je razvilo podjetje DeepSeek AI. Aktivira le podmnožico vseh svojih parametrov na token, kar mu omogoča močno zmogljivost pri razmišljanju, matematiki in kodiranju, hkrati pa ohranja stroške inferenciranja bistveno nižje kot pri primerljivih dense modelih. Objavljen z odprtimi utežmi, DeepSeek V3 je postal priljubljena izbira med razvijalci in raziskovalci, ki potrebujejo zmogljiv osnovni model, ki ga lahko samostojno gostijo, prilagodijo ali integrirajo prek API-ja. Benchmarki ga postavljajo v konkurenčno razmerje z vodilnimi lastniškimi modeli, kot je GPT-4o, zlasti pri ocenjevanju matematičnih in logičnih nalog. Model je dobro primeren za tehnične asistente, potek generiranja kode, delovne tokove raziskav in katerokoli aplikacijo, kjer sta pomembni kakovost sklepanja in učinkovitost proračuna.
Razdelitev kriterijev
- Arhitektura mešanice strokovnjakov
- Konkurenčni rezultati na benchmarkih za razmišljanje in matematiko
- Odprtokodni uteži modela
- API dostop prek platforme DeepSeek
- Podpora za dolgo okno konteksta
- Enostavna fina nastavitev


