Pretekla bitka · 2026-02-20 UTC

LLM Obračun — 20. februar 2026

Iz kategorije LLM. 14 oznake postavljenih med 3 borci. DeepSeek R1 je osvojil krono.

Končna razvrstitev

Postava

Borci

Profili vsakega orodja, ki je tekmovalo v tej bitki, razvrščeni po končnem rezultatu.

1DeepSeek R1 logo

DeepSeek R1

Odprtokodni veliki jezikovni model, ki izstopa pri razmišljanju, matematiki in programiranju, z licenco MIT za brezplačno uporabo in spreminjanje.

4.8 (4)
Brezplačno
Zaslonska slika DeepSeek R1

DeepSeek R1 je odprtokodni veliki jezikovni model, ki izstopa pri razmišljanju, matematiki in programiranju. Uporablja arhitekturo Mixture of Experts (MoE) s 37 B aktivnimi parametri in 671 B skupnimi parametri, podpora za 128 K dolžino konteksta. Model vključuje napredne tehnike okrepitvenega učenja, da doseže samoverifikacijo, večkorakovno refleksijo in razmišljanje usklajeno s človekom. DeepSeek R1 je dosegel state-of-the-art zmogljivost v različnih benchmarkih, vključno s 97,3 % natančnostjo na MATH‑500, 79,8 % stopnjo uspešnosti na AIME 2024 ter prehitel 96,3 % udeležencev Codeforces. Model je na voljo v več različicah, od 1,5 B do 70 B parametrov, in je licenciran pod MIT za brezplačno uporabo in spreminjanje. DeepSeek R1 lahko uporabljate brezplačno na spletu, različica, ki izkorišča WebGPU, pa lahko teče lokalno v brskalniku. Model je zasnovan za reševanje kompleksnih problemov, večjezično razumevanje in generiranje kode proizvodne kakovosti. Njegove prednosti vključujejo izjemno matematično razmišljanje, generiranje kode ter sposobnosti naravnega jezikovnega razumevanja. Vendar pa kot odprtokodni model lahko zahteva tehnično strokovnost za njegovo namestitev in fino nastavljanje za specifične primere uporabe. DeepSeek R1 se uvršča med vrhunske AI modele po vsem svetu, s sposobnostmi, ki so primerljive z vodilnimi lastniškimi rešitvami. Njegova open‑source narava omogoča razvoj, ki ga poganja skupnost, in stalne nadgradnje, vključno s načrtovano multimodalno podporo, izboljšanjem konverzacijskih zmogljivosti ter optimizacijo porazdeljene inferenčne. Model ima čisto reinforcement learning razvoj, kar mu omogoča doseganje matematične zmogljivosti na nivoju GPT-4 po precej nižjih stroških. Možnost vizualizacije chain-of-thought naslavlja izzive AI "black box" in zagotavlja vpogled v proces razmišljanja modela. DeepSeek R1-jev API ponuja OpenAI‑kompatibilno končno točko za integracijo po ceni $0.14 na milijon žetonov. Teže modela so odprtokodne, kar omogoča komercialno uporabo in spreminjanje.

Razdelitev kriterijev

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Arhitektura Mešanice strokovnjakov (MoE)
  • Napredne tehnike okrepljenega učenja
  • Samospreverjanje in večkorakovne refleksijske zmožnosti
  • Razmišljanje usklajeno z ljudmi
  • Podpora za dolžino konteksta 128 K
  • API končna točka, združljiva z OpenAI
2Pixtral 12B 24.09 logo

Pixtral 12B 24.09

Odprti multimodalni 12B model, ki obravnava mešane slike in besedilo z oknom konteksta 128K.

4.6 (5)
Brezplačno
Zaslonska slika Pixtral 12B 24.09

Pixtral 12B 24.09 je multimodalni model podjetja Mistral AI, ki znotraj enega zaporedja obdeluje tako slike kot besedilo, pri čemer podpira različne velikosti in razmerje stranic slik. Uporablja dekodirnik jezika z 12 milijardami parametrov, povezan z vizualnim enkoderjem, kar omogoča naloge, kot so vizualno odgovarjanje na vprašanja, razumevanje dokumentov, interpretacija grafov in opisovanje slik. Model sprejme kontekst do 128 K tokenov, kar omogoča, da se več slik prepletajo z dolgim tekstom v enem promptu. Izdan je pod odprto licenco, zato se lahko namešča lokalno ali preko ponudnikov inferencije, kar ga naredi primernega za razvijalce, ki gradijo vizualno-jezikovne aplikacije, raziskovalne delovne tokove in multimodalne agente.

Razdelitev kriterijev

Ease of use1
Value for money1
Features & power0
Integrations1
Support & docs1
Reliability1
  • 12B parametriški vizualno-jezikovni model
  • Mešani vnos slik in besedila
  • 128K tokenov dolžine konteksta
  • Nativna podpora za spremenljiv velikost slike
  • Izdaja z odprtimi težami
  • Primeren za OCR, VQA in opisovanje slik.
3DeepSeek V3 logo

DeepSeek V3

Odprtokodni model mešanice strokovnjakov, ki ponuja razmišljanje na nivoju GPT‑4o po delčku stroškov.

4.8 (6)
Brezplačno
Zaslonska slika DeepSeek V3

DeepSeek V3 je obsežen mixture-of-experts (MoE) jezikovni model, ki ga je razvilo podjetje DeepSeek AI. Aktivira le podmnožico vseh svojih parametrov na token, kar mu omogoča močno zmogljivost pri razmišljanju, matematiki in kodiranju, hkrati pa ohranja stroške inferenciranja bistveno nižje kot pri primerljivih dense modelih. Objavljen z odprtimi utežmi, DeepSeek V3 je postal priljubljena izbira med razvijalci in raziskovalci, ki potrebujejo zmogljiv osnovni model, ki ga lahko samostojno gostijo, prilagodijo ali integrirajo prek API-ja. Benchmarki ga postavljajo v konkurenčno razmerje z vodilnimi lastniškimi modeli, kot je GPT-4o, zlasti pri ocenjevanju matematičnih in logičnih nalog. Model je dobro primeren za tehnične asistente, potek generiranja kode, delovne tokove raziskav in katerokoli aplikacijo, kjer sta pomembni kakovost sklepanja in učinkovitost proračuna.

Razdelitev kriterijev

Ease of use0
Value for money0
Features & power0
Integrations1
Support & docs1
Reliability1
  • Arhitektura mešanice strokovnjakov
  • Konkurenčni rezultati na benchmarkih za razmišljanje in matematiko
  • Odprtokodni uteži modela
  • API dostop prek platforme DeepSeek
  • Podpora za dolgo okno konteksta
  • Enostavna fina nastavitev