Prošla bitka · 2026-02-20 UTC

LLM Obračun — 20. veljače 2026.

Iz kategorije LLM. 14 oznaka postavljeno među 3 boraca. DeepSeek R1 je preuzeo krunu.

Konačni poredak

Postava

Borci

Profili svakog alata koji se natjecao u ovoj bitci, rangirani prema konačnom rezultatu.

1DeepSeek R1 logo

DeepSeek R1

Otvoreno-kodu veliki model jezika koji se izdvaja u razumevanju, matematicama i kođiranju uz dozvolu MIT za besplatan uporab i mijenjaj.

4.8 (4)
Besplatno
Slika od DeepSeek R1

DeepSeek R1 je otvorenosloženi velik model beseda koji je izrazito dobr za zasnivanje zaključaka, rješavanje matematičkih problema i programsku podršku. Upotrebljava Mixture of Experts (MoE) arhitekturu sa 37 milijardama akcione mogućnosti i ukupno 671 milijardu paramtera, podržava dužinu konteksta do 128K slogova. Model uključuje napredne tehničke tehnike učenja sustava za postizanje samoupravljanja, multi-step refleksije i razumijevanja usmjerenih prema ljudima svojstava. DeepSeek R1 je učinio velik napredak u različitim benchmark testovima, uključujući 97,3 posto točnosti na MATH-500, 79,8 posto uspješnosti na AIME 2024, i je superiorniji u odnosu na 96,3 posto sudionika na Codeforces-u. Model je dostupan u mnogim varijantama, od 1,5 milijarde do 70 milijardi paramatera, i je ličen pod MIT licencom za besplatan uporab i modifikaciju. DeepSeek R1 može se upotrijebiti online besplatno, te je preporučena verzija podržava WebGPU za lokalno izvođenje u web pregledniku. Model je dizajniran za kompleksno rešavanje problema, razumijevanje više jezika i generiranje proizvodnog stepena koda. Svojim jakostima uključuje iznimno matematičko razumevanje, generiranje koda te mogućnosti razumijevanja prirodnog jezika. Međutim, kao otvorena-source model, moguće ga je potrebno kandidati tehničkom znanju za implementaciju i fino podešavanje za specifične primjene DeepSeek R1 je pozicioniran među najboljim performansama AI modela u svijetu, sa mogućnostima komparabilnima sa vodećim samostalnim rješenjima. Javno dostupan status omogućava zajednički pokretane razvojne procese i kontinuiranu updatiranje, uključujući planirana multimodalna podrška, poboljšanje konverzacije i optimizaciju distibuirane izvršbe. Model ima čistu razvojnu potporu učenja na nagradu, što mu omogućava dostići performanse u matematici na razini GPT-4-a sa znatno nižim troškovima. Kapacitet za vizualizaciju lanca razmišljanja adresa izazove "crne kutije" u AI, pružajućiinsighte u postupak modelove razičite. DeepSeek R1 nudi API endpoint kompatibilan s OpenAI, koji se može integrirati i koji se tara po 0,14 dolara po milijuni tokena. Težine modela su dostupne kao otvoreni kod, dozvoljavajući njihovu komercijalnu upotrebu i modifikaciju.

Razljepljivanje kriterija

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Mješanje stručnjaka (MoE) arhitektura
  • Napredne tehnike učenja po utvrđivanju
  • Autoverifikacija i više-koracna pogubljenja sposobnost
  • Ljudski-aligeniran razumljivanje
  • Potpora za duge kontekstačne dužine od 128K
  • Otvoreni API-endpoint kompatibilan s OpenAI-om
2Pixtral 12B 24.09 logo

Pixtral 12B 24.09

Otvoren multimodalni model veličine 12B koji obrađuje međuproizvoljni slike i tekst s okrenitom dužinom konteksta od 128 KB.

4.6 (5)
Besplatno
Slika od Pixtral 12B 24.09

Pixtral 12B 24.09 je multimodalni model iz sustava Mistral AI koji obrađuje obje slike i tekst unutar jednoga reda, podržava različite veličine i omjere objekata. Korištenjem 12-miliard parametara jezika decodera uzgrađenog uz vidni encoder, omogućavaju se zadaci poput viđenje pitanja i odgovora, razumijevanje dokumenata, interpretacija grafika, te popisivanje slika. Model podržava do 128 KB token konteksta, što omogućava uplitanje više slika s dugotrajanom tekstualnom vrpcom u jedan zahtjev. Objavljeno je pod otvorenom licencijom, što omogućava njegovo lokalno implementiranje ili kroz provajdera inferencije, čime se osigurava što je odgovora za inženjere koji tvore vizualno-tekstualne aplikacije, radne tokove istraživanja i višemodele umijeće.

Razljepljivanje kriterija

Ease of use1
Value for money1
Features & power0
Integrations1
Support & docs1
Reliability1
  • 12B parametarski model vizije-jezičkog sustava
  • Međuproizvolji tekst i slike kao ulaz
  • Dužina konteksta od 128 KB
  • Nativno podržano varijabilno veličina i format slika
  • Izdanje s otvorenim štetima
  • Prijepitljivo za OCR, VQA i opisivanje
3DeepSeek V3 logo

DeepSeek V3

Otvoreni model mješavine stručnjaka koji nudi razumijevanje na razini GPT-4o po fragmentu troška.

4.8 (6)
Besplatno
Slika od DeepSeek V3

DeepSeek V3 je velika, hibridna jezična inteligencija (mixture-of-experts, MoE) koju je razvila tvrtka DeepSeek AI. Ona aktivira samo podskup svojih ukupnih parametara po token, što joj omogućava da postigne snažne rezultate u razumijevanju, matematici i programskim zadacima, a istovremeno podržava znatno niže trošak inferencije u usporedbi s gustim modelima. Objavljen s otvorenim tezginama, DeepSeek V3 je postao popularan izbor za razvijatelje i istraživače koji trebaju sposoban osnovni model koji mogu samostalno hostati, fino podešiti ili integrirati putem API-ja. Benchmarkovi ga stavljaju u konkurentski odnos prema vodećim privatnim modelima poput GPT-4o, posebno na ocjenama matematike i logičkog razumljivaњa. Model je dobro prilagođen tehničkim asistentima, cjevovodima za generiranje koda, istraživačkim radnim tokovima i svim aplikacijama u kojima kvaliteta razumljivosti i efikasnost proračuna imaju istovremeno važnu ulogu.

Razljepljivanje kriterija

Ease of use0
Value for money0
Features & power0
Integrations1
Support & docs1
Reliability1
  • Arhitektura mješavine stručnjaka
  • Konkurentno razumijevanje i matematički benchmarki
  • Otvoreni modele težina
  • Pristup API-u putem platforme DeepSeek
  • Podrška za dugi kontekstualni prozor
  • Prijateljski za fino podešavanje