Möödunud lahing · 2026-02-20 UTC

LLM Vastasseis — 20. veebruar 2026

Kategooriast LLM. 14 märget pandud 3 võitleja kohta. DeepSeek R1 võttis krooni.

Lõppseis

Koosseis

Võitlejad

Iga selles lahingus võistelnud tööriista profiilid, järjestatud nende lõppskoori järgi.

1DeepSeek R1 logo

DeepSeek R1

Avatud lähtekoodiga suur keeleline mudel, mis silmitsi seisab tõhusas põhjendamis-, matemaatika- ja kooditöödes ning mille MIT-litsents võimaldab tasuta kasutamist ja muutmist.

4.8 (4)
Tasuta
DeepSeek R1 ekraanipilt

DeepSeek R1 on avatud lähtekoodiga suur keeleline mudel, mis silmitsi seisab põhjendamis-, matemaatika- ja kooditöödes. Mudel kasutab Mixture of Experts (MoE) arhitektuuri, millel on 37 B aktiivset parameetrit ja 671 B koguarv, toetades 128 K konteksti pikkust. Mudel sisaldab täiustatud reinforcement learning tehnoloogiaid enesetäitamise, multi-step refleksiooni ja inimikeelpõhise põhjendamise saavutamiseks. DeepSeek R1 on saavutanud tipptasemel tulemuslikkuse erinevates võistlustes, sealhulgas 97,3 % täpsus MATH-500 ülesannete puhul, 79,8 % läbimise määr AIME 2024 puhul ning ületades 96,3 % Codeforces osalejatest. Mudel on saadaval mitmesugustes variantides, mis ulatuvad 1,5 B kuni 70 B parameetrini, ning sellel on MIT-litsents, mis võimaldab tasuta kasutamist ja muutmist. DeepSeek R1 saab kasutada veebis tasuta ning WebGPU kiirendatud versioon töötab lokaalselt brauseris. Mudeli eesmärk on keerukate probleemide lahendamine, mitmekeelse mõistmise ning tootmisvalmis koodi genereerimine. Selle tugevused hõlmavad erakordset matemaatilist põhjendamist, koodi loomist ja loodusliku keele mõistmist. Kuid avatud lähtekoodiga mudelina võib nõuda tehnilist ekspertteadmisi juurutamiseks ja täpse kohandamiseks konkreetsetele kasutuskeskkondadele. DeepSeek R1 asub globaalselt kõrgepäraste AI mudelite seas, pakkudes võimeid võrreldavaks juhtivatele proprietaarsetele lahendustele. Selle avatud lähtekoodiline loomus võimaldab kogukondpõhist arendust ja pidevaid uuendusi, sealhulgas kavandatud multimodaalse toega, vestluspõhise täiustamise ja jaotatud järeldamise optimeerimise. Mudel põhineb puhasel reinforcement learning arendusel, mis võimaldab saavutada GPT‑4 tasemel matemaatilise jõudluse oluliselt madalama kuluga. Chain-of-thought visualiseerimisvõime lahendab AI “pime kast” probleemi, pakkudes ülevaadet mudeli põhjendamiskäitumisest. DeepSeek R1 API pakub OpenAI‑sõbralikku lõpp‑punkti integratsiooniks, hinnas 0,14 $ miljoni tokeni kohta. Mudeli kaalud on avatud lähtekoodiga, võimaldades kaubanduslikku kasutamist ja muutmist.

Разбивка критериев

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Mixture of Experts (MoE) arhitektuur
  • Täiustatud reinforcement learning tehnoloogiad
  • Enesetäitamise ja multi-step refleksiooni võimed
  • Inimikeelpõhine põhjendamine
  • Toetab 128 K konteksti pikkust
  • OpenAI‑sõbralik API lõpp‑punkt
2Pixtral 12B 24.09 logo

Pixtral 12B 24.09

Pixtral 12B model, piisaväline endavastav interiga/pildi ja teksti kohta

4.6 (5)
Tasuta
Pixtral 12B 24.09 ekraanipilt

Pixtral 12B 24.09 on Mistral AI-st pärit multimodaalne mudel, mis töötleb nii pilte kui ka teksti ühes järjestuses, toetades muutuvaid pildi suurusi ja kuvasuhteid. See kasutab 12 miljardi parameetriga keeldekoodrit, mis on seotud nägemis kodeerijaga, võimaldades selliseid ülesandeid nagu visuaalne küsimuste vastamine, dokumendi mõistmine, diagrammide tõlgendamine ja pildi pealkirjastamine. Mudel aktsepteb kuni 128K tokeni konteksti, võimaldades mitmel pildil olla põimitud pika tekstiga ühes viipas. Välja antud avatud litsentsi all, saab seda juurutada kohapeal või järeldusteenuse pakkujate kaudu, muutes selle sobivaks arendajatele, kes ehitavad nägemus-keele rakendusi, uurimistööd ja multimodaalseid agente.

Разбивка критериев

Ease of use1
Value for money1
Features & power0
Integrations1
Support & docs1
Reliability1
  • 12B parameetri visioon-keelemudel
  • Vaheldumisi pilt- ja tekstisisendid
  • 128K märgi kontekstipikkus
  • Native muutuv pildi suurus tugi
  • Avatud kaalu väljalase
  • Sobib OCR-i, VQA ja pealkirjastamise jaoks
3DeepSeek V3 logo

DeepSeek V3

Avolekoodiga spetsialistite segamudel, mis pakub GPT-4o tasemel arutlemist vaid murdeosaga.

4.8 (6)
Tasuta
DeepSeek V3 ekraanipilt

DeepSeek V3 on DeepSeek AI poolt välja töötatud suur masti ekspertide segu (MoE) keelemudel. See aktiveerib ainult osa oma koguparameetritest märgi kohta, võimaldades tal saavutada kõrget jõudlust arutlemis-, matemaatika- ja kodeerimisülesannetes, hoides samal ajal järelduskulusid märkimisväärselt madalamal kui võrreldavad tihedad mudelid. Ava kaaludega välja antud DeepSeek V3 on muutunud populaarseks valikuks arendajate ja uurijate seas, kes vajavad võimsat põhimudelit, mida nad saavad ise hostida, peenhäälestada või API kaudu integreerida. Võrdlusnäitajad asetavad selle konkurentsivõimeliselt juhtivate patenteeritud mudelite, nagu GPT-4o, kõrvale, eriti matemaatika ja loogilise arutluse hindamisel. See mudel sobib hästi tehnilisteks assistentideks, koodi genereerimise torujuhtmeteks, uurimistöövoogudeks ja kõikideks rakendusteks, kus on oluline nii arutlus kvaliteet kui ka eelarve tõhusus.

Разбивка критериев

Ease of use0
Value for money0
Features & power0
Integrations1
Support & docs1
Reliability1
  • Spetsialistite segamude arhitektuur
  • Konkurentsivõimelised arutlemise ja matemaatika mõõdikud
  • Avatud lähtekoodiga mudeli kaalud
  • API juurdepääs DeepSeek platvormi kaudu
  • Pikk kontekstuakna tugi
  • Suunatamisele sobiv