Praeita kova · 2026-02-20 UTC
LLM Susirėmimas — 2026 m. vasario 20 d.
Iš LLM kategorijos. 14 įvertinimai pateikti tarp 3 kovotojų. DeepSeek R1 laimėjo vainiką.
Galutiniai rezultatai
Dalyviai
Kovotojai
Kiekvieno šioje kovoje dalyvavusio įrankio profiliai, surikiuoti pagal galutinį rezultatą.

DeepSeek R1
Atvirųjų šaltinių didelis žiūrių modelis, pagerintis problemų išsprendimą, matematiką ir kodus, naudojantis MIT licenzija sąlygomis neiįprastai be mokesčių.

DeepSeek R1 yra atvirasjųjų didelių jutikų modelių šaknis, kuris išsipjauna gebėjimą nagrinėti abstraktinius ryšius, matematinės matematikos uždaras bei kodo uždovynes. Jis naudoja Mixture of Experts (MoE) architektūrą su 37 mlrd. veikiamų parametrų ir 671 mlrd. parametru, paspėdina 128K konteksto ilgį. Šis modelis įtaisija pasitelktį mokymosi išmokymą pasiekti savo verifikavimą, keliojų refleksiją bei žmogiško orientuotąjų raiškos širdžius. DeepSeek R1 pasiekęs visų sąlygujų geriausių rezultatus keliojų standartų, žemęjant 97.3% taikslumo pagal MATH-500, 79.8% sėkmės laipsniui pagal AIME 2024, bei priešpaskutiniuosių 96.3% uždarytojų Codeforces. Šis modelis pasižymi daugybemi variantais, besiskiriantais nuo 1,5 mlrd. iki 70 mlrd. parametru, ir pateikiamas pagal MIT licenciją be jokių išlaidų. DeepSeek R1 taip pat naudojamas internete už nulinį išlaidų ir įtaisijamas paspėtinio WebGPU pagrindu, leidžianti kiekvienąjį vartotoją paleisti ir pasirūpinti tinklavietės aplinkybėmis. Modelis sukurtas kompleksinių problemai sprendimo, daugialypių kalbų įtraukties ir pagrindinio kodui generavimo tikslais. Jo gebėjimai apima nuostabių matematikinių argumentacijų, kodą generuojančių, bei prirodžios kalbos supratimo galių. Vienintelis, bet modelis yra atvira prieigos sistema, nors galbūt norint tobulinti ir išsaugoti modelio bei pritaikyti jį konkretniems naudojimams, reikia naudoti techninių žinių. DeepSeek R1 yra įvertinamas už aukštųjų AI modelių rango pasaulyje, su galiomis panašiomis į lyderių savitines sprendinius. Jo atvirųjų šaltinių (open-source) priklausomybė leidžia bendruomeniniam vystymui ir toliau vykstančioms patobulinimams, tarp jų numatytame multimodaliojo palaikymo bei pokalbių užteisinimo, bei panaudojimo plieniniuose įrenginiuose (distributed inference) optimizacijai. Modelis turi tiesioginę mokytojos mokymosi raidą, kas leidžia jo pasiekti GPT-4 lygio matematikos funkcionalumo ženkliai auktžemes kostė. Sukauptos minties vizualizavimo galimybės spragša „juodojo skydo“ AI iššūkius, suteikiančios įrangos mokymosi procesų atvaizdą. DeepSeek R1 šioje sistemoje API suteikia atvirojo API bei vykdo OpenAI - kompatybę, integruojamą bei taikantį $0,14 per milijoną žodžių bei mokesčius. Modelio svoriu yra atviro kaltis, leidžiantis komercinei veiklai ir permainamui.
Kriterijų išskirstymas
- Mixture of Experts (MoE) architektūra
- Papildinti kartų mokymosi technika
- Savarankiškas apvertinimas bei daugiaspakos išsprendimai:
- Logikos orientuotas mokymasis.
- Atžava 128K konteksto ilgumas
- OpenAI kompatybingas API endpoint

Pixtral 12B 24.09
Atvira multimodala 12B modelis, prieinama keliame vaizdų ir tekstų su 128K konteksto langeliu.

Pixtral 12B 24.09 yra daugjų modelis iš Mistral AI, kuris apdorovauja be vieno sekimo bei paveikslus ir tekstus, remdamasis svyruojančiais paveikslų dydžiais ir proporcijomis. Šis modelis naudoja 12 milijardų parametrų kalbos dekoderį kartu su vaizduotiems skaičiuotuvas, leidžiantis atlikti užduotis kaip vaizdo klausymas, dokumentų apdorojimas, diagramų interpretavimas ir paveikslelo antrąją užduotis. Modelis priima iki 128K token sąrašų konteksto, leidžiant įvairius vaizdus susiejęs ilguosiu tekstu vieno prašymo metu. Išleistas atviro licence taishinė, todėl jis gali būti įdiegtas lokalėje vietoje bei per inferencijos operatoriuos, tuo tikriančiau rekomenduojamas programuotojams pradedantys vizualizacijos kalbos taiklinių priemonių, tyrimų kėdainių bei multimodalinių agentų kūrimą.
Kriterijų išskirstymas
- 12B parametru vaizdų-anglų modelis
- Viduriuje patekantis tekstas ir vaizdas
- 128K simbolių konteksto ilgumas
- Natūralus pokytis vaizdo dydžių užtvaris
- Atviro žingslio išleidimas
- Tvirtina OCR, VQA, ir nukreipinius tekstus

DeepSeek V3
Atviras mėginių modelis, siūlantysis GPT-4 lygio priežastingumą vos nežemesnei kainai.

DeepSeek V3 yra didelio masto mėginių (MaE) kalbos modelis, sukurtas DeepSeek AI. Jis veikia tik dalykinės savo visų parameterių, leidžiant jį delistirdinti gausiąją atliekamą performanciją kovos, matematikos bei programinės kodu realizacijos uždaviniais, todėl infekcinės užteiktų sąnaudų sumažėja lyginant su taip patiųjų tankiųjų modelių. DeepSeek V3 atviro svoris išleistas, jis tapo populiariausiu variantu programuotojams ir tyrėjams, kurie nori gali savimi nuošalų pagrindinį modelį, kurį jiems gali pasididžioti, ar integruoti API. Įvertinimai sakyja, kad jis prieigos prie lyderių savininkų, tokio paties kaip GPT-4o modelioi, kad labanore matematikos ir logiko priežastingumo įvertinimų. Jis labai tinkamiai sudaro savo paslaugas specialistams, kode generavimo tiekime, mokslinių tyrimų workflow, bei visai sąvokai, kuriai yra svarbus atsiskaityti dėl priežastingumo kokybės bei biudžeto efektyvumo.
Kriterijų išskirstymas
- Mėginių kovos architektūra
- Mėginių kovų bei matematikos įvertinimų bendrųjų vertinimai
- Atviro svoris, kuris galioja savimi išsaugotui
- API bei svoris, kuris pridedamas DeepSeek platformoje
- Gamtinės konteksto langelės palaikymas
- Labai gerai atsiskaitytų savininkų bei integracijų prijungimas


