Iepriekšējā cīņa · 2026-02-20 UTC
LLM Sadursme — 2026. gada 20. februāris
No LLM kategorijas. 14 atzīmes izvietotas starp 3 cīnītājiem. DeepSeek R1 izcīnīja kroni.
Gala rezultāti
Sastāvs
Cīnītāji
Katra rīka profili, kas piedalījās šajā cīņā, sarindoti pēc to gala rezultāta.

DeepSeek R1
Atvērts lielais valodas modelis, kas izceļas loģikas, matemātikas un kodēšanas uzdevumos, ar MIT licence brīvas izmantošanas un modificēšanas tiesībām.

DeepSeek R1 ir atvērtais kodeksa liela valodu modelis, kas pārveidojas ar analīzi, matemātikas uzdevumiem un programmēšanas uzskaņošanai. Tā lieto Mixture of Experts (MoE) architektūru ar 37T aktīviem parametriem un 671T parametriem kopsummu, atbalstot 128T T maiņu ilgumu. Modelis iekļauj pazīstītus apmācības mācīšanas tehnikas, lai sasniegtu pašizcelšanos, daudzgadīgu refleksiju un cilvēkam piemērotu analīzes spēju. DeepSeek R1 ir sasniedzis uzlabotu panākumu daudzos benchmarkiem, to skaitā 97,3% precīzību MATH-500, 79,8% veiksmību AIME 2024, un ir pārspējušis 96,3% Codeforces dalībnieku. Modelis ir pieejams dažādos variantos, no 1,5T līdz 70T parametru, un tiek izdodams ar MIT licenzi no bezmaksas izmantošanas un modificēšanas. DeepSeek R1 var tiešsaistē lietot bez maksas, un WebGPU-accelerētais variantam ir iespēja izmantot to arī lokāli pārlūkā. Modēls ir paredzēts kompleksu problēmu risināšanai, daudzu valodu saprīšanai un ražošanas kvalitātes koda izveidošanai. To pamatīgās prasības ietver izņēmuma matemātisko argumentāciju, kodu izveidošanu un natīviegas valodu saprīšanu spējas. Tomēr, kā atvērtā-souce modēla, to saskaņošana un speciālu lietotāju gadījumu papildināšana var prasīt tehnisko pieredzi. DeepSeek R1 atrodas tajos pamatos, kur ir augsti ierindoti pasaules AI modeli, savas iespējas izvietojoties virs vadošo, privātīgu risinājumu līmeņa modeliem. Atvērtā sūtīšanas dabība ļāwa ar komūnu sadarbību veikt attīstību un aizsāk, ietverot plānotos multimodālās atbalsta, saruninieka paplašinājumu un sadali atvasiņu palielinājumu. Modelis ir pilnīgi cēloņu mācīšanās attīstība, kas ļauj to sasniedzēt GPT-4 līmeņa matemātikas rezultātus ar vēlams zemāku cenu. Ceļa gatavības vizualizācijas iespēja skar ar IA "melna došu" izaicinājumiem, nododot ieksversmu modela domāšanas procesā. DeepSeek R1 API piedāvā atvērtā izmantošanas OpenAI atbilstīgu punktu, integrēšanai cenā 0,14 USD miljonos tokenu. Modela svarus ir atvērtā izmantošanas, ļaujot komerciālu izmantošanu un modificēšanu.
Kritēriju sadalījums
- Ekspertu sajaukuma (MoE) arhitektūra
- Paplašinātas pastiprināšanas mācīšanās tehnoloģijas
- Pašpārbaudes un vairāku soļu refleksijas iespējas
- Cilvēka saskaņota loģiskā domāšana
- Atbalsts 128 K konteksta garumam
- OpenAI-saderīgs API galapunkts

Pixtral 12B 24.09
Atvērts multimodāls 12B modelis, kas apstrādā iekavētus attēlus un tekstu ar 128K konteksta logu.

Pixtral 12B 24.09 ir multimodalā modelis no Mistral AI, kas apstrāda arī attēlus un tekstu vienā secībā, atbalstojot mainīgas attēlu izmērus un attēlu attiecības. Tas tiek izmantots kopā ar 12 milliardu parametru valodu decoderi un viesions encodi, izaugsmei paskatīt tādas uzdevumi kā vizuālie jautājumi, dokumentu apzinība, grafikām interpretācija, un attēlus pavadzīšanas teksta veidošana. Modeli ir iespēja apstrādāt līdz 128K tokenu kontekstu, pieskrietot vairākiem attēliem ar ilgāku tekstu vienotā ieteikuma laukā. Sadaļā ir atvērti licenci, kurš var tikt izmantots vietēji vai caur inferences providers, kas iezīmē to kā ideālu rīku vides programmētājiem, kas strādā ar redzamības-tekstas attīstību, pētnieku plāna un multimodālo agentu izstrādei.
Kritēriju sadalījums
- 12B parametru redzes‑valodas modelis
- Iekavēti attēlu un teksta ievades
- 128K tokenu konteksta garums
- Nativs mainīgo attēlu izmēru atbalsts
- Atvērta svara izlaidums
- Piemērots OCR, VQA un uzrakstu ģenerēšanai

DeepSeek V3
Atvērtā pirmkoda "mixture-of-experts" modelis, kas piedāvā GPT-4o līmeņa izpēti par daļi no izdevumiem.

DeepSeek V3 ir liela skala līdzekļu (MoE) valodu modelis, kas tika izstrādāts ar DeepSeek AI. Tas aktivizē tikai daļu no visa sava pārmērīga parametriem katrā tokenā, ļaujot to pieejamiem rezultātiem uzskaitīšanai, matematikai un programmatūras uzdevumiem, saglabājot izvadusmaksu izdevumu noteicošāki zemīgi salīdzinājumā ar līdzīgiem blīviem modeliem. Pabeigts ar atvērtām svaru vienībām, DeepSeek V3 ir kļuvis par populāru izvēli raksturotājiem un zinātniekiem, kas ir jāiekārto spēcīga pamatskate, kas var būt pašreizēji jāiekārto pārbaudīti vai integretā ar API. Pierādījumi iekļauj to kā vienu no vadošajām privātpiedāvējamām modelēm, kā GPT-4o, galvenokārt ar matemātikas un logiskās izvēles pārbaudes. Modela ir labi izvēlēta par tehniskajiem palīgiem, kodu ģenerēšanas plūsmām, pētniecības darbdarību un jebkuru lietojumprogrammu, kurās lielākā nozīme ir rādītāju kvalitāte un biļetenam efektivitāte.
Kritēriju sadalījums
- Mixture-of-experts arhitektūra
- Konkurētspējīgas izpētes un matemātikas pārbaudījumu rezultāti
- Atvērtā pirmkoda modeļa svarbaji
- API piekļuve caur DeepSeek platformu
- Lielas konteksta loga atbalsts
- Piemērots precizēšanai


