Bătălie trecută · 2026-02-20 UTC

LLM Confruntare — 20 februarie 2026

Din categoria LLM. 14 puncte plasate pe 3 luptători. DeepSeek R1 a luat coroana.

Clasament final

Lotul

Luptătorii

Profilurile fiecărui instrument care a concurat în această bătălie, clasate după scorul lor final.

1DeepSeek R1 logo

DeepSeek R1

Un model de limbaj open-source la scară largă, excelent în sarcini de raționare, matematică și codare, cu licențiere MIT pentru utilizare și modificare gratuită.

4.8 (4)
Gratuit
Captură de ecran DeepSeek R1

DeepSeek R1 este un model de limbă mare open-source care excellează în sarcinile de raționamente, matematică și cod. El utilizează o arhitectură Mixture of Experts (MoE) cu 37B de parametri activi și 671B de parametri totali, susținând o lungime de context de 128K. Modelul înglobează tehnici de învățare din întăriri avansate pentru a obține verificarea de sine, reflecția de mai multe pași și căpătarea capacităților de raționament aliniate la om. DeepSeek R1 a atins performanța de încercare din stadiul actual în diverse baza de indicatori, inclusiv 97.3% de exactitate pe MATH-500, 79.8% de procent de reușită pe AIME 2024, și depășind 96.3% dintre participanții la Codeforces. Modelul este disponibil în variante multiple, pertrănd cu 1.5B până la 70B de parametri, și este licențiat sub MIT pentru utilizare și modificare gratuită. DeepSeek R1 poate fi utilizat online gratuit, iar o versiune accelerată cu WebGPU poate fi rulată local într-un browser. Modelul a fost proiectat pentru rezolvarea problemelor complexe, înțelegerea multilingvă și generarea codului în producție. Sarcinile sale includ o rezoluție matematică remarcabilă, generarea codului și capacitățile de înțelegere naturală a limbajului. Cu toate acestea, ca model deschis sursă, poate necesita o experiență tehnică pentru implementare și ajustare la cerințe specifice utilizării. DeepSeek R1 se afiază printre cele mai bune modele AI la nivel global, având performante comparabile cu soluțiile proprietar proprii de top. Natura sa open-source permite dezvoltarea comunitară și actualizările continue, inclusiv cele planificate pentru suport multimodul, îmbunătățirea conversațională și optimizarea înferenței distribuite. Modelul are un dezvoltare bazată pe învățare prin recompensă pură, ceea ce îi permite să atingă performanțele matematice la nivelul GPT-4 la un cost semnificativ mai mic. Capabilitatea de vizualizare a procesului de gândire a lanțurilor de gândire abordează provocarea „boxei negre” a IA, furnizând însăși o imagine a procesului său de raționament. API-ul lui DeepSeek R1 oferă un punct de acces compatibil cu OpenAI pentru integrare, preț de 0,14 dolari pe milion de token-uri. Weighțile modelului sunt deschise sursă, ceea ce permite utilizarea comercială și modificarea ei.

Diviziunea criteriilor

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Arhitectură Mixture of Experts (MoE)
  • Tehnici avansate de învățare prin consolidare
  • Capacități de auto-verificare și reflecție multi-pas
  • Raționare aliniată la om
  • Suport pentru lungimea contextului de 128K
  • Punct de terminare API compatibil OpenAI
2Pixtral 12B 24.09 logo

Pixtral 12B 24.09

Model multimodal deschis de 12B care gestionează imagini și text întrețesute cu o fereastră de context de 128K.

4.6 (5)
Gratuit
Captură de ecran Pixtral 12B 24.09

Pixtral 12B 24.09 este un model multimodal din Mistral AI care procesează atât imagini, cât și texte într-o singură secvență, susținând dimensiuni și raporturi imagistice variabile. Se utilizează un deocodificator de limbaj cu 12 miliarde de parametri, asociat cu un codificator de vizualizare, ceea ce permite sarcini ca răspunsul la întrebări vizuale, interpretarea documentelor, analizarea diagramei și crearea caption-urilor de imagine. Modelul acceptă până la un context de 128K de tokeni, permitemând intercalarea mai multor imagini cu texte de lungă formă într-o singură prompt. Lansat sub o licență deschisă, poate fi implementat local sau prin intermediari de inferență, făcându-l adecvat dezvoltorilor care construiesc aplicații de vedere-limbaj, fluxuri de lucru de cercetare și agenți multimodali.

Diviziunea criteriilor

Ease of use1
Value for money1
Features & power0
Integrations1
Support & docs1
Reliability1
  • Model de viziune și limbaj cu 12B parametri
  • Intrări de imagini și text întrețesute
  • Lungimea contextului de 128K tokeni
  • Suport nativ pentru dimensiuni variabile ale imaginii
  • Lansare cu greutate deschisă
  • Potrivit pentru OCR, VQA și etichetare
3DeepSeek V3 logo

DeepSeek V3

Model sursă deschisă mixtă de experți care oferă capacități de raționare la nivelul GPT-4o la o fracțiune din cost.

4.8 (6)
Gratuit
Captură de ecran DeepSeek V3

DeepSeek V3 este un model de limbă de dimensiuni mari, tip mixture-of-experts (MoE), dezvoltat de DeepSeek AI. Activă doar o submulțime din totalul parametrilor săi per token, permitând lui să presteze o performanta foarte bună în sarcini de raționament, matematică și codare, în timp ce este capabil să mențină costurile de inferences semnificativ mai mici decât modelele comparabile dense. DeepSeek V3 a fost lansat cu greutăți deschise, devenind așadar o alegere populară pentru dezvoltatori și cercetători care au nevoie de un model de bază capabil pe care să îl găzduiască ei înșiși, să-l finețească sau să-l integreze prin intermediul API. Datele de referință îl situează în zona concurenței cu modele proprietare conducătoare, precum GPT-4o, mai ales în teste de evaluare a raționamentului matematic și logic. Modelul este bine adaptat pentru asistenții tehnici, pipelines de generare a codului, fluxurile de lucru de cercetare și orice aplicație în care se cere calitatea raționamentului și eficiența bugetară ambelor.

Diviziunea criteriilor

Ease of use0
Value for money0
Features & power0
Integrations1
Support & docs1
Reliability1
  • Arhitectură mixtă de experți
  • Benchmark-uri competitive de raționare și matematică
  • Greutăți ale modelului open-source
  • Acces API prin platforma DeepSeek
  • Suport pentru ferestre lungi de context
  • Prietenos cu fine-tuning-ul