Mennyt taisto · 2026-02-20 UTC

LLM Yhteenotto — 20. helmikuuta 2026

Kategoriasta LLM. 14 merkkiä asetettu 3 taistelijan kesken. DeepSeek R1 otti kruunun.

Lopulliset sijoitukset

Kokoonpano

Taistelijat

Profiilit jokaisesta työkalusta, joka kilpaili tässä taistossa, järjestettynä lopullisen pistemääränsä mukaan.

1DeepSeek R1 logo

DeepSeek R1

Avoin lähdekoodi suuren kielen malli, jossa toiminnassa loistaa päättely, matematiikka ja koodaaminen, ja sen lisensoimaan vapauksella käytetään ja muokataan MIT-määräyksen mukaan.

4.8 (4)
Ilmainen
DeepSeek R1 kuvakaappaus

DeepSeek R1 on avoin kohde suurelle kielelle, joka erinomaisessa tapauksessa pyörittää, laskutoimituksia ja ohjelmointitöitä. Se käyttää Mixture of Experts (MoE) -arkkitehtuuria, jossa on 37 miljardia aktivia parametria ja 671 miljardia yht. parametria ja tukee 128 000 kehän pituutta. Maksiminimmiä modeli sisältää edistyksellisiä ohjausopetus menetelmiä saavuttaakseen itsevarmentumista, monipuolista kaksivaiheista yläreuna ja ihmisen sovituksen tasona pyritytään pyörittämään kykyjä. DeepSeek R1 on saavuttanut edistyksellistä vakiintumista monessa vertailussa, mukaan lukien 97,3 prosentin tarkkuus MATH-500, 79,8 prosentin pääsystahti AIME 2024 ja ylöksytymään 96,3 prosenttia Codeforces osallistujista. Käyttöliittymä on saatavana useassa muodossa, 1,5 miljardiin 70 miljardiin parametria, ja se on lisensoidu kuten MIT vapaasti kaytettava. Vaihtoehtona DeepSeek R1 voidaan pyörittää vapaasti verkkopalvelussa ja WebGPU käytönohjatun vaihtoehdon voidaan käyttää paikalliskoneella ja selaimessa. Malli on suunniteltu monimutkaisen ongelmien ratkaisemiseen, monikieliseen ymmärrykseen sekä tuotantovarmenteiselle koodin luomiselle. Sen taituruudet sisältävät erinomaisen matemaattisen argumentoinnin kyvyn, koodin luomisen sekä luonnollisen kielen ymmärryksen. Kuitenkin, koska se on avoimen lähdekoodin malli, sitä voi tarvita teknillistä asiantuntijaosaamista käyttöönottoon ja tarkistettavuuteen niinikään erityistapauksien mukaan. DeepSeek R1 on sijoitettu maailmanlaajuisiin parhaiten menestyneisiin AI-malleihin, ja sen kyvyt ovat vertailukelpoisia etenkin suuryritysten omistamiin kehittämiin ratkaisuihin. Avoimen lähdekoodin luontainen luonne mahdollistaa yhteisöllisen kehittämisen ja jatkuvia päivityksiä, joista tulee muun muassa multimodaalin tuen, keskusteluiden parantaminen sekä jakohakkuisen inferenssin optimointi. Malli on kehitetty täysin tukiasiantuntijakoulutuksella, joka mahdollistaa sen saavuttavan GPT-4-tasoista matematiikkaa huomattavasti halvemmalla. Käyttöketjukuvauksen taito kohdistaa AI- "mustoihin laatikoihin" (black box challenges) haastamalla, ja tarjoaa näkemyksiä mallin käsittelystä. DeepSeek R1:n API tarjoaa avointa OpenAI-päätepistettä integrointia varten, joka hintaa $0.14 miljoonan aseman kohdalla. Malleissa on avointa painotustiedostoa, jolloin se sallii kaupallisen käytön ja muokkausmahdollisuus.

Kriteerien jakautuminen

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • MoE -arkkitehtuurin sekoitus
  • Etäistä oppimista hyödyntävät etenkin edistyneet toimintamalli
  • Oma todennettavuus ja monivaiheinen toiminnanpalautusvaihe
  • Instrumentoidut reaaliaikaan alentuneet toiminnantarkoitus ja matematiikka
  • Tuki 128K-syvyisinä osoitteissa
  • Avoin API -pistekirjapyyntö
2Pixtral 12B 24.09 logo

Pixtral 12B 24.09

Avoin multimodaalinen 12B-malli, joka käsittelee lomitetut kuvat ja teksti 128K:n kontekstin ikkunalla.

4.6 (5)
Ilmainen
Pixtral 12B 24.09 kuvakaappaus

Pixtral 12B 24.09 on Mistral AI:n kehittämä multimodaalinen malli, joka käsittelee kuvia ja tekstiä samassa sekvenssissä, tukee erikokoisia kuvia ja eri kuvasuhteita. Se hyödyntää 12‑miljardia parametria sisältävää kielidekooderia yhdessä näköenkooderin kanssa, mahdollistaen tehtäviä kuten visuaalinen kysymysvastaus, asiakirjojen ymmärtäminen, kaavioiden tulkinta ja kuvatekstien luominen. Malli hyväksyy jopa 128 K tokenin kontekstin, jolloin useita kuvia voidaan vuorotella pitkän tekstin kanssa yhdessä kehotteessa. Julkaistu avoimen lisenssin alla, sen voi ottaa käyttöön paikallisesti tai inferenssipalveluntarjoajien kautta, mikä tekee siitä sopivan kehittäjille, jotka rakentavat vision-language -sovelluksia, tutkimustyönkulkuja ja monimodaalisia agenteja.

Kriteerien jakautuminen

Ease of use1
Value for money1
Features & power0
Integrations1
Support & docs1
Reliability1
  • 12B-parametrinen näkö‑kielimalli
  • Lomitetut kuva‑ ja tekstisyötteet
  • 128K tokenin kontekstipituus
  • Sisäänrakennettu tuki vaihtuville kuvakokoille
  • Avoin painot julkaisussa
  • Sopiva OCR:ään, VQA:han ja kuvatekstien luomiseen
3DeepSeek V3 logo

DeepSeek V3

Avoin lähdekoodi -mikäli-neuvojamalli tarjoaa GPT-4 tason perustelun neljällä annoksella hintaansa edullisemmin.

4.8 (6)
Ilmainen
DeepSeek V3 kuvakaappaus

DeepSeek V3 on suuren mittakaavan sekä asiantuntijan- että arkkitehtuurista asiantutkimusta (MoE, Mixture-of-Experts) soveltava suullisen kielen malli, jonka on kehittänyt DeepSeek AI. Se käynnistää vain osan kaikkien parametreidensa joukosta per token, mikä mahdollistaa sen antaa vahva tasoinen menestys asiantuntijakäyttäytymisessä, matematiikassa ja ohjelmoinnissa, samalla kun viitearvojen alennus aiheuttaa selvästi verrattaessakin pientä laskennan kustannusta vertailukelpoisemmille tiivistymättömille malleille. DeepSeek V3 julkistettiin avoimilla painorajoin, mikä on tekevänyt sen suosituksi kehittäjien ja tutkijoiden keskuudessa. Heidän tarpeensa on ketterä alkeismalli, joka saa itse isännöidä, jota voidaan tarkkailevasti sovittaa tai integroida API:llä. Mittausarvot sijoittavat sen kilpailevien suojattujen malleiden kanssa, kuten GPT-4o, erityisesti matematiikka- ja looginen johtajuusarviotuoteroissa. DeepSeek V3 on sopiva tekniikkapalveluille, koodin tuottamispolkuille, tutkimuskäytäntöjen työkaluille ja milloin tahansa soveltuville sovelluksille, missä käytännön logiikka ja budjettitoimittavuus ovat arvoja.

Kriteerien jakautuminen

Ease of use0
Value for money0
Features & power0
Integrations1
Support & docs1
Reliability1
  • Mikäli-eksperttiarkkitehtuuri
  • Kilpailukykyiset perustelu- ja matematiikkatehokkuukset
  • Avoin mallin painot
  • API-tietoiskuja kautta DeepSeek alustaa
  • Kauaspyörivän tilan tuki
  • Viimeistelty mukava muunneltavuus