Pretekla bitka · 2025-08-08 UTC

LLM Obračun — 8. avgust 2025

Iz kategorije LLM. 28 oznake postavljenih med 6 borci. DeepSeek V3 je osvojil krono.

Končna razvrstitev

Postava

Borci

Profili vsakega orodja, ki je tekmovalo v tej bitki, razvrščeni po končnem rezultatu.

1DeepSeek V3 logo

DeepSeek V3

Odprtokodni model mešanice strokovnjakov, ki ponuja razmišljanje na nivoju GPT‑4o po delčku stroškov.

4.8 (6)
Brezplačno
Zaslonska slika DeepSeek V3

DeepSeek V3 je obsežen mixture-of-experts (MoE) jezikovni model, ki ga je razvilo podjetje DeepSeek AI. Aktivira le podmnožico vseh svojih parametrov na token, kar mu omogoča močno zmogljivost pri razmišljanju, matematiki in kodiranju, hkrati pa ohranja stroške inferenciranja bistveno nižje kot pri primerljivih dense modelih. Objavljen z odprtimi utežmi, DeepSeek V3 je postal priljubljena izbira med razvijalci in raziskovalci, ki potrebujejo zmogljiv osnovni model, ki ga lahko samostojno gostijo, prilagodijo ali integrirajo prek API-ja. Benchmarki ga postavljajo v konkurenčno razmerje z vodilnimi lastniškimi modeli, kot je GPT-4o, zlasti pri ocenjevanju matematičnih in logičnih nalog. Model je dobro primeren za tehnične asistente, potek generiranja kode, delovne tokove raziskav in katerokoli aplikacijo, kjer sta pomembni kakovost sklepanja in učinkovitost proračuna.

Razdelitev kriterijev

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Arhitektura mešanice strokovnjakov
  • Konkurenčni rezultati na benchmarkih za razmišljanje in matematiko
  • Odprtokodni uteži modela
  • API dostop prek platforme DeepSeek
  • Podpora za dolgo okno konteksta
  • Enostavna fina nastavitev
2Janus pro logo

Janus pro

DeepSeekov odprti multimodalni model za generiranje slik in vizualno razumevanje v eni unifikirani arhitekturi.

4.8 (4)
Brezplačno
Zaslonska slika Janus pro

Janus Pro je odprtokodni multimodalni AI model podjetja DeepSeek, na voljo v različicah z 1 mrd in 7 mrd parametrov. Združuje vizualno razumevanje in ustvarjanje slik v en sam okvir, saj ločuje poti vizualnega kodiranja, kar modelu omogoča tako interpretacijo slik kot tudi njihovo ustvarjanje iz tekstualnih navodil. 7B varianta prinaša konkurenčne rezultate na benchmarkih za sintezo besedila-v-izgled in vizualno odgovarjanje na vprašanja, pogosto se ujema ali presegajo večje specializirane modele. Objavljeno pod MIT licenco, Janus Pro lahko samostojno gostite, fino prilagajate in vključite v raziskovalne ali proizvodne tokove brez omejitev uporabe. Primerna je za razvijalce, raziskovalce in hobiste, ki potrebujejo fleksibilen multimodalni temeljni model za eksperimentiranje, prototipiranje ali gradnjo aplikacij, ki združujejo ustvarjanje slik z razumevanjem slik.

Razdelitev kriterijev

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Generiranje slik iz besedila
  • Vizualno odgovarjanje na vprašanja in analiza slik
  • Unifikirana transformacijska arhitektura
  • Možnosti z 1 mrd. in 7 mrd. parametri
  • MIT-licencirani odprti modeli
  • Podpora multimodalnemu vhodu in izhodu
3DeepSeek R1 logo

DeepSeek R1

Odprtokodni veliki jezikovni model, ki izstopa pri razmišljanju, matematiki in programiranju, z licenco MIT za brezplačno uporabo in spreminjanje.

4.8 (4)
Brezplačno
Zaslonska slika DeepSeek R1

DeepSeek R1 je odprtokodni veliki jezikovni model, ki izstopa pri razmišljanju, matematiki in programiranju. Uporablja arhitekturo Mixture of Experts (MoE) s 37 B aktivnimi parametri in 671 B skupnimi parametri, podpora za 128 K dolžino konteksta. Model vključuje napredne tehnike okrepitvenega učenja, da doseže samoverifikacijo, večkorakovno refleksijo in razmišljanje usklajeno s človekom. DeepSeek R1 je dosegel state-of-the-art zmogljivost v različnih benchmarkih, vključno s 97,3 % natančnostjo na MATH‑500, 79,8 % stopnjo uspešnosti na AIME 2024 ter prehitel 96,3 % udeležencev Codeforces. Model je na voljo v več različicah, od 1,5 B do 70 B parametrov, in je licenciran pod MIT za brezplačno uporabo in spreminjanje. DeepSeek R1 lahko uporabljate brezplačno na spletu, različica, ki izkorišča WebGPU, pa lahko teče lokalno v brskalniku. Model je zasnovan za reševanje kompleksnih problemov, večjezično razumevanje in generiranje kode proizvodne kakovosti. Njegove prednosti vključujejo izjemno matematično razmišljanje, generiranje kode ter sposobnosti naravnega jezikovnega razumevanja. Vendar pa kot odprtokodni model lahko zahteva tehnično strokovnost za njegovo namestitev in fino nastavljanje za specifične primere uporabe. DeepSeek R1 se uvršča med vrhunske AI modele po vsem svetu, s sposobnostmi, ki so primerljive z vodilnimi lastniškimi rešitvami. Njegova open‑source narava omogoča razvoj, ki ga poganja skupnost, in stalne nadgradnje, vključno s načrtovano multimodalno podporo, izboljšanjem konverzacijskih zmogljivosti ter optimizacijo porazdeljene inferenčne. Model ima čisto reinforcement learning razvoj, kar mu omogoča doseganje matematične zmogljivosti na nivoju GPT-4 po precej nižjih stroških. Možnost vizualizacije chain-of-thought naslavlja izzive AI "black box" in zagotavlja vpogled v proces razmišljanja modela. DeepSeek R1-jev API ponuja OpenAI‑kompatibilno končno točko za integracijo po ceni $0.14 na milijon žetonov. Teže modela so odprtokodne, kar omogoča komercialno uporabo in spreminjanje.

Razdelitev kriterijev

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability0
  • Arhitektura Mešanice strokovnjakov (MoE)
  • Napredne tehnike okrepljenega učenja
  • Samospreverjanje in večkorakovne refleksijske zmožnosti
  • Razmišljanje usklajeno z ljudmi
  • Podpora za dolžino konteksta 128 K
  • API končna točka, združljiva z OpenAI
4ASI:One logo

ASI:One

Agentičen AI asistent, ki koordinira avtonomne agente za izpolnitev večstopinjnih nalog.

4.5 (4)
Brezplačno
Zaslonska slika ASI:One

ASI:One je AI pomočnik, ki temelji na konceptu agentne inteligence, kjer pogovorni vmesnik lahko pošilja in koordinira specializirane samostojne agente za obravnavo zapletenih zahtev. Namesto da bi vrnil le besedilo, lahko načrtuje, kliče orodja in izvaja delovne tokove v imenu uporabnika. Razvito znotraj ekosistema Artificial Superintelligence Alliance je postavljeno kot osebni AI agent, ki se integrira z dezentraliziranimi omrežji agentov. Uporabniki z njim lahko vodijo pogovore o vsakodnevnih vprašanjih ali delegirajo daljše naloge, kot so raziskave, primerjave, načrtovanje in iskanje podatkov preko povezanih storitev.

Razdelitev kriterijev

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability1
  • Razgovorni vmesnik za klepet
  • Orkestracija avtonomnih agentov
  • Načrtovanje in izvajanje večstopinjnih nalog
  • Povezljivost z zunanjimi agenti in storitvami
  • Zapisnik in kontekst v slogu osebnega asistenta
  • Ustvarjeno na ASI Alliance agent stack
5Latest DeepSeek R2 logo

Latest DeepSeek R2

Model AI prihodnjega generacije, osredotočen na razmišljanje, iz DeepSeek

4.8 (6)
Brezplačno
Zaslonska slika Latest DeepSeek R2

Najnovejša DeepSeek R2 je naslednik DeepSeekovega modela R1 za razmišljanje, zasnovan za zagotavljanje močnejšega korak po koraku reševanja problemov v matematiki, kodiranju in analitičnih nalogah. Namen je razširiti odprt raziskovalni pristop, ki je naredil prejšnje izdaje DeepSeek priljubljene med razvijalci in raziskovalci. Model je usmerjen k izboljšani natančnosti, daljšemu obravnavanju konteksta in bolj učinkovitemu inference v primerjavi s svojim predhodnikom, kar ga dela primernega za tehnične pomočnike, agentične delovne tokove in integracijo v prilagojene aplikacije. Dostopnost in natančne specifikacije so odvisne od uradnih kanalov izdaje DeepSeek. Uporabniki lahko običajno dostopajo do modela prek API, vmesnika za klepet ali z izvajanjem odprtih teže, če so na voljo, kar omogoča fleksibilnost tako za posamezno eksperimentiranje kot za proizvodno uvajanje.

Razdelitev kriterijev

Ease of use1
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability1
  • Napredno verižno razmišljanje
  • Razširjen kontekstni prostor
  • Podpora za ustvarjanje kode in odpravljanje napak
  • Večjezično razumevanje
  • API in dostop prek klepeta
  • Primeren za agentične aplikacije
6Pronoia logo

Pronoia

Arabsko-centriran velik jezikovni model, prilagojen za razumevanje in generiranje z materni kakovostjo.

4.7 (6)
Brezplačno

Pronoia je velik jezikovni model, posebej fino prilagojen arabščini, ki cilja na natančnejše razumevanje, generiranje in sklepanja v jeziku kot splošni večjezični modeli. Je vodilni arabsko-osredotočen LLM, ki je optimiziran za dialekte, klasične oblike in sodobni standardni arabski jezik. Model se lahko uporablja za naloge, kot so ustvarjanje vsebin, povzemanje, prevajanje, podpora strankam in pogovorna AI na trgih, ki govorijo po arabskem jeziku. Z usmeritvijo svojega usposabljanja na arabskih podatkih Pronoia zajema subtilnosti, kot so morfologija, diakritični znaki in kulturni kontekst, ki jih širši modeli pogosto obravnavajo neskladno.

Razdelitev kriterijev

Ease of use1
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • Arabsko optimiziran jezikovni model
  • Generiranje besedil in povzemanje
  • Podpora za prevajanje
  • Možnosti pogovornega in chatbot-a
  • Prilagojen za poslovno NLP v arabščini
  • Pokriva sodobno standardno arabščino in dialekte