Korábbi csata · 2025-08-08 UTC
LLM Leszámolás — 2025. augusztus 8.
A(z) LLM kategóriából. 28 jelölés elhelyezve 6 versenyző között. DeepSeek V3 szerezte meg a koronát.
Végeredmény
A felállás
A versenyzők
Minden eszköz profilja, amely ebben a csatában versenyzett, a végső pontszámuk szerint rangsorolva.

DeepSeek V3
Nyílt forráskódú szakértők összetétele egy modell, amely az árarányos mértékű GPT-4 szintű érvelést kínál.

A DeepSeek V3 egy nagy méretű mixture-of-experts (MoE) nyelvi modell, amelyet a DeepSeek AI fejlesztett ki. Csak paramétereinek egy részét активálja minden egyes tokenhez, ami lehetővé teszi, hogy erős teljesítményt nyújtson az érvelésben, a matematikában és a kódolási feladatokban, miközben lényegesen alacsonyabb inferencia költségeket tart fenn, mint a hasonló sűrű modellek. Nyílt súlyokkal kiadva a DeepSeek V3 népszerű választás lett azoknak a fejlesztőknek és kutatóknak, akik olyan képes alapmodellt keresnek, amelyet saját környezetben üzemeltethetnek, finomíthatnak vagy API-n keresztül integrálhatnak. A benchmark tesztek azt mutatják, hogy versenyképes a vezető licenszelt modellekkel szemben, mint például a GPT-4o, különösen a matematikai és logikai érvelési értékelések terén. A modell jól használható técnai asszisztenseknek, kódgeneráló pipeline-oknak, kutatási munkafolyamoknak és minden olyan alkalmazásnak, ahol a következtetés minősége és a költséghatékonyság is számít.
Kritériumok szétosztása
- Szakértők összetétele
- Versenyképes érvelési és matematikai teljesítmény
- Nyílt modell súlyok
- API hozzáférés a DeepSeek platformon keresztül
- Hosszú kontextusablak támogatás
- Fine-tuning barátó

Janus pro
Az open multimodális modell a Janus Pro a DeepSeek-től a képgenerálás és a vizuális megértés egyetlen egységes architektúrájában.

A Janus Pro a DeepSeek által kínált nyílt forráskódú multimodális mesterséges intelligencia-modell, amely 1B és 7B paraméter-kiadásban elérhető. A modell összefésüli a vizuális megértést és az képekgenerálást egyetlen keretrendszerben, függetleníteni az optikai kódolóutakat, lehetővé téve, hogy a modellel dolgozzunk vizuálisan és képeket generáljunk szöveges promptokból. A 7B változat személyre szabott eredményeket nyújt a szövegből kép készítésén és a vizuális kérdésekre adott válaszon alapuló benchmarkeken, gyakran eléri vagy túlszárnyalja a nagyobb, szakosodott modelleket. Az MIT-licenc alá rendelt Janus Pro önellátható, például tökéletesíthető, és beintegrálható kutatási vagy termelési áramkövekre a felhasználástól függetlenül. A Janus pro a kísérletezéshez, prototyípusok készítéséhez vagy olyan alkalmazások építéséhez kívánó fejlesztőknek, kutatóknak és hobbibnak alkalmas, akiknek szüksége van egy rugalmas multimodális alapmodellre képalkotással és képrelési értelemzéssel kapcsolatos projektekhez.
Kritériumok szétosztása
- Text-to-image generálás
- Vizuális kérdés-felelet és képvizsgálat
- Egyesített transformer architektúra
- 1 milliárd és 7 milliárd paraméteres opciók
- MIT-licenc alatt megnyitott súlyok
- Multimodális bemeneti és kimeneti támogatás

DeepSeek R1
Nyílt forráskódú nagy nyelvi modell, amely kiemelkedően teljesíti a logikai, számítástechnikai és kódolási feladatokat az MIT-licenc segítségével ingyenesen használható és módosítható.

A DeepSeek R1 egy nyílt forráskódú, nagy nyelvi modell, amely kiválóan teljesít az érvelési, matematikai és kódolási feladatokban. Egy szakértők kombinációját (MoE) használó architektúrával rendelkezik 37MILLIÁRD aktív paraméterrel és 671MILLIÁRD összes paraméterrel, támogatva a 128E context hosszát. A modell fejlett megerősítési tanulási technikákat alkalmaz az önmegvédés, a többlépes reflexió és az emberközpontú érvelési képességek eléréséhez. A DeepSeek R1 csúcskategóriás teljesítményt ért el számos benchmarkban, beleértve a 97,3%-os pontosságot az MATH-500-on, 79,8%-os átmeneti rátát az AIME 2024-ben, és felülmúlja a Codeforces résztvevők 96,3%-át. A modell több változatban is elérhető, 1,5MILLIÁRD-tól 70MILLIÁRD paraméterig terjed, és az MIT licensz alatt ingyenesen használható és módosítható. A DeepSeek R1 ingyenesen használható online, és egy WebGPU-gyorsított verzió helyileg is futtatható egy böngészőben. A modell összetett problémamegoldásra, többnyelvű megértésre és termelési szintű kódgenerálásra készült. Erősségei közé tartozik a kiváló matematikai okoskodás, kódgenerálás és természetes nyelvi megértési képességek. Mivel nyílt forráskódú modell, technikal expertízét igényelheti a telepítése és finomhangolása specifikus használati esetekhez. A DeepSeek R1 a világ legjobb teljesítményű AI modellei közé tartozik, képességei összehasonlíthatóak a vezető, Tulajdonosi megoldásokkal. Nyílt forráskódja lehetővé teszi a közösség által vezérelt fejlesztést és a folyamatos frissítéseket, beleértve a tervezett multimodális támogatást, a beszélgetésfejlesztést és a distribuált inference optimalizálást. A modell tisztán megerősítés-alapú tanulással készült, amely lehetővé teszi, hogy GPT-4 szintű matematikai teljesítményt érjen el lényegesen alacsonyabb költségek mellett. A gondolkodási láncok vizualizációs képessége megoldja a mesterséges intelligencia "fekete doboz" kihívásait, betekintést nyújtva a modell okgondolkodási folyamatába. A DeepSeek R1 API egy OpenAI-kompatibilis végpontot kínál integrációhoz, $0,14-es árral milliónkénti tokenenként. A modell súlyai nyílt forráskódúak, ami lehetővé teszi a kereskedelmi felhasználást és módosítást.
Kritériumok szétosztása
- Mixture of Experts (MoE) architektúrá
- Magasabb szintű erősítési tanulási technikák
- Saját ellenőrzés és többszintű visszavérzés
- Ember-célú logika
- 128 K kontext hossz támogatás
- OpenAI kompatibilis végpont API

ASI:One
Agentikus AI-asszisztens, amely koordinálja az autonóm ügynököket többlépcsős feladatok elvégzéséhez.

ASI:One egy AI asszisztens, amely az agentikus intelligencia koncepciójára épül, ahol egy konverzációs felület képes feladatokat delegálni és koordinálni specializált autonóm ügynököket a komplex kérések kezelésére. Csak szöveget nem ad vissza, hanem tervez, eszközöket hív meg, és munkafolyamatokat hajt végre a felhasználó nevében. Az Artificial Superintelligence Alliance ökoszisztémáján belül fejlesztették, személyes AI ügynökként helyezkedik el, amely integrálódik a decentralizált ügynökségi hálózatokkal. A felhasználók mindennapi kérdéseire cseveghetnek vele, vagy hosszabb feladatokat (kutatás, összehasonlítás, ütemezés, adatlekérdezés) delegálhatnak kapcsolódó szolgáltatásokon keresztül.
Kritériumok szétosztása
- Konverzációs chat felület
- Autonóm ügynökök összehangolása
- Többlépcsős feladattervezés és végrehajtás
- Kapcsolódás külső ügynökökhöz és szolgáltatásokhoz
- Személyre szabott asszisztens stílusú memória és kontextus
- Az ASI Alliance ügynök-alkatrészekre épít

Latest DeepSeek R2
Generációs előrelépés az intelligens érveléshez fókuszált AI modellben a DeepSeek-ből

Az Új DeepSeek R2 a DeepSeek kétéves korú értelmi modellel, a DeepSeek R1 utódja. Kifejlesztette a számításokat, a programozást, valamint az analitikai feladatok lépésről lépésre való eredményesebb megoldását. Kiterjeszti azon nyitott kutatási hozzáállást, amely korábban a DeepSeek kiadásait népszerűvé tette a fejlesztőkkel és kutatók körében. A model kifejezetten a követelményt hajtja végre a jobb pontosság javítása, a hosszabb környezeti kezelés és hatékonyabb inferencia a csapatainak a kiváltására, hogy készen álljon a technológiai segítők, az agensek munkafolyamatok és a beépítés az egyéni alkalmazások számára. A hozzáférhetőség és az pontosabb specifikációk attól függnek, hogy a DeepSeek hivatalos kiadási csatornái. Az új modellel való értekezés számos módoson keresztül is elérhető a felhasználók számára. Előfordulhat API-n, chat interféls, vagy olyan esetekben is, amikor nyitott súlyokat kínálnak, így lehetővé válva az egyén számára a szabad terepet az kísérletezéshez, és a gyakorlati üzembevitelhez is.
Kritériumok szétosztása
- Fejlett láncoló gondolkodás
- Nagyobb kontextus-ablak
- Kód generálása és hibakeresés
- Multilingviség
- API és chat-alapú hozzáférés
- Működik agenciális alkalmazások számára
Pronoia
Arabic-fő Large Language Model, amely finetuning a nemzeti minőségű megértést és generálást szolgáltat.
A Pronoia egy nagyméretű nyelvtani modell, amely szigorúan ki lett finetuneelve arabra, és tökéletesebb értelmezési, generálási és érvelési képességeket kíván kínálni, mint az általános célú többnyelvű modelljei. A vezető arab-orientált LLM-nek tekintjük, amelyet a dialektusokhoz, a klasszikus szabásokhoz és a modern standard arabhoz rendeztek be. A modellevelezőt olyan feladatokhoz használhatja, mint a tartalmi megalkotás, a összefoglalás, a fordítás, a vevőtámogatás és dialógus-alapú AI a arab országok érdekeit szolgáló piacokon. Az arab adatokra összpontosítva a kiképzését, a Pronoia különösen odafigyel a morfológiára, a diakritikára és a kulturális kontextusra, melyet általánosabb modelljei gyakran egyenlőtlenül kezelnek.
Kritériumok szétosztása
- Arab-optimizált nyelvi model
- Szöveg és összefoglalás generálása
- Fordítási támogatás
- Közbeszéd és chatbot képességek
- A vállalatközi arab NLP számításokhoz alkalmas
- Az MSA és a dialektusok lefedése




