Korábbi csata · 2025-08-08 UTC

LLM Leszámolás — 2025. augusztus 8.

A(z) LLM kategóriából. 28 jelölés elhelyezve 6 versenyző között. DeepSeek V3 szerezte meg a koronát.

Végeredmény

A felállás

A versenyzők

Minden eszköz profilja, amely ebben a csatában versenyzett, a végső pontszámuk szerint rangsorolva.

1DeepSeek V3 logo

DeepSeek V3

Nyílt forráskódú szakértők összetétele egy modell, amely az árarányos mértékű GPT-4 szintű érvelést kínál.

4.8 (6)
Ingyenes
DeepSeek V3 képe

A DeepSeek V3 egy nagy méretű mixture-of-experts (MoE) nyelvi modell, amelyet a DeepSeek AI fejlesztett ki. Csak paramétereinek egy részét активálja minden egyes tokenhez, ami lehetővé teszi, hogy erős teljesítményt nyújtson az érvelésben, a matematikában és a kódolási feladatokban, miközben lényegesen alacsonyabb inferencia költségeket tart fenn, mint a hasonló sűrű modellek. Nyílt súlyokkal kiadva a DeepSeek V3 népszerű választás lett azoknak a fejlesztőknek és kutatóknak, akik olyan képes alapmodellt keresnek, amelyet saját környezetben üzemeltethetnek, finomíthatnak vagy API-n keresztül integrálhatnak. A benchmark tesztek azt mutatják, hogy versenyképes a vezető licenszelt modellekkel szemben, mint például a GPT-4o, különösen a matematikai és logikai érvelési értékelések terén. A modell jól használható técnai asszisztenseknek, kódgeneráló pipeline-oknak, kutatási munkafolyamoknak és minden olyan alkalmazásnak, ahol a következtetés minősége és a költséghatékonyság is számít.

Kritériumok szétosztása

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Szakértők összetétele
  • Versenyképes érvelési és matematikai teljesítmény
  • Nyílt modell súlyok
  • API hozzáférés a DeepSeek platformon keresztül
  • Hosszú kontextusablak támogatás
  • Fine-tuning barátó
2Janus pro logo

Janus pro

Az open multimodális modell a Janus Pro a DeepSeek-től a képgenerálás és a vizuális megértés egyetlen egységes architektúrájában.

4.8 (4)
Ingyenes
Janus pro képe

A Janus Pro a DeepSeek által kínált nyílt forráskódú multimodális mesterséges intelligencia-modell, amely 1B és 7B paraméter-kiadásban elérhető. A modell összefésüli a vizuális megértést és az képekgenerálást egyetlen keretrendszerben, függetleníteni az optikai kódolóutakat, lehetővé téve, hogy a modellel dolgozzunk vizuálisan és képeket generáljunk szöveges promptokból. A 7B változat személyre szabott eredményeket nyújt a szövegből kép készítésén és a vizuális kérdésekre adott válaszon alapuló benchmarkeken, gyakran eléri vagy túlszárnyalja a nagyobb, szakosodott modelleket. Az MIT-licenc alá rendelt Janus Pro önellátható, például tökéletesíthető, és beintegrálható kutatási vagy termelési áramkövekre a felhasználástól függetlenül. A Janus pro a kísérletezéshez, prototyípusok készítéséhez vagy olyan alkalmazások építéséhez kívánó fejlesztőknek, kutatóknak és hobbibnak alkalmas, akiknek szüksége van egy rugalmas multimodális alapmodellre képalkotással és képrelési értelemzéssel kapcsolatos projektekhez.

Kritériumok szétosztása

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Text-to-image generálás
  • Vizuális kérdés-felelet és képvizsgálat
  • Egyesített transformer architektúra
  • 1 milliárd és 7 milliárd paraméteres opciók
  • MIT-licenc alatt megnyitott súlyok
  • Multimodális bemeneti és kimeneti támogatás
3DeepSeek R1 logo

DeepSeek R1

Nyílt forráskódú nagy nyelvi modell, amely kiemelkedően teljesíti a logikai, számítástechnikai és kódolási feladatokat az MIT-licenc segítségével ingyenesen használható és módosítható.

4.8 (4)
Ingyenes
DeepSeek R1 képe

A DeepSeek R1 egy nyílt forráskódú, nagy nyelvi modell, amely kiválóan teljesít az érvelési, matematikai és kódolási feladatokban. Egy szakértők kombinációját (MoE) használó architektúrával rendelkezik 37MILLIÁRD aktív paraméterrel és 671MILLIÁRD összes paraméterrel, támogatva a 128E context hosszát. A modell fejlett megerősítési tanulási technikákat alkalmaz az önmegvédés, a többlépes reflexió és az emberközpontú érvelési képességek eléréséhez. A DeepSeek R1 csúcskategóriás teljesítményt ért el számos benchmarkban, beleértve a 97,3%-os pontosságot az MATH-500-on, 79,8%-os átmeneti rátát az AIME 2024-ben, és felülmúlja a Codeforces résztvevők 96,3%-át. A modell több változatban is elérhető, 1,5MILLIÁRD-tól 70MILLIÁRD paraméterig terjed, és az MIT licensz alatt ingyenesen használható és módosítható. A DeepSeek R1 ingyenesen használható online, és egy WebGPU-gyorsított verzió helyileg is futtatható egy böngészőben. A modell összetett problémamegoldásra, többnyelvű megértésre és termelési szintű kódgenerálásra készült. Erősségei közé tartozik a kiváló matematikai okoskodás, kódgenerálás és természetes nyelvi megértési képességek. Mivel nyílt forráskódú modell, technikal expertízét igényelheti a telepítése és finomhangolása specifikus használati esetekhez. A DeepSeek R1 a világ legjobb teljesítményű AI modellei közé tartozik, képességei összehasonlíthatóak a vezető, Tulajdonosi megoldásokkal. Nyílt forráskódja lehetővé teszi a közösség által vezérelt fejlesztést és a folyamatos frissítéseket, beleértve a tervezett multimodális támogatást, a beszélgetésfejlesztést és a distribuált inference optimalizálást. A modell tisztán megerősítés-alapú tanulással készült, amely lehetővé teszi, hogy GPT-4 szintű matematikai teljesítményt érjen el lényegesen alacsonyabb költségek mellett. A gondolkodási láncok vizualizációs képessége megoldja a mesterséges intelligencia "fekete doboz" kihívásait, betekintést nyújtva a modell okgondolkodási folyamatába. A DeepSeek R1 API egy OpenAI-kompatibilis végpontot kínál integrációhoz, $0,14-es árral milliónkénti tokenenként. A modell súlyai nyílt forráskódúak, ami lehetővé teszi a kereskedelmi felhasználást és módosítást.

Kritériumok szétosztása

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability0
  • Mixture of Experts (MoE) architektúrá
  • Magasabb szintű erősítési tanulási technikák
  • Saját ellenőrzés és többszintű visszavérzés
  • Ember-célú logika
  • 128 K kontext hossz támogatás
  • OpenAI kompatibilis végpont API
4ASI:One logo

ASI:One

Agentikus AI-asszisztens, amely koordinálja az autonóm ügynököket többlépcsős feladatok elvégzéséhez.

4.5 (4)
Ingyenes
ASI:One képe

ASI:One egy AI asszisztens, amely az agentikus intelligencia koncepciójára épül, ahol egy konverzációs felület képes feladatokat delegálni és koordinálni specializált autonóm ügynököket a komplex kérések kezelésére. Csak szöveget nem ad vissza, hanem tervez, eszközöket hív meg, és munkafolyamatokat hajt végre a felhasználó nevében. Az Artificial Superintelligence Alliance ökoszisztémáján belül fejlesztették, személyes AI ügynökként helyezkedik el, amely integrálódik a decentralizált ügynökségi hálózatokkal. A felhasználók mindennapi kérdéseire cseveghetnek vele, vagy hosszabb feladatokat (kutatás, összehasonlítás, ütemezés, adatlekérdezés) delegálhatnak kapcsolódó szolgáltatásokon keresztül.

Kritériumok szétosztása

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability1
  • Konverzációs chat felület
  • Autonóm ügynökök összehangolása
  • Többlépcsős feladattervezés és végrehajtás
  • Kapcsolódás külső ügynökökhöz és szolgáltatásokhoz
  • Személyre szabott asszisztens stílusú memória és kontextus
  • Az ASI Alliance ügynök-alkatrészekre épít
5Latest DeepSeek R2 logo

Latest DeepSeek R2

Generációs előrelépés az intelligens érveléshez fókuszált AI modellben a DeepSeek-ből

4.8 (6)
Ingyenes
Latest DeepSeek R2 képe

Az Új DeepSeek R2 a DeepSeek kétéves korú értelmi modellel, a DeepSeek R1 utódja. Kifejlesztette a számításokat, a programozást, valamint az analitikai feladatok lépésről lépésre való eredményesebb megoldását. Kiterjeszti azon nyitott kutatási hozzáállást, amely korábban a DeepSeek kiadásait népszerűvé tette a fejlesztőkkel és kutatók körében. A model kifejezetten a követelményt hajtja végre a jobb pontosság javítása, a hosszabb környezeti kezelés és hatékonyabb inferencia a csapatainak a kiváltására, hogy készen álljon a technológiai segítők, az agensek munkafolyamatok és a beépítés az egyéni alkalmazások számára. A hozzáférhetőség és az pontosabb specifikációk attól függnek, hogy a DeepSeek hivatalos kiadási csatornái. Az új modellel való értekezés számos módoson keresztül is elérhető a felhasználók számára. Előfordulhat API-n, chat interféls, vagy olyan esetekben is, amikor nyitott súlyokat kínálnak, így lehetővé válva az egyén számára a szabad terepet az kísérletezéshez, és a gyakorlati üzembevitelhez is.

Kritériumok szétosztása

Ease of use1
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability1
  • Fejlett láncoló gondolkodás
  • Nagyobb kontextus-ablak
  • Kód generálása és hibakeresés
  • Multilingviség
  • API és chat-alapú hozzáférés
  • Működik agenciális alkalmazások számára
6Pronoia logo

Pronoia

Arabic-fő Large Language Model, amely finetuning a nemzeti minőségű megértést és generálást szolgáltat.

4.7 (6)
Ingyenes

A Pronoia egy nagyméretű nyelvtani modell, amely szigorúan ki lett finetuneelve arabra, és tökéletesebb értelmezési, generálási és érvelési képességeket kíván kínálni, mint az általános célú többnyelvű modelljei. A vezető arab-orientált LLM-nek tekintjük, amelyet a dialektusokhoz, a klasszikus szabásokhoz és a modern standard arabhoz rendeztek be. A modellevelezőt olyan feladatokhoz használhatja, mint a tartalmi megalkotás, a összefoglalás, a fordítás, a vevőtámogatás és dialógus-alapú AI a arab országok érdekeit szolgáló piacokon. Az arab adatokra összpontosítva a kiképzését, a Pronoia különösen odafigyel a morfológiára, a diakritikára és a kulturális kontextusra, melyet általánosabb modelljei gyakran egyenlőtlenül kezelnek.

Kritériumok szétosztása

Ease of use1
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • Arab-optimizált nyelvi model
  • Szöveg és összefoglalás generálása
  • Fordítási támogatás
  • Közbeszéd és chatbot képességek
  • A vállalatközi arab NLP számításokhoz alkalmas
  • Az MSA és a dialektusok lefedése