Iepriekšējā cīņa · 2025-08-08 UTC

LLM Sadursme — 2025. gada 8. augusts

No LLM kategorijas. 28 atzīmes izvietotas starp 6 cīnītājiem. DeepSeek V3 izcīnīja kroni.

Gala rezultāti

Sastāvs

Cīnītāji

Katra rīka profili, kas piedalījās šajā cīņā, sarindoti pēc to gala rezultāta.

1DeepSeek V3 logo

DeepSeek V3

Atvērtā pirmkoda "mixture-of-experts" modelis, kas piedāvā GPT-4o līmeņa izpēti par daļi no izdevumiem.

4.8 (6)
Bezmaksas
DeepSeek V3 ekrāna attēls

DeepSeek V3 ir liela skala līdzekļu (MoE) valodu modelis, kas tika izstrādāts ar DeepSeek AI. Tas aktivizē tikai daļu no visa sava pārmērīga parametriem katrā tokenā, ļaujot to pieejamiem rezultātiem uzskaitīšanai, matematikai un programmatūras uzdevumiem, saglabājot izvadusmaksu izdevumu noteicošāki zemīgi salīdzinājumā ar līdzīgiem blīviem modeliem. Pabeigts ar atvērtām svaru vienībām, DeepSeek V3 ir kļuvis par populāru izvēli raksturotājiem un zinātniekiem, kas ir jāiekārto spēcīga pamatskate, kas var būt pašreizēji jāiekārto pārbaudīti vai integretā ar API. Pierādījumi iekļauj to kā vienu no vadošajām privātpiedāvējamām modelēm, kā GPT-4o, galvenokārt ar matemātikas un logiskās izvēles pārbaudes. Modela ir labi izvēlēta par tehniskajiem palīgiem, kodu ģenerēšanas plūsmām, pētniecības darbdarību un jebkuru lietojumprogrammu, kurās lielākā nozīme ir rādītāju kvalitāte un biļetenam efektivitāte.

Kritēriju sadalījums

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Mixture-of-experts arhitektūra
  • Konkurētspējīgas izpētes un matemātikas pārbaudījumu rezultāti
  • Atvērtā pirmkoda modeļa svarbaji
  • API piekļuve caur DeepSeek platformu
  • Lielas konteksta loga atbalsts
  • Piemērots precizēšanai
2Janus pro logo

Janus pro

DeepSeek atvērtā multimodālā modelis attēlu radīšanai un vizuālajai izpratnei vienā vienotā arhitektūrā.

4.8 (4)
Bezmaksas
Janus pro ekrāna attēls

Janus Pro ir atvērto koda multimodalas AI modeļa no DeepSeek, kas ir pieejama 1B un 7B parametrveida versijās. Tas apvieno zināšanu attīstību attālināti no skaisto apstrādes ceļiem, dodot modelim iespēju gan skatu interpretēt, gan to izveidot teksta aicinājuma pamata. 7B varianta variants ir konkurētīgi rezultāti teksta-attēla saskaņošanas un vizuālas jautājs-atbildes noteikumiem, bieži sasniedzot vai pārspieot lielākus specializētos modelus. Izdots ar MIT licenci, Janus Pro var būt nākamā šķelšanā, detalizēti pielāgots un iekļauts zinātniskās vai produktīvās plūsmas sistēmu bez izmantošanas ierobežojumiem. Tas ir piemērots developers, zinātniekiem un hobiementiem, kuriem nepieņems daudzveidīga multimodālā bāzi, lai eksperimentētu, prototipētu vai celtas aplikācijas, kas kombinē images radīšanu ar images saprātu.

Kritēriju sadalījums

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Teksta uz attēlu ģenerēšana
  • Vizuālie jautājumu atbildēšana un attēlu analīze
  • Vienota transformer arhitektūra
  • 1B un 7B parametru iespējas
  • MIT licences atvērtie svari
  • Multimodālais ievades un izvades atbalsts
3DeepSeek R1 logo

DeepSeek R1

Atvērts lielais valodas modelis, kas izceļas loģikas, matemātikas un kodēšanas uzdevumos, ar MIT licence brīvas izmantošanas un modificēšanas tiesībām.

4.8 (4)
Bezmaksas
DeepSeek R1 ekrāna attēls

DeepSeek R1 ir atvērtais kodeksa liela valodu modelis, kas pārveidojas ar analīzi, matemātikas uzdevumiem un programmēšanas uzskaņošanai. Tā lieto Mixture of Experts (MoE) architektūru ar 37T aktīviem parametriem un 671T parametriem kopsummu, atbalstot 128T T maiņu ilgumu. Modelis iekļauj pazīstītus apmācības mācīšanas tehnikas, lai sasniegtu pašizcelšanos, daudzgadīgu refleksiju un cilvēkam piemērotu analīzes spēju. DeepSeek R1 ir sasniedzis uzlabotu panākumu daudzos benchmarkiem, to skaitā 97,3% precīzību MATH-500, 79,8% veiksmību AIME 2024, un ir pārspējušis 96,3% Codeforces dalībnieku. Modelis ir pieejams dažādos variantos, no 1,5T līdz 70T parametru, un tiek izdodams ar MIT licenzi no bezmaksas izmantošanas un modificēšanas. DeepSeek R1 var tiešsaistē lietot bez maksas, un WebGPU-accelerētais variantam ir iespēja izmantot to arī lokāli pārlūkā. Modēls ir paredzēts kompleksu problēmu risināšanai, daudzu valodu saprīšanai un ražošanas kvalitātes koda izveidošanai. To pamatīgās prasības ietver izņēmuma matemātisko argumentāciju, kodu izveidošanu un natīviegas valodu saprīšanu spējas. Tomēr, kā atvērtā-souce modēla, to saskaņošana un speciālu lietotāju gadījumu papildināšana var prasīt tehnisko pieredzi. DeepSeek R1 atrodas tajos pamatos, kur ir augsti ierindoti pasaules AI modeli, savas iespējas izvietojoties virs vadošo, privātīgu risinājumu līmeņa modeliem. Atvērtā sūtīšanas dabība ļāwa ar komūnu sadarbību veikt attīstību un aizsāk, ietverot plānotos multimodālās atbalsta, saruninieka paplašinājumu un sadali atvasiņu palielinājumu. Modelis ir pilnīgi cēloņu mācīšanās attīstība, kas ļauj to sasniedzēt GPT-4 līmeņa matemātikas rezultātus ar vēlams zemāku cenu. Ceļa gatavības vizualizācijas iespēja skar ar IA "melna došu" izaicinājumiem, nododot ieksversmu modela domāšanas procesā. DeepSeek R1 API piedāvā atvērtā izmantošanas OpenAI atbilstīgu punktu, integrēšanai cenā 0,14 USD miljonos tokenu. Modela svarus ir atvērtā izmantošanas, ļaujot komerciālu izmantošanu un modificēšanu.

Kritēriju sadalījums

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability0
  • Ekspertu sajaukuma (MoE) arhitektūra
  • Paplašinātas pastiprināšanas mācīšanās tehnoloģijas
  • Pašpārbaudes un vairāku soļu refleksijas iespējas
  • Cilvēka saskaņota loģiskā domāšana
  • Atbalsts 128 K konteksta garumam
  • OpenAI-saderīgs API galapunkts
4ASI:One logo

ASI:One

Agentiska AI palīdzība, kas koordinē neattīstītu agentus, lai izpildītu multi-steps uzdevumus.

4.5 (4)
Bezmaksas
ASI:One ekrāna attēls

ASI:One ir cīņas spēka asistents, kas ir būvēts ap ideju par agentu spēju, kurā saziņas interface uzraudzībā var izsaukt un koordinēt specializētas autonomas agentes, lai nodarbotos ar komplikātām pieprasījumiem. Tomēr vietais nav tikai pievienot tekstu, bet tas var plānot, sazināties ar instrumentiem, un izpildīt darbplūsas naudas kontu aizņēmnieka uzrādīšanos. Tas tika izstrādāts cits starp Artificial Superintelligence Alliance ekosistēmu un taisnesīgu agentu tīklu. Tas ir paredzēts kā personas AI pārstāvja, lai pievienotos decentralizētiem agentu tīkliem. Lietotāji var uzrunāt to par visas dienas jautājumiem vai piešķirt tam ilgākas uzdevumus, kā piemēram, pētniecību, saskanību, programmēšanu un dati izmaiņas, kas ir savienoti ar citiem pakalpojumiem.

Kritēriju sadalījums

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability1
  • Konversācijas chat interfeisa
  • Neattīstītu agentu orkestrēšana
  • Multi-steps uzdevumu plānošana un izpildīšana
  • Saites saīsināšana ar ārējiem agentiem un pakalpojumiem
  • Personiska palīdzības stils memori un konteksts
  • Būtībā uztaisīta uz ASI apvienība agenta staka
5Latest DeepSeek R2 logo

Latest DeepSeek R2

Nākotnes paaudzes, koncentrēts uz loģisko domāšanu AI modelis no DeepSeek

4.8 (6)
Bezmaksas
Latest DeepSeek R2 ekrāna attēls

Latest DeepSeek R2 ir R1 loģiskās domāšanas modeļa pēcnācējs, kas paredzēts, lai nodrošinātu spēcīgāku soļa pa solim problēmu risināšanu matemātikā, kodēšanā un analītiskajos uzdevumos. Tas mērķē paplašināt atvērtās pētniecības pieeju, kas padarīja iepriekšējos DeepSeek izlaidumus populārus izstrādātājiem un pētniekiem. Modelis uzsver uzlabotu precizitāti, garāku konteksta apstrādi un efektīvāku izpēti salīdzinājumā ar iepriekšējo, padarot to piemērotu tehniskajiem asistentiem, agentu darba plūsmām un integrācijai uz pielāgotās lietojumprogrammās. Pieejamība un precīzās specifikācijas atkarīgas no DeepSeek oficiālajiem izlaistes kanāliem. Lietotāji parasti piekļūst modelim API, tērzēšanas interfeisam vai, ja ir pieejamas atvērtās sveres, izpildot tos, sniedzot elastību gan individuālai eksperimentācijai, gan ražošanas izvietošanai.

Kritēriju sadalījums

Ease of use1
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability1
  • Uzlabota ķēdes domāšanas loģika
  • Paplašināta konteksta logs
  • Koda ģenerēšana un atkļūdošanas atbalsts
  • Daudzvalodu saprašana
  • API un tērzēšanas interfeisa piekļuve
  • Piemērots agentu lietojumprogrammām
6Pronoia logo

Pronoia

Arābu valodas oriģinālais liels valodas modelis, kurš ir paredzēts savienojumam un ģenerēšanai ar dzimtās kvalitātes izpratni

4.7 (6)
Bezmaksas

Pronoia ir liela valodas modelis, kas specificēti fine-tunēts, lai precīzi pamostītos arābu valodu un sniegt precīzākas komprehijs, izveidošanas un pēdējo līdzekļu izvēles ietvaros, tādējādi pārspējojot vispārīgas, daudzvalodīgu modelī. Tā ir izaugsme arābu valodu orientēto LLM, ar optimizācijām dialektiem, klasiciskajiem formas formām un mūsdienu standartu arābu valodai. Šis models var tiek izmantots darbībām, kādām ir saturu rakstīšana, saistīšana, tulkošana, klientu atbalsts un dzirdēšana, kādas tiek izmantotas Arābijas valstu tirgos. Koncentrējoties uz trainings darbu uz Arābijas duļķiem modelis norķina svarīgi aspekti, kā arī gramatiskās formas un dialektu speciālās burtu zīmju noteikšanu, kā arī kultūras kontekstu, kas plašākajos modelos nav tik konsekventi nodrošināti.

Kritēriju sadalījums

Ease of use1
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • Arābu valodas optimizēts valodas modelis
  • Teksta ģenerēšana un kopsavilkuma veidošana
  • Tulkošanas atbalsts
  • Konversāciju un čata robotu iespējas
  • Piemērots uzņēmumu arābu NLP
  • MSA un dialektu pārvaldība