Eerdere strijd · 2025-08-08 UTC

LLM Duel — 8 augustus 2025

Uit de categorie LLM. 28 markeringen geplaatst over 6 strijders. DeepSeek V3 pakte de kroon.

Eindstand

De line-up

De strijders

Profielen van elke tool die in deze strijd meedeed, gerangschikt op eindscore.

1DeepSeek V3 logo

DeepSeek V3

Open-source mixture-of-experts-model dat GPT-4o-achtige redenering levert tegen een fractie van de kosten.

4.8 (6)
Gratis
Screenshot van DeepSeek V3

DeepSeek V3 is een grootschalig Mixture-of-Experts (MoE) taalmodel ontwikkeld door DeepSeek AI. Het activeert slechts een subset van zijn totale parameters per token, waardoor het sterke prestaties levert bij redeneerstaken, wiskunde en programmeertaken, terwijl de inferentiekosten aanzienlijk lager blijven dan bij vergelijkbare dichte modellen. Uitgebracht met open weights, is DeepSeek V3 een populaire keuze geworden voor ontwikkelaars en onderzoekers die een capabel basismodel nodig hebben dat ze zelf kunnen hosten, fijn afstemmen of integreren via API. Benchmarks plaatsen het model concurrerend tegen toonaangevende propriëtaire modellen zoals GPT-4o, vooral op wiskundige en logische redeneertestevaluaties. Het model is zeer geschikt voor technische assistenten, code generatiepijplijnen, onderzoeks workflows en elke toepassing waarbij zowel de kwaliteit van het redeneren als de budget efficiëntie belangrijk zijn.

Kritériumverdeling

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Mixture-of-experts-architectuur
  • Competitieve benchmarks op redeneervermogen en wiskunde
  • Open-source modelgewichten
  • API-toegang via DeepSeek-platform
  • Ondersteuning voor lange contextvensters
  • Geschikt voor fine-tuning
2Janus pro logo

Janus pro

DeepSeek's open multimodaal model voor beeldgeneratie en visuele begrip in één uniforme architectuur.

4.8 (4)
Gratis
Screenshot van Janus pro

Janus Pro is een open-source multimodaal AI-model van DeepSeek, beschikbaar in 1B- en 7B-parameter versies. Het verenigt visueel begrip en beeldgeneratie in één kader door de visuele coderingswegen te ontkoppelen, waardoor het model zowel afbeeldingen kan interpreteren als maken op basis van tekstprompts. De 7B-variant levert concurrerende resultaten op benchmarks voor tekst-naar-beeld-synthese en visuele vraagbeantwoording, vaak overeenkomend met of overtreffend grotere gespecialiseerde modellen. Uitgegeven onder een MIT-licentie, kan Janus Pro zelf worden gehost, fijngesteld en geïntegreerd in onderzoeks- of productie-pipelines zonder gebruiksbeperkingen. Het is geschikt voor ontwikkelaars, onderzoekers en hobbyisten die een flexibele multimodaal basismodel nodig hebben voor experimentatie, prototyping of het bouwen van toepassingen die beeldcreatie combineren met beeldbegrip.

Kritériumverdeling

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Tekst-naar-beeld generatie
  • Visuele vraagbeantwoording en beeldanalyse
  • Geünificeerde transformator architectuur
  • 1B- en 7B-parameter opties
  • MIT-licentie open gewichten
  • Multimodaal invoer- en uitvoerondersteuning
3DeepSeek R1 logo

DeepSeek R1

Een open-source groot taalmodel dat uitblinkt in redeneren, wiskunde en coderingstaken met MIT-licentie voor gratis gebruik en aanpassing.

4.8 (4)
Gratis
Screenshot van DeepSeek R1

DeepSeek R1 is een open-source groot taalmodel dat uitblinkt in redeneren, wiskunde en coderingstaken. Het maakt gebruik van een Mixture of Experts (MoE) architectuur met 37B actieve parameters en 671B totale parameters, en ondersteunt een contextlengte van 128K. Het model integreert geavanceerde reinforcement learning-technieken om zelf-verificatie, multi-step reflectie en mensgericht redeneren te realiseren. DeepSeek R1 heeft state-of-the-art prestaties behaald op diverse benchmarks, waaronder 97,3% nauwkeurigheid op MATH-500, een slagen van 79,8% op AIME 2024 en het overtreffen van 96,3% van de Codeforces-deelnemers. Het model is beschikbaar in verschillende varianten, variërend van 1,5B tot 70B parameters, en is gelicenseerd onder MIT voor gratis gebruik en aanpassing. DeepSeek R1 kan online gratis worden gebruikt, en een WebGPU-versnelling versie kan lokaal in een browser draaien. Het model is ontworpen voor complexe probleemoplossing, meertalige begrip en productie-waardige codegeneratie. De sterke punten zijn uitzonderlijke wiskundige redenering, codegeneratie en mogelijkheden voor natuurlijke taalbegrip. Als open-source model kan het echter technische expertise vereisen om te implementeren en af te stemmen op specifieke toepassingen. DeepSeek R1 staat op het niveau van de beste AI-modellen wereldwijd, met mogelijkheden die vergelijkbaar zijn met toonaangevende commerciële oplossingen. De open-source aard maakt communitygedreven ontwikkeling en continue upgrades mogelijk, waaronder geplande multimodale ondersteuning, conversatieverbetering en gedistribueerde inferentie-optimalisatie. Het model is ontwikkeld met puur reinforcement learning, waardoor het GPT‑4‑niveau wiskundeprestaties behaalt tegen een aanzienlijk lagere kostprijs. De chain-of-thought visualisatie‑mogelijkheid biedt inzichten in het redeneringsproces van het model, waardoor AI “black box” uitdagingen worden aangepakt. De API van DeepSeek R1 biedt een OpenAI‑compatibele endpoint voor integratie, met een prijs van 0,14 $ per miljoen tokens. De gewichten van het model zijn open-source, waardoor commercieel gebruik en aanpassing mogelijk zijn.

Kritériumverdeling

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability0
  • Mixture of Experts (MoE) architectuur
  • Geavanceerde reinforcement learning-technieken
  • Zelf-verificatie en multi-step reflectiemogelijkheden
  • Mensgericht redeneren
  • Ondersteuning voor 128K contextlengte
  • OpenAI-compatibele API-endpoint
4ASI:One logo

ASI:One

Agentische AI‑assistant die autonome agenten coördineert om meerstaps‑taken uit te voeren.

4.5 (4)
Gratis
Screenshot van ASI:One

ASI:One is een AI‑assistant die draait om het concept van agentische intelligentie, waarbij een conversatie‑interface speciale autonome agenten kan inzetten en coördineren om complexe verzoeken af te handelen. In plaats van alleen tekst te retourneren, kan het plannen, tools aanroepen en workflows uitvoeren namens de gebruiker. Ontwikkeld binnen het Artificial Superintelligence Alliance‑ecosysteem, is het gepositioneerd als een persoonlijke AI‑agent die integreert met gedecentraliseerde agentennetwerken. Gebruikers kunnen er met een chat vragen stellen voor dagelijks gebruik of langere taken delegeren, zoals onderzoek, vergelijkingen, planning en dataverzoeken via verbonden services.

Kritériumverdeling

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability1
  • Conversatie‑chat interface
  • Orkestratie van autonome agenten
  • Planning en uitvoering van meervoudige taken
  • Connectiviteit met externe agenten en services
  • Persoonlijke assistent‑stijl geheugen en context
  • Gebouwd op de ASI Alliance agent stack
5Latest DeepSeek R2 logo

Latest DeepSeek R2

Volgende generatie redeneergerichte AI-model van DeepSeek

4.8 (6)
Gratis
Screenshot van Latest DeepSeek R2

Latest DeepSeek R2 is de opvolger van DeepSeek's R1 redeneermodel, ontworpen om sterkere stap-voor-stap probleemoplossing te leveren bij wiskunde, codering en analytische taken. Het doel is om de open onderzoeksaanpak voort te zetten die eerdere DeepSeek-releases populair maakte onder ontwikkelaars en onderzoekers. Het model richt zich op verbeterde nauwkeurigheid, langere contextverwerking en efficiëntere inferentie in vergelijking met zijn voorganger, waardoor het geschikt is voor technische assistenten, agentic workflows en integratie in aangepaste toepassingen. Beschikbaarheid en exacte specificaties zijn afhankelijk van de officiële release-kanalen van DeepSeek. Gebruikers kunnen het model meestal benaderen via de API, de chatinterface of door open weights uit te voeren waar deze worden aangeleverd, waardoor flexibiliteit ontstaat voor zowel individuele experimenten als productie-implementatie.

Kritériumverdeling

Ease of use1
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability1
  • Geavanceerde chain-of-thought redeneermogelijkheden
  • Uitgebreid contextvenster
  • Code generatie en foutopsporing ondersteuning
  • Meertalig begrip
  • API en chat-gebaseerde toegang
  • Geschikt voor agentic toepassingen
6Pronoia logo

Pronoia

Arabisch-eerste grote taalmodel fine-tuned voor inheemse-kwaliteit begrijpen en genereren.

4.7 (6)
Gratis

Pronoia is een groot taalmodel dat specifiek is afgestemd op het Arabisch, met als doel een nauwkeurigere tekstbegrip, -generatie en -redenering in de taal te leveren dan algemene meertalige modellen. Het wordt gepositioneerd als een toonaangevend Arabisch gericht LLM, met optimalisaties voor dialecten, klassieke vormen en modern standaard Arabisch. Het model kan worden gebruikt voor taken zoals contentcreatie, samenvatting, vertaling, klantenondersteuning en conversationele AI in Arabisch sprekende markten. Door de training te concentreren op Arabische gegevens, richt Pronoia zich op nuances zoals morfologie, diacritica en culturele context die bredere modellen vaak inconsistent hanteren.

Kritériumverdeling

Ease of use1
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • Arabisch geoptimaliseerd taalmodel
  • Tekstgeneratie en samenvatting
  • Vertaling ondersteuning
  • Conversatie en chatbotcapabiliteiten
  • Geïntegreerd in arabische NLP enterprise-toepassingen
  • Omschrijving van MSA en dialecten