Vergangene Schlacht · 2025-08-08 UTC

LLM Duell — 8. August 2025

Aus der Kategorie LLM. 28 Marken verteilt auf 6 Kämpfer. DeepSeek V3 holte sich die Krone.

Endstand

Die Aufstellung

Die Kämpfer

Profile aller Tools, die in dieser Schlacht angetreten sind, nach Endpunktzahl sortiert.

1DeepSeek V3 logo

DeepSeek V3

Open-Source-Mixture-of-Experts-Modell, das GPT-4o-ähnliche Denkfähigkeiten zu einem Bruchteil der Kosten bietet.

4.8 (6)
Kostenlos
Screenshot von DeepSeek V3

DeepSeek V3 ist ein großskaliges Mixture-of-Experts (MoE)-Sprachmodell, das von DeepSeek AI entwickelt wurde. Es aktiviert pro Token nur einen Teil seiner Gesamtparameter, wodurch es eine starke Leistung bei Aufgaben zu logischem Schließen, Mathematik und Programmierung erbringt, während die Inferenzkosten deutlich niedriger bleiben als bei vergleichbaren dichten Modellen. Mit offenen Gewichten veröffentlicht, ist DeepSeek V3 zu einer beliebten Wahl für Entwickler und Forscher geworden, die ein leistungsfähiges Grundmodell benötigen, das sie selbst hosten, feinabstimmen oder über die API integrieren können. Benchmarks positionieren es wettbewerbsfähig gegenüber führenden proprietären Modellen wie GPT-4o, insbesondere bei mathematischen und logischen Denkaufgaben. Das Modell eignet sich gut für technische Assistenten, Code‑Generierungspipelines, Forschungs‑Workflows und jede Anwendung, bei der sowohl die Qualität der Argumentation als auch die Kosten‑effizienz wichtig sind.

Kriterienaufschlüsselung

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Mixture-of-Experts-Architektur
  • Wettbewerbsfähige Denk- und Mathematik-Benchmarks
  • Open-Source-Modellgewichte
  • API-Zugriff über DeepSeek-Plattform
  • Lange Kontextfenster-Unterstützung
  • Feinabstimmung freundlich
2Janus pro logo

Janus pro

DeepSeek's offene multimodale Modell für die Bildgenerierung und visuelle Verständnis in einer einheitlichen Architektur.

4.8 (4)
Kostenlos
Screenshot von Janus pro

Janus Pro ist ein Open-Source‑Multimodal‑KI‑Modell von DeepSeek, das in 1‑Billion‑ und 7‑Billion‑Parameter‑Versionen verfügbar ist. Es vereint visuelles Verständnis und Bildgenerierung in einem einzigen Framework, indem es die visuellen Codierungspfade entkoppelt, sodass das Modell sowohl Bilder interpretieren als auch aus Texteingaben heraus erzeugen kann. Die 7B‑Variante liefert wettbewerbsfähige Ergebnisse bei Benchmarks für Text‑zu‑Bild‑Synthese und visuelle Frage‑Antworten und erreicht oft die Leistung größerer spezialisierter Modelle oder übertrifft sie sogar. Unter einer MIT‑Lizenz veröffentlicht, kann Janus Pro selbstgehostet, feinabgestimmt und in Forschungs‑ oder Produktionspipelines integriert werden, ohne Nutzungsbeschränkungen. Es richtet sich an Entwickler, Forschende und Hobbyisten, die ein flexibles multimodales Foundation‑Modell für Experimente, Prototyping oder den Aufbau von Anwendungen benötigen, die Bildgenerierung mit Bildverständnis verbinden.

Kriterienaufschlüsselung

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Text-to-Image-Generierung
  • Visual Question Answering und Bildanalyse
  • Einheitliche Transformer-Architektur
  • 1-Billion- und 7-Billion-Parameteroptionen
  • MIT-gehostete offene Gewichte
  • Multimodale Eingabe- und Ausgabestützung
3DeepSeek R1 logo

DeepSeek R1

Ein quelloffenes großes Sprachmodell, das bei Denk-, Mathematik- und Codierungsaufgaben mit MIT-Lizenzierung für kostenlose Nutzung und Modifikation herausragt.

4.8 (4)
Kostenlos
Screenshot von DeepSeek R1

DeepSeek R1 ist ein Open‑Source‑großes Sprachmodell, das besonders gut bei logischen Schlussfolgerungen, mathematischen Aufgaben und Programmierung ist. Es verwendet eine Mixture‑of‑Experts (MoE)‑Architektur mit 37 Mrd. aktiven Parametern und insgesamt 671 Mrd. Parametern und unterstützt eine Kontextlänge von 128 K. Das Modell integriert fortschrittliche Reinforcement‑Learning‑Techniken, um Selbstverifikation, mehrstufige Reflexion und menschenorientierte Reasoning‑Fähigkeiten zu ermöglichen. DeepSeek R1 hat in verschiedenen Benchmarks State‑of‑the‑Art‑Leistungen erzielt, darunter 97,3 % Genauigkeit bei MATH‑500, eine Durchfallquote von 79,8 % beim AIME 2024 und übertrifft 96,3 % der Codeforces‑Teilnehmer. Das Modell ist in mehreren Varianten von 1,5 B bis 70 B Parametern verfügbar und unter der MIT‑Lizenz für freie Nutzung und Modifikation lizenziert. DeepSeek R1 kann online kostenlos genutzt werden, und eine WebGPU‑beschleunigte Version lässt sich lokal im Browser ausführen. Das Modell ist für komplexe Problemlösungen, mehrsprachiges Verständnis und die Produktion von Code in Produktionsqualität konzipiert. Zu seinen Stärken gehören außergewöhnliche mathematische Schlussfolgerungen, Codegenerierung und Fähigkeiten im natürlichen Sprachverständnis. Da es sich jedoch um ein Open-Source‑Modell handelt, kann es technisches Fachwissen erfordern, um es für spezifische Anwendungsfälle bereitzustellen und fein abzustimmen. DeepSeek R1 ist weltweit unter den leistungsstärksten KI‑Modellen positioniert und verfügt über Fähigkeiten, die mit führenden proprietären Lösungen vergleichbar sind. Durch seine Open‑Source‑Natur ermöglicht es eine community‑getriebene Entwicklung und kontinuierliche Upgrades, einschließlich geplanter multimodaler Unterstützung, konversationeller Verbesserung und verteilter Inferenzoptimierung. Das Modell verfügt über eine reine Reinforcement‑Learning‑Entwicklung, die es ermöglicht, eine GPT‑4‑Level‑Mathematikleistung zu erreichen – und das zu deutlich geringeren Kosten. Die Chain‑of‑Thought‑Visualisierungsfähigkeit adressiert die KI‑„Black‑Box“-Problematik und liefert Einblicke in den Denkprozess des Modells. Die API von DeepSeek R1 bietet einen OpenAI‑kompatiblen Endpunkt für die Integration und kostet $0.14 pro Million Tokens. Die Modellgewichte sind Open‑Source und erlauben kommerzielle Nutzung sowie Modifikationen.

Kriterienaufschlüsselung

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability0
  • Mixture of Experts (MoE)-Architektur
  • Fortschrittliche Reinforcement-Learning-Techniken
  • Selbstverifizierungs- und mehrstufige Reflexionsfähigkeiten
  • Menschlich ausgerichtete Denkfähigkeit
  • Unterstützung für 128K Kontextlänge
  • OpenAI-kompatibler API-Endpunkt
4ASI:One logo

ASI:One

Agente AI-Helferin, die autonome Agenten koordiniert, um mehrschrittige Aufgaben zu erfüllen.

4.5 (4)
Kostenlos
Screenshot von ASI:One

ASI:One ist ein KI‑Assistent, der auf dem Konzept der agentischen Intelligenz basiert, bei dem eine dialogbasierte Schnittstelle spezialisierte autonome Agenten starten und koordinieren kann, um komplexe Anfragen zu bearbeiten. Anstatt nur Text zurückzugeben, kann er planen, Werkzeuge aufrufen und Workflows im Auftrag des Benutzers ausführen. Entwickelt im Ökosystem der Artificial Superintelligence Alliance, positioniert es sich als persönlicher KI‑Agent, der in dezentrale Agentennetzwerke integriert ist. Nutzer können mit ihm über alltägliche Fragen chatten oder längere Aufgaben wie Recherche, Vergleiche, Terminplanung und Datenabfragen über verbundene Dienste delegieren.

Kriterienaufschlüsselung

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability1
  • Konsoverationaler Chat-Schnittstelle
  • Autonome Agenten-Orchestrierung
  • Mehrschrittige Aufgabenplanung und -ausführung
  • Verbindung zu externen Agenten und Diensten
  • Stil einer persönlichen Assistenten Gedächtnis- und Kontexterinnerung
  • Aufgebaut auf der ASI-Allianz-Agenten-Stack
5Latest DeepSeek R2 logo

Latest DeepSeek R2

KI-Modell der nächsten Generation mit Fokus auf Schlussfolgerungen von DeepSeek

4.8 (6)
Kostenlos
Screenshot von Latest DeepSeek R2

DeepSeek R2 ist der Nachfolger von DeepSeek’s R1, dem Reasoning-Modell, und wurde entwickelt, um stärkere Schritt-für-Schritt-Lösungen in Mathematik, Coding und analytischen Aufgaben zu liefern. Es zielt darauf ab, den offenen Forschungsansatz fortzusetzen, der frühere DeepSeek-Veröffentlichungen bei Entwicklern und Forschern beliebt gemacht hat. Das Modell fokussiert auf verbesserte Genauigkeit, längere Kontextverarbeitung und effizientere Inferenz im Vergleich zum Vorgänger, wodurch es für technische Assistenten, agentische Workflows und die Integration in maßgeschneiderte Anwendungen geeignet ist. Die Verfügbarkeit und genauen Spezifikationen hängen von den offiziellen Release-Kanälen von DeepSeek ab. Benutzer können in der Regel über die API, eine Chat-Schnittstelle oder das Ausführen offener Gewichte (sofern verfügbar) auf das Modell zugreifen, was Flexibilität für sowohl individuelle Experimente als auch Produktionsbereitstellungen bietet.

Kriterienaufschlüsselung

Ease of use1
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability1
  • Fortgeschrittenes Chain-of-Thought-Reasoning
  • Erweitertes Kontextfenster
  • Unterstützung bei Codegenerierung und Debugging
  • Mehrsprachiges Verständnis
  • API- und Chat-basierter Zugriff
  • Geeignet für agentische Anwendungen
6Pronoia logo

Pronoia

Ein großer Sprachmodel, das auf Arabisch zugeschnitten ist und für eine natürliche Verständnis- und Generierungsfähigkeit optimiert wurde.

4.7 (6)
Kostenlos

Pronoia ist ein großes Sprachmodell, das speziell für das Arabische optimiert wurde, um ein genaueres Verständnis, eine bessere Generierung und logischere Schlussfolgerungen in dieser Sprache zu liefern als allgemeine, mehrsprachige Modelle. Es gilt als führendes arabisch fokussiertes LLM mit Optimierungen für Dialekte, klassische Formen und modernes Standardarabisch. Das Modell kann für Aufgaben wie Inhaltserstellung, Zusammenfassung, Übersetzung, Kundensupport und konversative KI in arabischsprachigen Märkten eingesetzt werden. Durch die Konzentration des Trainings auf arabische Daten zielt Pronoia auf Nuancen wie Morphologie, Diakritika und kulturellen Kontext ab, die von umfassenderen Modellen oft inkonsistent gehandhabt werden.

Kriterienaufschlüsselung

Ease of use1
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • Arabisch-optimiertes Sprachmodell
  • Textgenerierung und Abstraktion
  • Übersetzungsunterstützung
  • Konversationale und Chatbots-Fähigkeiten
  • Geeignet für enterprise-Arabistik NLP
  • Abdeckung des MSA und der Dialekte