Geçmiş savaş · 2026-02-20 UTC

LLM Hesaplaşma — 20 Şubat 2026

LLM kategorisinden. 3 savaşçıya 14 işaret yerleştirildi. DeepSeek R1 tacı aldı.

Nihai sıralama

Kadro

Savaşçılar

Bu savaşta yarışan her aracın profilleri, nihai puanlarına göre sıralandı.

1DeepSeek R1 logo

DeepSeek R1

Genel amacıyla olan büyük dil modellerinden biri olan DeepSeek R1, mantıklarında, matematik hesaplamalarında ve kodlama görevlerinde çok yüksek başarıya ulaştı ve MIT lisansı ile ücretsiz olarak kullanım ve değiştirme sağlar.

4.8 (4)
Ücretsiz
DeepSeek R1 ekran görüntüsü

DeepSeek R1, mantık, matematik ve kodlama görevlerinde üstün performans gösteren açık kaynaklı büyük dil modelidir. 37 milyar etkin parametresi ile 671 milyar toplam parametresi bulunan bir Mixture of Experts (MoE) mimarisi kullanır ve 128K metin uzunluğu destekler. Model, selbst doğrulama, çok adımlı yansıtma ve insan-çerçevede mantık yetenekleri için gelişmiş reforlama öğrenme teknikleri kullanır. DeepSeek R1, MATH-500'de %97.3 doğruluk, AIME 2024'te %79.8 geçme oranı ile çeşitli ölçütlerde en iyi performans göstermiştir ve Codeforces katılımcılarını %96.3'ten daha fazla atlatabilmiştir. Model 1,5 milyar ila 70 milyar parametreye varan birden fazla varyansta mevcuttur ve MIT lisansıyla ücretsiz olarak kullanılıp modifiye edilebilir. DeepSeek R1, online olarak ücretsiz olarak kullanılabilir ve WebGPU hızlandırmalı bir sürümü de yerel olarak bir tarayıcıda çalıştırılabilir. Model, karmaşık problem çözme, çok dilli anlayış ve üretim sınıfı kod oluşturma için tasarlanmıştır. Güçleri, olağanüstü matematiksel mantık becerileri, kod oluşturma ve doğallaşmış dil anlayış yeteneklerdir. Ancak, açık kaynak olan bu model, belirli kullanım alanları için konuşlandırmaya ve ayarlamaya teknik uzmanlık gerektirebilir. DeepSeek R1, küresel çapta lider özel çözümlere benzeyen performansıyla üst sıralarda yer almaktadır. Açık kaynaklı yapısı ile topluma açık geliştirme ve sürekli güncellemelere izin veriyor, planlanan multimodal destek, sohbet iyileştirme ve dağıtımlı inferences optimizations dahil. Model, GPT-4 seviyesindeki matematik performansı elde etmek için çok daha düşük bir maliyetle geliştirilmiş bir güçlendirilmiş öğrenme temelinde çalışır. Zincirleme düşünme görüntüleme yeteneği AI'de 'kazanılırsa açıklanmaz' (black box) zorluklarını giderir ve modelin düşünme sürecine ışık tutar. DeepSeek R1'in API'si, entegrasyon için OpenAI uyumlu bir uç nokta sunmakta, 1000000 token için 0,14 dolara satılmaktadır. Modelin ağırlıkları açık kaynakte olup, ticari kullanma ve değişiklik yapma imkanı sunmaktadır.

Kriterlerin ayrıştırılması

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Sertifikalı Araçlar Mimarisine Gecis (Mixture of Experts / MoE) mimarisi
  • Gelişmiş Teşvik Öğrenme Teknolojileri
  • Kendiliğinden Doğrulama ve Çok Adımli Düşünce Yetenekleri
  • İnsan Odaklı Mantık
  • 128K Kontekst Uzunluğu Desteklemesi
  • OpenAI-Kompatible API Endpoint'i
2Pixtral 12B 24.09 logo

Pixtral 12B 24.09

Çıkarılmış modda 12B model, 128K bağlam penceresi ile karışık görüntü ve metin ile işlenir.

4.6 (5)
Ücretsiz
Pixtral 12B 24.09 ekran görüntüsü

Pixtral 12B 24.09, Mistral AI'den bir modası geçen görsel-modali bir modeldir. Bir tek dizi içindeki resim ve metni işler ve varyasyonlu görüntü boyutları ve aspect oranları da destekler. 12 milyar parametreye sahip bir dil kodlama cihazını görme kodlama cihazıyla birleştiren Pixtral 12B 24.09, görsel soruları yanıtlamak, belge anlama, grafik yorumlama, görüntü başlıkları oluşturma gibi görevleri destekler. Model, 128K token altyapısını destekleyerek, çoklu görüntü ile uzun metne entegre bir komut istemi oluşturmak için birçok imgeyi bir komut istemi içinde birleştirmeyi sağlar. Açık lisans altında yayınlanan bu model, yerel olarak veya ön-yargı sağlayıcıları aracılığıyla kullanılabilecek şekilde dağıtımdan geçirilebilir, bu nedenle görüntü-dil uygulamaları oluşturmak için geliştiricilere, araştırmaya yönelik akışlar ve çok kanallı ajanlar inşa için elverişlidir.

Kriterlerin ayrıştırılması

Ease of use1
Value for money1
Features & power0
Integrations1
Support & docs1
Reliability1
  • 12B parametrenli bir görü-görü-dil modelidir.
  • İlişkili resim ve metin girişleri desteği.
  • 128K token bağlama uzunluğu.
  • Oluşkan resim boyutu desteği.
  • Açık ağırlık sürümü.
  • OCR, VQA ve etiketleme gibi uygulamalar için uygundur.
3DeepSeek V3 logo

DeepSeek V3

Açık kaynaklı bir uzmanın uzmanların bir arada çalışmasının ötesinde, GPT-4 seviyesindeki akıl yürütme yeteneklerini çok daha düşük maliyetlerde sunar.

4.8 (6)
Ücretsiz
DeepSeek V3 ekran görüntüsü

DeepSeek V3, DeepSeek AI tarafından geliştirilen büyük ölçekli bir mixture-of-expert (MoE) dil modelidir. Tek bir token için yalnızca toplam parametrelerinin birSubset'ini aktif eder, bu sayede derin düşünme, matematik ve kodlama gibi görevlerde güçlü performans sunarken, kıyaslayamayacağınız yoğunluklu modellerden katma maliyetini önemli ölçüde düşürür. Açık ağırlıklarla DeepSeek V3, geliştiriciler ve araştırmacılar tarafından kendini barındırmak,ayarlamak ya da API aracılığıyla entegre etmek için güçlü bir temel modeli içeren yaygın bir tercih haline geldi.Benchmark sonuçlarına göre, matematiksel ve logiksel akıl yürütme ölçütlerinde özellikle GPT-4o gibi lider tüzel modellerine karşı rekabetçi bir konuma yer almayı başardı. Model, teknik yardımcılar, kod oluşturma pipeline'leri, araştırma akışlarını ve bütçe verimliliğine sahip herhangi bir uygulama için geçerli bir nedenleme kalitesi sağlar.

Kriterlerin ayrıştırılması

Ease of use0
Value for money0
Features & power0
Integrations1
Support & docs1
Reliability1
  • Uzmanların uzmanların bir arada çalışması mimarisi
  • Kompotatif akıl yürütme ve matematik performansı
  • Açık kaynaklı model ağı
  • API erişimi DeepSeek platformu üzerinden
  • Geniş bir contexto penceresi desteği
  • Üstüne uzmanlaşmış bir model