Geçmiş savaş · 2026-02-20 UTC
LLM Hesaplaşma — 20 Şubat 2026
LLM kategorisinden. 3 savaşçıya 14 işaret yerleştirildi. DeepSeek R1 tacı aldı.
Nihai sıralama
Kadro
Savaşçılar
Bu savaşta yarışan her aracın profilleri, nihai puanlarına göre sıralandı.

DeepSeek R1
Genel amacıyla olan büyük dil modellerinden biri olan DeepSeek R1, mantıklarında, matematik hesaplamalarında ve kodlama görevlerinde çok yüksek başarıya ulaştı ve MIT lisansı ile ücretsiz olarak kullanım ve değiştirme sağlar.

DeepSeek R1, mantık, matematik ve kodlama görevlerinde üstün performans gösteren açık kaynaklı büyük dil modelidir. 37 milyar etkin parametresi ile 671 milyar toplam parametresi bulunan bir Mixture of Experts (MoE) mimarisi kullanır ve 128K metin uzunluğu destekler. Model, selbst doğrulama, çok adımlı yansıtma ve insan-çerçevede mantık yetenekleri için gelişmiş reforlama öğrenme teknikleri kullanır. DeepSeek R1, MATH-500'de %97.3 doğruluk, AIME 2024'te %79.8 geçme oranı ile çeşitli ölçütlerde en iyi performans göstermiştir ve Codeforces katılımcılarını %96.3'ten daha fazla atlatabilmiştir. Model 1,5 milyar ila 70 milyar parametreye varan birden fazla varyansta mevcuttur ve MIT lisansıyla ücretsiz olarak kullanılıp modifiye edilebilir. DeepSeek R1, online olarak ücretsiz olarak kullanılabilir ve WebGPU hızlandırmalı bir sürümü de yerel olarak bir tarayıcıda çalıştırılabilir. Model, karmaşık problem çözme, çok dilli anlayış ve üretim sınıfı kod oluşturma için tasarlanmıştır. Güçleri, olağanüstü matematiksel mantık becerileri, kod oluşturma ve doğallaşmış dil anlayış yeteneklerdir. Ancak, açık kaynak olan bu model, belirli kullanım alanları için konuşlandırmaya ve ayarlamaya teknik uzmanlık gerektirebilir. DeepSeek R1, küresel çapta lider özel çözümlere benzeyen performansıyla üst sıralarda yer almaktadır. Açık kaynaklı yapısı ile topluma açık geliştirme ve sürekli güncellemelere izin veriyor, planlanan multimodal destek, sohbet iyileştirme ve dağıtımlı inferences optimizations dahil. Model, GPT-4 seviyesindeki matematik performansı elde etmek için çok daha düşük bir maliyetle geliştirilmiş bir güçlendirilmiş öğrenme temelinde çalışır. Zincirleme düşünme görüntüleme yeteneği AI'de 'kazanılırsa açıklanmaz' (black box) zorluklarını giderir ve modelin düşünme sürecine ışık tutar. DeepSeek R1'in API'si, entegrasyon için OpenAI uyumlu bir uç nokta sunmakta, 1000000 token için 0,14 dolara satılmaktadır. Modelin ağırlıkları açık kaynakte olup, ticari kullanma ve değişiklik yapma imkanı sunmaktadır.
Kriterlerin ayrıştırılması
- Sertifikalı Araçlar Mimarisine Gecis (Mixture of Experts / MoE) mimarisi
- Gelişmiş Teşvik Öğrenme Teknolojileri
- Kendiliğinden Doğrulama ve Çok Adımli Düşünce Yetenekleri
- İnsan Odaklı Mantık
- 128K Kontekst Uzunluğu Desteklemesi
- OpenAI-Kompatible API Endpoint'i

Pixtral 12B 24.09
Çıkarılmış modda 12B model, 128K bağlam penceresi ile karışık görüntü ve metin ile işlenir.

Pixtral 12B 24.09, Mistral AI'den bir modası geçen görsel-modali bir modeldir. Bir tek dizi içindeki resim ve metni işler ve varyasyonlu görüntü boyutları ve aspect oranları da destekler. 12 milyar parametreye sahip bir dil kodlama cihazını görme kodlama cihazıyla birleştiren Pixtral 12B 24.09, görsel soruları yanıtlamak, belge anlama, grafik yorumlama, görüntü başlıkları oluşturma gibi görevleri destekler. Model, 128K token altyapısını destekleyerek, çoklu görüntü ile uzun metne entegre bir komut istemi oluşturmak için birçok imgeyi bir komut istemi içinde birleştirmeyi sağlar. Açık lisans altında yayınlanan bu model, yerel olarak veya ön-yargı sağlayıcıları aracılığıyla kullanılabilecek şekilde dağıtımdan geçirilebilir, bu nedenle görüntü-dil uygulamaları oluşturmak için geliştiricilere, araştırmaya yönelik akışlar ve çok kanallı ajanlar inşa için elverişlidir.
Kriterlerin ayrıştırılması
- 12B parametrenli bir görü-görü-dil modelidir.
- İlişkili resim ve metin girişleri desteği.
- 128K token bağlama uzunluğu.
- Oluşkan resim boyutu desteği.
- Açık ağırlık sürümü.
- OCR, VQA ve etiketleme gibi uygulamalar için uygundur.

DeepSeek V3
Açık kaynaklı bir uzmanın uzmanların bir arada çalışmasının ötesinde, GPT-4 seviyesindeki akıl yürütme yeteneklerini çok daha düşük maliyetlerde sunar.

DeepSeek V3, DeepSeek AI tarafından geliştirilen büyük ölçekli bir mixture-of-expert (MoE) dil modelidir. Tek bir token için yalnızca toplam parametrelerinin birSubset'ini aktif eder, bu sayede derin düşünme, matematik ve kodlama gibi görevlerde güçlü performans sunarken, kıyaslayamayacağınız yoğunluklu modellerden katma maliyetini önemli ölçüde düşürür. Açık ağırlıklarla DeepSeek V3, geliştiriciler ve araştırmacılar tarafından kendini barındırmak,ayarlamak ya da API aracılığıyla entegre etmek için güçlü bir temel modeli içeren yaygın bir tercih haline geldi.Benchmark sonuçlarına göre, matematiksel ve logiksel akıl yürütme ölçütlerinde özellikle GPT-4o gibi lider tüzel modellerine karşı rekabetçi bir konuma yer almayı başardı. Model, teknik yardımcılar, kod oluşturma pipeline'leri, araştırma akışlarını ve bütçe verimliliğine sahip herhangi bir uygulama için geçerli bir nedenleme kalitesi sağlar.
Kriterlerin ayrıştırılması
- Uzmanların uzmanların bir arada çalışması mimarisi
- Kompotatif akıl yürütme ve matematik performansı
- Açık kaynaklı model ağı
- API erişimi DeepSeek platformu üzerinden
- Geniş bir contexto penceresi desteği
- Üstüne uzmanlaşmış bir model


