Geçmiş savaş · 2025-08-08 UTC

LLM Hesaplaşma — 8 Ağustos 2025

LLM kategorisinden. 6 savaşçıya 28 işaret yerleştirildi. DeepSeek V3 tacı aldı.

Nihai sıralama

Kadro

Savaşçılar

Bu savaşta yarışan her aracın profilleri, nihai puanlarına göre sıralandı.

1DeepSeek V3 logo

DeepSeek V3

Açık kaynaklı bir uzmanın uzmanların bir arada çalışmasının ötesinde, GPT-4 seviyesindeki akıl yürütme yeteneklerini çok daha düşük maliyetlerde sunar.

4.8 (6)
Ücretsiz
DeepSeek V3 ekran görüntüsü

DeepSeek V3, DeepSeek AI tarafından geliştirilen büyük ölçekli bir mixture-of-expert (MoE) dil modelidir. Tek bir token için yalnızca toplam parametrelerinin birSubset'ini aktif eder, bu sayede derin düşünme, matematik ve kodlama gibi görevlerde güçlü performans sunarken, kıyaslayamayacağınız yoğunluklu modellerden katma maliyetini önemli ölçüde düşürür. Açık ağırlıklarla DeepSeek V3, geliştiriciler ve araştırmacılar tarafından kendini barındırmak,ayarlamak ya da API aracılığıyla entegre etmek için güçlü bir temel modeli içeren yaygın bir tercih haline geldi.Benchmark sonuçlarına göre, matematiksel ve logiksel akıl yürütme ölçütlerinde özellikle GPT-4o gibi lider tüzel modellerine karşı rekabetçi bir konuma yer almayı başardı. Model, teknik yardımcılar, kod oluşturma pipeline'leri, araştırma akışlarını ve bütçe verimliliğine sahip herhangi bir uygulama için geçerli bir nedenleme kalitesi sağlar.

Kriterlerin ayrıştırılması

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Uzmanların uzmanların bir arada çalışması mimarisi
  • Kompotatif akıl yürütme ve matematik performansı
  • Açık kaynaklı model ağı
  • API erişimi DeepSeek platformu üzerinden
  • Geniş bir contexto penceresi desteği
  • Üstüne uzmanlaşmış bir model
2Janus pro logo

Janus pro

Derinlik'inki açık multimodal model, birleşik mimariyle görüntü oluşturma ve görsel anlaşmanın aynı zaman diliminde derinlemesine derinlemesine çalışıyor.

4.8 (4)
Ücretsiz
Janus pro ekran görüntüsü

Janus Pro, DeepSeek'ten olan açık kaynaklı çokmodal bir AI modelidir, 1B ve 7B parametre sürümlerinde mevcuttur. Model, görsel kodlama yollarını ayırmak suretiyle tek bir framework içinde görsel anlamayı ve metin uyarlarını kullanarak görseller oluşturmayı bir araya getirir, böylece model hem görüntülere yorum getirebilir hem de metin uyarları ile görseller oluşturabilir. 7B varyantı metin-görsel sentezleme ve görsel soru-cevaplama için ölçütlen benchmarklerde rekabetçi sonuçlar verir ve genellikle daha büyük özel modellerle eşleşerek veya aşarak sonuçlanır. MIT lisansı altında yayınlanan Janus Pro, kullanım kısıtlaması olmadan araştırma veya üretim.pipeline'larına self-host, fine-tune ve entegre edilebilir. Geliştiriciler, araştırmacılar ve hobistan için flexible bir çok modalitya Dayanaklı temel modeline ihtiyaç duyanlar olmak üzere, geliştirme, prototiplendirme veya görüntüleme ile anlamayı birleştiren uygulamalar oluşturma gibi ihtiyaçlara yanıt vermek üzere Janus pro'u tercih ettiklerimize uygun.

Kriterlerin ayrıştırılması

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • Metin-biçim oluşturma
  • Görüşme ve görüntü analizi
  • Bütünleştirici transformör mimarisi
  • 1B ve 7B parametre seçeneği
  • MIT lisanslı açık ağızlar
  • Çokmodal giriş ve çıkış desteği
3DeepSeek R1 logo

DeepSeek R1

Genel amacıyla olan büyük dil modellerinden biri olan DeepSeek R1, mantıklarında, matematik hesaplamalarında ve kodlama görevlerinde çok yüksek başarıya ulaştı ve MIT lisansı ile ücretsiz olarak kullanım ve değiştirme sağlar.

4.8 (4)
Ücretsiz
DeepSeek R1 ekran görüntüsü

DeepSeek R1, mantık, matematik ve kodlama görevlerinde üstün performans gösteren açık kaynaklı büyük dil modelidir. 37 milyar etkin parametresi ile 671 milyar toplam parametresi bulunan bir Mixture of Experts (MoE) mimarisi kullanır ve 128K metin uzunluğu destekler. Model, selbst doğrulama, çok adımlı yansıtma ve insan-çerçevede mantık yetenekleri için gelişmiş reforlama öğrenme teknikleri kullanır. DeepSeek R1, MATH-500'de %97.3 doğruluk, AIME 2024'te %79.8 geçme oranı ile çeşitli ölçütlerde en iyi performans göstermiştir ve Codeforces katılımcılarını %96.3'ten daha fazla atlatabilmiştir. Model 1,5 milyar ila 70 milyar parametreye varan birden fazla varyansta mevcuttur ve MIT lisansıyla ücretsiz olarak kullanılıp modifiye edilebilir. DeepSeek R1, online olarak ücretsiz olarak kullanılabilir ve WebGPU hızlandırmalı bir sürümü de yerel olarak bir tarayıcıda çalıştırılabilir. Model, karmaşık problem çözme, çok dilli anlayış ve üretim sınıfı kod oluşturma için tasarlanmıştır. Güçleri, olağanüstü matematiksel mantık becerileri, kod oluşturma ve doğallaşmış dil anlayış yeteneklerdir. Ancak, açık kaynak olan bu model, belirli kullanım alanları için konuşlandırmaya ve ayarlamaya teknik uzmanlık gerektirebilir. DeepSeek R1, küresel çapta lider özel çözümlere benzeyen performansıyla üst sıralarda yer almaktadır. Açık kaynaklı yapısı ile topluma açık geliştirme ve sürekli güncellemelere izin veriyor, planlanan multimodal destek, sohbet iyileştirme ve dağıtımlı inferences optimizations dahil. Model, GPT-4 seviyesindeki matematik performansı elde etmek için çok daha düşük bir maliyetle geliştirilmiş bir güçlendirilmiş öğrenme temelinde çalışır. Zincirleme düşünme görüntüleme yeteneği AI'de 'kazanılırsa açıklanmaz' (black box) zorluklarını giderir ve modelin düşünme sürecine ışık tutar. DeepSeek R1'in API'si, entegrasyon için OpenAI uyumlu bir uç nokta sunmakta, 1000000 token için 0,14 dolara satılmaktadır. Modelin ağırlıkları açık kaynakte olup, ticari kullanma ve değişiklik yapma imkanı sunmaktadır.

Kriterlerin ayrıştırılması

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability0
  • Sertifikalı Araçlar Mimarisine Gecis (Mixture of Experts / MoE) mimarisi
  • Gelişmiş Teşvik Öğrenme Teknolojileri
  • Kendiliğinden Doğrulama ve Çok Adımli Düşünce Yetenekleri
  • İnsan Odaklı Mantık
  • 128K Kontekst Uzunluğu Desteklemesi
  • OpenAI-Kompatible API Endpoint'i
4ASI:One logo

ASI:One

Özneyi AI yardımcıları arasında otomatik ajansları koordine eden multi-adım görevleri tamamlamak için özendirici bir AI yardımcısı.

4.5 (4)
Ücretsiz
ASI:One ekran görüntüsü

ASI:One, agnetik zekâya dayalı bir AI yardımcısıdır. Bu yardımcısı, bir söyleşi arayüzü aracılığıyla karmaşık talepleri işletebilecek uzman özerk ajansları gönderebilir ve koordine edebilir. Tek metin döndürmesi yerine, ASI:One planlama, araç çağrısı ve kullanıcının adımlarını gerçekleştirmek için akış işlemleri gerçekleştirebilir. Artfakirli Süper Zekâ Allianse ekosistemine dayalı olarak tasarlanıyor ASI:One, merkezi olmayan ajan ağı ile entegre edilebilir kişisel bir AI.agent. Kullanıcılar her gün gelen sorular için ona sohbet edebilir ya da bağlantılu hizmetler üzerinden yapılacak aramalardan ödünç alınan daha uzun görevler gibi karşılaştırmalar, araştırmalar, planlama ve veri aramaları için onu yetkilendirebilirler.

Kriterlerin ayrıştırılması

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability1
  • Sürdürülebilir diyalog arayüzü
  • Otonom agent koordinasyon
  • Çok adımlı görev planlama ve uygulanması
  • Dış agent ve servis bağlantılar
  • Bireysel yardımcı gibi hafıza ve bağlam
  • ASI Alandağı Stack a alınmak
5Latest DeepSeek R2 logo

Latest DeepSeek R2

DeepSeek'ten gelen sonraki jenerasyon mantıklı düşünme odaklı AI моделі.

4.8 (6)
Ücretsiz
Latest DeepSeek R2 ekran görüntüsü

DeepSeek R2 son modeldir, DeepSeek R1 düşünceli modelin ardılı olarak, matematik, kodlama ve analitik görevler için daha sağlam adım-by-adım sorun çözümleme sunmayı amaçlamaktadır. Popüler olduğu geliştiriciler ve araştırmacılar tarafından önceki DeepSeek sürümlerinin açık araştırmaya dayanan yaklaşımlarını genişletmeyi hedeflemektedir. Model, öncekinden daha yüksek doğruluk, daha uzun bağlam işleme ve daha verimli inference için tasarım yapmıştır. Bu nedenle teknik yardımcılar, agenci akıllı iş akışları ve özel uygulamalar INTO.integrationine uygun hale gelmiştir. Mevcutluk ve kesin specsDeepSeek'ın resmi yayıncı kanallarına bağlıdır. Kullanıcılar genellikle modeli API üzerinden, sohbet arayüzü veya sağlandığı durumda açık ağırlıkların çalıştırılmasıyla erişebilirler, hem bireysel denemeler hem de üretim deploymentsı için esneklik sunmaktadır.

Kriterlerin ayrıştırılması

Ease of use1
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability1
  • Mantıklı düşünme zinciri halinde yapılan mantık yürütmesini geliştirmek
  • Uzatılmış konteks penceresi
  • Kod oluşturma ve hata ayıklama desteği
  • Çoklu dil anlayışını desteklemek
  • API ve sohbet temelli erişim
  • İcra için uygun agental uygulamalar
6Pronoia logo

Pronoia

Büyük dil modelinin Arapça-öncesi hali, natiftir kaliteye anlama ve oluşturma için optimize ediliyor.

4.7 (6)
Ücretsiz

Pronoia, genel-purpose çok dilli modellere kıyasla daha doğru comprehension, generation ve reasoning sunmak için özel olarak fine-tuned Arapça bir dil modelidir. Arapça odaklı bir lider LLM olarak konumlandırılmış olup, diyalektler, klasik formlar ve modern standart Arapça için optimizasyonlar içerir. Model, içerik oluşturma, özetleme, çeviri, müşteri desteği ve Arapça konuşma AI dahil olmak üzere Arapça konuşma pazarlarında görevler için kullanılabilir. İkincil veri üzerinde yoğunlaşmak suretiyle Arapça morphology, aksan ve kültürel bağlam gibi daralan modellerin tutarlı bir şekilde içermeye çalıştığı nuances'u hedefleyen Pronoia, Arapça konuşma için daha iyi sonuçlar sağlar.

Kriterlerin ayrıştırılması

Ease of use1
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • Arapça-özlendirilmiş dil modeli
  • Metin oluşturma ve özetleme
  • Çeviri desteği
  • Söylenen ve sohbet botu özellikleri
  • Arapca NLP'li企业 için uygun
  • MSA ve lehçelerin kapsamı