معركة سابقة · 2026-02-20 UTC
LLM مواجهة — 20 فبراير 2026
من فئة LLM. 14 علامات موزعة على 3 متنافسين. DeepSeek R1 نال التاج.
الترتيب النهائي
التشكيلة
المتنافسون
ملفات تعريف كل أداة تنافست في هذه المعركة، مرتبة حسب الدرجة النهائية.


DeepSeek R1 هو نموذج لغة كبير مفتوح المصدر يمتاز في مهام العرض والرياضيات والبرمجة. يستخدم هيكلاً من نوع Mixture of Experts (MoE) مع 37بليون معامل 활ية و671 بليون معامل إجمالي، ويدعم طول سياق 128 كيلو. يتضمن النموذج تقنيات تعلم تعافي متقدم لتحقيق التأكيد الذاتي والتفكير المتعدي والreasoning المتوافق مع البشر. достиг DeepSeek R1 أداءً على أعلى مستوى في مختلف البنود, بما في ذلك 97.3٪ دقة على MATH-500 و 79.8٪ معدل مرور على AIME 2024 وتفوق 96.3٪ من المشاركين في Codeforces. يتوفر النموذج بvariant متعددة، تتراوح من 1.5 مليار إلى 70 مليار معامل، ومرخص بموجب MIT للاستخدام والتطوير المجاني. يمكن استخدام DeepSeek R1 عبر الإنترنت مجانًا، ويمكن تشغيل نسخة مدعومة من WebGPU محليًا في المتصفح. تم设计 هذا المنهج للتعامل مع المشكلات المعقدة والتفاهم المتعدد اللغات وانتاج شفرة من الطراز الصناعي. وتشمل قوته القدرة الاستثنائية على التفكير الرياضي وانتاج الشفرة والفهم اللغوي الطبيعي. ومع ذلك، كـ نموذج مفتوح المصدر، قد يتطلب الخبرة الفنية لتثبيته وتحسينه لاستخدامات محددة. يوضع DeepSeek R1 في مقدمة النماذج عالية الأداء ذكاءً اصطناعيًا على مستوى العالم، مع إمكانيات قابلة للمقارنة مع الحلول المملوكة الرائدة. وتسمح طبيعته المفتوحة المصدر بالتطوير القائم على المجتمع والترقيات المستمرة، بما في ذلك دعم الوسائط المتعددة المخطط له وتحسين التحديث الحواري والاستدلال الموزع. يتميز النموذج بتطوير تعليم تعزيزي نقي، مما يسمح له بالحصول على أداء رياضي على مستوى GPT-4 بتكلفة أقل بكثير. تسمح خاصية تعريف تسلسل الفكر بالتغلب على تحديات "الصندوق الأسود" للذكاء الاصطناعي، مما يوفر رؤى حول عملية استدلال النموذج. يوفر واجهة برمجة تطبيقات DeepSeek R1 نقطة نهاية متوافقة مع OpenAI للدمج ، بسعر 0.14 دولار لكل مليون رمز. يتم توفير أوزان الطراز مفتوحة المصدر ، مما يسمح بالاستخدام التجاري والتعديل.
تفصيل المعايير
- هيكل الخبراء الم مختلط (MoE)
- تقنيات التعلم التعزيزي المتقدمة
- قابليات التحقق الذاتي والت phảnعكسة متعددة الخطوات
- الاستدلال المحاذي للإنسان
- دعم uzun لطول السياق 128K
- نقطة نهاية API متوافقة مع OpenAI

Pixtral 12B 24.09
نموذج بيكترسال 12B: معالجة متعددة الوسائط للصور والنصوص مع نافذة سياق تصل إلى 128 ألف رمز.

هو نموذج متعدد النمط من Mistral AI يعالج كلًا من الصور والنصوص في سلسلة واحدة، وينتهج هذا النموذج أحوالًا متعددة للأحجام والاشتراطات في الصور. ويستخدم محدد اللغة ذا 12 مليار پارامتر مع محدد الرؤية لتنفيذ مهام مثل استباحة السؤال المرئي والتفهم الكتابي تفسير الجداول وتعريف الصور. يقبل النموذج أقصى 128K من سياق tokens، مما ي允ى وضع الصور المتعددة بالتوازي مع نصوص طويلة في استفسار واحد. صدر تحت رخصة مفتوحة، ويمكن تطبيعه محليًا أو عبر مقدمي الاستدلال، مما يجعلوه ملائمًا للع髪يين الذين يبنون تطبيقات اللغة-النظرية، وتمارين البحث، والمرتّبات الوظائف المتعددة.
تفصيل المعايير
- نظام زبان-صورة بالحجم 12B
- مدخلات صورة والنص متداخلة
- طول سياق التجزئة 128K
- دعم الحجم الصورة المتجدد بمعد
- الإصدار المفتوح للمترجة
- يندفع لاستخدام OCR، VQA، وكتابة العناوين


DeepSeek V3 هو نموذج لغة مدمج خبير متعدد كبير الحجم (MoE) طورته شركة DeepSeek AI. يتم تنشيط جزء فقط من معاملاته الإجمالية لكل رمز، مما يسمح له โดย تقديم أداء قوي في مهام المنطق والرياضيات والبرمجة مع الحفاظ على تكلفتها في الاستدلال بشكل كبير أقل من النماذج المجسمة المماثلة. أُصدِرَ مع权重 مفتوح، أصبح DeepSeek V3 خيارًا شائعًا للمطورين والباحثين الذين يحتاجون إلى μοντέل أساسي قوي يمكنهم استضافته自ياً أو تعديله الدقيق أو التكامل přes واجهة برمجة التطبيقات. تقع الاختبارات الموحدة له في المنافسة مع النماذج الاقطاعية الرائدة مثل GPT-4o، خاصة في تقييمات الرياضيات والمنطق. النموذج مناسب بشكل جيد للمساعدين الفنيين، وخطوط أنابيب生成 الشفرة، وتدفقات البحث، وأي تطبيق حيث يهم جودة المنطق والكفاءة المالية معًا.
تفصيل المعايير
- هندسة خلیط الخبراء
- مقاييس المنطق والرياضيات التنافسية
- أوزان النموذج مفتوحة المصدر
- API access via DeepSeek platform
- دعم نافذة السياق الطويل
- صديق للتطوير الدقيق


