معركة سابقة · 2024-01-17 UTC

LLM مواجهة — 17 يناير 2024

من فئة LLM. 37 علامات موزعة على 8 متنافسين. ASI:One نال التاج.

الترتيب النهائي

التشكيلة

المتنافسون

ملفات تعريف كل أداة تنافست في هذه المعركة، مرتبة حسب الدرجة النهائية.

1ASI:One logo

ASI:One

مساعد الذكاء الاصطناعي الوكيل الذي ينسق الوكلاء المستقلين لأداء مهام متعددة الخطوات.

4.5 (4)
مجاني
لقطة شاشة لـ ASI:One

ASI:One هو مساعد الذكاء الاصطناعي الذي يُبنى حول فكرة الذكاء الواعي، حيث يمكن أن ي.dispatch ويعمل بشكل مستقل لجنداء مسؤولة عن إنجاز المهام المركبة. بالنظر إلى أن الواجة في العائد عندها فقط النص، يمكنه planning, والتحريك أدوات, تنفيذ workflows على اسم المستخدم. نَمَت فيwithin داخل محيط التحالف للحكمة الفائقة الاصطناعية , وتمت مواقعتها kaoك كوظيفة مسؤول شخصي عن.agent الذكية التي تجمع مع مواردها مع شبكات الagent المساومة اللامركزية . يستطيع المستخدمين التكلم معها لأسئله اليومية أو委يير المهام longer longer الطويلة مثل البحث و المقارنة والتخطيط ومطالعة البيانات عبر الخدمات الوصل .

تفصيل المعايير

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • INTERFACE KHALIJI JADID LI-TAHADHUB
  • ORCHESTRATION OF AGENTS AL-MUTAWASSI'AH
  • TANWEER TAQRSI MULTI-BIADAT WA TANFIZ
  • MUTASHABIHAT LI-AZA'AJ JAWRATH WAL WAFAQAT
  • DHIKR TA'ALII LI-TANFAH WA AL-NAZRA AL-MAKHNUSA
  • MABNI ALA KITAFAH AL-MUSHARAKAH AL-JAWALI'AH AL-RASMIYAH
2Gemini 2.0 Flash logo

Gemini 2.0 Flash

جيني 2.0 فلاش: نموذج الذكاء الاصطناعي السريع والمتعدد الأنماط من جوجل لمهام الوكلاء في الوقت الفعلي مع نافذة سياق تتكون من مليون رمز

4.6 (5)
مجاني
لقطة شاشة لـ Gemini 2.0 Flash

Gemini 2.0 Flash هو نموذج الجيل التالي من Google DeepMind المحسن للسرعة والنطاق والاستدلال المتعدد القياسات. يقبل النصوص والصور والصوت والفيديو كمدخل ويمكن أن يولد نصوصاً وصوراً وصوتاً كخرج، مما يجعله مناسبًا للتطبيقات التفاعلية الغنية. صمم مع مراعاة سير العمليات الوكيلية، يدعم الموديل استخدام الأدوات المحلية، واستدعاء الدوال، ونافذة سياق بحجم 1M من الرموز للتعامل مع المستندات الكبيرة، أو قواعد التعليمات البرمجية، أو الجلسات المتواصلة لفترات طويلة. وتجعل اللاتنسية المنخفضة منه خيارًا عمليًا للمساعدين، والتحليل في الوقت الفعلي، والتنصيب على مستوى الإنتاج. يمكن للمطورين الوصول إلى Gemini 2.0 Flash من خلال Gemini API و Google AI Studio و Vertex AI، مع توفر SDKs عبر اللغات الرئيسية.

تفصيل المعايير

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • نافذة سياق بحجم 1M توكن
  • إدخال چند القنوات: نص، صورة، صوت، فيديو
  • استدعاء أداة أصيلة وتنفيذ رمز
  • استجابات بث في الوقت الفعلي
  • توليد الصور والصوت
  • متاح عبر Gemini API و Vertex AI
3Mistral Small 3 logo

Mistral Small 3

سلالة صغيرة ميستل 3 - نموذج لغة كبير مفتوح المصدر يقدم أداءً مميزًا مع متطلبات موارد أقل

4.5 (4)
مجاني
لقطة شاشة لـ Mistral Small 3

هذا Mistral Small 3 هو نموذج اللغة الكبير lightweight من Mistral AI ، مصممًا لتوفير قدرات التأليف والجدل القوية على الرغم من أن الكمبيوتر الخفيف ي चलत بفعالية على سختة الحواسيب. يستهدف مطورو برامج و المنظمات التي تريد إنشاء الذكاء الصناعي القابل والقوي بدون تكلفة الاستثمار في نماذج كبيرة الحجم من العوالم. تم إصداره بمرخصة مفتوحة، يمكن استضافة النموذج بنفسه وصيانته وتكنيولوجيا إدماجه في التطبيقات التجارية. التوازن بين سرعته ودقة النتيجه و كفاءته في الاستهلاك يجعله مناسبًا للوكلاء المحادثة ونشر المحتوى والTASKS المضمنة في البرمجيات والتشغيل على الشبكات الخاصة حيث يكون وقت الإجابة وقتية أو يحتاج الحماية من الخصوصية.

تفصيل المعايير

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • إطلاق نموذج بدون وزن
  • مصمم للاستخدام المعتدل
  • نتائج المعاينة التنافسية
  • دعم المرونة والتخصيص الفني
  • مصمم لتطبيق في موقع العمل الداخلي
  • إنتاج النص بشكل متعلم متعدد اللغات
4OpenAI o3 logo

OpenAI o3

نموذج الذكاء الاصطناعي المتقدم من OpenAI لحل المشكلات المعقدة والمتعددة الخطوات

4.0 (4)
مجاني
لقطة شاشة لـ OpenAI o3

انثحا اي وكل أنثقا عقسد o3‏, قاط يد تندبة ان ثنأي الثنيك, ايختاف ان ثنأي حديدة ، الثعثية حية ان ثخحداوي كد علة محدددة, قاسن طميلة باشوي الثخحية متخصبة إلي ك دينا اعلال علمان إهكذى تجاب أيبار كنونوي اَ لعلى. نقوم هنا بتعزيز deepness على expense من speed مقارنة بmodels المحادثة العاملة. حيث يمكن o3 لتحليل النصين غير الواضحين، وتقييم العديد من المناهج، وتحضير outputs أكثر موثوقية من خلال التقييمات في المbenchmarks التي تتجاهل المنطق والuse tools. يمكن للdevelopers الوصول إليه من خلال OpenAI API و ChatGPT، حيث يدمج مع tools مثل web browsing وفي Python وفحص الملفات، etc. يهدف النموذج إلى الباحثين ومهندسي البرمجيات والمستخدمين البارعين الذين تحتاجهم إلى دقة أقوى على مشاكل شاقّة، وهم على استعداد لاستبدال بعض تأخيرات الإجراء والتكلفة بحالة أعلى جودة.

تفصيل المعايير

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • التمتع بتعقيد تفكير سلسلة التتابع
  • استخدام الأداة بما في ذلك إدخال التعليمات البرمجية والويب والملفات
  • مختبرة عرض سيئة للوثائق الطويلة
  • Availability API و Availability ChatGPT
  • زيادة دقة على معايير STEM
  • دعم تشغيلات وظيفية مركبة معقدة
5DeepSeek R1 logo

DeepSeek R1

الذكاء الاصطناعي المتطرف: استكشاف حدود الذكاء الاصطناعي.

4.8 (4)
مجاني
لقطة شاشة لـ DeepSeek R1

DeepSeek R1 هو نموذج لغة كبير مفتوح المصدر يمتاز في مهام العرض والرياضيات والبرمجة. يستخدم هيكلاً من نوع Mixture of Experts (MoE) مع 37بليون معامل 활ية و671 بليون معامل إجمالي، ويدعم طول سياق 128 كيلو. يتضمن النموذج تقنيات تعلم تعافي متقدم لتحقيق التأكيد الذاتي والتفكير المتعدي والreasoning المتوافق مع البشر. достиг DeepSeek R1 أداءً على أعلى مستوى في مختلف البنود, بما في ذلك 97.3٪ دقة على MATH-500 و 79.8٪ معدل مرور على AIME 2024 وتفوق 96.3٪ من المشاركين في Codeforces. يتوفر النموذج بvariant متعددة، تتراوح من 1.5 مليار إلى 70 مليار معامل، ومرخص بموجب MIT للاستخدام والتطوير المجاني. يمكن استخدام DeepSeek R1 عبر الإنترنت مجانًا، ويمكن تشغيل نسخة مدعومة من WebGPU محليًا في المتصفح. تم设计 هذا المنهج للتعامل مع المشكلات المعقدة والتفاهم المتعدد اللغات وانتاج شفرة من الطراز الصناعي. وتشمل قوته القدرة الاستثنائية على التفكير الرياضي وانتاج الشفرة والفهم اللغوي الطبيعي. ومع ذلك، كـ نموذج مفتوح المصدر، قد يتطلب الخبرة الفنية لتثبيته وتحسينه لاستخدامات محددة. يوضع DeepSeek R1 في مقدمة النماذج عالية الأداء ذكاءً اصطناعيًا على مستوى العالم، مع إمكانيات قابلة للمقارنة مع الحلول المملوكة الرائدة. وتسمح طبيعته المفتوحة المصدر بالتطوير القائم على المجتمع والترقيات المستمرة، بما في ذلك دعم الوسائط المتعددة المخطط له وتحسين التحديث الحواري والاستدلال الموزع. يتميز النموذج بتطوير تعليم تعزيزي نقي، مما يسمح له بالحصول على أداء رياضي على مستوى GPT-4 بتكلفة أقل بكثير. تسمح خاصية تعريف تسلسل الفكر بالتغلب على تحديات "الصندوق الأسود" للذكاء الاصطناعي، مما يوفر رؤى حول عملية استدلال النموذج. يوفر واجهة برمجة تطبيقات DeepSeek R1 نقطة نهاية متوافقة مع OpenAI للدمج ، بسعر 0.14 دولار لكل مليون رمز. يتم توفير أوزان الطراز مفتوحة المصدر ، مما يسمح بالاستخدام التجاري والتعديل.

تفصيل المعايير

Ease of use0
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • هيكل الخبراء الم مختلط (MoE)
  • تقنيات التعلم التعزيزي المتقدمة
  • قابليات التحقق الذاتي والت phảnعكسة متعددة الخطوات
  • الاستدلال المحاذي للإنسان
  • دعم uzun لطول السياق 128K
  • نقطة نهاية API متوافقة مع OpenAI
6DeepSeek V3 logo

DeepSeek V3

البحث العميق V3: نموذج غير مركزي مفتوح المصدر مع قدرات تفوق GPT-40.

4.8 (6)
مجاني
لقطة شاشة لـ DeepSeek V3

DeepSeek V3 هو نموذج لغة مدمج خبير متعدد كبير الحجم (MoE) طورته شركة DeepSeek AI. يتم تنشيط جزء فقط من معاملاته الإجمالية لكل رمز، مما يسمح له โดย تقديم أداء قوي في مهام المنطق والرياضيات والبرمجة مع الحفاظ على تكلفتها في الاستدلال بشكل كبير أقل من النماذج المجسمة المماثلة. أُصدِرَ مع权重 مفتوح، أصبح DeepSeek V3 خيارًا شائعًا للمطورين والباحثين الذين يحتاجون إلى μοντέل أساسي قوي يمكنهم استضافته自ياً أو تعديله الدقيق أو التكامل přes واجهة برمجة التطبيقات. تقع الاختبارات الموحدة له في المنافسة مع النماذج الاقطاعية الرائدة مثل GPT-4o، خاصة في تقييمات الرياضيات والمنطق. النموذج مناسب بشكل جيد للمساعدين الفنيين، وخطوط أنابيب生成 الشفرة، وتدفقات البحث، وأي تطبيق حيث يهم جودة المنطق والكفاءة المالية معًا.

تفصيل المعايير

Ease of use1
Value for money1
Features & power0
Integrations0
Support & docs1
Reliability0
  • هندسة خلیط الخبراء
  • مقاييس المنطق والرياضيات التنافسية
  • أوزان النموذج مفتوحة المصدر
  • API access via DeepSeek platform
  • دعم نافذة السياق الطويل
  • صديق للتطوير الدقيق
7Llama 3.3 logo

Llama 3.3

llama 3.3: نموذج لغوي ضخم من ميتا مصمم لتوفير توليد نص متعدد اللغات بكفاءة وجودة عالية

4.8 (5)
مجاني
لقطة شاشة لـ Llama 3.3

Llama 3.3 هو نموذج لغة كبير من ميتا مصمم لتوفير معالجة منطقية قوية وبرمجة ومتعددة اللغات والكفاءة في التشغيل أكثر من النماذج الرائدة السابقة. يدعم مجموعة واسعة من اللغات وي適 للمرافئ الصحية، وتوليد المحتوى وتلخيص والأدوات الخاصة بالمطورين. إذا تم إصداره مع الأوزان المفتوحة، يمكن نشره محليًا أو من خلال principales السحابة ومقدمي الاستدلال، مما يعطي الفرق مرونة في التكلفة والاتساق والتعامل مع البيانات. وقد تم تحسين متغيّره المُصغَّر لتنفيذ التعليمات بدقة وإنتاج استجابات مفيدة ومتحاورة. يستخدم المطورون عادة Llama 3.3 كل قاعدة لتحسين التطبيقات الخاصة المجال، ونظم الإنشاء المدعومة بالاسترجاع، وعمليات العمل الوكيلية.

تفصيل المعايير

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability0
  • jنـقة مولتي لنگويج للنصوص
  • تركيبة محادثة معدة مع الإرشادات
  • دعم السياق الطويل
  • قدرات البرمجة والتفكير
  • أوزان مفتوحة للتعدين الدقيق
  • متوافق مع الإطارات الرئيسية للإستدلال
8Pronoia logo

Pronoia

فهم العربية كما لم تفهم من قبل مع نموذج اللغة العربية الأول

4.7 (6)
مجاني

تهدف برونوس إلى تحسين الفهم والإنشاء والاستدلال اللغوي بشكل أكثر دقة في اللغة العربية مقارنة بmodeleح لغة شاملة. تُعرف كأحد MODELEح لغوى متزايدة من اللغة العربية، مع التعديلات لمحلياتها ومصادرها الكلاسيكية الحديثة ومعاييرها المعاصرة. يمكن استخدام نموذج البيانات THIS THIS THIS للقيام بالمهام مثل إنتاج المحتوى، وقص المختصر، والنقل، ودعم العملاء، ونظريات التفاعل باللغة العربية بشكل خاص في الأسواق الناطقة باللغة العربية. من خلال التركيز في تدريب THIS THIS THIS على البيانات العربية، يتحكم هذا الدعم في خصوصيات مثل النحو والمقاطع والمنطقة الثقافية التي يتناولها نماذج أوسع منها بلا ثبات.

تفصيل المعايير

Ease of use0
Value for money1
Features & power0
Integrations1
Support & docs0
Reliability0
  • نماذج اللغة المُعدة للعربية
  • إجراء التحليل النحوي والتوليد النصي والاستئصال
  • دعم الترجمة
  • قدرة على التواصل والتفاعل مع البوتات الشات
  • مصممة للنطام الذكي العربي للأغراض المنقحة
  • Coverage of ماء و اللهجات