קרב קודם · 2025-08-08 UTC

LLM התמודדות — 8 באוגוסט 2025

מקטגוריית LLM. 28 סימונים הוצבו על פני 6 לוחמים. DeepSeek V3 זכה בכתר.

הדירוג הסופי

ההרכב

הלוחמים

פרופילים של כל כלי שהשתתף בקרב הזה, ממוין לפי הציון הסופי.

1DeepSeek V3 logo

DeepSeek V3

דגם בקוד פתוח עם ארכיטקטורת תערובת-מומחים, המציע יכולות היסק ברמת GPT-4o במחיר נמוך משמעותית.

4.8 (6)
חינם
תמונה של DeepSeek V3

DeepSeek V3 הוא מודל שפה בקנה מידה גדול מסוג mixture-of-experts (MoE) שפותח על ידי DeepSeek AI. המודל מפעיל רק תת‑קבוצה של הפרמטרים הכוללים שלו לכל טוקן, מה שמאפשר לו לספק ביצועים חזקים בהיסק, במתמטיקה ובמשימות קידוד תוך שמירה על עלויות אינפרנס משמעותית נמוכות לעומת מודלים צפופים דומים. עם משקלים פתוחים, DeepSeek V3 הפכה לבחירה פופולרית בקרב מפתחים וחוקרים שזקוקים למודל יסוד חזק שניתן לארח בעצמם, לבצע עליו התאמה מדויקת, או לשלב אותו דרך API. המדדים מציבים אותה בתחרות עם מודלים קנייניים מובילים כגון GPT-4o, במיוחד במבחני מתמטיקה והסקת מסקנות לוגיות. המודל מתאים היטב לעוזרים טכניים, צינורות ליצירת קוד, זרימות עבודה מחקריות, ולכל יישום שבו חשובים גם איכות ההיסק וגם יעילות התקציב.

חלוקת קריטריונים

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • ארכיטקטורת תערובת-מומחים
  • מדדי היסק ומתמטיקה תחרותיים
  • משקולות דגם בקוד פתוח
  • גישה ל- API דרך פלטפורמת DeepSeek
  • תמיכה בחלון הקשר ארוך
  • ידידותי לכוונון עדין
2Janus pro logo

Janus pro

מודל רב-מודאלי פתוח של DeepSeek ליצירת תמונות והבנה ויזואלית בארכיטקטורה מאוחדת אחת.

4.8 (4)
חינם
תמונה של Janus pro

Janus Pro הוא מודל AI מולטימודלי קוד פתוח מבית DeepSeek, זמין בגרסאות של 1B ו‑7B פרמטרים. הוא מאחד הבנה ויזואלית ויצירת תמונות במערכת אחת על‑ידי הפרדת מסלולי הקידוד הוויזואלי, מה שמאפשר למודל לפרש תמונות וליצור אותן מתוך פקודות טקסט. הגרסה 7B מספקת תוצאות תחרותיות במדדי ביצוע של סינתזת טקסט‑לתמונה ו‑visual question answering, ולעיתים משווה או עולה על מודלים מיוחדים גדולים יותר. שוחררה ברישיון MIT, Janus Pro ניתנת לאירוח עצמי (self‑hosted), לבצע עליה fine‑tuning ולשלב אותה (integrated) בצינורות מחקר או ייצור ללא מגבלות שימוש. הוא מתאים למפתחים, חוקרים וחובבים הזקוקים למודל יסוד רב‑מודלי וגמיש לצורך ניסויים, פיתוח אבטיפוס או בניית יישומים המשולבים יצירת תמונות והבנתן.

חלוקת קריטריונים

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability1
  • יצירת תמונות מטקסט
  • עניינים ויזואליים וניתוח תמונות
  • ארכיטקטורת טרנספורמר מאוחדת
  • אפשרויות 1B ו-7B פרמטרים
  • משקלים פתוחים ברישיון MIT
  • תמיכה בקלט ופלט רב-מודאלי
3DeepSeek R1 logo

DeepSeek R1

מודל שפה גדול בקוד פתוח המתמחה במשימות היגיון, מתמטיקה ותכנות עם רישיון MIT לשימוש ושינוי בחינם.

4.8 (4)
חינם
תמונה של DeepSeek R1

DeepSeek R1 הוא מודל שפה גדול בקוד פתוח המצטיין בהיסק, במתמטיקה ובמשימות קידוד. הוא משתמש בארכיטקטורת Mixture of Experts (MoE) עם 37 מיליארד פרמטרים פעילים ו‑671 מיליארד פרמטרים סה"כ, ותומך באורך הקשר של 128K. המודל משלב טכניקות למידת חיזוק מתקדמות כדי להשיג אימות עצמי, חשיבה מרובת שלבים והיסק תואם אנושית. DeepSeek R1 השיג ביצועים ברמת‑ה‑אמנות במבחנים שונים, כולל דיוק של 97.3% ב‑MATH‑500, שיעור מעבר של 79.8% ב‑AIME 2024, ועולה על 96.3% ממשתתפי Codeforces. המודל זמין במספר גרסאות, בטווח של 1.5B עד 70B פרמטרים, ורישיון MIT מאפשר שימוש חופשי ושינוי. ניתן להשתמש ב‑DeepSeek R1 אונליין בחינם, וגרסה מואצת ב‑WebGPU יכולה לרוץ באופן מקומי בדפדפן. המודל תוכנן לפתרון בעיות מורכבות, הבנה מרובת שפות וייצור קוד ברמת ייצור. חוזקיו כוללים חשיבה מתמטית יוצאת דופן, יצירת קוד והבנת שפה טבעית. עם זאת, כמודל קוד פתוח, ייתכן ויידרש ידע טכני כדי לפרוס ולכוון אותו למקרים ספציפיים. DeepSeek R1 ממוקמת בין המודלים המובילים בביצועים בעולם, עם יכולות השוות לפתרונות הקנייניים המובילים. האופי open-source שלה מאפשר פיתוח קהילתי מתמשך ושדרוגים רציפים, כולל תמיכה מתוכננת במודוליות multimodal, חיזוק conversational, ואופטימיזציית distributed inference. המודל עבר פיתוח בטה של reinforcement learning, מה שמאפשר לו להגיע לביצועי מתמטיקה ברמת GPT-4 בעלות משמעותית נמוכה יותר. יכולת ה‑visualization של chain-of-thought מתמודדת עם אתגרי ה‑black box של AI, ומספקת תובנות על תהליך ההיסק של המודל. API של DeepSeek R1 מציע נקודת קצה תואמת ל‑OpenAI לשילוב, במחיר של 0.14 $ לכל מיליון טוקנים. משקלי המודל זמינים בקוד פתוח, מה שמאפשר שימוש מסחרי ושינוי.

חלוקת קריטריונים

Ease of use1
Value for money1
Features & power1
Integrations1
Support & docs1
Reliability0
  • ארכיטקטורת Mixture of Experts (MoE)
  • טכניקות למידה חיזוק מתקדמות
  • יכולות אימות עצמי והיסטוריה רב-שלבית
  • היגיון מיושר לאדם
  • תמיכה באורך הקשר של 128K
  • נקודת קצה API תואמת OpenAI
4ASI:One logo

ASI:One

מסייע צירף AI שקורן סובינטים סתומים כדי לשלב תסקיר חד-זמני

4.5 (4)
חינם
תמונה של ASI:One

ASI:One הוא עוזר בינה מלאכותית שנבנה סביב רעיון של אינטליגנציה אגנטית, שבו ממשק שיחה יכול לשלוח ולתאם סוכנים אוטונומיים מיומנים לטיפול בבקשות מורכבות. במקום להחזיר רק טקסט, הוא יכול לתכנן, לקרוא כלים ולבצע תהליכי עבודה בשם המשתמש. פותח בתוך אקוסיסטם של Artificial Superintelligence Alliance, הוא מציג עצמו כ‑סוכן אישי מבוסס AI שמתחבר לרשתות סוכנים מבוזרות. משתמשים יכולים לשוחח איתו לשאלות יומיומיות או להקצות לו משימות ארוכות יותר כגון מחקר, השוואות, תיאום לוחות זמנים והסתכלות על נתונים בין שירותים מחוברים.

חלוקת קריטריונים

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs1
Reliability1
  • אינטרפייס צ'אט שיחתי
  • ניהול סוכנים אוטונומיים
  • תכנון וביצוע משימות במספר שלבים
  • חיבור לסוכנים ושירותים חיצוניים
  • זיכרון והקשר בסגנון עוזר אישי
  • בנוי על ערימת הסוכנים של ASI Alliance
5Latest DeepSeek R2 logo

Latest DeepSeek R2

מודל AI לשיפוע יחסי הפשט

4.8 (6)
חינם
תמונה של Latest DeepSeek R2

Latest DeepSeek R2 הוא היורש של מודל ההיסק R1 של DeepSeek, שנועד לספק פתרון חזק יותר של בעיות צעד‑אחר‑צעד במתמטיקה, קידוד ומשימות אנליטיות. הוא שואף להרחיב את הגישה של מחקר פתוח שהפכה את הגרסאות הקודמות של DeepSeek לפופולריות בקרב מפתחים וחוקרים. המודל שואף לשיפור הדיוק, טיפול ארוך יותר בקונטקסט, והסקה יעילה יותר בהשוואה לקודמו, מה שהופך אותו למתאים לעוזרים טכניים, זרימות עבודה אגנזיות, ולשילוב ביישומים מותאמים אישית. זמינות ומפרטים מדויקים תלויים בערוצי השחרור הרשמיים של DeepSeek. משתמשים יכולים בדרך כלל לגשת למודל דרך API, ממשק צ'אט, או על‑ידי הרצת המשקלים הפתוחים כאשר הם זמינים, מה שמאפשר גמישות הן לניסויים פרטיים והן לפריסת ייצור.

חלוקת קריטריונים

Ease of use1
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability1
  • רשת-חשבון של- Chain-of-thought חסרת מודל
  • חלון-שפה-ברור
  • תמיכה-Code- generation
  • הבנה-זו- Multilingual
  • API ומערכת- Chat
  • מתאים- Suitable- ל- applications
6Pronoia logo

Pronoia

למודל שפה גדול, המתאים שוב ושוב, עם מומצא ייחודי, להבנה ולהפקת איכות רציפה, של מבטא ארצישראלי-ערבי.

4.7 (6)
חינם

פronoia היא מודל שפה גדול המותאם במיוחד לערבית, במטרה לספק הבנה, יצירה והנמקה מדויקים יותר בשפה מאשר מודלים רב-לשוניים למטרות כלליות. הוא ממוקם כמודל LLM מוביל בערבית, עם אופטימיזציות לניבים, צורות קלאסיות וערבית סטנדרטית מודרנית. ניתן להשתמש במודל עבור משימות כגון יצירת תוכן, סיכום, תרגום, תמיכת לקוחות ובינה מלאכותית שיחתית בשווקים דוברי ערבית. על ידי ריכוז האימון שלו על נתונים ערביים, מכוון למינוחים כמו מורפולוגיה, ניקוד והקשר תרבותי שלעתים קרובות מודלים רחבים יותר מטפלים באופן לא עקבי.

חלוקת קריטריונים

Ease of use1
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • מודל שפה, תאומן למבטא
  • הפקת ודיווח כותב
  • תמיכה בשפת ת"ר
  • דמיון ושיחה
  • א-ל- NLP לתאגידים במב' '
  • פעול א- 100 ' MSA