קרב קודם · 2026-01-03 UTC
AI Agent Development Frameworks התמודדות — 3 בינואר 2026
מקטגוריית AI Agent Development Frameworks. 28 סימונים הוצבו על פני 10 לוחמים. Cerebrum: AIOS SDK זכה בכתר.
הדירוג הסופי
ההרכב
הלוחמים
פרופילים של כל כלי שהשתתף בקרב הזה, ממוין לפי הציון הסופי.


Cerebrum הוא SDK לפיתוח ופריסה של סוכני AI מבוססי LLM בתוך מסגרת ה-AIOS (מערכת הפעלה לסוכני AI). AIOS מטפל באתגרים כגון תזמון, החלפת הקשר, ניהול זיכרון וניהול כלים עבור סוכנים מבוססי LLM. ה-SDK של Cerebrum מאפשר למפתחים לבנות ולבצע יישומי סוכנים על ידי אינטראקציה עם ליבת ה-AIOS. הוא תומך גם ב-Web UI וגם ב-Terminal UI. ה-SDK כולל תכונות לרישום LLMs זמינים, סוכנים וכלי עבודה, כמו גם הורדה, העלאה והפעלה של סוכנים וכלי עבודה. Cerebrum נועד למשתמשי סוכנים ומפתחים, ומאפשר להם ליצור ולפרוס יישומי סוכני AI.
חלוקת קריטריונים
- פיתוח ופריסה של סוכנים
- ניהול סוכני AI מבוססי LLM
- תמיכה ב-Web UI ו-Terminal UI
- ניהול סוכנים וכלי עבודה
- רישום LLMs זמינים, סוכנים וכלי עבודה
- הורדה והעלאה של סוכנים וכלי עבודה

Awesome MCP Servers
רשימת ידידותית של שרתי Model Context Protocol (MCP) להרחבת חסכן איי לדעת אתגרים ונתונים.

Awesome MCP Servers הוא רשימה שמופעלת על ידי הקהילה של שרתי Model Context Protocol (MCP) שמחברים עוזרי בינה מלאכותית למערכות חיצוניות. הוא מתעד יישומים במגוון קטגוריות כגון מסדי נתונים, מערכות קבצים, כלים למפתחים, אפליקציות פרודוקטיביות ושירותים רשת, מה שמקל על גילוי אינטגרציות המרחיבות את מה שיכולות המודלים לעשות. המשאב מיועד למפתחים ובנאי בינה מלאכותית שמחפשים לתת למערכות מבוססות LLM גישה לנתונים ולפעולות מעולם האמיתי מבלי לכתוב כל מחבר מאפס. הרשומות כוללות לרוב קישורים למאגרי מקור, תיאורים קצרים ותגים המאפשרים למשתמשים לסנן לפי מקרה שימוש או טכנולוגיה. בגלל שהוא מבוסס על פורמט ‚awesome list‘ בקוד פתוח, התרומות מגיעות ממערכת ה-MCP הרחבה, וה‑רשימה מתפתחת יחד עם הפרוטוקול עצמו.
חלוקת קריטריונים
- רשימה ידידותית של הצצות MCP
- מאויר על פי תחום ולמטרה
- קישורים לרפרנצות מקור
- כולל כמו ושער האיניציאטארפ
- פתוח להשתפות קהילה
- אפשריות הכו רפרנציה לחקיר יעקב ה-MCP

OpenAI Codex SDK
סביבת פיתוח API להקמת ושליטה על סוכני Codex באופן תכנותי דרך TypeScript, CLI או GitHub Actions.

SDK ה-OpenAI Codex הוא קבצי פיתוח תוכנה שמאפשר למתכנתים להקים ולשלוט על סוכני Codex באופן תכנותי. ה-SDK תומך באינטרפייסים מסוגים שונים, כולל TypeScript, CLI, ו- GitHub Actions. ה-SDK עוצב כדי לספק אופצייה נמרצת לת״אב Codex סוכנים לתוך מגוון תכניות וזרימות עבודה. בעזרת ה-SDK Codex המתכנתים יכולים לבנות סוכנים מותאמי, להגדיר תכונות סוכן, ולנהל ת״אח Codex. כמו כן ה-SDK מספק כלים לביקורת איכות ולאופטימיזציה של ביצועי סוכן. ה- SDK מיועד לממסדי המתארגנים לבנות תכניות אשר תחכו באפש"ר Codex.
חלוקת קריטריונים
- ריצוג נוסחאות
- יצירת קוד
- ריצוג תמונות
- ריצוג קול
- זמינות רשמית
- קריאת קומנד


BabyAGI הוא מסגרת ניסויית לבניית סוכנים אוטונומיים הבונים את עצמם. היא נוצרה כהתפתחות של BabyAGI המקורי מ-מרץ 2023, שהציג תכנון משימות לסוכנים אוטונומיים. המסגרת בנויה סביב מסגרת פונקציות חדשה הנקראת 'functionz' המאחסנת, מנהלת ומבצעת פונקציות ממסד נתונים. היא כוללת מבנה מבוסס גרפים למעקב אחר ייבוא, פונקציות תלויות וסודות אימות, יחד עם יכולות טעינה אוטומטית וניהול יומנים מקיף. המסגרת כוללת גם לוח בקרה לניהול פונקציות, הפעלת עדכונים וצפייה ביומנים. היא נועדה להיות פשוטה ולעורר דיון בקרב מפתחים, לא לשימוש בייצור. הרעיון המרכזי הוא לבנות את הדבר הפשוט ביותר שיכול לבנות את עצמו, מה שהופך אותו לגישה מעניינת לפיתוח סוכנים אוטונומיים.
חלוקת קריטריונים
- רישום פונקציות וניהול מטא-נתונים
- מעקב אחר תלות ותלות מרכזית
- טעינה אוטומטית וניהול יומנים
- לוח בקרה לניהול פונקציות וצפייה ביומנים

Gemma 3
דגם AI בקוד פתוח המותאם לביצועי GPU יחיד, התומך בקלטים מולטימודליים ולמעלה מ-140 שפות.

Gemma 3 היא אוסף של מודלים פתוחים קלים במשקל וביצועים, מתקדמים ביותר, שנועדו לרוץ על מכשירים, במיוחד מותאמים לביצועים על יחידת GPU אחת. הוא תומך בקלטים מולטימודאליים וב‑יותר מ‑140 שפות. המודל מגיע במגוון גדלים (1B, 4B, 12B, ו‑27B), כך שמפתחים יכולים לבחור את ההתאמה הטובה ביותר לחומרה ולצרכי הביצועים שלהם. Gemma 3 מציע יכולות מתקדמות של reasoning טקסטואלי וויזואלי, חלון הקשר של 128 000 טוקנים, וקריאת פונקציות למשימות מורכבות. הוא כולל גם גרסאות קוונטיות לביצועים מהירים יותר ולדרישות חישוב מצומצמות. המודל הוא חלק מהמחויבות של Google להפוך טכנולוגיית AI שימושית לנגישה, והוא נבנה על בסיס המחקר והטכנולוגיה שמאחורי מודלי Gemini 2.0. Gemma 3 נועדה לאפשר למפתחים ליצור אפליקציות AI שיכולות לרוץ ישירות על מכשירים כגון טלפונים, מחשבים ניידים ותחנות עבודה. Gemma 3 מציג ביצועים מהמתקדמים ביותר לגודלו, ומקדם על מודלים אחרים כגון Llama3-405B, DeepSeek‑V3, ו‑o3‑mini בהערכות העדפת אדם ראשוניות. הוא מאפשר יישומים גלובליים עם תמיכה מוכנה לשימוש ביותר מ‑35 שפות ותמיכה מאומנת מראש ל‑יותר מ‑140 שפות. המודל מאפשר יצירת זרימות עבודה מונעות AI באמצעות קריאת פונקציות ופלט מובנה. הפיתוח של Gemma 3 כלל פרוטוקולי בטיחות קפדניים, כגון ממשל נתונים נרחב, התאמה למדיניות הבטיחות באמצעות כיוונון עדין, והערכות מדדים חזקות. משפחת המודלים הפתוחים של Gemma זכתה לאימוץ משמעותי, עם יותר מ‑100 מיליון הורדות וקהילה תוססת שיצרה יותר מ‑60,000 וריאנטים של Gemma. היכולות של Gemma 3 מתאימות למפתחים המחפשים ליצור חוויות משתמש מרתקות שיכולות לרוץ על GPU או TPU בודד.
חלוקת קריטריונים
- תמיכה ב-AI מולטימודלי
- פיתוח ממוקד באחריות
- כוונון עדין נרחב
- תמיכה ב-140 שפות
- ביצועים משופרים


ScreenAgent הוא ג'נרל-סורסי Visual Language Model (VLM) לקאנץ נועד לבקר GUIs הם מערב אופרטציות עכבר/קוים. הוא מאפשר התמשכות עם מסכי מעקב וטיהור אפשרות. המיזם כול-לד-פרק חשיבת/טיק-התו/סקרב-מ-קאנץ הממון-לד- למל-ע-ע- -סקרב/ - שליפת של חי-ה- - - - - - - - - - - - - - - - - - , , .
חלוקת קריטריונים
- ביצועי - תכשיב- -
- חשיבת/טיק-התו/סק- - - - -
- ת- - - -
- אנצ/י- - - -
- VLM - - - -
- pros

AIWaves Agents
מסגרת LLM אדפטיבית בקוד פתוח לבנייה, אימון והטמעה של סוכני שפה אוטונומיים.

AIWaves Agents היא מסגרת LLM אדפטיבית בקוד פתוח לבנייה, אימון והטמעה של סוכני שפה אוטונומיים. הוא עודכן לגרסה 2.0 של Agents, שמוסיף תמיכה בלמידת סוכנים והערכתם באמצעות למידה סימבולית, מסגרת שיטתית בהשראת אימון רשתות עצביות. מסגרת זו מאפשרת את אימונם של סוכני שפה על ידי יצירת אנלוגיה בין פाइपליינים של סוכנים וגרפים חישוביים של רשתות עצביות. המסגרת פועלת על ידי ביצוע סוכן תחילה ואחסון המסלול שלו, כולל כניסות, תפוקות, הנחיות ושימוש בכלים. לאחר מכן היא מעריכה את התוצאה באמצעות פונקציית הפסד מבוססת שפה, מורידה את ההפסד כדי לחשב גרדיינטים של שפה, ומעדכנת את הרכיבים הסימבוליים של הסוכן בהתאם. תהליך זה מאפשר לסוכנים ללמוד ולהסתגל לאורך זמן. Agents 2.0 תומך גם באופטימיזציה של מערכות מרובות סוכנים על ידי טיפול בצמתים כסוכנים שונים או לאפשר לסוכנים מרובים לפעול בתוך צומת יחיד. המסגרת נועדה להיות גמישה וניתנת הרחבה, ותומכת ביישומים שונים וכיווני מחקר. הפרויקט מספק מדריך התקנה, כולל אפשרויות להתקנה ממאגר Git או לפיתוח מקומי. הוא כולל גם ציטוטים למאמרי מחקר קשורים. הנקודות החזקות של המסגרת טמונות בגישה החדשנית שלה ללמידת סוכנים ובפוטנציאל שלה לקידום המחקר בסוכני שפה אוטונומיים. עם זאת, המורכבות שלה והתלות שלה בהנחיות מעוצבות בקפידה עשויים להציג אתגרים למשתמשים.
חלוקת קריטריונים
- תמיכה בסוכני שפה אוטונומיים
- אימון סוכני שפה
- הטמעת סוכני שפה
- אפשור סוכנים מתפתחים עצמית

Claude MCP Agents
סוכני בינה מלאכותית הבנויים על פרוטוקול MCP של Anthropic לשילוב כלים ונתונים ללא הפרעות.

Claude MCP Agents הם סוכנים בינה מלאכותית שמנצלים את פרוטוקול הקונטקסט של Anthropic (MCP) כדי להתחבר למגוון רחב של מקורות נתונים חיצוניים, APIים וכלים למפתחים. על ידי תקנון זרימת הקונטקסט בין Claude למערכות חיצוניות, הסוכנים יכולים לקרוא קבצים, לבצע שאילתות במסדי נתונים, להפעיל שירותים ולפעול על מידע בזמן אמת ללא אינטגרציות מותאמות אישית לכל מקור. הגישה מיועדת למפתחים ולצוותים שמבנים אוטומציה, סוכני סיוע למחקר וסוכני זרימת עבודה, שצריכים גישה אמינה לנתונים ארגוניים או אישיים. הספציפיקציה הפתוחה של MCP מאפשרת אותו סוכן להתחבר לכלים חדשים ככל שמופיעים קונקטורים, מה שמפחית את הלוק‑אין ואת עומס האינטגרציה.
חלוקת קריטריונים
- שילוב עם פרוטוקול Model Context Protocol
- מתחבר לקבצים, API ומסדי נתונים
- ניתן להרחבה באמצעות שרתים מותאמים אישית של MCP
- תומך בזרימות עבודה אגנטיות, רב-שלביות
- תואם למשפחת המודלים של Claude
- תקן פתוח לתפעול הדדי


BabyCatAGI היא גרסה מפושטת ומשופרת של BabyAGI, שנועדה לטפל במשימות מורכבות באמצעות סוכני AI אוטונומיים. היא מפרקת יעדים ברמה גבוהה למשימות משנה ניהוליות, מבצעת אותם ברצף ומתאמת את התוכנית שלה בהתבסס על תוצאות ביניים, מה שהופך אותה למתאימה למחקר, יצירת תוכן ופתרון בעיות רב-שלביות. המסגרת מעדיפה קוד מינימלי וקריאות, מה שהופך אותה לנגישה למפתחים שרוצים להתנסות ב-AI אגנטי ללא עומס של ספריות תזמור גדולות יותר. היא משתלבת עם מודלי שפה וכלי חיפוש באינטרנט כדי לאסוף הקשר, לחשוב על בעיות וליצור פלטים מובנים. כפרויקט ניסיוני פתוח, BabyCatAGI מתאימה ביותר ליצירת אב טיפוס של זרימות עבודה של סוכנים, ללמוד כיצד פועלים מערכות אוטונומיות מונעות משימות, ולהתאים פיפליינס לצורכי אוטומציה ספציפיים.
חלוקת קריטריונים
- יצירת רשימת משימות וקידום
- ביצוע משימות משנה אוטונומי
- שילוב חיפוש באינטרנט להקשר
- זרימת עבודה של היסק ברצף
- יישום Python קל משקל
- יעדים וקידומים מותאמים אישית


BabyDeerAGI היא מסגרת סוכני AI מקוצרת שנועדה לאפשר ביצוע משימות במקביל ליעילות משופרת. היא מיועדת למפתחים ולחוקרים המעוניינים לייעל את זרימות העבודה של ה- AI שלהם. על ידי אפשרות לביצוע מספר משימות בו-זמנית, BabyDeerAGI יכולה להפחית משמעותית את זמן העיבוד הכולל. המסגרת בנויה עם גמישות בחשבון, תומכת באינטגרציה עם מודלים וכלי AI שונים. עם זאת, פרטים ספציפיים על היכולות והמגבלות שלה אינם מתועדים במידה נרחבת במקורות הזמינים.
חלוקת קריטריונים
- ביצוע משימות במקביל
- אינטגרציה גמישה עם מודלי AI
- מסגרת סוכני AI מקוצרת
- תמיכה בעיבוד בו-זמנית









