קרב קודם · 2025-01-11 UTC
AI Agent Development Frameworks התמודדות — 11 בינואר 2025
מקטגוריית AI Agent Development Frameworks. 38 סימונים הוצבו על פני 10 לוחמים. Mastra זכה בכתר.
הדירוג הסופי
ההרכב
הלוחמים
פרופילים של כל כלי שהשתתף בקרב הזה, ממוין לפי הציון הסופי.

Mastra
סלל-מקורי של TypeScript פרופילט של גדול-זכהי, עבודי ספרט, RAG, זכור, ו-MCP, עם צורס-אקוררי-ק-ש-ק-ב-ק-ש-ש.'

Mastra היא מסגרת קוד פתוח ב-TypeScript לבניית אפליקציות וסוכנים המופעלים על‑ידי AI. היא מספקת סט של כלים למפתחים המאפשרים לעבור מרעיון ליישום, כולל סוכנים, זרימות עבודה, זיכרון, מרחבי עבודה וניטור. Mastra משתלבת עם מסגרות Frontend ו‑Backend שונות וניתנת לפריסה כשרת עצמאי. היא מאפשרת למפתחים לבנות מגוון יכולות, כגון סוכני אוטומציה פנימיים, סוכנים המופנים ללקוחות ועוד. Mastra כוללת תכונות כמו ניטור מובנה, בדיקות חוזרות, וזרמים ניתנים לאחסון במטמון ולהמשך. היא נועדה לתמוך בסטארט‑אפים המתפתחים במהירות ובארגונים גלובליים גדולים. ארכיטקטורת Mastra מתמקדת בסוכנים, שניתן להגדיר עם הוראות, מודלים, כלי והתנהגות בזמן ריצה. סוכנים יכולים לתקשר עם משתמשים, לבצע משימות, ולהעביר לזרימות מוצר. המסגרת כוללת גם מערכת אירועים מובנית, וכן מערכת לפרסום ומנוי לאירועים עם Redis Streams ו‑Google Cloud Pub/Sub. ל‑Mastra יש מערכת אקולוגית עשירה של משאבים, כולל ספרים, בלוגים ומדריכים. יש לה קהילה גדולה של משתמשים והיא מאומצת באופן נרחב בתעשיות שונות.
חלוקת קריטריונים
- Agents
- Workflows
- Memory
- Workspaces
- Observability
- Built-in event system


AI Legion היא פלטפורמה קוד-פתוח ליצירת סוכנים אוטונומיים של בינה מלאכותית שמבצעים שיתוף פעולה להשגת משימות. היא משתמשת במודלים לשפה גדולה, כגון GPT-3.5-turbo ו-GPT-4, כדי לאפשר לסוכנים לעבוד יחד ולהשיג מטרות מורכבות. הפלטפורמה מספקת מסגרת להגדרת וניהול סוכנים אלה, כולל קבצי תצורה, APIs ו-workflows. AI Legion נבנתה להיות ניתנת להרחבה והתאמה אישית, מה שמאפשר למשתמשים ליצור ולשלב את המודלים, הפעולות והפיצ'רים שלהם. הפלטפורמה מתאימה למגוון שימושים, כולל מחקר, פיתוח והטמעת מערכות AI אוטונומיות. הקמת סביבה של AI Legion דורשת התקנת התלויות הנדרשות, כולל Node.js ו‑API keys של OpenAI. לאחר מכן ניתן להפעיל את הסוכנים (agents) ולבצע איתם אינטראקציה דרך הקונסול. הפלטפורמה כוללת גם תכונות לניהול מצב הסוכנים, כולל אפשרות למחיקת לוגים של אירועים והפעלה מחדש של הסוכנים עם קונפיגורציות מותאמות. AI Legion הוא כלי רב עוצמה לבניית והטלת מערכות בינה מלאכותית אוטונומיות, והטבע שלו בקוד פתוח מאפשר גישה למגוון רחב של משתמשים. עם זאת, הוא דורש גם כמות משמעותית של מומחיות טכנית ומאמץ תצורה כדי להקים ולהשתמש בו באופן יעיל. יתרון מרכזי של AI Legion הוא היכולת שלו לאפשר לסוכנים ללמוד ולהתאים לאורך זמן, תוך שימוש בשילוב של למידת מכונה וטכניקות גרף ידע. זה מאפשר לסוכנים לשפר את ביצועיהם ואת יכולות קבלת ההחלטות כשהם מתקשרים עם הסביבה. עם זאת, AI Legion מציג גם מספר אתגרים והגבלות, כולל הצורך במאמץ נרחב להגדרת תצורה וניהול, הסיכון לשגיאות של סוכנים ולולאות אינסופיות, והפוטנציאל להעלאת עלויות גבוהות של ספירת טוקנים ושימוש ב-API. בנוסף, השימוש במודלים לשפה גדולים עשוי להעלות דאגות סביב הטיה ודיוק. לגבי תכונות ספציפיות, AI Legion כוללת תמיכה בחיפוש באינטרנט, מנועי חיפוש מותאמים, ו-API, וכן את היכולת לנהל מצב סוכן ולהפעיל מחדש סוכנים עם הגדרות מותאמות. הפלטפורמה ניתנת להרחבה רבה, ומאפשרת למשתמשים ליצור ולשלב מודלים, פעולות ותכונות משלהם. כמה מקרים פוטנציאליים לשימוש ב‑AI Legion כוללים מחקר ופיתוח של מערכות AI אוטונומיות, פריסה של תהליכים ועבודות מבוססות AI, ויצירת כלים ויישומים מותאמים אישית מבוססי AI. בסך הכול, AI Legion היא פלטפורמה חזקה וניתנת להרחבה לבניית והפצת מערכות AI אוטונומיות, אך היא דורשת מומחיות טכנית משמעותית ומאמץ תצורה לשימוש יעיל.
חלוקת קריטריונים
- Web Search
- Custom Search Engines
- APIs ו-Webhooks להפלטה
- הנהגת- מנהיג מדיני
- Custom Model ו-Action Creation
- Knowledge Graph, Machine Learning ל-Graph


AutoML-Agent הוא מסגרת קוד פתוח המשתמשת בסוכנים מתואמים של מודלים לשפה גדולים כדי לנהל את כל מחזור חיי למידת מכונה. במקום להסתמך על מודל או סקריפט יחיד, היא מקצה משימות כגון הבנת נתונים, עיבוד מקדים, בחירת מודלים, אימון והערכה בין סוכנים מומחים העובדים יחד למטרה משותפת. המסגרת מיועדת לחוקרים ולמפתחים שמעוניינים לאוטומט ניסויים ללא צורך בכתיבת קוד צינורית מורכב. על ידי תיאור מאגר נתונים ומטרה בשפה טבעית, משתמשים יכולים להפעיל סוכנים שמציעים, בונים ומקצוענים פתרונות מועמדים, תוך הצגת תוצאות והסבר לאורך הדרך. מאחר והוא קוד פתוח, AutoML-Agent ניתן להרחבה באמצעות סוכנים מותאמים, כלים או שרתים אחראים למודלים, מה שמאפשר להשתמש בו כערכת AutoML מעשית וכשטח ניסוי למחקר של זרימות עבודה של סוכנים מרובי.
חלוקת קריטריונים
- מתרגלתופירון
- �payer-קילמטלטר-קריאת וזרן דברינר ברגבוג
- תאופירוניצה ןברישות
- עולם התיקוק
- ציבה פרינדקטעות
- היתופום גיפון


Cerebrum הוא SDK לפיתוח ופריסה של סוכני AI מבוססי LLM בתוך מסגרת ה-AIOS (מערכת הפעלה לסוכני AI). AIOS מטפל באתגרים כגון תזמון, החלפת הקשר, ניהול זיכרון וניהול כלים עבור סוכנים מבוססי LLM. ה-SDK של Cerebrum מאפשר למפתחים לבנות ולבצע יישומי סוכנים על ידי אינטראקציה עם ליבת ה-AIOS. הוא תומך גם ב-Web UI וגם ב-Terminal UI. ה-SDK כולל תכונות לרישום LLMs זמינים, סוכנים וכלי עבודה, כמו גם הורדה, העלאה והפעלה של סוכנים וכלי עבודה. Cerebrum נועד למשתמשי סוכנים ומפתחים, ומאפשר להם ליצור ולפרוס יישומי סוכני AI.
חלוקת קריטריונים
- פיתוח ופריסה של סוכנים
- ניהול סוכני AI מבוססי LLM
- תמיכה ב-Web UI ו-Terminal UI
- ניהול סוכנים וכלי עבודה
- רישום LLMs זמינים, סוכנים וכלי עבודה
- הורדה והעלאה של סוכנים וכלי עבודה

Gemma 3
דגם AI בקוד פתוח המותאם לביצועי GPU יחיד, התומך בקלטים מולטימודליים ולמעלה מ-140 שפות.

Gemma 3 היא אוסף של מודלים פתוחים קלים במשקל וביצועים, מתקדמים ביותר, שנועדו לרוץ על מכשירים, במיוחד מותאמים לביצועים על יחידת GPU אחת. הוא תומך בקלטים מולטימודאליים וב‑יותר מ‑140 שפות. המודל מגיע במגוון גדלים (1B, 4B, 12B, ו‑27B), כך שמפתחים יכולים לבחור את ההתאמה הטובה ביותר לחומרה ולצרכי הביצועים שלהם. Gemma 3 מציע יכולות מתקדמות של reasoning טקסטואלי וויזואלי, חלון הקשר של 128 000 טוקנים, וקריאת פונקציות למשימות מורכבות. הוא כולל גם גרסאות קוונטיות לביצועים מהירים יותר ולדרישות חישוב מצומצמות. המודל הוא חלק מהמחויבות של Google להפוך טכנולוגיית AI שימושית לנגישה, והוא נבנה על בסיס המחקר והטכנולוגיה שמאחורי מודלי Gemini 2.0. Gemma 3 נועדה לאפשר למפתחים ליצור אפליקציות AI שיכולות לרוץ ישירות על מכשירים כגון טלפונים, מחשבים ניידים ותחנות עבודה. Gemma 3 מציג ביצועים מהמתקדמים ביותר לגודלו, ומקדם על מודלים אחרים כגון Llama3-405B, DeepSeek‑V3, ו‑o3‑mini בהערכות העדפת אדם ראשוניות. הוא מאפשר יישומים גלובליים עם תמיכה מוכנה לשימוש ביותר מ‑35 שפות ותמיכה מאומנת מראש ל‑יותר מ‑140 שפות. המודל מאפשר יצירת זרימות עבודה מונעות AI באמצעות קריאת פונקציות ופלט מובנה. הפיתוח של Gemma 3 כלל פרוטוקולי בטיחות קפדניים, כגון ממשל נתונים נרחב, התאמה למדיניות הבטיחות באמצעות כיוונון עדין, והערכות מדדים חזקות. משפחת המודלים הפתוחים של Gemma זכתה לאימוץ משמעותי, עם יותר מ‑100 מיליון הורדות וקהילה תוססת שיצרה יותר מ‑60,000 וריאנטים של Gemma. היכולות של Gemma 3 מתאימות למפתחים המחפשים ליצור חוויות משתמש מרתקות שיכולות לרוץ על GPU או TPU בודד.
חלוקת קריטריונים
- תמיכה ב-AI מולטימודלי
- פיתוח ממוקד באחריות
- כוונון עדין נרחב
- תמיכה ב-140 שפות
- ביצועים משופרים

MiniMax‑M1
מודל סיבי-פתוח מאומן בסקאלה גדולה עם מסגרת Mixture-of-Experts רב-עקיבא היברידית, 1 מיליון סימנים פתח נלקטיב.

MiniMax-M1 הוא מודל רזונינג היברידי בקנה מידה גדול עם משקל פתוח. הוא מבוסס על ארכיטקטורת Mixture-of-Experts (MoE) היברידית המשולבת במנגנון lightning attention, המאפשר סקלינג יעיל של חישוב בזמן ריצה (test-time compute). המודל תומך באופן טבעי באורך הקשר של מיליון טוקנים ונאמן באמצעות reinforcement learning (RL) בקנה מידה גדול על מגוון בעיות. הוא חורג ממודלים פתוחים חזקים אחרים במשימות הנדסת תוכנה מורכבות, שימוש בכלים ומשימות הקשר ארוך. ניסויים על מדדי ביצועים סטנדרטיים מראים ש‑MiniMax‑M1 מצטיין על פני מודלים אחרים במשימות קטגוריה כגון מתמטיקה, תכנות, הנדסת תוכנה, שימוש בכלים מבוססי סוכן, והבנת הקשר ארוך. המודל מתאים במיוחד למשימות מורכבות שדורשות עיבוד של קלטים ארוכים וחשיבה נרחבת. MiniMax‑M1 משמש בסיס חזק לסוכני מודלי שפה מהדור הבא, כדי לחשוב ולטפל באתגרים מהעולם האמיתי. השוואת ביצועי הבנצ'מרק של המודלים המסחריים המובילים והמודלים בקוד פתוח במשימות קטגוריות שונות מדגישה את ביצועי המודל. הדו"ח הטכני מספק מידע נוסף על ארכיטקטורת המודל, פרוטוקול האימון ותוצאות ההערכה.
חלוקת קריטריונים
- מסגרת Mixture-of-Experts (MoE) רב-עקיבא-היברידית
- Lightning attention mechanism
- שליוו- RL (reinforcement learning)
- 1,000,000 סימנים-פתח-נלקטבים
- כלי-מיחשוב-עקיבא-זמן-נעילה-הרחב


ScreenAgent הוא ג'נרל-סורסי Visual Language Model (VLM) לקאנץ נועד לבקר GUIs הם מערב אופרטציות עכבר/קוים. הוא מאפשר התמשכות עם מסכי מעקב וטיהור אפשרות. המיזם כול-לד-פרק חשיבת/טיק-התו/סקרב-מ-קאנץ הממון-לד- למל-ע-ע- -סקרב/ - שליפת של חי-ה- - - - - - - - - - - - - - - - - - , , .
חלוקת קריטריונים
- ביצועי - תכשיב- -
- חשיבת/טיק-התו/סק- - - - -
- ת- - - -
- אנצ/י- - - -
- VLM - - - -
- pros


BabyAGI הוא מסגרת ניסויית לבניית סוכנים אוטונומיים הבונים את עצמם. היא נוצרה כהתפתחות של BabyAGI המקורי מ-מרץ 2023, שהציג תכנון משימות לסוכנים אוטונומיים. המסגרת בנויה סביב מסגרת פונקציות חדשה הנקראת 'functionz' המאחסנת, מנהלת ומבצעת פונקציות ממסד נתונים. היא כוללת מבנה מבוסס גרפים למעקב אחר ייבוא, פונקציות תלויות וסודות אימות, יחד עם יכולות טעינה אוטומטית וניהול יומנים מקיף. המסגרת כוללת גם לוח בקרה לניהול פונקציות, הפעלת עדכונים וצפייה ביומנים. היא נועדה להיות פשוטה ולעורר דיון בקרב מפתחים, לא לשימוש בייצור. הרעיון המרכזי הוא לבנות את הדבר הפשוט ביותר שיכול לבנות את עצמו, מה שהופך אותו לגישה מעניינת לפיתוח סוכנים אוטונומיים.
חלוקת קריטריונים
- רישום פונקציות וניהול מטא-נתונים
- מעקב אחר תלות ותלות מרכזית
- טעינה אוטומטית וניהול יומנים
- לוח בקרה לניהול פונקציות וצפייה ביומנים

MCP‑Use
פלטפורמה קוד-פתוח ליצירת קשר עם LLMs ו-MCP servers ובניית אינטגרטורי AI כפי שבאים

mcp-use הוא פלטפורמה קוד פתוח שמקלה על חיבור מודלים גדולים של שפה (LLMs) לשרתי MCP ומאפשרת פיתוח של סוכני AI מותאמים אישית שיכולים לתקשר עם מודלים אלה. הפלטפורמה מספקת מסגרת MCP מלאה (mcp-use SDK) לבניית אפליקציות ChatGPT, מחברים ל‑Claude, ושרתי MCP. עם MCP‑Use, מפתחים יכולים לנצל קוד בסיסי יחיד כדי לפרוס את היישומים שלהם על פני משטחים שונים שבהם משתמשים וסוכנים כבר עובדים, כולל ChatGPT, Claude ו‑Gemini. הפלטפורמה מציעה מגוון כלים ותכונות, כגון אפשרות ליצור יישומי MCP בפקודה אחת, פריסה אוטומטית ל‑Manufact Cloud, ו‑analytics ו‑observability מובנים. מפתחים יכולים להשתמש ב‑SDK של MCP‑Use כדי לבנות ולפרוס שרתי MCP ויישומים מבלי להזדקק לכלים נוספים. הפלטפורמה גם מספקת Visual Inspector ו‑Sandbox עם יכולות בדיקה, מה שמאפשר למפתחים לבדוק את האפליקציות שלהם ללא צורך ב‑LLM פעיל. MCP‑Use שואפת לפשט את פיתוח והפריסה של יישומים המבוססים על MCP, מה שהופך אותה לאופציה מושכת למפתחים המעוניינים לבנות ולפרוס סוכנים ויישומים מותאמים של בינה מלאכותית.
חלוקת קריטריונים
- ניהול MCP server
- יצירת קשר ושילוב LLM
- פיתוח אינטגרטורי AI קצר
- מימוש אוטומטי הקצאה, ועליית עגם
- Visual Inspector וניסויי הסורק שמאל
- אנליטיקה בנויה ב


Rasa היא פלטפורמת בינה מלאכותית לשיחות המסייעת למפתחים לבנות צ'אט וירטואלי ומסייעים קוליים הקשריים עם שליטה מלאה בנתונים, מודלים והפריסה. ליבה בקוד פתוח מטפלת בהבנת שפה טבעית ובניהול דיאלוג, בעוד ש- Rasa Pro מוסיף תכונות ארגוניות כמו אנליטיקה, בקרות אבטחה ותשתיות ניתנות להרחבה. Rasa Studio מספק ממשק עם קוד נמוך למעצבים ולצוותים השוחחים כדי לשתף פעולה על נתוני אימון, תזרימי שיחה, ובדיקות ללא כתיבת קוד. ביחד, הכלים תומכים בצוותים היברידיים שמעבירים עוזרים על פני ערוצי הודעות, מערכות IVR, ויישומים מותאמים אישית. הוא משמש בדרך כלל על ידי ארגונים בתחומי הבנקאות, הטלקום, הבריאות והממשלה, כאשר נדרשת פריסה מקומית, עמידה בדרישות תקינה והתאמה אישית.
חלוקת קריטריונים
- מנוע בינה-מלומדת לעיון-שפה
- ניהול דיאלוג, עם פעולות-גיבוי מחוץ
- Rasa Studio - ממשק-נמוך-הקוד
- אופציוני-קול ובעלי-נוימד
- אולפן-הערכת-נתוני - רעיון-קו-גימנאס
- בטחנ-עסקי-IT









