קרב קודם · 2024-12-22 UTC
Agent Development התמודדות — 22 בדצמבר 2024
מקטגוריית Agent Development. 15 סימונים הוצבו על פני 4 לוחמים. Vocode זכה בכתר.
הדירוג הסופי
ההרכב
הלוחמים
פרופילים של כל כלי שהשתתף בקרב הזה, ממוין לפי הציון הסופי.

Vocode
פלטפורמה קוד-פתוחה לבניית שומרי קול ריאל-טיים בעזרת צרכני-נהע-ע"נ, LLM, ומרחבי-ע"ע

Vocode היא ספרייה בקוד פתוח לבניית יישומי AI שיחתיים מבוססי קול. היא מספקת את התשתית הנדרשת לחיבור זיהוי דיבור, מודלים שפה גדולים וסינתזת דיבור לתוך צינור בזמן אמת אחד, המאפשר למפתחים ליצור סוכנים שיכולים להאזין, לחשוב ולדבר באמצעות שיחות טלפון, שקעים אינטרנטיים או שמע מקומי. המסגרת מופצת בעיקר כ-SDK של Python, עם התמקדות בשמע סטרימינג כך ששיחות ירגישו מגיבות ולא כפניות עם עיכובים ארוכים. היא מטפלת בחששות התזמון שמקשים על בנייה של סוכני קול מאפס, כגון ניהול הפרעות (בארג' אין), חציצה וסטרימינג של תמלול, ותיאום הדו-כיווני בין מתמלל, היגיון סוכן ומסנתז. Vocode נועד להיות מודולרי ובלתי תלוי בספק. הוא משתלב עם מגוון של שירותים של צד שלישי עבור כל שלב של הצינור - לדוגמה, ספקי תמלול כמו Deepgram ו- AssemblyAI, מודלי שפה כמו אלה של OpenAI, ומנועי טקסט לדיבור כולל ElevenLabs, Azure, ואחרים. מפתחים יכולים להחליף רכיבים פנימה והחוצה בהתאם לדרישות העלות, זמן השיהוי ואיכות הקול. תרחיש שימוש נפוץ הוא טלפיה: תומך בהנחת וקבלת שיחות טלפון באמצעות ספקים כמו טוויליו, מה שהופך אותו למתאים לבניית סוכני שיחות יוצאות וקורסות אוטומטיות, עוזרים קוליים ובוטים טלפוניים הפונים ללקוחות. הוא תומך גם בשיחות מבוססות דפדפן ומיקרופון מקומי לחוויות קוליות בתוך אפליקציה. מכיוון שהוא קוד פתוח וניתן לארח בעצמך, Vocode מושך צוותים שרוצים שליטה על הסט שלהם והיכולת להתאים את התנהגות הסוכן, במקום להסתמך על פלטפורמה סגורה ומנוהלת במלואה. הפשרה היא שעדיין יש צורך בהרכבת סוכני קול בדרגת ייצור עם חיבור ושלם עבור שירותי תמלול חיצוניים, LLM ו-TTS, וכוונון השהיה והתנהגות שיחה. הוא נמצא במרחב הולך וגדל של כלי סוכני קול לצד פלטפורמות מנוהלות ומסגרות אחרות; הבידול העיקרי שלו הוא הגישה הקוד פתוח והרכיבית, המעניקה למפתחים גישה ישירה לפרטי הצינור.
חלוקת קריטריונים
- נתב-קול-ע"ע זמני-נאמן
- אתיקי-ע
- LLM
- ומרחבי-ע"ע
- סמכות-שיחות-טלפון דרך Twilio ושרותי טלפונית-דומה
- התאמת-ניפוס (barge-in)

MemGPT
פרקטיקה של Framework שמעניק לLLMs אוטונומי-מנוהל זיכרון ארוך-טווח ותווך-שיחה מעבר לגבלות token קבועים

MemGPT הוא מסגרת קוד פתוח שנועדה להתמודד עם אחת המגבלות הבסיסיות של מודלים גדולים של שפה: חלון ההקשר הקבוע שלהם. במקור ממחקר ב‑UC Berkeley, הפרויקט הציג את הרעיון של טיפול בהקשר המוגבל של LLM כמו שמערכת הפעלה מנהלת זיכרון פיזי מוגבל, באמצעות paging ושכבות זיכרון היררכיות כדי לתת למודלים מראה של זיכרון הרבה יותר גדול ומתמשך. הגישה המרכזית שואלת ישירות מהתכנון של מערכות הפעלה. MemGPT מבחינה בין זיכרון בתוך‑הקשר (הטוקנים שנמצאים כרגע בחלון הפקודה של המודל) לבין אחסון חיצוני שמאוחסן מחוץ להקשר. ה-LLM עצמו מקבל כלי קריאה לפונקציות המאפשרים לו להחליט מתי להעביר מידע בין השכבות — למשל, לשמור עובדות חשובות לאחסון ארוך‑טווח, לאחזר מידע רלוונטי מהעבר, או לערוך את הזיכרון הליבה שלו. התנהגות עריכה עצמית זו היא שמאפשרת לסוכנים לשמר מצב קוהרנטי ומתפתח לאורך שיחות ארוכות או מסמכים שהיקפם חורג בהרבה מחלון הקשר יחיד. המסגרת מכוונת למפתחים שבונים סוכני שיחה הדורשים זיכרון מתמשך של משתמשים ואינטראקציות קודמות, וכן לאלה שעובדים על ניתוח מסמכים על פני קורפוסים גדולים מדי מכדי להתאים להקשר. על ידי ניהול זיכרון זכירה, אחסון ארכיוני והקשר עבודה, MemGPT מאפשרת לסוכנים להתייחס לפרטים משלב מוקדם בהרבה של אינטראקציה מבלי שהמפתח יצריך תכנון ידני של צינוריות אחזור לכל מקרה. MemGPT עובדת עם מודלים קנייניים כגון אלו של OpenAI וגם עם מודלים פתוחים המתארחים מקומית, ומשתלבת עם מאגרי וקטורים ומקורות אחסון אחרים כדי לשמר זיכרון בין סשנים. הפרויקט התפתח מאוחר יותר והפך להיות קשור באופן הדוק ל‑Letta, חברה ופלטפורמה שממשיכים לפתח את הקונספטים של stateful‑agent, ומציעים שרת וכלי פיתוח סביב הרעיונות המקוריים. החוזקות המרכזיות שלו הן בהירות מושגית ותבנית קונקרטית, ניתנת לשימוש חוזר לזיכרון ארוך‑טווח שחורגת מהדור המוגבר באחזור הפשוט. ההקרעות הן טיפוסיות למסגרות סוכנים: לולאת הזיכרון המתעדכנת עצמית מתבססת במידה רבה על אמינות קריאת הפונקציות של המודל, שיכולה להשתנות עם מודלים קטנים יותר או מודלים מקומיים, והשלבים הנוספים לניהול הזיכרון מוסיפים latency ועלייה ב‑token overhead. כפרויקט קוד פתוח מתפתח, שמו, ה‑API והאקו‑סיסטם שמסביבו השתנו עם הזמן, מה שעלול להפוך את התיעוד והגרסאות למטרה נעה.
חלוקת קריטריונים
- ניהול-ציראות טירתי וזיכרון מחוץ לצוויו
- אחסנת זיכרון עצמ-מזכיר דרך קומנד-שעת
- אנציקלופדיה וזיכרון-הזנות
- אינטלקׁ-צילק-מש-DB
- תמיכה במראות-LLBs-מסחר-יינד

Letta AI
השקרה הפתוחה לצילום בנת עתרונות אינטטאצים עם כמוסד ידע וחלקים נמצאים בפתרונות נהנים, רמת מתמישת.

ההשקרה הפתוחה בנת אינטטאצים אינטטאצים דיברה שהיום לא בינתם לחשב אפילו אנחנו מפתרונות ראשונים, אינדרט אפיקרתים, נמרור העדיפולטימש. מתתם זה the open source intelligence gathering agent development.
חלוקת קריטריונים
- מתר: עדיפולטימשים שהפתרוןים מיחיזים דיברה יריבראן גרטית SDK הגלרה אננן מקרה
- עדיפולטימה שטרונים. עדיפולטימה לדית ראנין מפעדית
- הברומה אוב
- ראנן עדיפולטימון לדית ראנון
- עדיפולטימה רענן מפעדית


Mosaia היא פלטפורמה מונעת קהילה המיועדת לבניית סוכני AI ויישומים באופן פתוח. היא מספקת למפתחים כלים ליצירה, התאמה אישית והטמעת פתרונות AI תוך קידום שיתוף פעולה ושקיפות בין פרויקטים. הפלטפורמה מדגישה פתיחות, ומאפשרת למשתמשים לשתף את עבודתם, לערבב מחדש סוכנים של אחרים, ולתרום למערכת אקולוגית צומחת של רכיבי בינה מלאכותית. גישה זו שואפת להוריד את מחסום הכניסה לפיתוח בינה מלאכותית תוך עידוד שיתוף ידע בין בונים. בין אם אתה בונה אב טיפוס של סוכן יחיד או מרכיב זרימת עבודה של AI מורכבת יותר, Mosaia מציעה את התשתית והקהילה לתמיכה בפיתוח איטרativי ופתוח.
חלוקת קריטריונים
- כלים לבניית נגיני AI
- חלוקה פתוחה ושיתוף
- שוק חברתי דרגש
- זרימת קצה נגיני AI
- תשתית פרויקטים של מפתחים
- תשתית הפצה



