קרב קודם · 2026-07-24 UTC

Observability התמודדות — 24 ביולי 2026

מקטגוריית Observability. 21 סימונים הוצבו על פני 9 לוחמים. Coval (YC S24) זכה בכתר.

הדירוג הסופי

ההרכב

הלוחמים

פרופילים של כל כלי שהשתתף בקרב הזה, ממוין לפי הציון הסופי.

1Coval (YC S24) logo

Coval (YC S24)

פלטפורמת סימולציה והערכה לבדיקת סוכני AI קולי וצ'אט בקנה מונית.

4.3 (4)
חינם
תמונה של Coval (YC S24)

קובל היא פלטפורמת מפתחים שנבנתה כדי לדמות, לבדוק ולהעריך סוכני AI לפני שהם מגיעים לפרודקשן. היא מאפשרת לצוותים להריץ אלפי שיחות סינתטיות נגד סוכני הקול או הצ'אט שלהם, תוך מדידת איך הם מתמודדים עם מקרים חריגים, הפסקות, קריאות לכלים ודיאלוג רב-סיבוב. במימון של Y Combinator (S24), Coval מציב את עצמו כ'approach' של רכב אוטונומי לביטחון של סוכן, תוך שימוש בבדיקות מבוססות סימולציה קפדניות ל-AI שיחתי. מהנדסים יכולים להגדיר תרחישים, לשחזר תנועת תעבורת ייצור, להעריך תוצאות מול מדדים מותאמים, ולעקוב אחרי ירידות ביצועים בין גרסאות הסוכן. הפלטפורמה מכוונת לצוותים שמפעילים סוכנים מול לקוחות בתחומי התמיכה, המכירות והפעולות, שבהם אמינות ועקביות הם קריטיים לפריסה.

חלוקת קריטריונים

Ease of use1
Value for money1
Features & power0
Integrations0
Support & docs1
Reliability0
  • סימולציה של שיחות בקנה מונית
  • בדיקת סוכני קול עם דיאלוגים ריאליסטיים
  • מדדי הערכה והסקור מותאמים אישית
  • מעקב רגרסיה בין גרסאות סוכנים
  • יצירת תרחישים ומקרים קצה
  • שחזור תעבורה בייצור
2Fiddler AI logo

Fiddler AI

פלטפורמת אבטחת ומעקב בינה מלאכותית לניטור, הסבר וקפיטרור של יישומי ML ו- LLM

4.7 (6)
חינם
תמונה של Fiddler AI

Fiddler AI היא פלטפורמת ארגונית שמסייעת לצוותים לעקוב, לנתח ולהגן על מודלים של למידת מכונה ויישומי AI גנרטיבי בתפעול. היא מספקת נראות על ביצועי המודל, הסטת נתונים, הטייה ובעיות איכות, ובמקביל מציעה אמצעי הגנה מפני סיכונים ספציפיים ל‑LLMs כגון הזיות, הזרקת פקודות ופלטים לא בטוחים. הכלי תוכנן למהנדסי ML, מדעי נתונים וצוותי סיכון וציות, Fiddler משלב הסברתיות, ניטור בזמן אמת, ומנגנוני בטיחות בתהליך עבודה אחד. הוא מתממשק עם צינורות ML נפוצים וסביבות ענן, ומסייע לארגונים ליישם פרקטיקות AI אחראיות בקנה מידה רחב.

חלוקת קריטריונים

Ease of use1
Value for money1
Features & power0
Integrations0
Support & docs0
Reliability1
  • ניטור ביצועי מודל ונדידת נתונים
  • זיהוי הזיות ובטיחות LLM
  • הגנה מפני הזרקת הנחיה ופריצת כלא
  • AI מוסבר וניתוח שורש
  • הערכות הטיה והוגנות
  • לוחות בקרה והתראות עבור AI בייצור
3Future AGI logo

Future AGI

פלטפורמה המשפרת את דיוק הבינה המלאכותית באמצעות כלי הערכה ואופטימיזציה מקיפים.

4.6 (5)
חינם
תמונה של Future AGI

Future AGI היא פלטפורמה המשפרת את דיוק ה‑AI באמצעות כלי הערכה ואופטימיזציה מקיפים. היא מאפשרת למשתמשים לבנות סוכנים מתחדשים בעצמם, ללכוד תקלות ולהבין את הסיבה. הפלטפורמה מציעה מגוון תכונות, כולל הערכת סוכנים, אופטימיזציה ושיחות מדומות. משתמשים יכולים ליצור ולנהל תרחישים, והפלטפורמה מספקת ניתוחים וכלי אופטימיזציה לשיפור ביצועי הסוכן. Future AGI נראה מיועד למפתחים ולעסקים המעוניינים לפרוס צ'אטבוטים וסוכנים מבוססי AI. הוא מאפשר למשתמשים לדמות שיחות, להעריך ולשפר את ביצועי הסוכנים, ולהשתלב עם מאגרי ידע. הפלטפורמה נראית ככלי למפתחים ליצירת ושיפור של סוכני AI, ולא כממשק פונה ללקוח. הפלטפורמה מציעה תכונות כגון agent evaluation, simulated conversations וניהול תרחישים. היא מאפשרת למשתמשים לערוך ולנהל prompts, להוסיף retrieval steps למאמרי knowledge base, ולשלב עם global prompts לטיפול במצבים מורכבים. בעוד Future AGI מספקת תכונות ערכיות לפיתוח ואופטימיזציה של בינה מלאכותית, היא גם מגיעה עם מגבלות. לדוגמה, היא מתבססת על ידע כללי ועלולה לדרוש שלבים נוספים עבור תרחישים מורכבים יותר. בנוסף, ההתבססות של הפלטפורמה על שיחות מדומות עשויה להגביל את היכולת שלה להתמודד עם אי‑ודאויות בעולם האמיתי. Future AGI נראה שהוא מציע סט ייחודי של תכונות לפיתוח ואופטימיזציה של AI. כלי ההערכה והאופטימיזציה המקיפים שלו הופכים אותו למשאב בעל ערך עבור מפתחים שמחפשים לחדד את הסוכנים המלאכותיים שלהם. עם זאת, ייתכן שהוא ידרוש פיתוח או אינטגרציה נוספים כדי להתמודד עם תרחישים מורכבים יותר ועם אי‑ודאויות בעולם האמיתי.

חלוקת קריטריונים

Ease of use1
Value for money0
Features & power1
Integrations0
Support & docs0
Reliability1
  • הערכת סוכנים ודירוג
  • שיחות מדומות וניהול תרחישים
  • שילוב עם בסיס ידע וגישה
  • טיפול בהנחיות גלובליות למצבים מורכבים
  • כלי ניתוח ואופטימיזציה
4AI2AI project logo

AI2AI project

צפה בשיחה בין שני סוכני AI בזמן אמת

4.5 (4)
חינם
תמונה של AI2AI project

באתר של פרויקט AI2AI, משתמשים יכולים לצפות בשיחות בזמן אמת בין שני סוכני AI. כדי להתחיל אינטראקציה, משתמשים חייבים ליצור שני ישויות, להקצות להם הנחיה, הקשר, קול ומין, ולבחור מודל שפה. ניתן להתחיל, לשמור ולשתף את האינטראקציה עם משתמשים אחרים באתר. דוגמאות אינטראקציות מסופקות, המראות תרחישים שונים, כגון פיתוי, כעס, סקרנות והצעות מכירה. משתמשים חדשים צריכים להירשם ולקבל $1 זיכוי כדי לחקור את הפלטפורמה. התמחור מבוסס על תעריף לדקה, החל מ-1 סנט לדקה.

חלוקת קריטריונים

Ease of use1
Value for money0
Features & power0
Integrations1
Support & docs0
Reliability0
  • צפייה בשיחה ישירה בין AI ל-AI
  • שני ישויות AI שונות בשיחה
  • חווית משתמש ללא מגע
  • הדגמת התנהגות AI מתעוררת
  • ממשק מבוסס דפדפן נגיש
5Arize AI logo

Arize AI

מלרכז הערכת LLM ועריכת תצפיות AI שמורכז לסיוע AI ומדעני נתונים במעקב, בתיקון ובקידום ביצועי...'

4.3 (6)
פרימיום חינמי
תמונה של Arize AI

Arize AI היא פלטפורמת תצפית על AI והערכת LLM. היא מסייעת למפתחים של AI ולמדעני נתונים במעקב, באיתור תקלות ובשיפור ביצועי המודלים שלהם. הפלטפורמה מספקת כלים לזיהוי בעיות והצעת תיקונים, מה שמאפשר למשתמשים לשפר את הדיוק והאמינות של המודלים שלהם. Arize AI מיועדת למפתחים של AI ולמדעני נתונים שצריכים למטב את ביצועי המודלים שלהם. יכולות הפלטפורמה כוללות ניטור ואיתור תקלות, המאפשרים למשתמשים לזהות ולטפל בבעיות במהירות. בנוסף, Arize AI מציעה תכונות להערכת ושיפור ביצועי המודלים, ומאפשרת למשתמשים ללטש את המודלים שלהם עם הזמן. באמצעות Arize AI, משתמשים יכולים לוודא שהמודלים שלהם פועלים בתפוקה מרבית, מה שמוביל לקבלת החלטות טובה יותר ותוצאות משופרות. המיקוד של הפלטפורמה על תצפית והערכה מבדיל אותה משאר כלי פיתוח ה‑AI, והופך אותה למשאב בעל ערך למי שעובד עם מודלים של שפה גדולים ומערכות AI מורכבות.

חלוקת קריטריונים

Ease of use0
Value for money1
Features & power0
Integrations1
Support & docs0
Reliability0
  • מעקב אחרי מודלי AI
  • איתור ותיקון בעיות
  • הצעת תיקונים
  • הערכת ביצועי המודל
  • הערכת ואופטימיזציית LLM
6Edwin AI logo

Edwin AI

סוכן AI למבצעי IT שמאיץ את גילוי התקלות, הטריאז' והפתרון.

4.7 (6)
חינם
תמונה של Edwin AI

Edwin AI הוא סוכן AI למבצעי IT שתוכנן להאיץ את גילוי התקלות, הטריאז' והפתרון. הוא מספק פלטפורמה מרכזית לצוותי IT לחקור תקלות, להבין את השפעתן, למצוא או ליצור פתרונות וליישמם בכלים קיימים ללא צורך לעבור בין מערכות. Edwin AI משווה התראות, מזהה גורמים מקוריים ומפעיל תיקונים אוטומטית, החל מההתראה הראשונה ועד לפתרון מאומת. הוא משתמש בנתוני היסטוריה ונתוני תצפית כדי לחזות ולמנוע הפסקות. הכלי משולב עם למעלה מ-3,000 כלים בתחומי תצפית, APM, ביטחון ו-CMDB, מה שמאפשר תובנות בזמן אמת ופעולה ומבטל סילואים. מחקר של Forrester מצא כי Edwin AI הניב רווח של 313% עבור ארגון מורכב, עם תקופת החזר על ההשקעה של 6 חודשים או פחות.

חלוקת קריטריונים

Ease of use0
Value for money0
Features & power1
Integrations1
Support & docs0
Reliability0
  • שילוב התראות והפחתת רעש
  • הצעות גורמים מקוריים בניהול AI
  • סיכום תקלות בשפה טבעית
  • שילובים עם פלטפורמות ITSM ותצפית
  • זרימות טריאז' אוטומטיות
  • עשרת ידע מתקלות קודמות
7FoundryAI logo

FoundryAI

בנה, הערך והשבח סוכני AI לאוטומציה עסקית

4.8 (4)
חינם
תמונה של FoundryAI

FoundryAI היא פלטפורמת פיתוח המתמקדת ביצירת סוכני AI שמטפלים בתהליכים עסקיים אמיתיים. היא משלבת כלים לעיצוב סוכנים, בדיקה ושיפור מתמשך, כך שהצוותים יכולים לעבור מהאבטיפוס לייצור מבלי לחבר בין מערכות נפרדות. הפלטפורמה מתמקדת בהערכת ביצועים, ומספקת למפתחים דרכים למדוד את ביצועי הסוכן מול משימות מוגדרות ולשפר את ההתנהגות לאורך זמן. זה עושה אותה מתאימה לארגונים שמאצלים תמיכת לקוחות, תפעול פנימי, או עבודה חזרתית של ידע שבה האמינות חשובה. FoundryAI מכוונת צוותים טכניים שצריכים יותר שליטה ממה שמציעים בנאי‑ללא‑קוד, אך רוצים איטרציה מהירה יותר מאשר בניית סוכנים מהיסוד.

חלוקת קריטריונים

Ease of use1
Value for money0
Features & power0
Integrations1
Support & docs0
Reliability0
  • סביבת בניית סוכנים
  • כלי הערכה ובדיקה
  • ניטור ביצועים
  • תמיכה באוטומציה של זרימות עבודה
  • לולאות שיפור איטרטיבי
  • שילוב עם מערכות עסקיות
8Helicone AI logo

Helicone AI

פלטפורמת נראות מקצה לקצה לניטור, ניפוי ושיפור אפליקציות LLM בייצור.

4.7 (6)
חינם
תמונה של Helicone AI

Helicone AI היא פלטפורמת נראות ממוקדת מפתחים, שנבנתה במיוחד עבור יישומים המונעים על ידי מודלים שפה גדולים. היא לוכדת בקשות, תגובות, עלויות ולטיות על פני ספקים, ונותנת לצוותים ההנדסיים תצוגה מאוחדת של התנהגות התכונות LLM שלהם בייצור. מעבר לרישום, Helicone מציעה כלים לניפוי בקשות, מעקב אחר זרימות עבודה של סוכנים רב-שלביים, הפעלת הערכות ומעקב אחר שימוש ברמת משתמש. צוותים יכולים לזהות רגרסיות, לשלוט בהוצאות ולשנות בקשות עם נתונים ולא עם ניחושים. היא משתלבת עם ספקי מודלים ומסגרות פופולריים באמצעות פרוקסי קל משקל או רישום אסינכרוני, מה שהופך אותו לפשוט להוסיף לערימות ק существующие ללא שינויים גדולים בקוד.

חלוקת קריטריונים

Ease of use0
Value for money0
Features & power1
Integrations0
Support & docs1
Reliability0
  • רישום בקשות ותגובות
  • מעקב אחר עלות ושימוש באסימונים
  • ניהול בקשות וגרסאות
  • מעקב אחר סוכנים והפעלות
  • הערכות ודוחות מותאמים אישית
  • אנליטיקה של משתמשים ומגבלות שיעור
9llm scout logo

llm scout

מעקב אחרי איך המותג שלכם מופיע ב‑ChatGPT, Claude, Perplexity וב‑Google AI Overviews.

4.8 (5)
חינם
תמונה של llm scout

LLM Scout הוא כלי ניטור מותגים שנבנה עבור עידן החיפוש הגנרטיבי. הוא עוקב אחרי איך החברה שלכם, המוצרים והמתחרים מוזכרים במגוון אסיסטנטים AI ומנועי תשובה, ומספק לצוותי השיווק ו‑SEO תובנות לערוץ שהכלים האנליטיים המסורתיים מפספסים. הפלטפורמה מריצה פקודות חוזרות על מערכות כמו ChatGPT, Claude, Perplexity ו‑Google AI Overviews, ולאחר מכן מדווחת על נתח הקול, סנטימנט, מקורות הציטוט ושינויים לאורך זמן. צוותים יכולים להשתמש בתובנות אלה כדי לחדד אסטרטגיית תוכן, לזהות פערים שבהם המתחרים מומלצים במקום, ולמדוד את השפעת מאמצי האופטימיזציה שמיועדים למודלים של שפה גדולים.

חלוקת קריטריונים

Ease of use0
Value for money1
Features & power1
Integrations0
Support & docs0
Reliability0
  • מעקב אחרי אזכורים של מותג ומתחרים
  • מעקב על פני ChatGPT, Claude, Perplexity ו‑AI Overviews
  • ניתוח סנטימנט ונתח הקול
  • צפייה במקורות הציטוט
  • מעקב אחרי פקודות מותאמות
  • דיווח על מגמות היסטוריות