Минала битка · 2026-07-24 UTC
Observability Двубой — 24 юли 2026 г.
От категория Observability. 21 гласове поставени сред 9 бойци. Coval (YC S24) грабна короната.
Финално класиране
Съставът
Бойците
Профили на всеки инструмент, който се състезава в тази битка, класирани по техния финален резултат.

Coval (YC S24)
Платформа за симулация и оценка на източниките за разговор и гласов сървър при масово тестване.

Coval е платформата на разработчика, проектирана да симулира, потвърждава и оценява AGI агенции преди да дойдат до производството. На тази платформа е възможно отбора да провеждат хиляди синтетични разговори срещу говора или чата ниановете си, изчислявайки как те справят с границните случаи, прекъсванията, изискванията за инструменти и множествено-повторния диалог. Подкрепени от Y Combinator (S24), себе си поставя на руптура като „апликация за самодвижещи се коли“ по отношение на издръжливостта на агентите, като прилага упорито симулация-предоставящо тестироване на конверзационна интелектуална машина. Иженерите могат да определете сценарии, да изпробват производството трафик, да оценяват изходните данни според лични методи за оценка и да проследяват регреси от агентните версии. Платформата се насочва към екипи, които изпращат клиентски лица в поддръжка, продажби и операции, където достоверност и последователност са критични за деплояване.
Разбивка на критериите
- Масово симулиране на разговор
- Тестване на сървър за глас с реалистичен диалог
- Кастомна оценка на метрици и оценка
- Преглед на регресия по версиите на сървърите
- Генерация на сценарии и случаи на граници
- Възпроизвеждане на реално трафик към производство

Fiddler AI
Платформа за наблюдение и сигурност на AI за monitorirane, обяснения и управление на приложенията на ML и LLM.

Фидлер АИ е бизнес платформа, която помага тимовете да следят, анализират и поддържат безопасността на машинните обучителни модели и апликации за генеративен АИ в произволен режим. Тя предлага прозрачност в изпълнение на модела, възможност за дрейф на данните, предразсъдъчен образец и проблемите със качеството, както и безопасни защити срещу рискове, специфични за LLM като галванизация, вливане на стимул, и небезопасното извлекване от данните. Намерен за инженери по ML, учени по данни и отбори за рискове и поддържане на изпълнение на закони, Fiddler съчетава обяснителност, реално време мониторинг и огради в единна работна среда. Интегрира се с обичайни пейсинове за ML и облакови средовирища, помагайки организици да изпълняват отговорни практики за AI на величина.
Разбивка на критериите
- Панели със следене на модела и дрейф на моделите
- Детекция на халвинация и безопасност на LLM
- Промяна и защита от външни намерения с инжекция на промоти
- Обяснение на AI и анализ на причините
- Оценка на съмнението и сбалансированост
- Панели със следене и uyar за AI в продукционен режим

Future AGI
Платформа, която подобрява точността на AI чрез всеобхватни оценки и оптимизиращи инструменти.

Бъдещият AGI е платформа, която подобрява准странността на AI чрез съвкупно изследване и оптимизация на инструменти. Няма възможност за потребителите да създават самодържащи се агенти, да откриват проблема и да знаят защо. Платформата предлага гама на функции, включително оценка на агента, оптимизация и виртуални разговори. Потребителите могат да създават и управляват сценарии, а платформата предлага аналии и инструменти за оптимизация за подобряване на изпълнителната ефективност на агента. Предиизвестният AGI изглежда отговаря на развитието на разработчици и бизнес-управленци, които търсят да разпространят AI-изобрани chattbots и агенти. Той позволява на потребителите да симулират разговори, да оценяват и оптимизират работата на агента, и да се интегрират със знание бази. Платформата се изглежда като утилита за развитието на разработчици, създаване и подобряване на AGI агенти, вместо на потребителската интерфейс. Платформата предлага функции като оценка на агенти, симулирани разговори и управление на сценарии. Тя позволява на потребителите да редактират и управляват въпросите, да добавят стъпки за извличане на знания за статии от базата данни и да интегрират с глобални въпроси за решения на сложни проблеми. Въпреки че Future AGI предлага ценна функционалност за развитието и оптимизирането на AI технологиите, то също така е ограничено. Например, то се събира на общия знания и може да изисква допълнителни действия, когато се справя с по-сложни сценарии. В допълнение като платформата използва симулирани разговори, то може да бъде ограничено да се справи с реалните свързани с неопределеностите. Виждало се, че Футура АГИ предлага уникална гама функции за развитие и оптимизация на AI. Неговите обстринали използвани и оптимизационни инструменти го прави ценен ресурс за разработчици, набитли да измийт своя агент AI. Въпреки това, може да бъде нужна допълнителна разработка или интеграция, за да се справят с по-сложни сценарии и съществени неопределености от реалния свят.
Разбивка на критериите
- Оценка и рангуване на агенти
- Симулирани разговори и управление на сценарии
- Вградяване и извличане от базата на знаения
- Обхватни хандли за сложни ситуации
- Анализи и оптимизиращи инструменти


На уебсайта на проекта AI2AI потребителите могат да наблюдават реално-часови разговори между двама агента за интелектуална среда (AI). За да започнат взаимодействието, потребителите трябва да създадат два обекта, назначавайки им зададена промпта, контекст, глас, полу и да изберат модел на езика (Language Model). Взаимодействието може да се започне, запази и да се поделя със зарегистрирани потребители на сайта. Предоставени са примерни взаимодействия, показващи различни сценарии, като например осъждане, гняв, любопитство и предлагане на продажби. Нови потребители трябва да се регистрират и да получат $1 кредити за да изследват платформата. Цената е основана на минутен тариф, започвайки от 1 цент с минута.
Разбивка на критериите
- Вживакъм разгледане на онлайн диалог между AI
- Въпросните двата ентитета за AI са в диалог
- Наблюдателна и безинтервенстивна потребителска опития
- Представяне на емергентния AI поведение
- Достъпна browser-based интерфейс

Arize AI
Платформа за наблюдение на ИИ и оценка на LLM, която помога на разработчиците на ИИ и учените данни да следят, отстраняват грешки и подобряват производителността...

Arize AI е платформа за наблюдаване на AI и оценка на LLM. Тя помага на разработчиците на AI и данните на учени за наблюдение, разбиране и подобряване на ефективността на нейните моделите на AI. Платформата предоставя инструменти за идентифициране на проблеми и предлагане на решения, помагайки потребителите да подобрят точността и надеждността на моделите си. Arize AI е проектирана за разработчиците на AI и данните на учените, които трябва да оптимизират ефективността на моделите си. Възможностите на платформата включват наблюдение и разбиране на проблема, което позволява бързо да се определат и да се решат проблеми. Arize AI също така предоставя функции за оценяване и подобряване на ефективността на модела, което позволява на потребителите да подобрят моделите им по време. Следвайки Arize AI, потребителите могат да се уверят, че моделите на AI на тях ефективно функционират, което води до по-добри решения и резултати. В съответствие със фокуса на платформата на наблюдаване и оценка, тя се различава от другите инструменти за развитие на AI, като прави една ценна ресурс за разработчиците на AI, които работят с големи модели на език и други сложни системи на AI.
Разбивка на критериите
- Monitorинг на моделите на интелектния съветник
- Решаване на проблемите и определение на причините
- Предложение на мнения за изправяне на проблемите
- Оценка на performansите на модела
- Оценка и оптимизация на модела на голяма база на данни (LLM)

Edwin AI
Агент за ИТ операции, който ускHEMA обажданията на инцидентите, класификацията и решаването им.

Edwin AI е интегриран извършителен агент за IT операции, дизайниран да улесни изолацията, тримасажа и изясняването на инциденти. предоставя centralized платформа на IT съставите за изследване на инциденти, за да намерят или създадат наемни фикси, и да бъдат приложени в съществуващите инструменти без да се претърпяват изменения между системи. Edwin AI корелейзира съобщения за тревога, идентифицира основни причини и тригерява аварийна лампа автоматично, започвайки от първата тревога до потвърдения рехабилирането. Следва от исторически модели и данни за наблюдимост за предпазване и предвидение на изключване. Инструментът интегрира с над 3 000 инструменти в областта на наблюдаването, APM, сигурността и CMDB, осигурявайки действайки в мъдрината, действителен изглед и премахване на изолации. Наблюдаването на Фортьер съобщи, че Edwin AI предоставил 313% ROI за обединен организационен състав, с периода на въръщане на инвестицията на 6 месеца или по-малко.
Разбивка на критериите
- Аutomатично корелефиране на аларми и намаляване на шума
- Предложения на коренните причини, управлявани от AI
- Натурално-езикови кратки сумаризации на инциденти
- Свързвания с платформи за ITSM и наблюдение на системи
- Автоматизирани роботи за класификация на инциденти
- Скъпиране на знания от изминали инциденти


Платформата FoundryAI е развитие на фокусирано намиране на AI агенти, които обслужват действителните бизнес протоколи. Съчетава инструменти за дизаин на агент, пробен процес и непрекъснат процес на подобряване, така че тимовете могат да преминат от прототип към производство без да съединяват отделни системи. Платформата се състои от изящественото оценяване, което дава създателите възможност да оценяват работата на агента според дефинирани задачи и да подобряват поведенето му през времето. Това го прави подходящ за организациите, които използват автоматизация за поддръжка на клиенти, вътрешни операции или повтарящи се задачи с познания, където също така е важно за надеждността. ФъндрайЕЙ има за цел техническите тимове, които имат нужда от повече контрол от този, който предлагат нискокодовите инструменти, но искат по-бързи експерименти, отколкото ако създават агенти изцяло от изначално.
Разбивка на критериите
- Образователен среда за създаване на агенти
- Инструменти за оценка и проверка
- Наблюдение върху изпълнението
- Поддръжка на автоматизацията на процеси
- Итеративни цикли на подобряване
- Интегриране със системи за бизнес
Helicone AI
Всебирна платформа за наблюдение, отбелязване и усъвършенстване на производствени приложения с LLM.
Хеликейн е разпространителска платформа, съсредоточена върху разработчиците, създадена специално за приложения, използващи големи модела на езика. Тя записва издаваните запитвания, отговорите, разходите и задължителната задържаност из средата на провайдъри, осигурявайки създателските отбори обединение гледна точка за начина на нашия LLM характеристики се изявяват в производства. Нараствявайки над записите изходяше от тях, Helicone предлага инструменти за отгласни за изтребване на грешки, следене на потоци на агенти с множество етапа, изпълнение на оценки и отчитане на използване при потребителско ниво. Съвместителските екипировки могат да разпознаят регресии, управляват разходите и дават шанс да подготвят изстроя с данни без да полагат на голямата теория. Включва се в популярните доставчици на модела и фреймворки чрез лековеждаща среда за сървър или асинхронен лог, което прави добавянето му в съществуващи стъкло лесно, без необходимост от значителни модификации в кода.
Разбивка на критериите
- Регистриране на заявки и отговори
- Намиране и отслежване на експенсове и токени
- Управление и версия използване на предимства
- Следене и агент-сеансна трасировка
- Тактилни оценки и конзоли за dashboard
- Анализа на потребители и лимитиране на скорост за извеждане на данни

llm scout
Наблюдавайте как се появява марката ви в рамките на ChatGPT, Claude, Perplexity и Google AI Обзорите.

LLM Scout е уеб мониторингов инструмент, проектиран за епохата на изчислителното търсене. Той следи отбелязванията на вашата компания, продукти и съперници в основните асистенти за изчислительно търсене и системи за отговори, предаваща визуализация на пиар и SEO тимовете в канал, който обикновените програми за анализи пропускат. Платформата използва преходящи заявки за тестване против системи като ChatGPT, Claude, Perplexity и AI превизначения на Google, след което извършва отчети за делът от гласът, настроението, цитираните източници и промени във времето. Отборите могат да използват тези съображения за доработка на стратегията за съдържание, определяне на пробели, в които съперниците са препоръчвани по-често вместо този, който е необходимо, и мерище въздействието на оптичните усилия за оптимизацията при големи модела на езика на програмиране.
Разбивка на критериите
- Monitorване на споменавания на бранда и конкурентите
- Наблюдаване в рамките на ChatGPT, Claude, Perplexity и AI Обзорите
- Анализа на настроенията и дялът на гласа
- Показване на цитатите и видимостта на източника
- Предварителен мониторване на промптове
- Отчети за исторически тенденции







