Минала битка · 2024-07-18 UTC
Software Testing (QA) Agents Двубой — 18 юли 2024 г.
От категория Software Testing (QA) Agents. 16 гласове поставени сред 5 бойци. PentAGI грабна короната.
Финално класиране
Съставът
Бойците
Профили на всеки инструмент, който се състезава в тази битка, класирани по техния финален резултат.

PentAGI
Аутономниот отворен源 автопроверъчен агент, който изпълнява над 20-те сигурносни инструменти в изолирания Docker sandbox с памет и веб интелект.

PentAGI е апачна, автономна агент за пробен пробуване на безопасност, която се провежда над 20+ безопасностни инструменти в изолирен Docker контейнер. Утилитата ползва изкуствена интелигентност за автоматизиращ безопасностно тестващ. Инструментът е проектиран за професионалисти и разследвали за информационна безопасност, които нуждаят се на мощен и преходен вариант за провеждане на проба на пробите. Основни функции включват изолиран окръглив свят, автоматизирано планове на задачите и интеграция с различни инструменти и търсачки системи. PentAGI също така предлага система за делегиране, обемна следящи състояние и подробни доклади.
Разбивка на критериите
- Изолирания Dockerокорен виртуален среда
- Вградената колекция от над 20 професионални сигурносни инструмента
- Умна система за памет със заява на дълъг срок
- Интеграция на граф за познаване
- Веб интелект чрез вграден броузър
- Интеграция на външни системи за търсене

Skill Scanner
Отворен източник сигурностен сканиращ инструмент, който изпълнява аудит на уменията на AI агент за инжекцията на предизвикателства и вредни модели.

Skill Scanner е отворен源 код статичен анализатор, проектиран да изследва уменията на агента за AI и плъгините за рискове за сигурност преди да бъдат разпространени. Той сканира данните за уменията, инструкциите и изпъкналата кодова база за знаци на възможни нападения с въпроси, скрити опити за отваряне на данни и подозрителни шаблони в кода, които могат да компрометират агента или потребителите му. Резултатите се излизат в САРИФ формат, което прави интеграцията на находките в ЦИ пайплайни, ревю на кода или секьюрити дашбордови, като GitHub код сканинг, лесно и ефективно. Налиците и команди за сигурност се използват за изпитване на трети рицарски умени, хардането на свои и налагане на базовите проверки в една агенска екосистема. Поради това, че проектът е отворен за общността, правилата и детектори могат да бъдат разширени или персонализирани, за да отговарят на организационните модели за рискове и политики.
Разбивка на критериите
- Детекция на модели за инжекция на предизвикателства
- Георгианство на данни извличателни хитове
- Сканер на вредни кодови модели
- Изход на отчет SARIF
- Програма за интеграция в CI/CD
- Разширяемо набор на правилата

Diffblue Cover
Автономен агент на AI, предназначен за генериране и поддържане на единични изпитания за Java на мащаби с гарантирана точност.

Diffblue Cover е самостоятелна AI агента, която генерира и поддържа изцяло Java единични тести при масовата производителност с гаранция за точност. Тя организира AI-кодови инструменти за създаване на обхватна високо-квалитетна покривност, намалявайки нуждата от интервенцията на разработчиците и ръчно създаване на тестове. Агентът обработва цялото кодов набор самостоятелно, включително и стари кодови бази, за да произвежда надеждни тестове без постоянно пълнотекстовно натискане или контекстно изклучване. Оферата ѝ съдържа резултатна цена, която се увеличава според генерираната стойност, което я прави привлекателна решение за предприятията, които търсят да модернизират стари кодови бази със съмнение.
Разбивка на критериите
- Автономно генериране на изпитания
- Обхват на изпитанията
- Поддържане на legacy кодове
- Bазирана на резултата ценова политика
- Пригоден за платформи с AI кодови инструменти

Flowtest AI
Агент за интелектуална помощ, който наблюдава уебсайтове чрез изкуствено симулирано потребителско взаимодействие с цел детектиране на проблеми и гарантиране на работоспособност.

Flowtest AI е уеб мониторингово изделие, силно подкрепяно от изкуствена интелигенция, проектирано да мимикрира реални потребителски интеракции на уеб ситета. Неговата основна функция е да детектира проблеми и да осигури работещите часове на веб приложенията чрез имитацията на начина, по който потребителите взаимодействат с уеб ситета. С тази подход се осигурява обективно извличане на данни, което преодолява традиционните методи на мониторинга. Flowtest AI вероятно се насочва към компаниите и организираните институции, които се състои на онлаин присъствие, предоставейки им информация за изпълняването и надеждността на уеб сайта. Откривайки потенциалните проблеми преди да повлияят на потребителите, Flowtest AI помага за запазване на съвършена потребителска експериментация. Инструментът си работа по да обучава поведението на реални потребители и след това преплитал тези интеракции, за да се тества за грешки, дадени часа или други проблеми, които може да отхвърлят потребителската експериментация. Сравни с другите мониторингови решения, Flowtest AI използва на AI за симулираните интеракции на потребителя, която предлага по-натурален възприятия от изпълняването на веб сайта. Въпреки това, характеристиките и пълната информация за оперативната механика на Flowtest AI, са малко известни. Някои от потенциалните преимущества на използване на Flowtest AI включват подобрено изпълнение и работещи часа на уеб сайта, подобрена потребителска експериментация и първоначална детектор на проблеми. На друг страна пък, ограниченията и потенциалните недостатъци на Flowtest AI не са добре разчетени без съответстващи конкретни данни за функциите и функцията на Flowtest AI. Макар да няма подходящи данни за характеристиките и механиката му, Flowtest AI и подобни инстументи представляват нови изобретения при мониторинга на уеб ситета, което отразява растяща важността на AI за спазване на качества и способноста на онлайн услугите.
Разбивка на критериите

Keploy
Отворен‑източников AI агент, който аутоматизира и поддържа единични, интеграционни и API тестира с моки.

Keploy е отворен سورс, AI-обусловен платформата за тестване, който хване реалните трафик на API с eBPF и ги реплицира в CI като определена регрессия на тестове, аутоматизирани имитации и продукционно подобни sandbox-а с нищо промени code. Поддържа всеки език (Go, Java, Python, Node.js, Rust, PHP, Ruby) и всяка рамка. Известните функции са достъпни чрез управляемата облак. Кеплой offers free tier, където разработчиките могат да изпробват платформата с 30 пробни сесиите на месец и 5 кредита на AI. Платформата също е подходяща за Pro tier ($24 на потребител/месец) и Enterprise tier с персонализирана поддръжка и SOC2/SLAs. Върхът на OSS останава за самия себе да е достъпен бестрешен вечно. Платформата позволява разработчици да регистрират ритърсивни тестове от реален трафик на API и да ги решият в CI като изолирани сандауни. Този процес изисква милисекунди, прави него много по-бързо от традиционните методи за тестване. Физичните характеристики на Keploy включват възможността да поддържатвсякаква език и фреймворк, генериране на автоматични mock-ове, и поддържане на среда за разработка с производствени характеристики без изменение на кода.
Разбивка на критериите
- Автогенерирани моки
- Сandbox с подобрена производителност на производството
- Тестиращи рилигационни тести
- Каптура на API трафик чрез eBPF
- Поддръжка на всяка програмна език и фреймворк
- API traffic capture with eBPF




