Минала битка · 2024-03-14 UTC
Software Testing (QA) Agents Двубой — 14 март 2024 г.
От категория Software Testing (QA) Agents. 12 гласове поставени сред 4 бойци. Diffblue Cover грабна короната.
Финално класиране
Съставът
Бойците
Профили на всеки инструмент, който се състезава в тази битка, класирани по техния финален резултат.

Diffblue Cover
Автономен агент на AI, предназначен за генериране и поддържане на единични изпитания за Java на мащаби с гарантирана точност.

Diffblue Cover е самостоятелна AI агента, която генерира и поддържа изцяло Java единични тести при масовата производителност с гаранция за точност. Тя организира AI-кодови инструменти за създаване на обхватна високо-квалитетна покривност, намалявайки нуждата от интервенцията на разработчиците и ръчно създаване на тестове. Агентът обработва цялото кодов набор самостоятелно, включително и стари кодови бази, за да произвежда надеждни тестове без постоянно пълнотекстовно натискане или контекстно изклучване. Оферата ѝ съдържа резултатна цена, която се увеличава според генерираната стойност, което я прави привлекателна решение за предприятията, които търсят да модернизират стари кодови бази със съмнение.
Разбивка на критериите
- Автономно генериране на изпитания
- Обхват на изпитанията
- Поддържане на legacy кодове
- Bазирана на резултата ценова политика
- Пригоден за платформи с AI кодови инструменти

Skill Scanner
Отворен източник сигурностен сканиращ инструмент, който изпълнява аудит на уменията на AI агент за инжекцията на предизвикателства и вредни модели.

Skill Scanner е отворен源 код статичен анализатор, проектиран да изследва уменията на агента за AI и плъгините за рискове за сигурност преди да бъдат разпространени. Той сканира данните за уменията, инструкциите и изпъкналата кодова база за знаци на възможни нападения с въпроси, скрити опити за отваряне на данни и подозрителни шаблони в кода, които могат да компрометират агента или потребителите му. Резултатите се излизат в САРИФ формат, което прави интеграцията на находките в ЦИ пайплайни, ревю на кода или секьюрити дашбордови, като GitHub код сканинг, лесно и ефективно. Налиците и команди за сигурност се използват за изпитване на трети рицарски умени, хардането на свои и налагане на базовите проверки в една агенска екосистема. Поради това, че проектът е отворен за общността, правилата и детектори могат да бъдат разширени или персонализирани, за да отговарят на организационните модели за рискове и политики.
Разбивка на критериите
- Детекция на модели за инжекция на предизвикателства
- Георгианство на данни извличателни хитове
- Сканер на вредни кодови модели
- Изход на отчет SARIF
- Програма за интеграция в CI/CD
- Разширяемо набор на правилата

PentAGI
Аутономниот отворен源 автопроверъчен агент, който изпълнява над 20-те сигурносни инструменти в изолирания Docker sandbox с памет и веб интелект.

PentAGI е апачна, автономна агент за пробен пробуване на безопасност, която се провежда над 20+ безопасностни инструменти в изолирен Docker контейнер. Утилитата ползва изкуствена интелигентност за автоматизиращ безопасностно тестващ. Инструментът е проектиран за професионалисти и разследвали за информационна безопасност, които нуждаят се на мощен и преходен вариант за провеждане на проба на пробите. Основни функции включват изолиран окръглив свят, автоматизирано планове на задачите и интеграция с различни инструменти и търсачки системи. PentAGI също така предлага система за делегиране, обемна следящи състояние и подробни доклади.
Разбивка на критериите
- Изолирания Dockerокорен виртуален среда
- Вградената колекция от над 20 професионални сигурносни инструмента
- Умна система за памет със заява на дълъг срок
- Интеграция на граф за познаване
- Веб интелект чрез вграден броузър
- Интеграция на външни системи за търсене

Keploy
Отворен‑източников AI агент, който аутоматизира и поддържа единични, интеграционни и API тестира с моки.

Keploy е отворен سورс, AI-обусловен платформата за тестване, който хване реалните трафик на API с eBPF и ги реплицира в CI като определена регрессия на тестове, аутоматизирани имитации и продукционно подобни sandbox-а с нищо промени code. Поддържа всеки език (Go, Java, Python, Node.js, Rust, PHP, Ruby) и всяка рамка. Известните функции са достъпни чрез управляемата облак. Кеплой offers free tier, където разработчиките могат да изпробват платформата с 30 пробни сесиите на месец и 5 кредита на AI. Платформата също е подходяща за Pro tier ($24 на потребител/месец) и Enterprise tier с персонализирана поддръжка и SOC2/SLAs. Върхът на OSS останава за самия себе да е достъпен бестрешен вечно. Платформата позволява разработчици да регистрират ритърсивни тестове от реален трафик на API и да ги решият в CI като изолирани сандауни. Този процес изисква милисекунди, прави него много по-бързо от традиционните методи за тестване. Физичните характеристики на Keploy включват възможността да поддържатвсякаква език и фреймворк, генериране на автоматични mock-ове, и поддържане на среда за разработка с производствени характеристики без изменение на кода.
Разбивка на критериите
- Автогенерирани моки
- Сandbox с подобрена производителност на производството
- Тестиращи рилигационни тести
- Каптура на API трафик чрез eBPF
- Поддръжка на всяка програмна език и фреймворк
- API traffic capture with eBPF



