Tidigare batalj · 2024-03-14 UTC
Software Testing (QA) Agents Uppgörelse — 14 mars 2024
Från kategorin Software Testing (QA) Agents. 12 markeringar placerade över 4 kämpar. Diffblue Cover tog kronan.
Slutställning
Uppställningen
Kämparna
Profiler av varje verktyg som tävlade i den här bataljen, rankade efter sin slutpoäng.

Diffblue Cover
En självständig AI-agent som genererar och underhåller Java enhetstester på stor skala med garanterad precisnost.

Diffblue Cover är en autonom AI-agent som genererar och underhåller Java-enhetstester i skala med säkerställd precision. Den orkestrerar AI-kodverktyg för att skapa omfattande högkvalitativa testomfattning, vilket minskar behovet av utvecklarintervention och manuell testskapande. Den autonoma agenten bearbetar hela kodbasen själv, inklusive legacy-kodbasen, för att producera tillförlitliga tester utan kontinuerligt utlysande eller kontextbyten. Den erbjuder resultatbaserad prisering som skalar efter värdet som genereras, vilket gör det till en attraktiv lösning för företag som är ute efter att modernisera legacy-kod med säkerhet.
Radbrytning av kriterier
- Självständig testgenerering
- Omfattande testomfång
- Stöd för legendarisk kodbase
- Prissättning beroende på resultat
- Kompatibilitet med plattformar för AI-utvecklingstjänster

Skill Scanner
Öppen källkodssäkerhets-scanner som granskar AI-agentfärdigheter för promptinjektion och farliga mönster.

Skill Scanner är en öppen källkod baserad statisk analysverktyg byggt för att inspektera kunskapsmodulens och plugin-programmens säkerhetsrisker innan de deployas. Verktyget ronar efter kunskapsmanifest, instruktioner och inbyggd kod för tecken på prompt injicering, dolda dataöverföringsförsök och misstänkta kod mönster som kan kompromettera en agent eller dess användare. Resultaten utnyttjas i SARIF-format, vilket gör det lätt att integrera fynden i CI-pipelinor, verktyg för kodgranskning eller säkerhetsdashboard som GitHub code scanning. Utvecklare respektive säkerhetslag påbörjar med att granska tredjepartsfunktioner, förstärka deras egna och upprätthåller grundläggande kontroller över en agentekosystem. Eftersom projektet är öppen källkod, kan regler och detektorer förlängas eller anpassas för att passa organisationens specifika hotbilder och policayer.
Radbrytning av kriterier
- Detektion av promptinjektionsmönster
- Heuristik för dataflykt
- Sökning efter farliga kodmönster
- Utdata i SARIF-format
- Integrering i CI/CD-pipelines
- Utbyggnadssät för regler

PentAGI
Öppen-sources autonomiska penetrationstestagenter som körs på 20+ säkerhetsverktyg i en isolerad Docker-sandbox med minne och webbintelligens.

PentAGI är en öppen-källkod autonomin penetrerings testnings agent som körs av 20+ säkerhetsverktyg i en isolerad Docker sandwich. Den använder artificiell intelligens teknologier för att automatisera säkerhets testing. Verktyget är utformat för informationssäkerhetsproffs och forskare som behöver en kraftfull och flexibel lösning för att genomföra penetrations tester. Nyckelfärdigheter inkluderar ett sandboxat utrymme, automatiserat uppgiftsplanering och integration med olika verktyg och sökningssystem. PentAGI erbjuder också en delegeringssystem, ingripande övervakning och detaljerade rapporten.
Radbrytning av kriterier
- Isolerad Docker-miljö
- Inbyggt verktygsamhang på 20+ professionella säkerhetsverktyg
- Smart minnesystem för långsiktig lagring
- Kunskapsgraf-integrering
- Webbintelligens via inbyggd webbläsare
- Externa söksystem-integrering

Keploy
En öppen källkods-AI-agent som auto-genererar och underhåller enhets-, integrations- och API-tester med mock-objekt.

Keploy är en open-source, AI-driven testplattform som fångar upp riktigt API-trafik med eBPF och återger den i CI som deterministiska regressions tester, automatiskt genererade mockobject och produktionsliknande sandlådor utan några kodändringar. Den stöder alla språk (Go, Java, Python, Node.js, Rust, PHP, Ruby) och alla ramverk. Avancerade funktioner är tillgängliga via den hanterade molntjänsten. Keploy erbjuder en kostnadsfri nivå där utvecklare kan testa plattformen med 30 testsviter/månad och 5 AI-krediter. Plattformen finns också tillgänglig i en Pro-nivå (24 dollar per användare/månad) och en Enterprise-nivå med anpassat stöd och SOC2/SLA. Kärnan som öppen källkod förblir kostnadsfri för självvärdning i obegränsad tid. Plattformen låter utvecklare spela in regressions_tester från riktigt API-trafik och upprepa dem i CI som isolerade sandlådor. Denna process tar millisekunder, vilket gör den mycket snabbare än traditionella testmetoder. Keploys funktioner inkluderar möjligheten att stödja vilket språk och ramverk som helst, generera auto-mocks och underhålla produktionsliknande sandlådor med noll kodändringar.
Radbrytning av kriterier
- Auto-genererade mock-objekt
- Produktionsliknande sandlådor
- Regressions-tester
- API-trafikavkodning med eBPF
- Stöd för alla språk och rammverk
- Support for any language and framework



