Tidigare batalj · 2023-12-10 UTC
Software Testing (QA) Agents Uppgörelse — 10 december 2023
Från kategorin Software Testing (QA) Agents. 6 markeringar placerade över 2 kämpar. Diffblue Cover tog kronan.
Slutställning
Skill Scanner
Diffblue CoverUppställningen
Kämparna
Profiler av varje verktyg som tävlade i den här bataljen, rankade efter sin slutpoäng.

Diffblue Cover
En självständig AI-agent som genererar och underhåller Java enhetstester på stor skala med garanterad precisnost.

Diffblue Cover är en autonom AI-agent som genererar och underhåller Java-enhetstester i skala med säkerställd precision. Den orkestrerar AI-kodverktyg för att skapa omfattande högkvalitativa testomfattning, vilket minskar behovet av utvecklarintervention och manuell testskapande. Den autonoma agenten bearbetar hela kodbasen själv, inklusive legacy-kodbasen, för att producera tillförlitliga tester utan kontinuerligt utlysande eller kontextbyten. Den erbjuder resultatbaserad prisering som skalar efter värdet som genereras, vilket gör det till en attraktiv lösning för företag som är ute efter att modernisera legacy-kod med säkerhet.
Radbrytning av kriterier
- Självständig testgenerering
- Omfattande testomfång
- Stöd för legendarisk kodbase
- Prissättning beroende på resultat
- Kompatibilitet med plattformar för AI-utvecklingstjänster

Skill Scanner
Öppen källkodssäkerhets-scanner som granskar AI-agentfärdigheter för promptinjektion och farliga mönster.

Skill Scanner är en öppen källkod baserad statisk analysverktyg byggt för att inspektera kunskapsmodulens och plugin-programmens säkerhetsrisker innan de deployas. Verktyget ronar efter kunskapsmanifest, instruktioner och inbyggd kod för tecken på prompt injicering, dolda dataöverföringsförsök och misstänkta kod mönster som kan kompromettera en agent eller dess användare. Resultaten utnyttjas i SARIF-format, vilket gör det lätt att integrera fynden i CI-pipelinor, verktyg för kodgranskning eller säkerhetsdashboard som GitHub code scanning. Utvecklare respektive säkerhetslag påbörjar med att granska tredjepartsfunktioner, förstärka deras egna och upprätthåller grundläggande kontroller över en agentekosystem. Eftersom projektet är öppen källkod, kan regler och detektorer förlängas eller anpassas för att passa organisationens specifika hotbilder och policayer.
Radbrytning av kriterier
- Detektion av promptinjektionsmönster
- Heuristik för dataflykt
- Sökning efter farliga kodmönster
- Utdata i SARIF-format
- Integrering i CI/CD-pipelines
- Utbyggnadssät för regler