Tidligere kamp · 2023-12-10 UTC
Software Testing (QA) Agents Oppgjør — 10. desember 2023
Fra kategorien Software Testing (QA) Agents. 6 merker plassert på tvers av 2 kjempere. Diffblue Cover tok kronen.
Endelige plasseringer
Skill Scanner
Diffblue CoverOppstillingen
Kjemperne
Profiler av hvert verktøy som konkurrerte i denne kampen, rangert etter sin endelige poengsum.

Diffblue Cover
En autonom AI-agent som genererer og vedlikeholder Java-enhetstester i stor skala med garantert nøyaktighet.

Diffblue Cover er en autonom AI‑agent som genererer og vedlikeholder Java‑unit‑tester i stor skala med garantert nøyaktighet. Den orkestrerer AI‑kodingverktøy for å lage omfattende, høy‑kvalitets testdekning, og reduserer behovet for utviklerintervensjon og manuell testoppretting. Agenten behandler hele kodebasen autonomt, inkludert eldre kodebaser, for å produsere pålitelige tester uten behov for kontinuerlig prompting eller kontekstbytte. Den tilbyr resultatbasert prising som skalerer med den verdien som genereres, og gjør den til en attraktiv løsning for bedrifter som ønsker å modernisere legacy‑kode med selvtillit.
Kriteriumfordeling
- Autonom testgenerering
- Omfattende testdekning
- Støtte for eldre kodebaser
- Resultatbasert prising
- Plattformkompatibilitet med AI-kodingsverktøy

Skill Scanner
Åpen-sørskrevet sikkerhets-scanne-r som auditer AI-agents ferdigheter etter innleggsskjema-injektion og onde mønstre

Skill Scanner er et åpent kildekode-verktøy for statisk analyse bygd til å inspisere intelligente agents ferdigheter og pluginer på sikkerhetstrusler før de blir deployert. Verktøyet skanner skillets manifest, instruksjoner og innsprengte kode for tegn på prompt-injektion, skjulte forsøk på dataeksfiltrering og mistenkelige kodesnurror som kunne kompromittere en agent eller dens brukere. Resultatene sendes ut i SARIF format, noe som gjør det enkelt å integrere funnene i CI-pipelines, kodegranskingsflyt eller sikkerhetspaneler som GitHub code scanning. Utviklere og sikkerhetslag kan bruke det til å vurdere tredjepartssikkerheter, harden sine egne og gjennomføre basis kontroller på en agentekosystem. Da prosjektet er Åpne kilder, kan regler og detektorer utvides eller tilpasses til å tilfredsstille organisasjonsspesifikke truetmodeller og policies.
Kriteriumfordeling
- Deteksjon av innleggsskjema-injektionsmønster
- Heuristikk for dataeksfiltrering
- Skanning etter onde kode-mønster
- Utputt etter SARIF-standarde
- Integrering med CI/CD-pipeline
- Ekstendibart regelsett