Korábbi csata · 2023-12-10 UTC
Software Testing (QA) Agents Leszámolás — 2023. december 10.
A(z) Software Testing (QA) Agents kategóriából. 6 jelölés elhelyezve 2 versenyző között. Diffblue Cover szerezte meg a koronát.
Végeredmény
Skill Scanner
Diffblue CoverA felállás
A versenyzők
Minden eszköz profilja, amely ebben a csatában versenyzett, a végső pontszámuk szerint rangsorolva.

Diffblue Cover
Autonóm AI ügynök, amely javított precizitással generál és karbantart Java egységteszteket nagy skálán.

A Diffblue Cover egy autonóm AI ügynök, amely javított precizitással generál és karbantart Java egységteszteket nagy skálán. Ügynöke koordinálja a mesterséges intelligencia kódolást segítő eszközöket a részletgazdag, magas minőségű tesztfedettség létrehozásához, csökkentve az fejlesztői beavatkozás és a kézi teszt létrehozása szükségességét. Az ügynök a teljes kódalapot önállóan feldolgozza, beleértve a régi kódalapot is, megbízható teszteket előállítva folyamatos szóbeli iránymutatás vagy kontextus váltás nélkül. Kínálja eredmény alapú árazást, amely a generált értékkel skálázódik, így az a vonzó megoldás a nagyvállalatok számára, amelyek biztosan modernizálják a régi kódjaikat.
Kritériumok szétosztása
- Autonóm teszteredményezés
- Részletgazdag tesztfedettség
- Régikódalapsupport
- Eredmény alapú árazás
- Levonható platform kompatibilitás AI kódolást segítő eszközökkel

Skill Scanner
Nyílt forráskódú biztonsági skannerek, amely auditálja az AI-ügynök képességeit a késési injekciós és gáncskodó mintákra.

A Skill Scanner egy nyílt forráskódú statikus analizáló eszköz, amely biztonsági kockázatokat vizsgál a virtuális ügynök-készségekben és beágyazott pluginokban a legyártásuk előtt. Az eszköz bejegyzett készségek, utasítások és csomagolt kód vizsgálatát végez, szövegbeviteli kiszedő, elrejtett adatkihallgató- és gyanús kód minták után kutatva, amik bárki ügynökét vagy használóit veszélyeztetik. Az eredmények kiadása SARIF formátumban történik, ami megkönnyíti a hibák integrálását a CI folyamatokba, az összefoglalókba vagy a biztonsági panelbe, például a GitHub code scoutingba. A fejlesztők és a biztonsági csapatok segítségével megvizsgálhatják a harmadik féltől származó készségeket, megerősíthetik a saját összetevőiket és alapértelmezett ellenőrzéseket vezethetnek be az ügynökkörnyezeten keresztül. Mivel a projekt nyílt forráskódú, a szabályok és adatkörülmények bővíthetők vagy szabályozhatók, hogy megfeleljenek az szervezetének specifikus veszélymodelleknek és politikáinak.
Kritériumok szétosztása
- A prompt injekció minták észlelése
- Adat elszállítás heurisztikus értékelések
- Gáncskodó kód minták felkutatása
- SARIF jelentés kimenet
- CI/CD folyamat integráció
- Kiterjeszthető szabálykészlet