Korábbi csata · 2024-03-14 UTC
Software Testing (QA) Agents Leszámolás — 2024. március 14.
A(z) Software Testing (QA) Agents kategóriából. 12 jelölés elhelyezve 4 versenyző között. Diffblue Cover szerezte meg a koronát.
Végeredmény
A felállás
A versenyzők
Minden eszköz profilja, amely ebben a csatában versenyzett, a végső pontszámuk szerint rangsorolva.

Diffblue Cover
Autonóm AI ügynök, amely javított precizitással generál és karbantart Java egységteszteket nagy skálán.

A Diffblue Cover egy autonóm AI ügynök, amely javított precizitással generál és karbantart Java egységteszteket nagy skálán. Ügynöke koordinálja a mesterséges intelligencia kódolást segítő eszközöket a részletgazdag, magas minőségű tesztfedettség létrehozásához, csökkentve az fejlesztői beavatkozás és a kézi teszt létrehozása szükségességét. Az ügynök a teljes kódalapot önállóan feldolgozza, beleértve a régi kódalapot is, megbízható teszteket előállítva folyamatos szóbeli iránymutatás vagy kontextus váltás nélkül. Kínálja eredmény alapú árazást, amely a generált értékkel skálázódik, így az a vonzó megoldás a nagyvállalatok számára, amelyek biztosan modernizálják a régi kódjaikat.
Kritériumok szétosztása
- Autonóm teszteredményezés
- Részletgazdag tesztfedettség
- Régikódalapsupport
- Eredmény alapú árazás
- Levonható platform kompatibilitás AI kódolást segítő eszközökkel

Skill Scanner
Nyílt forráskódú biztonsági skannerek, amely auditálja az AI-ügynök képességeit a késési injekciós és gáncskodó mintákra.

A Skill Scanner egy nyílt forráskódú statikus analizáló eszköz, amely biztonsági kockázatokat vizsgál a virtuális ügynök-készségekben és beágyazott pluginokban a legyártásuk előtt. Az eszköz bejegyzett készségek, utasítások és csomagolt kód vizsgálatát végez, szövegbeviteli kiszedő, elrejtett adatkihallgató- és gyanús kód minták után kutatva, amik bárki ügynökét vagy használóit veszélyeztetik. Az eredmények kiadása SARIF formátumban történik, ami megkönnyíti a hibák integrálását a CI folyamatokba, az összefoglalókba vagy a biztonsági panelbe, például a GitHub code scoutingba. A fejlesztők és a biztonsági csapatok segítségével megvizsgálhatják a harmadik féltől származó készségeket, megerősíthetik a saját összetevőiket és alapértelmezett ellenőrzéseket vezethetnek be az ügynökkörnyezeten keresztül. Mivel a projekt nyílt forráskódú, a szabályok és adatkörülmények bővíthetők vagy szabályozhatók, hogy megfeleljenek az szervezetének specifikus veszélymodelleknek és politikáinak.
Kritériumok szétosztása
- A prompt injekció minták észlelése
- Adat elszállítás heurisztikus értékelések
- Gáncskodó kód minták felkutatása
- SARIF jelentés kimenet
- CI/CD folyamat integráció
- Kiterjeszthető szabálykészlet

PentAGI
Nyílt forráskódú autonóm hídfestési ügynökök, amelyek az ellenőrzött Docker-szandbökben 20-nál több biztonsági eszközt futtathatnak az emlékezetesség és a webes intelligencia alapján.

A PentAGI egy nyílt forráskódú autonóm hídfestési ügynök, amely az ellenőrzött Docker-szabályrendszerben 20-nál több biztonsági eszközt futtat. Az eszköz mesterséges intelligencia technológiákat használ a biztonsági tesztelés automatizálására. Az eszközt informatikai biztonsági szakemberek és kutatók fejlesztették ki, akiknek egy hatékony és flexibilis megoldásra van szükségük a hídfestések elvégzéséhez. A jelentősek közé tartozó felektárterület különálló, azonnal végrehajtott feladattervezés, valamint a különböző eszközök és keresőrendszerek integrációja. A PentAGI delegálási rendszert, részletes felügyeletet és jelentést nyújt.
Kritériumok szétosztása
- Ellenőrzött Docker-környezet
- Beépített 20-nál több profi biztonsági eszköz
- Intelligens emlékezetrendszer hosszú távú tárolásra
- Ismeretegyüttes-integráció
- Webes intelligencia beépített böngészőn keresztül
- Külső keresőrendszerek integrációja

Keploy
Nyílt forráskódú AI-ügynök, amely automatikusan és fenntartja egység, integrációs és API teszteket a szimulációkkal.

A Keploy egy nyíltszínvonalú, mesterséges intelligencia-alapú tesztelési platform, ami az eBPF segítségével valóddisztifikált API forgalmat rögzít és újrareplíci CI-ben determinisztikus regressziós tesztekként, szintautomatikus mockolékként, valós idejű gyakorlemezési környezetekként nulla kódmódosítás mellett. Bármilyen programozási nyelvet és keretrendszert támogat, és az üzemeltetett felhőben elérhetővé válnak a fejlett funkciók. A Keploy ingyenes szintet kínál, ahol a fejlesztők 30 tesztelési csomaggal és 5 AI kredittel próbálhatják ki a platformot. A platform elérhető Pro szintben ($24/használó/hónap) és egy Enterprise szintben is, melyhez különleges támogatás és SOC2 / SLA került besorolás. Az OSS-kernel mindig ingyen hozzáférhető önellátáshoz. A platforma lehetővé teszi a fejlesztőknek, hogy rögzítsenek regressziós teszteket a valós API forgalom alapján, és azt a CI-be másolják át izolált körülmények között. Ez a folyamat milliszekundumokat vesz igénybe, ennél sokkal gyorsabb, mint a hagyományos tesztelési módszerek. A Keploy funkciói magukban foglalják a bármilyen nyelv és keretrendszer támogatását, az auto-pusztítások generálását és a kódváltás nélküli, a produkciós környezetekhez hasonló készenléti környezet fenntartását.
Kritériumok szétosztása
- Automatikusan generált szimulációk
- Termelési könyvtárakhoz hasonló környezetek
- Regressziós tesztek
- API forgalom rögzítése eBPF segítségével
- Bármilyen nyelv és keretrendszer támogatása



