Mennyt taisto · 2024-07-18 UTC
Software Testing (QA) Agents Yhteenotto — 18. heinäkuuta 2024
Kategoriasta Software Testing (QA) Agents. 16 merkkiä asetettu 5 taistelijan kesken. PentAGI otti kruunun.
Lopulliset sijoitukset
Kokoonpano
Taistelijat
Profiilit jokaisesta työkalusta, joka kilpaili tässä taistossa, järjestettynä lopullisen pistemääränsä mukaan.

PentAGI
Avoimen lähdekoodin autonomiset tunkeutumistestausagentit, jotka ajavat yli 20 turvallisuustyökalua eristetyssä Docker-sandboxesissa käyttäen muistia ja web-älykkyyttä.

PentAGI on avoimen lähdekoodin autonominen tunkeutumistestausagentti, joka suorittaa yli 20 turvallisuustyökalua eristettyssä Docker-hiekkalaatikossa. Se hyödyntää tekoälytekniikoita automatisoidakseen turvallisuustestausta. Työkalu on suunniteltu tietoturva‑ammattilaisille ja tutkijoille, jotka tarvitsevat tehokkaan ja joustavan ratkaisun tunkeutumistestausten suorittamiseen. Keskeisiä ominaisuuksia ovat hiekkalaatikkoympäristö, automatisoitu tehtäväsuunnittelu ja integraatio eri työkalujen ja hakujärjestelmien kanssa. PentAGI tarjoaa myös delegointijärjestelmän, kattavan valvonnan ja yksityiskohtaiset raportit.
Kriteerien jakautuminen
- Eristetty Docker-ympäristö
- Sisäänrakennettu paketti, jossa yli 20 ammatillista turvallisuustyökalua
- Älykäs muistijärjestelmä pitkäaikaista tallennusta varten
- Tietägraafin integraatio
- Web-älykkyys sisäänrakennetun selaimen kautta
- Ulkoisten hakujärjestelmien integraatio

Skill Scanner
Avoimen lähdekoodin tietoturvaskanneri, joka tarkastelee AI-agenttien taitoja promptin injektiosta ja haitallisista malleista.

Skill Scanner on avoimen lähdekoodin staattinen analyysityökalu, joka tarkastaa AI-agenttien taidot ja lisäosat mahdollisten turvallisuusriskien varalta ennen niiden käyttöönottoa. Se skannaa taitojen manifestit, ohjeet ja pakatun koodin merkkejä prompt-injektioista, piilotetusta tiedon exfiltroinnista ja epäilyttävistä koodimalleista, jotka voisivat uhata agenttia tai sen käyttäjiä. Skill Scanner tuottaa tulokset SARIF-muodossa, mikä tekee löydösten integroinnista helppoa CI-putkuihin, koodikatselun työnkuluihin tai turvallisuustoimialustoihin kuten GitHubin koodiskannaus. Kehittäjät ja turva-asiantuntijat voivat käyttää sitä kolmannen osapuolen taitojen tarkastamiseen, omien taitojen vahvistamiseen ja perustason tarkastusten toteuttamiseen agenttien ekosysteemissä. Koska projekti on avoimen lähdekoodin, sääntöjä ja detektoreita voidaan laajentaa tai mukauttaa organisaation omiin uhka‑malliin ja politiikoihin.
Kriteerien jakautuminen
- Promptin injektiomallien havaitseminen
- Datan exfiltraation heuristiikat
- Haitallisten koodimallien skannaus
- SARIF-raporttien luonti
- CI/CD-putken integrointi
- Laajennettavissa oleva sääntöjoukko

Diffblue Cover
Autonominen AI-agentti, joka luokittelee ja ylläpitää Java-järjestelmätestejä massasääntöistä tarkkuudella,

Diffblue Cover on itsehoitava AI-agentti, joka tuottaa ja ylläpitää Javalähteitä skalaarilla tarkkuudella. Se koordinoi AI-koodintekotöitä tuotollen ja laadukkaan testikattavuuden luomiseen, vähenemällä kehittäjän puolesta ja manuaalisten testien luomisesta. Agentti käsittelee koko koodipulan itsestään omavarma, mukaan lukien perinteistä koodipulaa, tuottaen uskottavia testejä ilman jatkuvaa toiston tai kontekstinvaihtelua tarvetta. Se tarjoaa tuotonperusteinen hintatapa, joka kasvaa arvon mukana, tehdäkseen siitä vetovoimaisen ratkaisun yrityksille, jotka etsivät luotettavaa menetelmää vanhoja koodipulakasvoja ajankohtaiseksi.
Kriteerien jakautuminen
- Autonominen testien luonti
- Laaja-alaisten testien kattavuus
- Arkaluontoisen koodistojen tuettavuus
- Arvo-perusteista hintakäytäntöä
- Yhteensopivuus AI-koodikäyttöö teemoihin

Flowtest AI
Tietäjä-agentti, joka tarkkailee verkkosivuja käyttämällä reaaliaikaisia käyttäjätapailmoituksia vianetsintään ja ajanmukaisuuden varmistamiseen.

Flowtest AI on tietokoneohjelmistoon perustuva valvontatyökalu, jonka tarkoitus on simuloi reaaliaikaisia käyttäjän vuorovaikenteita verkkosivustoilla. Sen päätehtävä on havaita ongelmat ja varmistaa verkkoseliteollisuuden käytettävyyttä mimeskemällä tapoja, joilla käyttäjät vuorovaikuttavat verkkosivustoissa. Tämän lähestymistavan avulla saadaan kattavampaa kokeilun tarkastelua, joka läpäisee perinteisten valvonnanmenettelyjen rajoitukset. Flowtest AI on todennäköisesti kohdistettu yrityksiin ja organisaatioihin, jotka turvautuvat raskaasti siihen, että niiden verkkopaikka on ulkomaailman näkyvillä, ja toimisto tarjoaa heille tietoja sivustonsa suorituskyvystä sekä luotettavuudesta. Analysoimalla mahdollisia ongelmia niiden aiheuttamasta käyttäjäkokemukselta, Flowtest AI auttaa ylläpitämään yhtenäistä käyttäjäkokemusta. Työkalu toimii siinä, että se oppii käyttäjien todellisesta käyttäytymisestä sekä jäljittää näitä vuorovaikintanäkemyksiä kokeiluun vikojen havaitsemiseksi, palvelun päättymisen jälkeen tai muiden ongelmien havaitsemiseksi, jotka saattoisivat vaikuttaa käyttäjien kokemaan. Tässä mielessä muut valvontalaitteet, Flowtest AI:n käyttöä AI:llä mimeskemällä käyttäjien vuorovaikintaa tarjoaa enemmän syvällistä ymmärrystä verkkosivuston suorituskyvystä. Kuitenkin, työlaitteen erityisominaisuuksia ja sen verrattavaa muiden valvontatietokoneohjelmistojen vertailu ilman lisätietoja tarjoavat mekanismin mukaista liiketoimintaa ei ole selvästi kuvattu. Lainauksella johtuen työyökalu, kuten Flowtest AI, edustaa uudentyyppistä lähestymistapaa verkkosivuvaluontaan korostamalla kasvavaa merkitystä tietokoneohjelmallisessa kehityksessä varmistamassa verkkopalvelujen laatu ja luotettavuus.
Kriteerien jakautuminen

Keploy
Avoin lähdekoodin AI-väline, joka automaattisesti luo ja ylläpitää yksikkö-, integraatio- ja API-testejä mockeja käyttäen.

Keploy on avoimen lähdekoodin, tekoälykäyttöinen testausalusta, joka käyttää eBPF:ää vangatakseen oikean API-liikenteen ja toistaa sen CI:ssä deterministisinä regressiotesteinä, automaattisesti generoituna mock-objektina ja tuotantoympäristön kaltaisina hiekkalaatikoissa ilman mitään koodimuutoksia. Se tukee mitä tahansa ohjelmointikieltä (Go, Java, Python, Node.js, Rust, PHP, Ruby) ja mitä tahansa kehysviitettä. Edistyneet ominaisuudet ovat käytettävissä hallitun pilven kautta. Keploy tarjoaa ilmaisen tilan, jossa kehittäjät voivat kokeilla alustaa 30 testisarjan ja 5 tekoälyluotuisuuden kuukaudessa. Alusta on myös saatavilla Pro-tasolla (24 dollaria/käyttäjä/kuukausi) ja Enterprise-tasolla, jossa on mukautettu tuki ja SOC2/SLA:t. OSS-ydinosio pysyy ilmaisena itseisännittelyyn rajattomasti. Alusta sallii kehittäjien tallentaa regressiotestit oikean API-liikenteen avulla ja toistaa ne CI:hen eristetyssä hiekkalaatikossa. Tämä prosessi kestää millisekunteja, mikä tekee siitä paljon nopeamman kuin perinteiset testausmenetelmät. Keployn ominaisuuksiin kuuluvat muun muassa mahdollisuus tukea mitä tahansa kieltä ja kehysviitekehystä, generoida auto-mokkeja ja ylläpitää tuotantoon kaltaisia hiekkalaatikkoja ilman yhtään koodimuutosta.
Kriteerien jakautuminen
- Automaattisesti luodut mockit
- Tuotantokaltaiset hiekkalaatikot
- Regressiotestit
- API-liikenteen kaappaus eBPF:llä
- Tuki mille tahansa kielelle ja kehykselle
- Support for any language and framework




