Minulá bitva · 2023-12-10 UTC
Software Testing (QA) Agents Souboj — 10. prosince 2023
Z kategorie Software Testing (QA) Agents. 6 hlasů umístěno napříč 2 bojovníky. Diffblue Cover získal korunu.
Konečné pořadí
Skill Scanner
Diffblue CoverSestava
Bojovníci
Profily každého nástroje, který soutěžil v této bitvě, seřazené podle jejich konečného skóre.

Diffblue Cover
Samostátnej autonomní AI agent, který generuje a udržuje Java jednotné testy ve velkém měřítku s garantovanou přesností.

Diffblue Cover je autonomní AI agent, který generuje a udržuje Java jednotné testy ve velkém měřítku s garantovanou přesností. Orchestrací AI kódovacích nástrojů vytváří komplexní vysoce kvalitní testovací pokrytí, snižuje potřebu zásahů vývojářů a manuální tvorby testů. Agent zpracovává celou kódovou bázi samoobslužně, včetně bází s historicky vyvinutým kódem, a produkuje spolehlivé testy bez nutnosti konstantního promptingu a přepínání kontextu. Nabízí odměňování na základě výsledku, které se měří podle vytvářené hodnoty, a tím nabízí atraktivní řešení pro podniky chtějící modernizovat historicky vyvinuté kódy se spolehlivostí.
Розбивка критеріїв
- Samostátelné generování testů
- Koncese testování
- Podpora kódových bází s historicky vyvinutým kódem
- Odměňování na základě výsledku
- Zaměření na kompatibilitu se SaaS AI kódovacích nástroji

Skill Scanner
Otevřený zdroj bezpečnostní skener, který prověřuje umělé agenty pro vstřikování promptů a podrážděné vzory.

Skill Scanner je open-source nástroj pro statickou analýzu vytvořený k inspekci dovedností a pluginů AI agentů z hlediska bezpečnostních rizik před jejich nasazením. Skenuje manifestační soubory dovedností, instrukce a přibalený kód pro známky vkládání výzev, skrytých pokusů o exfiltraci dat a podezřelých vzorů kódu, které by mohly ohrozit agenta nebo jeho uživatele. Výsledky jsou vydávány ve formátu SARIF, což umožňuje snadno integrovat nálezy do CI pipelineů, pracovních postupů kontroly kódu nebo bezpečnostních dashboardů, jako je například GitHub code scanning. Vývojáři a bezpečnostní týmy jej mohou použít k prověření dovedností třetích stran, posílení vlastních dovedností a vynucení základních kontrol v celém ekosystému agentů. Protože je projekt open source, pravidla a detektory lze rozšířit nebo přizpůsobit tak, aby vyhovovaly specifickým modelům hrozeb a zásadám organizace.
Розбивка критеріїв
- Detection vzoru vstřikování promptů
- Heuristiky úniku dat
- Štíhlý skánování kódových vzorů
- Výstup zprávy SARIF
- Integrace CI/CD pipeline
- Prodloužitelný soubor pravidel