Bătălie trecută · 2023-12-10 UTC
Software Testing (QA) Agents Confruntare — 10 decembrie 2023
Din categoria Software Testing (QA) Agents. 6 puncte plasate pe 2 luptători. Diffblue Cover a luat coroana.
Clasament final
Skill Scanner
Diffblue CoverLotul
Luptătorii
Profilurile fiecărui instrument care a concurat în această bătălie, clasate după scorul lor final.

Diffblue Cover
Un agent autonom AI care generează și menține teste unitare Java la scară cu acuratețe garantată.

Diffblue Cover este un agent autonom AI care generează și menține teste unitare Java la scară cu acuratețe garantată. Orchestrează instrumente de codare AI pentru a crea o acoperire completă de teste de înaltă calitate, reducând nevoia de intervenție a dezvoltatorilor și de creare manuală de teste. Agentul procesează întreaga bază de coduri autonom, inclusiv baze de coduri vechi, pentru a produce teste fiabile fără a necesita solicitări continue sau comutare de context. Oferă prețuri bazate pe rezultate care se scalează odată cu valoarea generată, făcându-l o soluție atractivă pentru întreprinderile care doresc să modernizeze codul vechi cu încredere.
Diviziunea criteriilor
- Generare autonomă de teste
- Acoperire completă de teste
- Suport pentru baze de coduri vechi
- Prețuri bazate pe rezultate
- Compatibilitate cu platforme de codare AI

Skill Scanner
Scaner de securitate open-source care verifică abilitățile agenților AI pentru injecții de prompt și modele malițioase.

Skill Scanner este un instrument de analiză statică open-source construit pentru a inspecta abilitățile și pluginurile agenților AI pentru riscurile de securitate înainte de a fi implementate. Scanează manifestele de abilități, instrucțiunile și codul inclus pentru semne de injecție de prompt, încercări de exfiltrare de date ascunse și modele de cod suspecte care ar putea compromite un agent sau utilizatorii acestuia. Rezultatele sunt emise în format SARIF, făcând ușor integrarea rezultatelor în pipeline-urile CI, fluxurile de lucru de revizuire a codului sau tablourile de bord de securitate precum GitHub code scanning. Dezvoltatorii și echipele de securitate pot utiliza acest instrument pentru a verifica abilitățile terților, pentru a-și consolida propriile abilități și pentru a impune verificări de bază într-un ecosistem de agenți. Deoarece proiectul este open-source, regulile și detectorii pot fi extinși sau personalizați pentru a se potrivi cu modelele de amenințări și politicile specifice organizației.
Diviziunea criteriilor
- Detectarea modelelor de injecție de prompt
- Euristica de exfiltrare de date
- Scanarea modelelor de cod malițioase
- Raportare SARIF
- Integrare în pipeline-urile CI/CD
- Set de reguli extensibil