Προηγούμενη μάχη · 2024-03-14 UTC
Software Testing (QA) Agents Αναμέτρηση — 14 Μαρτίου 2024
Από την κατηγορία Software Testing (QA) Agents. 12 βαθμοί τοποθετήθηκαν σε 4 μαχητές. Το Diffblue Cover πήρε το στέμμα.
Τελική κατάταξη
Η σύνθεση
Οι μαχητές
Προφίλ κάθε εργαλείου που διαγωνίστηκε σε αυτή τη μάχη, καταταγμένα με βάση την τελική τους βαθμολογία.

Diffblue Cover
Μιά ατόμω ασφαλή μηχανή που δημιουργεί και διατηρεί ασφαλείς ταξινόμησης Java με διασφαλμένη ακρίβεια

Το Diffblue Cover είναι αυτόνομος.agent AI που tạoει και φροντίζει τις Java ενότητες thửσης στο масштυλo με πλήρη ακρίβεια. Διαχειρίζεται πιέσεις AI κώδικα για να δημιουργήσει ένα πλήρες κάλυμμα υψηλής ποιότητας, μειώνοντας την ανάγκη παρέμβασης developer και χειρισμού ελέγχου δοκιμών. Ο(agent) επεξεργάζεται ολόκληρη τη βάση κώδικα αυτόνομα, συμπεριλαμβανομένων των παλαιών βάσεων κώδικα, για να προduce αξιόπιστες δοκιμές χωρίς τη χρέωση συνεχούς εντολών ή αλλαγών κατάστασης. Προσφέρει τιμές με βάση την τελική κατάσταση που μεγαλώνει μαζί με την αξία που παράγεται, καθιστώντας το ένα ευπρόσδεκτο λύση για τις εταιρείες που ερευνάνε την παλιά κody με εμπιστοσύνη.
Κατανομή κριτηρίων
- Άνετη γεννύση δοκιμαστικών τμημάτων
- Συμπληρούμενη κάλυψη ανταλλαγών
- Підstütηση υπάρχουσων κωδικών-δικτυών
- Κύρωση βάσει αποτελείων πωλήσεων
- Πλατφόρμα compatibility με AI coding tools

Skill Scanner
Σαρωτής ασφαλείας ανοιχτού κώδικα που ελέγχει τις δεξιότητες των AI πρακτόρων για μοτίβα ένεσης προτροπής και κακόβουλα μοτίβα.

Skill Scanner είναι ένα ανοιχτού κώδικα εργαλείο στατικής ανάλυσης, σχεδιασμένο να επιθεωρεί τις δεξιότητες και τα plugins των AI πρακτόρων για κινδύνους ασφαλείας πριν αναπτυχθούν. Σαρώνει τα μανιφέστους δεξιοτήτων, τις οδηγίες και τον ενσωματωμένο κώδικα για ενδείξεις prompt injection, κρυφές προσπάθειες εξαγωγής δεδομένων και ύποπτα πρότυπα κώδικα που θα μπορούσαν να θέσουν σε κίνδυνο έναν πράκτορα ή τους χρήστες του. Τα αποτελέσματα εκδίδονται σε μορφή SARIF, καθιστώντας εύκολο το ενσωμάτωση των ευρημάτων σε CI pipelines, ροές εργασίας ελέγχου κώδικα ή πίνακες ελέγχου ασφαλείας όπως το GitHub code scanning. Οι προγραμματιστές και οι ομάδες ασφαλείας μπορούν να το χρησιμοποιήσουν για να αξιολογήσουν τις δεξιότητες τρίτων, να ενισχύσουν τις δικές τους και να επιβάλουν βασικούς ελέγχους σε ολόκληρο το οικοσύστημα των agents. Καθώς το έργο είναι ανοιχτού κώδικα, οι κανόνες και οι ανιχνευτές μπορούν να επεκταθούν ή να προσαρμοστούν ώστε να ταιριάζουν με τα μοντέλα απειλών και τις πολιτικές που είναι ειδικές για τον οργανισμό.
Κατανομή κριτηρίων
- Ανίχνευση μοτίβων ένεσης προτροπής
- Αλγοριθμικές ενδείξεις εξαγωγής δεδομένων
- Σάρωση κακόβουλων προτύπων κώδικα
- Έξοδος αναφοράς SARIF
- Ενσωμάτωση σε pipeline CI/CD
- Επεκτάσιμο σύνολο κανόνων

PentAGI
Ανοικτού κώδικα αυτόνομα agents δοκιμής penetration που εκτελούν πάνω από 20 εργαλεία ασφαλείας σε απομονωμένο Docker sandbox με μνήμη και web intelligence.

Το PentAGI είναι ένας ελεύθερος, αυτόματος agent για penetration testing που εκτελεί πάνω από 20 εργαλεία ασφαλείας σε ένα απομονωμένο Docker sandbox. Εκμεταλλεύεται τεχνολογίες τεχνητής νοημοσύνης για να αυτοματοποιήσει τις δοκιμές ασφαλείας. Το εργαλείο έχει σχεδιαστεί για επαγγελματίες και ερευνητές ασφαλείας πληροφοριών που χρειάζονται ισχυρή και ευέλικτη λύση για τη διεξαγωγή penetration tests. Τα βασικά χαρακτηριστικά περιλαμβάνουν ένα sandboxed περιβάλλον, αυτοματοποιημένο σχεδιασμό εργασιών και ενσωμάτωση με διάφορα εργαλεία και συστήματα αναζήτησης. Το PentAGI προσφέρει επίσης σύστημα αναθέσεων, ολοκληρωμένη παρακολούθηση και λεπτομερή αναφορά.
Κατανομή κριτηρίων
- Περιβάλλον Sandbox Docker
- Ενσωματωμένο πακέτο 20+ επαγγελματικών εργαλείων ασφαλείας
- Σύστημα Smart Memory για μακροπρόθεσμη αποθήκευση
- Ενσωμάτωση Knowledge Graph
- Web Intelligence μέσω ενσωματωμένου browser
- Ενσωμάτωση εξωτερικών συστημάτων αναζήτησης

Keploy
Ένας open‑source AI agent που αυτοματοποιεί τη δημιουργία και τη συντήρηση unit, integration και API tests με mocks.

Keploy είναι μια πλατφόρμα δοκιμών με τεχνητή νοημοσύνη και ανοιχτού κώδικα που καταγράφει πραγματικό API traffic με eBPF και το αναπαράγει στο CI ως deterministic regression tests, auto-generated mocks, και production‑like sandboxes, χωρίς αλλαγές κώδικα. Υποστηρίζει οποιαδήποτε γλώσσα (Go, Java, Python, Node.js, Rust, PHP, Ruby) και οποιοδήποτε framework. Προχωρημένες δυνατότητες είναι διαθέσιμες μέσω της managed cloud. Το Keploy προσφέρει μια δωρεάν επιπέδο όπου οι προγραμματιστές μπορούν να δοκιμάσουν την πλατφόρμα με 30 test suites ανά μήνα και 5 AI credits. Η πλατφόρμα είναι επίσης διαθέσιμη σε επίπεδο Pro ($24 ανά χρήστη/μήνα) και επίπεδο Enterprise με εξατομικευμένη υποστήριξη και SOC2/SLAs. Το OSS core παραμένει δωρεάν για αυτοεξυπηρέτηση απεριόριστα. Η πλατφόρμα επιτρέπει στους προγραμματιστές να καταγράφουν regression tests από πραγματικό API traffic και να τα αναπαράγουν στο CI ως απομονωμένα sandboxes. Αυτή η διαδικασία παίρνει milliseconds, κάνοντας το πολύ πιο γρήγορο από τις παραδοσιακές μεθόδους δοκιμών. Οι δυνατότητες του Keploy περιλαμβάνουν την ικανότητα να υποστηρίζει οποιαδήποτε γλώσσα και πλαίσιο, να δημιουργεί αυτόματες προσομοιώσεις (auto-mocks), και να διατηρεί περιβάλλοντα sandboxes παρόμοια με την παραγωγή χωρίς αλλαγές κώδικα.
Κατανομή κριτηρίων
- Αυτοπαράγγιζόμενα mocks
- Sandbox τύπου παραγωγής
- Regression tests
- API traffic capture with eBPF
- Υποστήριξη για οποιαδήποτε γλώσσα και framework



