Минула битва · 2023-12-10 UTC
Software Testing (QA) Agents Протистояння — 10 грудня 2023 р.
З категорії Software Testing (QA) Agents. 6 позначок поставлено серед 2 бійців. Diffblue Cover здобув корону.
Підсумкові результати
Skill Scanner
Diffblue CoverУчасники
Бійці
Профілі кожного інструмента, який змагався в цій битві, ранжовані за підсумковим балом.

Diffblue Cover
Незалежний штучний інтелект, що викликає та підтримує Юніт-тести Java масштабним чином із гарантованою точністю.

Diffblue Cover - незалежний штучний інтелект, що викликає та підтримує Юніт-тести Java масштабним чином із гарантованою точністю. Він координує інструменти штучного інтелекту для створення повного та високоякісного тестового покриття, зменшуючи необхідність інтервентів розробників та手шевого створення випробувань. Агент обробляє весь кодбаз підкресово включно з історичним кодбаз, щоб створити надійні випробування без необхідності постійного запитання чи змінох обстановки працювання. Вона має пропозицію виходу, яка зростає відповідно до згенерованих цінності, роблячи його привабливим рішенням для підприємств, які бажають сучасізувати історичний код з вірою.
Розподіл критеріїв
- автономне створення випробувань
- повне покриття випробуванням
- підтримка історичного кодбазу
- пріцікування виходу, яке зростає відповідно до цінності згенерованої якості
- зв'язкість із платформами AI кодування

Skill Scanner
Відкритий сканер безпеки, що перевіряє навички агентів AI на наявність підстановки запитів і шкідливих патернів.

Skill Scanner є відкритим джерелом інструментом статичної аналітики, призначеним для осмотру даних спеціальностей AI-агентів і додатків щодо існування ризиків безпеки перед їх розгортанням. Інструмент здійснює пошук файлів данихManifest, інструкцій, та вставлених кодів на наявність ознак спроб введення викликів, незапланованих спроб виведення даних та підозрілих візуальних шаблонів, які можуть загрозити агенту чи його користувачам. Результати видаляються в форматі SARIF, що зроблює інтеграцію виявлених даних в процеси CI, тексти ревю коду або панелі безпеки, наприклад GitHub code scanning. Власниками розробками та командами безпеки надається можливість вивчити треті партнерські вміння, зміцнити власні та виконувати базові перевірки у екосистемі агентів. Бажано відкритий код проекту забезпечує можливість розширення або індивідуалізації правил та виявлення для реалізації організаційно-підприємницьких моделей загроз та політик.
Розподіл критеріїв
- Виявлення патернів підстановки запитів
- Гевристика витоку даних
- Сканування патернів шкідливого коду
- Вивід звітів у форматі SARIF
- Інтеграція з CI/CD пайплайнами
- Розширювана набір правил