Минула битва · 2025-04-24 UTC
Agent Development Протистояння — 24 квітня 2025 р.
З категорії Agent Development. 32 позначок поставлено серед 7 бійців. DeepOpinion здобув корону.
Підсумкові результати
Учасники
Бійці
Профілі кожного інструмента, який змагався в цій битві, ранжовані за підсумковим балом.

DeepOpinion
Інтер'єрна платформа мистецтв інтелекту втоматизації складної діяльності та нерівністичних даних.

DeepOpinion – бізнес-орієнтована платформа з автоматизацією процесів, призначена для обробки складної документаційної роботи, з якою звичайні РПА засоби не можуть впоратися. Вона поєднує великі лінгвістичні моделі з інструментами управління потоками роботи для обробки некерованих вхідних даних, таких як електронна пошта, договори, рахунки і листи від клієнтів, масштабно. Платформа спрямована на команди зі сфери фінансової діяльності, страхової діяльності, обслуговування клієнтів та операцій, які мають потребу в надійному, контролюваному AI обробці бізнес-процесів. Платформа дозволяє організаціям створювати та розгортати агентів AI, які можуть читати, класифікувати, вилучати та виконувати дії стосовно інформації без великих індивідуальних розробок. З можливостями для розгортання в-cloud чи на-премісних серверах, DeepOpinion спрямована на інтеграцію в регульовані середовища підприємства, зменшуючи тим самим час обробки маніпульованих робіт від тілесних пізнавальних завдань.
Розподіл критеріїв
- Агенти AI для обробки документів та текстів
- Автоматизація системи роботи для діяльності знань
- Викриття даних з некристалізованих джерел
- Підвищено ґрунтовна безпеки та опції розгортання підприємства
- Інтеграція існуючого бізнес-системи
- Контроль перевірки людини в якості лінії людини в якості людини

Letta AI
Відкрита платформа для створення штучних інтелектуних агентів зі станційним управлінням та розвиненим розумінням.

Платформа Letta AI призначена для створення штучних інтелектуних агентів зі станційним управлінням зі збереженою пам'яттю та розвиненим розуміннем. Якість розвиток агентів, здатних зберігати інформацію про попередні взаємодії, що забезпечує більш складну та контекстно-орієнтовану прийом прийняття рішень. Це особливе користування, особливо тоді, коли потрібні агенти, здатні навчитися від попередніх досвідів та відповідати відповідно. Letta AI спрямована на розробників та дослідників, які цікавляться створенням розвинених штучних інтелектуних агентів для різних застосувань, починаючи від служби клієнта та закінчуючи складнішими завданням розв'язування проблем. Застосування зберігання інформації та розвиненого розуміння, Letta AI дозволяє розробити агентів штучного інтелекту, які можуть виконувати низку завдань зі вищою ступенем самодостатності та інтелектність.
Розподіл критеріїв
- Штучні інтелектуальні агенти зі станційним управлінням
- Станційне управління
- Розвинений розумінь

Botpress
Платформа від початку до кінця для створення, розгортання та керування агентами AI та чатбота

Botpress - платформа розробки для створення агентів інтерактивної AI шляхом використання великих мовних моделей. Вона надаючи візуальну конструкцію будівельника, SDK та інтерґрації з популярними каналами повідомлень, дозволяє командам розробляти агентів здатних тримати природні розмови, виконувати виклики до API та виконувати багатокрокові завдання. Платформа поєднує низькодові інструменти з варіантами глибшої налаштування, так що і неспеціалісти та розробники можуть працювати над тим самим проєктом. Вибірки якими користувачі можуть володіти наприклад бази знань, аналіз даних та передача завдань людини роблять продукт придатним для експлуатації у продукційних випадках, наприклад надання підтримки, захоплення ідентифікованих лідів та внутрішня автоматизація. Botpress пропонує вільну версію для експериментування та виплачені плани, які зростають зі зростанням використання, також відкрите джерело спільнотної версії для самовідправлених розгорток.
Розподіл критеріїв
- Редактор потоку діалогу з перетягуванням і встановленням елементів
- Агенти, які використовують LLM
- Увімкнення бази знань з документів та URLs
- Деплоїмент через кілька каналів (вібр, WhatsApp, Slack тощо)
- Аналітика і спостереження за діалогами
- Надання робітника людини та співпраця окремих команд

Gretel AI
Платформа створення синтетичної дані для генерування даних із захистом конфіденційности та підготовки даних для роботи зі штучним інтелектом, які відображають реальні дані.

Гретел AI - це спеціалізований платформ для розробників для створення синтетичної дані, яка статистично відповідає справжніх наборах даних без розкриття чутливих інформацій. Тіссі користують його мовою вільної розробки для AI і проектів аналітики, коли доступ до даних виробництва обмежений у зв'язку з приватністю, дотриманням законодавства або обмеженням на наявність. Платформа забезпечує API, SDK та підготовлені моделі для генерації таблиць, тексту та даних серіальної обробки, а також інструменти для оцінки якості та ризику щодо конфіденційності. Вона підтримує звичні випадки використання, такі як підготовка моделей машинного навчання, збільшення україномовних класів, спільне використання даних серед команди, та тестування програмного забезпечення з реалістичними, але штучними записами.
Розподіл критеріїв
- Джерелені моделі для синтетичної таблично-відсортованої та текстової даних.
- Надання різниці приватності та керування видаленням особистих відомостей.
- Звітність щодо якості та ризику конфіденційности.
- Приєднання SDK Python та REST API.
- Допечаті моделі та особисті шаблони.
- Альтернативна та самостійно запущена деплоєм опції

NetX
Модульна економічна мережа, що поєднує інфраструктуру блокчейну із можливостями штучного інтелекту.
NetX — це модульна економічна мережа, призначена для об'єднання технологій блокчейну та штучного інтелекту в єдиній структурі. Її архітектура дозволяє розробникам та організаціям підключати компоненти для децентралізованих транзакцій, обміну даними та послуг на основі штучного інтелекту, підтримуючи різноманітні випадки використання в цифрових економіках. Платформа прагне поєднати традиційну функціональність блокчейну із роботою механізмів машинного навчання, дозволяючи токенізовані стимули, автоматизацію смарт-контрактів та аналітику на основі штучного інтелекту працювати в межах однієї екосистеми. Це робить її придатною для команд, що створюють Web3-додатки, які потребують інтелектуального оброблення або прийняття рішень на основі даних. Підкреслюючи модульність, NetX прагне надати розробникам гнучкість у зборці їхнього стека, дозволяючи обирати ті компоненти блокчейну, штучного інтелекту та економічні примітиви, які найкраще відповідають потребам їхнього проєкту.
Розподіл критеріїв
- Модульні компоненти мережі
- Шар інтеграції з блокчейном
- Сумісність із сервісами штучного інтелекту
- Підтримка смарт-контрактів
- Токенізовані економічні примітиви
- Інструменти, орієнтовані на розробників

Snorkel Flow
Програмна мітка даних та платформа розробки AI для швидшого створення виробничих моделей.

Snorkel Flow - підприємницька платформа для програмної розробки даних, яка надає командам можливість маркувати, готувати та поліпшувати тренувальну інформацію за допомогою функцій маркування замість звернення виключно до ручної ідентифікації. Завдяки закріпленню до спеціалістів галузі в уніфікованих прийомах використання, це прискорює шлях від первинних даних до готових до використання моделей штучного інтелекту. Платформа поєднує слабку супервізію, навчання моделей і аналіз помилок в одному процесі роботи, чим допомагає спеціалістам у галузі даних і фахівцям конкретної галузі працювати разом над наборами даних і моделями. Вона підтримує ряд випадків використання, включаючи класифікацію документів,_EXTRACTION довідкової інформації та тонування базових моделей для підприємств.
Розподіл критеріїв
- Програмне позначення за допомогою функцій міток
- Слабка супервізія і агрегація міток
- Вбудоване навчання та оцінка моделі
- Інструменти аналізу помилок та розділення даних
- Підтримка тонкого налаштування фундаментальних моделей
- Інструменти співпраці для експертів і дата‑ученців

LangSmith
Платформа спостережності, оцінки та відладки для застосунків LLM від команди LangChain

LangSmith — це платформа розробника, розроблена з командою LangChain для допомоги командам трасувати, тестувати, оцінювати та контролювати програми, що працюють шляхом великих мовних моделей. Хоча він тісно інтегрується з LangChain та LangGraph фрейморками, він багатоагностичний стосовно фреймворків і може інструментувати будь-яку програми LLM за допомогою своїх SDK і API. Його основне призначення — розібратися зі внутрішньою несподіваністю LLM на основі систем, де виходи невизначені та помилкові можуть бути крихітними, надаючи розробникам візуалізацію того, що їхні ланцюжки, агенти та запити фактично робять під час виконання часу. Платформа зосереджена на трасуванні: кожен запуск програми створює деталізовану, вкладену слід, що показує кожен крок, включно із запитами, відгуками моделі, використанням токенів, затримкою, викликами інструментів та проміжними видами даних. Цим зробити легшою розробку складних багатошарових агентів та каналів генерування зі збереженням та підтягуванням вмісту, де джерело гіркої відповіді може бути заховані кілька шарів глибоко. Виробники можна побачити окремі сліди, фільтрувати та шукати у різні виконувані програми та просікуватися точно у вхідну інформацію та вивідні дані кожного вузла. LangSmith також надає інструменти для оцінки якості програми. Команди можуть створювати набори даних зі шляхів виконання або спеціально відібраних прикладів, виконувати своє програмне забезпечення щодо цих наборів даних та оцінювати виходи за допомогою вбудованих оцінювачів, особистих перевірок за допомогою коду або підхід з використанням LLM як судді. Ці можливості підтримують регресійні вимірювання при зміні запитів або моделей і допомагають оцінити, чи зміни справді поліпшують результати, замість чого їм доводилося розраховувати виключно за допомогою інтуїції. Для професійного використання запропоновано панелі спостереження, що відстежують такі показники, як затримка, витрати, частку помилок та відгуки протягом часу, крім можливості збирання людини відгуку щодо користувача та анотацій користувача. Підставковий менеджмент та підсвічуванням компонент дозволяє командам робити експерименти щодо підготовки запитів і порівнювати виходи моделі зі сторінокою. LangSmith спрямований у першу чергу на розробників та команди, які відправляють функції LLM та потребують виходу за межами спотворених друку та відлагодження, у напрямок системного спостереження та оцінки. Його головною перевагою є глибина інтеграції з LangChain екосистемою та поєднана робота потоку спостереження, даних та оцінки. Правдиві компроміс щодо цього інструменту полягають у тому, що найбільше відчуття очікує від вас досвід роботи у світі LangChain/LangGraph, що оцінка за допомогою LLM в собі не досконала та вимагає уваги при виконанні, а також воно є хостедним комерційним продуктом зі заробітчною ціновою політикою, хоча існує можливість самовідлагодження деяких планах. Інструмент конкурує з іншими інструментами спостереження за LLM, такими як Langfuse, Helicone, Arize Phoenix та Weights & Biases Weave.
Розподіл критеріїв
- Запуск слідкування з кроків-ковер-стовпці на входах, виходах та використання токенів
- Створення наборів даних і автоматична оцінка
- Вбудовані, кодові та оціники LLM
- Монітори Dashboard для виробництва
- Збір людини відгуку та анотація
- Управління попередженнями, версіями та місцем виконання






