Relari (YC W24)Платформа за тестване, оценка и създаване на съответстващи данни за агенти AI.
Преглед
Ключови функции
- Генерация на съответстващи данни
- Автоматизирана оценена програмна схема за агенти
- Симулация и съседство на сцени и разговори
- Настройваеми оценителни метрици
- Протест на регресия за приложения на ЛЛМ
- Изчерпателна извозвестия и отчети за изпълнение
- Оценяване на изпълнение и предоставяне на отчети
Цени
- Модел
- Free
- Категория
- Наблюдимост
- Оценка
- 4.3 / 5 (6)
Случаи на употреба
Тестване на агенти AI.
Съществуващи и тестваеми агенти за агенти за AI.
Плюсове и минуси
Плюсове
- Пусната за целенасочени от тестване на многошагови агенти AI.
- Генерира съответстващи данни на масов износ.
- Поддържа настройваеми метрици и оценителни критерии.
- Подкрепа от Y Combinator с активно разрастване.
- Препоръчителна за приложенията срещу ЛЛМ
Минуси
- Основно насочено към технически тимове, а не към непрофесионалисти.
- Ново платформено решение с развиващ се набор на функции.
- Възможни да бъде изисквано интегриране за фитинги при съществуващи стъклове
Рекорд от битки
В 3 битки в Пантеона.
Last 3 battles
Отзиви
Средно от 6 оценки.
Влез, за да оставиш отзив.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Въпроси
Какви са предимствата на използването на Relari?
Relari е проектиран специално за оценка на многосрочни AI агенти, генерира синтетични тестови данни в мащаб и поддържа персонализирани метрики и оценители, като се развива активно с подкрепата на Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Подходящ ли е Relari за нетехнически екипи?
Relari е предимно насочен към технически екипи, а не към нетехнически потребители, и може да изисква интеграционна работа, за да се впише в съществуващите стекове.
Asked by Hasan Demir · May 27, 2026
Какви функции поддържа Relari?
Relari поддържа функции като генериране на синтетични набори от данни, автоматизирани pipeline‑и за оценка на агенти, симулация на сценарии и персонализируеми метрики за оценка.
Asked by Marisol Pena · Apr 17, 2026
За какво се използва Relari?
Relari е платформа за тестване, оценка и генериране на синтетични данни за AI агенти, която помага на екипите да подобрят надеждността си чрез систематично тестване и оценка.
Asked by Hana Kobayashi · Mar 25, 2026
Задай въпрос
Алтернативи на Наблюдимост

Единен платформен интерфейс за разработчиките за създаване, мониторинг и скалане на приложенията на LLM.

Платформа за сигурност и управление за самостоятелни АИ агенти и интелигентни системи.

Платформа от начало до край за оценяване, мониторинг и усъвършенстване на агенти AI

Наблюдавайте как се появява марката ви в рамките на ChatGPT, Claude, Perplexity и Google AI Обзорите.

Едно кодова платформа за построяване на AI workflow, която позволява компаниите да автоматизират операциите си, интегрирайки множество great language models (LLMs) и свързвайки запитвания без затруднения...

Създаване, оценяване и подобряване на АИ агенти за изгодна автоматизация
Всебирна платформа за наблюдение, отбелязване и усъвършенстване на производствени приложения с LLM.

Агент за ИТ операции, който ускHEMA обажданията на инцидентите, класификацията и решаването им.
Trending now

API за документарна интелегенция, който парсира, разделя, използва OCR и извлича структурирана информация от сложни PDF, презентации и таблици.

Раждане на спонсорираните отговори, заплатено за клик.

Представи Скоро и Сигурно Задачите по Биология с Пълни Обяснения

Премахваме границите между картините и съдържанието им, обхващайки в голяма размерност многообразни картинки и текстове в рамки на окото на масив от 128K на съответстващия модели.
