Relari (YC W24) logo

Relari (YC W24)Platforma za testiranje, evaluaciju i generiranje umjetnog podataka za AI agentove.

4.3 (6)
Daniel NikulshynRecenzirao Daniel Nikulshyn·Ažurirano srpanj 2026.

Pregled

Relari je razvojni platform zasnovan na poboljšanju pouzdanosti AI agenata kroz sustavatizirano testiranje i ocjenu. Pomaže timovima u generiranju sintetskih skupova podataka, pokretanju automatskih evaluacija i benchmarkiranju performansi agenata preko realističnih scenarija prije slanja u produkciju. S potporom kompanije Y Combinator (W24), Relari ciljano je inženjerske ekipe koje razvijaju složenom aplikacijama na temelju LLM te višekorake agente koji se tradicionalno testiraju kao što treba. Njihovo oruđe okrenuto je na uvodeženje softversko-inženjerskog stroga režima – jedinitne jedinice, regresnog kontroliranja i izlaznim mjerama – u neizvjesne sustave AI-a ugrađene u njima. Plataforma podržava prilagođene procjene, simulaciju scenarija i stalnu kontrolu, čime se učvršćuje njena korisnost za oba pre-launch validation i nastavnu garanciju kvalitete za proizvode agenta.

Ključne značajke

  • Generacija umjetnog pode data seta
  • Automatizirane sustave evaluacije agenta
  • Simulacija scenarija i razgovora
  • Konzurnibilni evaluacijski metrii
  • Pregled revizije za aplikacije LLM
  • Mjeritelj vježbin u izvedbi i izvještavanje

Cijene

Model
Free
Ocjena
4.3 / 5 (6)

Slučajevi uporabe

Testiranje AI agenta

Relijabilni procjenjujivi agenti evaluacija za AI agentove.

Prednosti i nedostaci

Prednosti

  • Namijenjena izravno za evaluaciju višestolih AI agentova
  • Generira umjetno testno podataka u velikom obimu
  • Podrka za kustm metrics i evaluators
  • Ima podršku kompanije Y Combinator s aktivnom razvojem

Nedostaci

  • Glavno namijenjena tehničkim ekipama, ne non-developers
  • Novija platforma s evoluiranim setom funkcija
  • Može zahtijevati rad u integraciji radi dodatka u postojeće arhitecture

Rekord bitaka

U 3 bitkama u Panteonu.

0
1.
0
2.
0
3.

Last 3 battles

Recenzije

4.3

Prosjek iz 6 ocjena.

5
2
4
4
3
0
2
0
1
0

Prijavi se za ostavljanje recenzije.

Fatima Zahra

Fatima Zahra

Apr 4, 2026

Skeptical, then convinced

I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.

Robert Ainsworth

Robert Ainsworth

Mar 17, 2026

Solid for our team

We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.

DW

Devin Walker

Feb 6, 2026

Skeptical, then convinced

I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.

Carlos Mendoza

Carlos Mendoza

Jul 20, 2025

Compared a few options

Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.

Yuki Mori

Yuki Mori

Jul 19, 2025

Use it every day

Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.

Leila Hassan

Leila Hassan

Jul 14, 2025

Skeptical, then convinced

I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.

Pitanja

Koji su prednosti korištenja Relarija?

Relari je namjenski razvijen za procjenu višekoraknih AI agenata, generira sintetske testne podatke u velikim količinama, podržava prilagodljive metrike i evaluator, s aktivnim razvojem podržanim od Y Combinatora.

Asked by Anya Sokolova · Jun 27, 2026

Je li Relari pogodan za nneteničke timove?

Relari je primarno namijenjen tehničkim timovima, a ne nije razvijen za netehnike, te može zahtijevati integracijski rad kako bi se uklopio u postojeće stackove.

Asked by Hasan Demir · May 27, 2026

Koje značajke podržava Relari?

Relari podržava značajke kao što su generiranje sintetskog skupa podataka, automatski postupak evaluacije agenta, simulacija scenarija i prilagodljivi mjereni evaluacijski standardi.

Asked by Marisol Pena · Apr 17, 2026

Za što se koristi Relari?

Relari je platforma za testiranje, procjenu i generiranje sintetskog podatka za AI agente, koja pomaže timovima da poboljšaju svoju pouzdaność kroz sistemsko testiranje i procjenu.

Asked by Hana Kobayashi · Mar 25, 2026

Postavi pitanje

Alternative za Najbliži pogled