Relari (YC W24)Platforma za testiranje, evaluaciju i generiranje umjetnog podataka za AI agentove.
Pregled
Ključne značajke
- Generacija umjetnog pode data seta
- Automatizirane sustave evaluacije agenta
- Simulacija scenarija i razgovora
- Konzurnibilni evaluacijski metrii
- Pregled revizije za aplikacije LLM
- Mjeritelj vježbin u izvedbi i izvještavanje
Cijene
- Model
- Free
- Kategorija
- Najbliži pogled
- Ocjena
- 4.3 / 5 (6)
Slučajevi uporabe
Testiranje AI agenta
Relijabilni procjenjujivi agenti evaluacija za AI agentove.
Prednosti i nedostaci
Prednosti
- Namijenjena izravno za evaluaciju višestolih AI agentova
- Generira umjetno testno podataka u velikom obimu
- Podrka za kustm metrics i evaluators
- Ima podršku kompanije Y Combinator s aktivnom razvojem
Nedostaci
- Glavno namijenjena tehničkim ekipama, ne non-developers
- Novija platforma s evoluiranim setom funkcija
- Može zahtijevati rad u integraciji radi dodatka u postojeće arhitecture
Rekord bitaka
U 3 bitkama u Panteonu.
Last 3 battles
Recenzije
Prosjek iz 6 ocjena.
Prijavi se za ostavljanje recenzije.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Pitanja
Koji su prednosti korištenja Relarija?
Relari je namjenski razvijen za procjenu višekoraknih AI agenata, generira sintetske testne podatke u velikim količinama, podržava prilagodljive metrike i evaluator, s aktivnim razvojem podržanim od Y Combinatora.
Asked by Anya Sokolova · Jun 27, 2026
Je li Relari pogodan za nneteničke timove?
Relari je primarno namijenjen tehničkim timovima, a ne nije razvijen za netehnike, te može zahtijevati integracijski rad kako bi se uklopio u postojeće stackove.
Asked by Hasan Demir · May 27, 2026
Koje značajke podržava Relari?
Relari podržava značajke kao što su generiranje sintetskog skupa podataka, automatski postupak evaluacije agenta, simulacija scenarija i prilagodljivi mjereni evaluacijski standardi.
Asked by Marisol Pena · Apr 17, 2026
Za što se koristi Relari?
Relari je platforma za testiranje, procjenu i generiranje sintetskog podatka za AI agente, koja pomaže timovima da poboljšaju svoju pouzdaność kroz sistemsko testiranje i procjenu.
Asked by Hana Kobayashi · Mar 25, 2026
Postavi pitanje
Alternative za Najbliži pogled

Koderski platform za gradnju, praćenje i skaliranje aplikacija temeljene na LLM tehnologiji.

Plataforma za sigurnost i upravljanje za samostalne agenti AI i zračne inteligentne sustave.

Pojamni platform za vrijednovanje, praćenje i poboljšanje agenata AI-a

Pratite kako se vaše marka pojavljuje diljem ChatGPT-a, Claude, Perplexityja i preglede Google AI-a.

Sistemska no-kodna izgradnja protokolnih rješenja za automatizaciju operacija kombinujući više velikih modela jezika (LLM) i spajajući zahtjeve u potpunosti automatski.

Izgradite, vrednujte i poboljšajte agente za poslovnu automatizaciju
All-in-one platform za nadzor, debagiranje i poboljšanje proizvodnih aplikacija baziranih na LLM tehnologiji.

AI agent za IT operacije koji ubrzava otkrivanje, triražu i rješavanje incidenta.
Trending now

API za inteligenciju dokumenata koji parsira, dijeli, OCR-uje i iskreće strukturirane podatke iz složnih PDF-a, dijaloga i tablica s podacima.

Sponzirani odgovori, plaća po klik

Točno pomoć pri domaćem radu s potpunim objašnjima

Otvoren multimodalni model veličine 12B koji obrađuje međuproizvoljni slike i tekst s okrenitom dužinom konteksta od 128 KB.
