Relari (YC W24)Platforma na testovanie, hodnotenie a generovanie syntetických dát pre AI agentov.
Prehľad
Kľúčové funkcie
- Generovanie syntetických dátových sád
- Automatizované hodnotiace pipeline pre agentov
- Simulácia scenárov a konverzácií
- Prispôsobiteľné hodnotiace metriky
- Regresné testovanie pre LLM aplikácie
- Benchmarkovanie výkonnosti a reportovanie
Cenník
- Model
- Free
- Kategória
- Observabilita
- Hodnotenie
- 4.3 / 5 (6)
Prípady použitia
Testovanie AI agentov
Spoľahlivé a testovateľné hodnotenie pre AI agentov.
Klady a zápory
Klady
- Navrhnuté špeciálne na hodnotenie viackrokových AI agentov
- Generuje syntetické testovacie dáta vo veľkom meradle
- Podporuje vlastné metriky a evaluátory
- Podporovaná Y Combinator s aktívnym vývojom
Zápory
- Primárne určené pre technické tímy, nie pre ne‑vývojárov
- Novšia platforma s neustále sa vyvíjajúcim súborom funkcií
- Môže vyžadovať integračnú prácu na prispôsobenie existujúcim stackom
Rekord bitiek
V 3 bitkách v Panteóne.
Last 3 battles
Recenzie
Priemer z 6 hodnotení.
Prihlás sa, aby si napísal recenziu.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Otázky
Aké sú výhody použitia Relari?
Relari je primárne navrhnutý pre hodnotenie multi-krokového AI agentov, generuje synetrické testovacie údaje v štári, podporuje osobitné merania a hodnotenia, a je zásadne rozvíjaný s podporu Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Je Relari vhodné pre neprofesionálne tímy?
Relari je primárne primárne určený na technické tímy, a nie na neprofesionály, a môže vyžadovať práce na integračiu aby sa prispôsobil existujúcim stokkám.
Asked by Hasan Demir · May 27, 2026
Aké sú funkcie podporované na Relari?
Relari podporuje funkcie ako napríklad generátor synthetic datasetov, priamych automatizovaných vyhodnocovacích tokov pre agentov, simuláciu scénariusov, a meraní hodnotenia s možnosťami upravovania.
Asked by Marisol Pena · Apr 17, 2026
Pre kým je platforma Relari určená?
Relari je platforma pre testovanie, hodnotenie a synetrickú generáciu údajov pre AI agentov, ktorá pomáha tímom lepšie prikročenie zavedením systematického testovania a vyhodnocovania.
Asked by Hana Kobayashi · Mar 25, 2026
Polož otázku
Alternatívy k Observabilita

Jednotná vývojárska platforma pre tvorbu, monitorovanie a škálovanie LLM aplikácií.

Bezpečnostná a riadiaca platforma pre autonómne AI agenty a inteligentné systémy.

Platforma end-to-end pre hodnotenie, monitorovanie a zlepšovanie AI agentov

Sledujte, ako sa vaša značka objavuje v ChatGPT, Claude, Perplexity a Google AI Overviews.

Bez kódovný nástroj na tvorbu pracovných postupov umelej inteligencie, ktorý umožňuje firmám automatizovať prevádzku integráciou viacerých veľkých jazykových modelov (LLM) a pripojením výziev...

Vytvárajte, hodnotte a zdokonaľujte AI agentov pre automatizáciu podnikania
All-in-one platforma pre pozorovanie na monitorovanie, ladenie a zlepšovanie produkčných LLM aplikácií.

Edwin AI: Artificial Intelligenca aplikovaná na IT-operácie, ktorá zamezáva uzavreté úlohy a spravuje incidente rýchlejšia.
Trending now

Blázená ustanovenie, rýchla solenie štúdie

Document intelligence API, ktorá parsuje, rozdeľuje, OCR-uje a extrahuje štruktúrované dáta z komplexných PDF, snímok a tabuľkových dokumentov.

Sponzorované odpovede, platba za klik.

Open multimodálny 12B model, ktorý spracováva prekladané obrázky a text s 128 K kontextovým oknom.
