Relari (YC W24)Platforma pro testování, hodnocení a generaci syntetických dat pro umělou inteligenci.
Přehled
Klíčové funkce
- Generace syntetických dataserií
- Automatizované evaluace agentů
- Simulace scénářů a konverzace
- Přizpůsobitelné evaluace metrik
- Regression testování aplikací pro LLM
- Benchmarkování výkonu a generování zpráv
- Monitorování nepřetržitě
Ceník
- Model
- Free
- Kategorie
- Obsahová sledovanlivost
- Hodnocení
- 4.3 / 5 (6)
Případy užití
Testování AI agentů
Reli crime a testovateible hodnocení pro AI agenty.
Pro a proti
Pro
- Určena speciálně pro testování multi-krokových AI agentů
- Generuje syntetické náhodně vygenerované testová data ve velké míře
- Podporuje přizpůsobitelné metriky a evaluace
- Zajistena podporou od Y Combinator, s aktivní vývojem
- Zajistena podporou SDK
Proti
- Primárně zaměřena na technické týmy, ne na non-developery
- Novější platforma s vývojem přizpůsobitelného sadu funkcí
- Možná vyžaduje integraci pro přizpůsobení stávajících stacků
Rekord bitev
Ve 3 bitvách v Pantheonu.
Last 3 battles
Recenze
Průměr z 6 hodnocení.
Přihlas se, abys mohl napsat recenzi.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Otázky
What are the pros of using Relari?
Relari je navržena speciálně pro hodnocení multi-step AI agentů, generuje syntetická testovací data ve velkém měřítku a podporuje vlastní metriky a evaluátory, s aktivním vývojem podporovaným Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Is Relari suitable for non-technical teams?
Relari je primárně zaměřena na technické týmy, nikoli na nedevelopeři, a může vyžadovat integraci, aby se přizpůsobila stávajícím stackům.
Asked by Hasan Demir · May 27, 2026
What features does Relari support?
Relari podporuje funkce jako generování syntetických datasetů, automatizované pipeline hodnocení agentů, simulaci scénářů a přizpůsobitelné metriky hodnocení.
Asked by Marisol Pena · Apr 17, 2026
What is Relari used for?
Relari je platforma pro testování, hodnocení a generování syntetických dat pro AI agenty, která pomáhá týmům zlepšit jejich spolehlivost prostřednictvím systematického testování a hodnocení.
Asked by Hana Kobayashi · Mar 25, 2026
Polož otázku
Alternativy k Obsahová sledovanlivost

Jednotná platforma pro vývoj, monitoring a škálování aplikací LLM.

Platforma pro bezpečnost a správu autonomních AI agentů a inteligentních systémů.

Plná platforma pro hodnocení, monitorování a zlepšování AI agentů

Monitorujte, jak vaše značka vychází v celkovém přehledu ChatGPT, Claude, Perplexity a Google AI Přehledů.

Virtuální no-kódový stavový builder Workflow že umožňuje podnikům automatizovat provoz díky integrovaným kombinacím více jazykových modelů velkých velikostí (LLM) a propojení promptů jako seamm.

Stavět, hodnocení a zlepšování AI agentů pro automatizaci podnikání
Celkově všestranná platforma observability pro sledování, ladění a zdokonalování aplikací se strojovým učením v produkci.

Agent pro IT operace, který urychluje detekci, triáž a zřizování incidentů.
Trending now

Inteligentní dokumentová API, které rozpoznává, rozděluje, převede na text a extrahuje strukturovaná data z komplexních dokumentů PDF, prezentací a-tabulkových formulářů.

Sponzorované odpovědi, platba za klik

Přesné domácí úkoly s vysvětlením

Otevřený multimodalní model 12B s 128K kontextovým oknem pro zpracování rozebraných obrazů a textů.
