Relari (YC W24)Platform voor testen, beoordeling en synthetische gegevensgeneratie voor AI-agents.
Overzicht
Belangrijkste functies
- Synthetische datasetgeneratie
- Automatische agentevaluatiepijplijnen
- Scenario- en conversatie-simulatie
- Aanpasbare evaluatiemetingen
- Regresietesten voor LLM-toepassingen
- Prestatiebenchmarking en rapportage
Prijs
- Model
- Free
- Categorie
- Observatie
- Beoordeling
- 4.3 / 5 (6)
Toepassingen
AI-agent-testen
Betrouwbare evaluatie en testbare agents voor AI-agents.
Pluspunten & minpunten
Pluspunten
- Doelgebouwd voor evaluatie van multi-stappige AI-agents
- Ontwikkelt synthetische testgegevens op grote schaal
- Ondersteunt aanpasbare metingen en evaluatoren
- Gedragen door Y Combinator met actieve ontwikkeling
Minpunten
- Voornamelijk gericht op technische teams, niet op niet-ontwickelaars
- Nieuwe platform dat een evoluerend functieset heeft
- Kan integratie-work vereisen om bestaande stacks aan te passen
Strijdrecord
Over 3 strijden in het Pantheon.
Last 3 battles
Recensies
Gemiddelde van 6 beoordelingen.
Log in om een review te schrijven.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Vragen
Wat zijn de voordelen van het gebruik van Relari?
Relari is speciaal ontworpen voor het evalueren van multi‑stap AI‑agents, genereert synthetische testdata op schaal en ondersteunt aangepaste metrics en evaluators, met actieve ontwikkeling ondersteund door Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Is Relari geschikt voor niet-technische teams?
Relari is primair gericht op technische teams, niet op niet‑ontwikkelaars, en kan integratiewerk vereisen om in bestaande stacks te passen.
Asked by Hasan Demir · May 27, 2026
Welke functies ondersteunt Relari?
Relari ondersteunt functies zoals synthetische datasetgeneratie, geautomatiseerde agentevaluatiepijplijnen, scenario‑simulatie en aanpasbare evaluatiemetrics.
Asked by Marisol Pena · Apr 17, 2026
Waarvoor wordt Relari gebruikt?
Relari is een platform voor het testen, evalueren en synthetisch genereren van data voor AI‑agents, waarmee teams hun betrouwbaarheid kunnen verbeteren door systematische testen en evaluatie.
Asked by Hana Kobayashi · Mar 25, 2026
Stel een vraag
Alternatieven voor Observatie

Geïntegreerd platform voor ontwikkelaars om LLM-toepassingen te bouwen, monitoren en schalen.

Veiligheids- en governanceplatform voor autonome AI‑agents en intelligente systemen.

End-to-end platform voor het evalueren, monitoren en verbeteren van AI-agents

Monitor hoe uw merk verschijnt op ChatGPT, Claude, Perplexity en Google AI Overviews.

Een no-code AI-werkstroombouwer waarmee bedrijven operaties kunnen automatiseren door meerdere grote taalmodellen (LLM's) te integreren en prompts naadloos te verbinden

Ontwikkel, evalueer en verbeter AI‑agenten voor bedrijfsautomatisering
All-in-one observability platform om productie-LLM-apps te monitoren, debuggen en verbeteren.

AI-agent voor IT-operations die incidentdetectie, triage en resolutie versnelt.
Trending now

Nauwkeurige Huiswerkhulp met Volledige Uitleg

Document intelligence-API die pdf's, Presentaties en spreadsheets analyseert, splijt en extraheren van complexe gestructureerde gegevens.

Open multimodaal 12B-model dat afgewisselde afbeeldingen en tekst met een 128K contextvenster verwerkt.

Gesponsorde antwoorden, betaald per klik.
