Relari (YC W24)Testing, evaluering og syntetisk datagenereringsplattform for AI-agenter.
Oversikt
Nøkkelfunksjoner
- Generering av syntetiske datasett
- Automatiserte evalueringspipelines for agenter
- Simulering av scenarier og samtaler
- Tilpassbare evalueringsmetrikker
- Regresjonstesting for LLM-apper
- Ytelsestesting og rapportering
Priser
- Modell
- Free
- Kategori
- Innsiktsverdighet
- Vurdering
- 4.3 / 5 (6)
Brukstilfeller
Testing av AI-agenter
Pålitelig og testbar evaluering av AI-agenter.
Fordeler og ulemper
Fordeler
- Skreddersydd for evaluering av flerstegs AI-agenter
- Genererer syntetiske testdata i stor skala
- Støtter tilpassede metrikker og evaluators
- Støttet av Y Combinator med aktiv utvikling
Ulemper
- Primært rettet mot tekniske team, ikke ikke-utviklere
- Nyere plattform med stadig utviklende funksjonssett
- Kan kreve integrasjonsarbeid for å passe inn i eksisterende stacks
Kamprekord
I 3 kamper i Panteon.
Last 3 battles
Anmeldelser
Gjennomsnitt fra 6 vurderinger.
Logg inn for å legge igjen en anmeldelse.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Spørsmål
Hva er fordelene med å bruke Relari?
Relari er spesialbygget for å evaluere multi-stegs AI-agenter, genererer syntetiske testdata i stor skala og støtter tilpassede metrikker og evalueringer, med aktiv utvikling støttet av Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Er Relari egnet for ikke-tekniske team?
Relari er primært rettet mot tekniske team, ikke ikke-utviklere, og kan kreve integreringsarbeid for å passe eksisterende stakker.
Asked by Hasan Demir · May 27, 2026
Hva funksjoner støtter Relari?
Relari støtter funksjoner som syntetisk datasettgenerering, automatiserte agentevalueringsrørledninger, scenarie-simulering og tilpassbare evalueringmetricaler.
Asked by Marisol Pena · Apr 17, 2026
Hva brukes Relari til?
Relari er en plattform for testing, evaluering og syntetisk datagenerering for AI-agenter, som hjelper teamene å forbedre påliteligheten gjennom systematisk testing og evaluering.
Asked by Hana Kobayashi · Mar 25, 2026
Still et spørsmål
Alternativer til Innsiktsverdighet

Enhetlig utviklerplattform for å bygge, overvåke og skalere LLM-applikasjoner.

Sikkerhets- og styringsplattform for autonome AI-agenter og intelligente systemer.

Fullstendig plattform for å evaluere, overvåke og forbedre AI-agenter

Overvåk hvordan ditt merke vises på tvers av ChatGPT, Claude, Perplexity og Google AI Overviews.

En no-code arbeidsflytbygger for AI som gjør det mulig for bedrifter å automatisere drift ved å integrere flere store språkmodeller (LLMs) og forbinde spørsmål sammen som en ferdig tekst.

Bygg, evaluer og forbedre AI‑agenter for forretningsautomatisering
Alt-i-ett observabilitetsplattform for å overvåke, feilsøke og forbedre produksjons‑LLM‑apper.

AI-agent for IT-drift som gjør oppdagelse, triage og løsning av hendelser raskere.
Trending now

Nøyaktig leksjonshjælp med fullstendige forklaringer

Document intelligence API som analyserer, deler opp, OCR-erer og henter ut strukturert data fra komplekse PDF‑er, lysbilder og regneark.

Åpne multimodale 12B-modellen håndterer overlapped billed- og tekstinput med en kontekstvindu på 128K.

Sponsede svar, betalt per klikk.
