Relari (YC W24)Plattform für Testing, Bewertung und generierte synthetische Daten für KI-Agenten.
Übersicht
Hauptfunktionen
- Synthetische Datenbankerzeugung
- Automatisierte Agentenevaluierungspipeline
- Szenario- und Gesprächssimulation
- Konfigurierbare Bewertungsmetriken
- Regressionstest für LLM-Anwendungen
- Leistungsbewertung und -berichterstattung
Preise
- Modell
- Free
- Kategorie
- Beobachtbarkeit
- Bewertung
- 4.3 / 5 (6)
Anwendungsfälle
Testen von KI-Agenten
Verlässliche und testbare Benutzer von KI-Agenten.
Pro & Contra
Pro
- Zur Entwicklung zugeschnitten für die Bewertung von Multi-Stell-AI-Agenten
- Generiert synthetisches Testdaten auf großen Maßstab
- Unterstützt benutzerdefinierte Metriken und Evaluator
- Gebannt von Y Combinator mit aktiver Entwicklung
- Fördert die Verwendung von Software-Engineering-Schriften, wie Einheitstests, Regressionsprüfungen und messbaren Metriken
Contra
- Zurückhaltend für technische Teams, nicht für Nicht-Entwickler
- Neue Plattform mit einem sich ständig verändernden Funktionsumfang
- Bekannt mit Integration arbeiten, die bestehende Stacks passt
Schlacht-Bilanz
Aus 3 Schlachten im Pantheon.
Last 3 battles
Bewertungen
Durchschnitt aus 6 Bewertungen.
Melde dich an, um eine Bewertung abzugeben.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Fragen & Antworten
Was sind die Vorteile der Nutzung von Relari?
Relari ist speziell für die Bewertung von Mehrschritt-KI-Agenten konzipiert, erzeugt synthetische Testdaten in großem Umfang und unterstützt benutzerdefinierte Metriken und Evaluatoren, mit aktiver Entwicklung und Unterstützung von Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Ist Relari für nicht-technische Teams geeignet?
Relari richtet sich in erster Linie an technische Teams, nicht an Nicht-Entwickler, und kann Integrationsarbeit erfordern, um in bestehende Stacks zu passen.
Asked by Hasan Demir · May 27, 2026
Welche Funktionen unterstützt Relari?
Relari unterstützt Funktionen wie die Erzeugung synthetischer Datensätze, automatisierte Agenten-Bewertungspipelines, Szenario-Simulationen und anpassbare Bewertungskriterien.
Asked by Marisol Pena · Apr 17, 2026
Wofür wird Relari verwendet?
Relari ist eine Plattform für das Testen, Bewerten und die Erzeugung synthetischer Daten für KI-Agenten, die Teams dabei unterstützt, ihre Zuverlässigkeit durch systematisches Testen und Bewerten zu verbessern.
Asked by Hana Kobayashi · Mar 25, 2026
Frage stellen
Alternativen zu Beobachtbarkeit

Einheitliche Entwicklerplattform zum Erstellen, Überwachen und Skalieren von LLM-Anwendungen.

Sicherheit und Governance-Plattform für autonome künstliche Intelligenz-Agente und intelligente Systeme.

End-to-End-Plattform zur Bewertung, Überwachung und Verbesserung von KI-Agenten

Überwache, wie Ihre Marke in den ChatGPT, Claude, Perplexity und Google AI Überblicken erscheint.

Eine no-code-AI-Workflow-Builder, die Unternehmen dabei unterstützt, ihre Operationen durch das Integrieren mehrerer großer Sprachmodelle (LLMs) und das Verbinden von Promptes automatisieren.

Baue, bewerte und verbessere AI-Agenten für Geschäftsautomatisierung
Vollständige Beobachtungsplattform zur Überwachung, Debugging und Verbesserung von Produktions-LLM-Anwendungen.

KI-Agent für IT-Betrieb, der den Einbruch von Eintrittsanfragen, -forschung und -lösung beschleunigt.
Trending now

Intelligenter Dokument API zur Analyse, Trennung, OCR-Analyse und Strukturierung von komplexen PDFs, Präsentationen und Tabellenkalkulationen.

Gepflichtete Antworten mit Provision pro Klick.

Genaue Hilfe bei Hausaufgaben mit ausführlichen Erklärungen

Offenes multimodales 12B-Modell, das ineinander verschachtelte Bilder und Text mit einem Kontextfenster von 128 K verarbeitet.
