Relari (YC W24)Piattaforma per il testing, l'evaluation e la generazione di dati sintetici per gli agenti di intelligenza artificiale.
Panoramica
Funzionalità chiave
- Generazione del set di dati sintetico
- Flussi di valutazione auto-matizzati degli agenti
- Simulazione dello scenario e della conversazione
- Metriche di valutazione personalizzabili
- Test di regressione per gli applicativi LLM
- Benchmarking e relazione delle prestazioni
Prezzi
- Modello
- Free
- Categoria
- Osservabilità delle Prestazioni
- Valutazione
- 4.3 / 5 (6)
Casi d’uso
Testing degli aggenti di intelligenza artificiale
Valutazione sicura e gestibile degli agenti di intelligenza artificiale.
Pro & contro
Pro
- Progettato per evausi multi-passaggio degli agenti di intelligenza artificiale
- Genera dei dati di test sintetici ad scala
- Supporta metriche e valutatori personalizzabili
- Sostenuo da parte dell'azienda Y Combinator con sviluppo attivo
Contro
- Principalmente destinato a team tecnici, non a non sviluppatori
- Piattaforma più nuova con un insieme di caratteristiche in evoluzione
- Potrebbe richiedere lavoro di integrazione per adattare la pila esistente
Storico battaglie
Su 3 battaglie nel Pantheon.
Last 3 battles
Recensioni
Media su 6 valutazioni.
Accedi per lasciare una recensione.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Domande e risposte
Quali sono i vantaggi dell'utilizzo di Relari?
Relari è progettato appositamente per valutare agenti AI multi-step, genera dati di test sintetici su larga scala e supporta metriche e valutatori personalizzati, con uno sviluppo attivo supportato da Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Relari è adatto a team non tecnici?
Relari è principalmente destinato a team tecnici, non a non sviluppatori, e potrebbe richiedere lavoro di integrazione per adattarsi agli stack esistenti.
Asked by Hasan Demir · May 27, 2026
Quali funzionalità supporta Relari?
Relari supporta funzionalità come generazione di dataset sintetici, pipeline automatizzate di valutazione degli agenti, simulazione di scenari e metriche di valutazione personalizzabili.
Asked by Marisol Pena · Apr 17, 2026
A cosa serve Relari?
Relari è una piattaforma per test, valutazione e generazione di dati sintetici per agenti AI, che aiuta i team a migliorare la loro affidabilità attraverso test sistematici e valutazioni.
Asked by Hana Kobayashi · Mar 25, 2026
Fai una domanda
Alternative a Osservabilità delle Prestazioni

Piattaforma unificata per sviluppatori per creare, monitorare e scalare applicazioni LLM

Piattaforma di sicurezza e governance per agenti di AI autonomi e sistemi intelligenti.

Piattaforma completa per l'evaluazione, monitoraggio e miglioramento degli agenti di intelligenza artificiale

Monitora come il tuo marchio appare in ChatGPT, Claude, Perplexità e Google AI Overviews.

Uno strumento per l'integrazione di workflow AI senza codice che consente alle aziende di automatizzare operazioni integrando più modelli di linguaggio grande e collegando i prompt... insieme.

Costruisci, valuta e migliorati gli agenti di IA per l'automazione aziendale
Piattaforma di osservabilità tutti-in-uno per monitorare, debuggare e migliorare applicazioni LLM in produzione.

Agente AI per le operazioni IT che accelera la detezione, l'analisi di triage e la risoluzione degli incidenti.
Trending now

API di intelligenza dei documenti che elabora, suddivide, riconosce testi da immagine e estrae dati strutturati da PDFs complessi, diapositive e fogli elettronici

Risposte sponsorizzate, pagate per clic

Aiuto di Alta Qualità per i Compiti con Spiegazioni Dettagliate

Modello multimodale di 12B con finestra di contesto di 128K per l'elaborazione di immagini e testi intercalati.
