Relari (YC W24)Πλατφόρμα δοκιμών, αξιολόγησης και δημιουργίας συνθετικών δεδομένων για AI agents.
Επισκόπηση
Βασικές λειτουργίες
- Δημιουργία συνθετικών συνόλων δεδομένων
- Αυτοματοποιημένες ροές αξιολόγησης πρακτόρων
- Προσομοίωση σεναρίων και συζητήσεων
- Προσαρμόσιμες μετρικές αξιολόγησης
- Δοκιμές παλινδρόμησης για εφαρμογές LLM
- Βαθμονόμηση απόδοσης και αναφορά
Τιμές
- Μοντέλο
- Free
- Κατηγορία
- Διατηρησιμότητα
- Βαθμολογία
- 4.3 / 5 (6)
Περιπτώσεις χρήσης
Δοκιμή AI agents
Αξιόπιστη και δοκιμαστέα αξιολόγηση πρακτόρων για AI agents.
Υπέρ και κατά
Υπέρ
- Σχεδιασμένο ειδικά για αξιολόγηση πολυ-βηματικών AI agents
- Δημιουργεί συνθετικά δεδομένα δοκιμών σε κλίμακα
- Υποστηρίζει προσαρμοσμένες μετρικές και αξιολογητές
- Υποστηρίζεται από το Y Combinator με ενεργή ανάπτυξη
Κατά
- Κυρίως στοχεύει σε τεχνικές ομάδες, όχι σε μη προγραμματιστές
- Νέα πλατφόρμα με εξελισσόμενο σύνολο λειτουργιών
- Μπορεί να απαιτήσει εργασίες ενσωμάτωσης για προσαρμογή σε υπάρχουσες υποδομές
Ρεκόρ μαχών
Σε 3 μάχες στο Πάνθεον.
Last 3 battles
Κριτικές
Μέσος όρος από 6 βαθμολογίες.
Σύνδεση για κριτική.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Ερωτήσεις
Ποια είναι τα πλεονεκτήματα της χρήσης του Relari;
Το Relari έχει σχεδιαστεί ειδικά για την αξιολόγηση πολυβήματων AI πρακτόρων, δημιουργεί συνθετικά δεδομένα δοκιμών σε μεγάλη κλίμακα, και υποστηρίζει προσαρμοσμένες μετρικές και αξιολογητές, με ενεργή ανάπτυξη που υποστηρίζεται από το Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Είναι το Relari κατάλληλο για μη‑τεχνικές ομάδες;
Το Relari είναι κυρίως σχεδιασμένο για τεχνικές ομάδες, όχι για μη‑προγραμματιστές, και μπορεί να απαιτεί ενσωμάτωση για να ταιριάξει με υπάρχουσες υποδομές.
Asked by Hasan Demir · May 27, 2026
Ποιες λειτουργίες υποστηρίζει το Relari;
Το Relari υποστηρίζει λειτουργίες όπως δημιουργία συνθετικών συνόλων δεδομένων, αυτοματοποιημένα pipelines αξιολόγησης πρακτόρων, προσομοίωση σεναρίων και προσαρμόσιμες μετρικές αξιολόγησης.
Asked by Marisol Pena · Apr 17, 2026
Για τι χρησιμοποιείται το Relari;
Το Relari είναι μια πλατφόρμα για δοκιμή, αξιολόγηση και δημιουργία συνθετικών δεδομένων για AI πράκτορες, βοηθώντας τις ομάδες να βελτιώσουν την αξιοπιστία τους μέσω συστηματικής δοκιμής και αξιολόγησης.
Asked by Hana Kobayashi · Mar 25, 2026
Κάνε μια ερώτηση
Εναλλακτικές για Διατηρησιμότητα

Πολιπλατφόρμα προγραμματιστών για την κατασκευή, παρακολούθηση και κλιμάκωση εφαρμογών LLM.

Πλατφόρμα ασφάλειας και διακυβέρνησης για αυτόνομους AI πράκτορες και έξυπνα συστήματα.

Πλατφόρμα end-to-end για την αξιολόγηση, παρακολούθηση και βελτίωση AI agents

Παρακολουθήστε πώς η μάρκα σας εμφανίζεται σε ChatGPT, Claude, Perplexity και τις Επισκοπήσεις Google AI.

Ένας δημιουργός ροών εργασίας AI χωρίς κώδικα που επιτρέπει στις επιχειρήσεις να αυτοματοποιούν τις λειτουργίες τους ενσωματώνοντας πολλαπλά μεγάλα μοντέλα γλώσσας (LLMs) και συνδέοντας προτροπές...

Δημιουργήστε, αξιολογήστε και βελτιώστε AI πράκτορες για επιχειρησιακό αυτοματισμό
Πλατφόρμα παρατηρησιμότητας όλα-ενός για την παρακολούθηση, αποσφαλμάτωση και βελτίωση παραγωγικών εφαρμογών LLM.

Μηχανιακή συνήγορος για τις Λειτουργίες Τεχνολογικών Συστημάτων που γρήγορα ανακαλύπτει, τυποποιητικά και συνδέει επεισόδια και λήξη.
Trending now

Σεμάντηση Έργο με Πλήρεις Ηλεκτρονικές Αποδευμάτων

API ευφυούς επεξεργασίας εγγράφων που αναλύει, χωρίζει, κάνει OCR και εξάγει δομημένα δεδομένα από σύνθετα PDF, διαφάνειες και λογιστικά φύλλα.

Ανοιχτό πολυμορφικό μοντέλο 12B που χειρίζεται αλληλοεναλλασσόμενες εικόνες και κείμενο με παράθυρο συμφραζομένων 128K.

Κομπολεπιθούμενοι απαντήσεις, ταμείνου ανά κλικ.
