Relari (YC W24)Testēšanas, novērtēšanas un sintētisko datu ģenerācijas platforma AI aģentiem.
Pārskats
Galvenās funkcijas
- Sintētisku datu kopumu ģenerācija
- Automātiskā aģentu novērtēšanas konveijeri
- Scenārija un konversāciju simulācija
- Personalizējamās novērtēšanas metrikas
- Regressijas testēšana LLM lietotnēs
- Efektivitātes benchmarkingu un atskaitēšana
Cenas
- Modelis
- Free
- Kategorija
- Attīstība pieejamība un pārvaldība
- Vērtējums
- 4.3 / 5 (6)
Lietošanas gadījumi
AI aģentu testēšana
Uzticami un testējami aģentu novērtējumi AI aģentiem.
Plusi un mīnusi
Plusi
- Specializēts, lai novērtētu daudzpakāpju AI aģentus
- Ģenerē sintētiskos testu datus lielā mērogā
- Atbalsta personalizētās metrikas un novērtētājus
- Atbalstīts no Y Combinator ar aktīvu attīstību
Mīnusi
- Galvenokārt vērsts uz tehniskām komandām, nevis neizstrādātājiem
- Jaunāka platforma ar mainīgu funkciju kopumu
- Var būt nepieciešama integrācijas darbība, lai pielāgotu esošām stekām
Kauju rekords
3 kaujās Panteonā.
Last 3 battles
Atsauksmes
Vidējais no 6 vērtējumiem.
Pieslēdzies, lai atstātu atsauksmi.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Jautājumi
Kādas ir priekšrocības izmantot Relari?
Relari ir izstrādāts, lai novērtētu daudzsoļu AI agentus, ģenerē sintētiskus testēšanas datus masveidā, atbalsta pielāgotas metrikas un novērtētājus, ar aktīvu izstrādi, ko atbalsta Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Vai Relari ir piemērots ne-tehniskām komandām?
Relari galvenokārt ir paredzēts tehniskām komandām, nevis neizstrādētājiem, un var prasīt integrācijas darbu, lai pielāgotu esošajām tehnoloģiju kopām.
Asked by Hasan Demir · May 27, 2026
Kādas funkcijas atbalsta Relari?
Relari atbalsta funkcijas kā sintētisko datu kopu ģenerēšana, automatizētie agentu novērtēšanas pipelines, scenāriju simulēšana un pielāgojamas novērtēšanas metrikas.
Asked by Marisol Pena · Apr 17, 2026
Ko Relari izmanto?
Relari ir platforma AI agentu testēšanai, novērtēšanai un sintētisko datu ģenerēšanai, kas palīdz komandām uzlabot to uzticamību caur sistemātisku testēšanu un novērtēšanu.
Asked by Hana Kobayashi · Mar 25, 2026
Uzdod jautājumu
Attīstība pieejamība un pārvaldība alternatīvas

Vienots izstrādātāju platforma LLM lietojumprogrammu izveidei, uzraudzībai un mērogošanai.

Drošības un pārvaldības platforma autonomajiem AI darbiniekiem un inteliģentajām sistēmām.

No sākuma līdz beigām platforma, kas novērtē, uzrauga un uzlabo AI agentus

Sekojiet, kā jūsu zīmols parādās ChatGPT, Claude, Perplexity un Google AI pārskatos.

Nav koda AI darbplūsmas veidotājs, kas ļauj uzņēmumiem automatizēt operācijas, integrējot vairākus lielos valodas modeļus (LLM) un savienojot uzvednes…

Izveidojiet, novērtējiet un uzlabojiet AI agentus uzņēmējdarbības automatizācijai
Visiens observācijas platforma, lai uzraudzītu, atkļūdotu un uzlabotu ražošanas LLM lietojumprogrammas.

AI asistents IT operācijām, kas paātrina incidentu atklāšanu, triage un atrisināšanu.
Trending now

Precīza Pildījuma Palīdzība ar Vispārējām Izskaidrojumiem

Dokumentu intelekta API, kas parse, dalās, OCR un izvelk strukturētus datus no kompleksām PDF, slaidēm un kalkulāciju tabulām.

Atvērts multimodāls 12B modelis, kas apstrādā iekavētus attēlus un tekstu ar 128K konteksta logu.

Finansētas atbildes, maksām uz klikšķi.
