Relari (YC W24)Todennäköisyyksien testaus, arviointi sekä tietynäytteen generaatioalusta AI-agentitien parissa.
Yleiskatsaus
Pääominaisuudet
- Synthetinen datasetin generaatio
- Automatisoitu agenttien arviointiin liittyvä ketterät ketjut
- Skenaariokeskundet ja keskusteltavuuden simulointi
- Muokattavissa olevia arviointimetodeja
- Jälkikäteen testaus LLM-sovelluksille
- Suorituskykykokeet ja raportointi
Hinnat
- Malli
- Free
- Kategoria
- Seurannan kyky
- Arvio
- 4.3 / 5 (6)
Käyttötapaukset
Testaus AI-agenttien
Luotettava ja testattava arviointi AI-agenttien toteuttamiselle.
Plussat ja miinukset
Plussat
- Omaa tarkoitusta varten kehitetty muutospaineisten AI-agentien arviointiin
- Synthetistä testitietoa skaalataan
- Tukee mukautettuja metriikkejä ja arviointilaitteita
- Taustalla Y Combinatorin kanssa aktiivinen kehitys
Miinukset
- Pääosin tähtää ketteränä käytössä oleville tekniseen tiimiin, ei kehystelemisistä
- Uusi alusta kehityksessä olevan ominaisuuden määrällä
- Osaaminen vaaditaan välttääkseen integraatio työtä varten vanhat räätälistä
Taisteluennätys
3 taistelussa Panteonissa.
Last 3 battles
Arvostelut
Keskiarvo 6 arviosta.
Kirjaudu sisään jättääksesi arvostelun.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.
Solid for our team
We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.
Use it every day
Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.
Kysymykset
Mitkä ovat Relarin käyttämisen edut?
Relari on tarkoitettu erityisesti monivaiheisten AI‑agenttien arviointiin, tuottaa synteettistä testidataa mittakaavassa, tukee räätälöityjä mittareita ja arvioijia, ja sen aktiivista kehitystä tukee Y Combinator.
Asked by Anya Sokolova · Jun 27, 2026
Onko Relari sopiva ei‑teknisille tiimeille?
Relari on pääasiassa suunnattu teknisille tiimeille, ei‑kehittäjille se ei välttämättä sovellu ja se saattaa vaatia integraatiotyötä olemassa oleviin stackeihin.
Asked by Hasan Demir · May 27, 2026
Mitä ominaisuuksia Relari tukee?
Relari tukee esimerkiksi synteettisten datasetien generointia, automatisoituja agenttien arviointiputkia, skenaarioiden simulointia ja räätälöitäviä arviointimittareita.
Asked by Marisol Pena · Apr 17, 2026
Mihin Relaria (YC W24) käytetään?
Relari on alusta AI‑agenttien testaamiseen, arviointiin ja synteettisen datan tuottamiseen, jonka avulla tiimit voivat parantaa luotettavuutta järjestelmällisen testauksen ja arvioinnin avulla.
Asked by Hana Kobayashi · Mar 25, 2026
Kysy kysymys
Seurannan kyky vaihtoehdot

Yhdistetty kehittäjien alusta LLM-sovellusten luomiseen, seuraamiseen ja mittakaavaan

Turvallisuus- ja hallintasivusto itsenäisille AI-agenteille ja älykkäille järjestelmissä.

Ei-puutteiden mittaus- ja seuraamusjärjestelmä AI-agenteille

Seuraa, miten merkitseväsi esiin olet kaikissa ai-heikoissa palveluissa, kuten ChatGPT, Claude, Perplexity ja Google AI Overviews.

No-code AI -työnkulunrakennus, joka mahdollistaa yrityksille operaatioiden automatisoinnin useiden suurten kielimallien (LLM) integroinnilla ja kehotteiden saumattomalla yhdistämisellä.

Rakenna, arvioi ja paranna bisneksen automointia varten AI-agenteja
Yhden neuvonnan määrän observabiliteettiplatvormi, jotta näkee, korjaat ja kehityt tuotantotietoja LLM ohjelmiasi.

Tietotekniikkayhteyksien automaattinen agentti, joka nopeuttaa tapahtumien havaitsemisen, luokittelun ja ratkaisun.
Trending now

Dokumentti-intelligentti API, joka parsitsee, jaetsee, tunnistaa OCR:in ja noutaa rakennepohjaisia tietoja monimutkaisista PDF-tiedostoista, näyttelyesitelmista ja lehtikuluista.

Vastineiden sponsoroiminen, maksettu per klikki.

Tarkka avuksi koulutehtävissä - selitykset mukaan lukien

Avoin multimodaalinen 12B-malli, joka käsittelee lomitetut kuvat ja teksti 128K:n kontekstin ikkunalla.
