Relari (YC W24) logo

Relari (YC W24)منصة لاختبار وتقييم وتوليد البيانات الاصطناعية لعملاء الذكاء الاصطناعي

4.3 (6)
Daniel Nikulshynمراجعة بواسطة Daniel Nikulshyn·تم التحديث يوليو 2026

نظرة عامة

Relari هي منصة مخصصة لمنشئي البرامج لمواكبة جودة واعتماد एजنتي الذكاء الإصطناعي من خلال نظام اختبار وتقييم منهجي. تساعد الفريق في إنتاجdatasets مصطنعة، وتشغيل التقييمات التلقائية، وقياس أداء الوكيل في نماذج واقعية قبل إرسالها إلى الإنتاج. يتم دعم شركة Relari من قبل برنامج Y Combinator (W24)، وتحديدًا فريقين هندسيين يطورون تطبيقات LLM المعقدة والمحددة بخواص المراوغة، كما يوجد مراحل متعددة للعملاء حيث يفوت التصنيف التقليدية للجودة هذه الفئات. وتعمل برامجها على تحديد منهجية هندسة البرامج - واختبارات الوحدة والمراجعة والتقييمات والقائمة العددية للبيانات - في الأنظمة المعقدة للاستخبارات. يوفر المنصة متبعين مخصصين وتحليلات سيناريو ودعم مراقبة مستمرة، مما يجعلها مفيدة للتحقق مسبقًا قبل الإطلاق وعلى قدم المساواةضمان جودة एजنتس الإنتاج المستمر.

الميزات الرئيسية

  • توليد مجموعات البيانات الاصطناعية
  • خطوط أنابيب تقييم الوكلاء الآليين المتكيفة
  • محاكاة السيناريوهات والمحادثات
  • مقاييس تقييم قابلة للتخصيص
  • اختبارات تراجعية لتطبيقات LLM
  • تقارير مرجعية للأداء

التسعير

النموذج
Free
التقييم
4.3 / 5 (6)

حالات الاستخدام

اختبار وتقييم وكلاء الذكاء الاصطناعي

تحسين موثوقية وتقييم وكلاء الذكاء الاصطناعي المتقدمة من خلال الاختبار والتقييم المنهجي.

المزايا والعيوب

المزايا

  • مصممة خصيصًا لاختبار وتقييم وكلاء الذكاء الاصطناعي متعدد الخطوات
  • توليد بيانات اختبار على مقياس واسع
  • يدعم المقاييس والاختبارات المخصصة
  • يدعم من قبل Y Combinator مع تطوير نشط
  • قد يتطلب بعض الدمج ليتناسب مع الإعدادات الحالية

العيوب

  • موجّه بشكل أساسي للفرق التقنية وليس للمطورين غير التقنيين
  • منصة جديدة مع مجموعة ميزات تتطور
  • قد يتطلب عمل تكامل ليناسب المجموعة الحالية

سجل المعارك

عبر 3 معارك في البانثيون.

0
الأول
0
الثاني
0
الثالث

Last 3 battles

المراجعات

4.3

المتوسط من 6 تقييم.

5
2
4
4
3
0
2
0
1
0

سجّل الدخول لكتابة مراجعة.

Fatima Zahra

Fatima Zahra

Apr 4, 2026

Skeptical, then convinced

I went in skeptical — most tools in this space overpromise. It actually delivers on customizable evaluation metrics, and purpose-built for evaluating multi-step AI agents caught me off guard. still, I'd recommend giving it a real trial.

Robert Ainsworth

Robert Ainsworth

Mar 17, 2026

Solid for our team

We rolled this out across the team last quarter and supports custom metrics and evaluators. Customizable evaluation metrics fits neatly into how we already work, and customizable evaluation metrics removed a step we used to do by hand. Primarily aimed at technical teams, not non-developers, which is the main caveat, but it has held up under daily use.

DW

Devin Walker

Feb 6, 2026

Skeptical, then convinced

I went in skeptical — most tools in this space overpromise. It actually delivers on performance benchmarking and reporting, and supports custom metrics and evaluators caught me off guard. Primarily aimed at technical teams, not non-developers is why this isn't a perfect score, still, I'd recommend giving it a real trial.

Carlos Mendoza

Carlos Mendoza

Jul 20, 2025

Compared a few options

Evaluated this against two competitors. Where it wins: scenario and conversation simulation and purpose-built for evaluating multi-step AI agents. Where it lags: may require integration work to fit existing stacks. On balance the feature set — especially scenario and conversation simulation — justifies the 5 stars for our use case.

Yuki Mori

Yuki Mori

Jul 19, 2025

Use it every day

Honestly didn't expect to like it this much. Performance benchmarking and reporting is exactly what I needed, and purpose-built for evaluating multi-step AI agents. I do wish may require integration work to fit existing stacks, but I reach for it almost every day now and it just clicks.

Leila Hassan

Leila Hassan

Jul 14, 2025

Skeptical, then convinced

I went in skeptical — most tools in this space overpromise. It actually delivers on regression testing for LLM apps, and supports custom metrics and evaluators caught me off guard. May require integration work to fit existing stacks is why this isn't a perfect score, still, I'd recommend giving it a real trial.

أسئلة وأجوبة

ما مزايا الأستخدام من منصة Relari؟

يستهدف Relari بنوعه لتقييم العاملين الآليون المرحلون، ويولّد النشر الاصلي للبيانات بكميات كبيرة، ويدعم الحسابات التخصيصية والتصنيف الحقيقي، مع التطوير النشط من خلال Y Combinator.

Asked by Anya Sokolova · Jun 27, 2026

هل يكون مناسباً لـ Relari الفريقين للاستخدام اللاهوتي؟

يسير Relari في الأساس في الطاقم الفني، وغير الأشخاص العاديون، و قد يتطلب العمل التلطيخي للمشوارع المعروضة الموجودة حالياً.

Asked by Hasan Demir · May 27, 2026

ما الأنشطة التي يدعمها Relari؟

يدعم Relari الأنشطة مثل النشر الاصلي للبيانات والمعايير التلقائية للتصنيف والاختبار السيناريو و المعايير التصنيفية القابلة للتخصيص.

Asked by Marisol Pena · Apr 17, 2026

ماذا تستخدم Relari لذلك؟

يستخدم Relari منصة لاختبار والتصنيف والنشر والتوليد الاصلي من البيانات المتعلقة بالعاملين الآليين، مما يساعد الفريق في تحسين ثقة عملائهم من خلال اختبار وتصنيف منهجية.

Asked by Hana Kobayashi · Mar 25, 2026

اطرح سؤالاً

بدائل لـ عياشي فوية كقوة