#Evaluation
17 tools tagged “Evaluation”
Athina AI
AI
FoundryAI
사업 자동화에 위한 인공지능 에이전트를 구축, 성과 평가, 향상하세요.
Log10
전문가용 LLM평가 성능을 자동실시간오류 감지로 확대
Langfuse
오픈 소스형 LLM 엔지니어링 플랫폼으로 observability, metrics, evaluations, prompt 관리를 통해 대형 자연어 모델 어플리케이션을 디버그하여 향상시키는 도구입니다.
Latitude
프로덕션 AI 에이전트를 한 개의(prompt)의 도움으로 빌드합니다.
Quotient AI
실시간 모니터링 및 평가 플랫폼: 검색, RAG 및 에이전트에서 AI 실패를 잡기위한.
Vijil
뢰성이 보장된 신뢰할 수 있는 AI 에이전트를 빌드, 평가, 및 운영하기 위한 플랫폼.
LangSmith
LLM 애플리케이션에 대한 관측성, 평가, 디버그 플랫폼 - LangChain 팀
Keywords AI
LLM으로 가속되는 신뢰할 수 있는 애플리케이션을 수송하는 데 필요한 관찰성 및 디버깅 플랫폼.
Coval
대량 scale에서 AI 음성 및 채팅 에이전트를 테스트하기 위한 시뮬레이션 및 평가 플랫폼
Phonic Voice AI
전사적 음성 AI 플랫폼으로 신뢰할 수 있는 대화형 음성 에이전트를 만들고, 관찰하고, 평가합니다.
KeywordsAI
개발자 플랫폼을 위한統합된 AI 모델 플랫폼
Phoenix
개방형 AI 애플리케이션 추적 및 측정 플랫폼
QualiaInterviews
인공 지능에 의해 주도되는 다언어 및 대화식 연구와 평가 면접의 규모 확장
Mosaic AI Agent Framework
데이터브릭스가 제공하는 높은 품질의 AI 에이전트와 RAG 애플리케이션을建设, 배포, 평가하기 위한 도구 모음입니다.
Humanloop
기업 규소 LLM 평가 및 프롬프트 관리 플랫폼으로 신뢰할 수 있는 AI 기능 전송
LangWatch
생산 환경에서 AI 애플리케이션의 monitoring, evaluation, 및 향상에 대한 LLM 최적화 스튜디오입니다.















