토픽 · evaluation-framework
evaluation-framework
evaluation-framework 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
리포지토리
10
총 스타
70,407
평균 스타
7,041
비중
0.00%
관련 토픽
같은 리포지토리에 evaluation-framework 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 evaluation-framework 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1
프롬프트, 에이전트 및 RAG 테스트. AI를 위한 레드 티밍/모의 해킹/취약점 스캐닝. GPT, Claude, Gemini, DeepSeek 등의 성능 비교. 명령줄 및 CI/CD 통합을 지원하는 간단한 선언형 설정. OpenAI 및 Anthropic에서 사용 중.
★ 24,664+215최근 7일 스타 변화 - #2★ 17,953+184최근 7일 스타 변화
- #3
언어 모델의 퓨쇼트(few-shot) 평가를 위한 프레임워크
★ 13,827+89최근 7일 스타 변화 - #4★ 5,037+7최근 7일 스타 변화
- #5★ 2,530+8최근 7일 스타 변화
- #6★ 2,037-2최근 7일 스타 변화
- #7
LLM 및 AI 에이전트 애플리케이션을 평가, 모니터링, 개선하기 위한 오픈소스 엔드투엔드 플랫폼. 트레이싱, 평가, 시뮬레이션, 데이터셋, 게이트웨이, 가드레일 제공. 자체 호스팅 가능. Apache 2.0.
★ 1,873+89최근 7일 스타 변화 - #8
AI 에이전트를 위한 최종 가이드 저장소
★ 1,528+422최근 7일 스타 변화 - #9
AgentLab: 다양한 작업에서 웹 에이전트를 개발, 테스트 및 벤치마킹하기 위한 오픈 소스 프레임워크로, 확장성과 재현성을 고려하여 설계되었습니다.
★ 627+2최근 7일 스타 변화 - #10
LLM 기반 애플리케이션을 위한 데이터 기반 평가
★ 517+1최근 7일 스타 변화