본문으로 건너뛰기
buildradar
Sign in
토픽 · llm-evaluation

llm-evaluation

llm-evaluation 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 37개
  • agent-skills-eval@darkrishabh

    agentskills.io 스타일의 AI 에이전트 스킬을 위한 테스트 러너

    724+16최근 7일 스타 변화
  • ClawBench@TIGER-AI-Lab

    일상적인 작업에서 브라우저 AI 에이전트를 테스트하기 위한 오픈소스 벤치마크.

    657+40최근 7일 스타 변화
  • Awesome-LLM-Eval: 주로 LLM 평가를 위한 도구, 데이터셋/벤치마크, 데모, 리더보드, 논문, 문서 및 모델의 선별 목록

    656-2최근 7일 스타 변화
  • 사회과학 분야의 LLM 관련 논문 모음

    648+1최근 7일 스타 변화
  • SkillCorpus@EverMind-AI

    Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.

    559최근 7일 스타 변화
  • 기업 내부 문서를 활용한 RAG용 데이터셋 및 벤치마크입니다.

    542+9최근 7일 스타 변화
  • continuous-eval@relari-ai

    LLM 기반 애플리케이션을 위한 데이터 기반 평가

    517+1최근 7일 스타 변화
← 토픽 목록으로