본문으로 건너뛰기
buildradar
Sign in
토픽 · evaluation-framework

evaluation-framework

evaluation-framework 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
10
총 스타
70,407
평균 스타
7,041
비중
0.00%

같은 리포지토리에 evaluation-framework 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 evaluation-framework 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • promptfoo@promptfoo

    프롬프트, 에이전트 및 RAG 테스트. AI를 위한 레드 티밍/모의 해킹/취약점 스캐닝. GPT, Claude, Gemini, DeepSeek 등의 성능 비교. 명령줄 및 CI/CD 통합을 지원하는 간단한 선언형 설정. OpenAI 및 Anthropic에서 사용 중.

    24,664+215최근 7일 스타 변화
  • deepeval@confident-ai

    LLM 평가 프레임워크

    17,953+184최근 7일 스타 변화
  • lm-evaluation-harness@EleutherAI

    언어 모델의 퓨쇼트(few-shot) 평가를 위한 프레임워크

    13,827+89최근 7일 스타 변화
  • Kiln@Kiln-AI

    AI 시스템 구축, 평가 및 최적화. 평가, RAG, 에이전트, 파인튜닝, 합성 데이터 생성, 데이터셋 관리, MCP 등을 포함합니다.

    5,037+7최근 7일 스타 변화
  • lighteval@huggingface

    Lighteval은 다양한 백엔드에서 LLM을 평가하기 위한 올인원 툴킷입니다

    2,530+8최근 7일 스타 변화
  • EvalAI@Cloud-CV

    :cloud: :rocket: :bar_chart: :chart_with_upwards_trend: 최신 AI 기술(SOTA) 평가

    2,037-2최근 7일 스타 변화
  • future-agi@future-agi

    LLM 및 AI 에이전트 애플리케이션을 평가, 모니터링, 개선하기 위한 오픈소스 엔드투엔드 플랫폼. 트레이싱, 평가, 시뮬레이션, 데이터셋, 게이트웨이, 가드레일 제공. 자체 호스팅 가능. Apache 2.0.

    1,873+89최근 7일 스타 변화
  • ai-agents-the-definitive-guide@Nicolepcx

    AI 에이전트를 위한 최종 가이드 저장소

    1,528+422최근 7일 스타 변화
  • AgentLab@ServiceNow

    AgentLab: 다양한 작업에서 웹 에이전트를 개발, 테스트 및 벤치마킹하기 위한 오픈 소스 프레임워크로, 확장성과 재현성을 고려하여 설계되었습니다.

    627+2최근 7일 스타 변화
  • continuous-eval@relari-ai

    LLM 기반 애플리케이션을 위한 데이터 기반 평가

    517+1최근 7일 스타 변화
← 토픽 목록으로