본문으로 건너뛰기
buildradar
Sign in
토픽 · agent-evaluation

agent-evaluation

agent-evaluation 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
9
총 스타
32,319
평균 스타
3,591
비중
0.00%

같은 리포지토리에 agent-evaluation 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 agent-evaluation 태그가 달린 리포지토리예요.

  • awesome-evals@benchflow-ai

    AI 에이전트 구축 및 평가를 위한 최고의 리소스(논문, 블로그, 강연, 도구, 벤치마크)를 엄선한 실속 있는 라이브러리. BenchFlow에서 유지 관리합니다.

    864
  • iFixAi@ifixai-ai

    AI 에이전트 독립 감사. AI 에이전트 경제에서 가장 중요한 질문에 답하기 위해 사람이 직접 또는 에이전트 스스로 실행합니다. 에이전트가 의도대로 작동하고 있나요? iFixAi를 사용하면 120초 이내에 이 질문에 대한 답을 얻을 수 있습니다.

    12,643+1,247최근 7일 스타 변화
  • giskard-oss@Giskard-AI

    🐢 LLM 에이전트를 위한 오픈소스 평가 및 테스트 라이브러리

    5,801+9최근 7일 스타 변화
  • coze-loop@coze-dev

    차세대 AI Agent 최적화 플랫폼: Cozeloop은 개발, 디버깅, 평가부터 모니터링까지 전체 라이프사이클 관리 기능을 제공하여 AI agent 개발의 어려움을 해결합니다.

    5,711+5최근 7일 스타 변화
  • trulens@truera

    LLM 실험 및 AI 에이전트를 위한 평가 및 추적

    3,530+2최근 7일 스타 변화
  • any-agent@mozilla-ai

    다양한 에이전트 프레임워크를 사용하고 평가하기 위한 단일 인터페이스

    1,199+2최근 7일 스타 변화
  • intelligent-audit-system@Ricky-7-Yan

    AuditPilot: 근거 기반 워크플로우, 거버넌스 도구, 평가 하네스, 사람 검토, 수정 전달을 위한 감사 가능한 엔터프라이즈 AI 에이전트

    1,166+0최근 7일 스타 변화
  • awesome-evals@benchflow-ai

    AI 에이전트 구축 및 평가를 위한 최고의 리소스(논문, 블로그, 강연, 도구, 벤치마크)를 엄선한 실속 있는 라이브러리. BenchFlow에서 유지 관리합니다.

    864+17최근 7일 스타 변화
  • pandaprobe@chirpz-ai

    AI 에이전트 디버깅 및 개선을 위한 추적, 평가, 메트릭을 제공하는 오픈 소스 에이전트 엔지니어링 플랫폼입니다. LangGraph, CrewAI, Claude Agent SDK 등과 통합됩니다.

    783+1최근 7일 스타 변화
  • ClawBench@TIGER-AI-Lab

    일상적인 작업에서 브라우저 AI 에이전트를 테스트하기 위한 오픈소스 벤치마크.

    664+54최근 7일 스타 변화
← 토픽 목록으로