Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · llm-evaluation

llm-evaluation

Các kho mã nguồn mở đang theo dõi được gắn thẻ llm-evaluation, sắp xếp theo số sao.

37 kho mã
  • agent-skills-eval@darkrishabh

    Trình chạy kiểm thử cho các kỹ năng AI agent theo phong cách agentskills.io

    724+16Thay đổi số sao trong 7 ngày qua
  • ClawBench@TIGER-AI-Lab

    Bộ tiêu chuẩn đánh giá mã nguồn mở cho các tác nhân AI trên trình duyệt thực hiện các tác vụ hàng ngày.

    657+54Thay đổi số sao trong 7 ngày qua
  • Awesome-LLM-Eval: danh sách tuyển chọn các công cụ, tập dữ liệu/benchmark, bản demo, bảng xếp hạng, tài liệu và mô hình, chủ yếu dành cho việc đánh giá LLM.

    656-2Thay đổi số sao trong 7 ngày qua
  • Các bài báo nghiên cứu nổi bật về việc ứng dụng LLM trong Khoa học Xã hội.

    648+1Thay đổi số sao trong 7 ngày qua
  • SkillCorpus@EverMind-AI

    Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.

    559Thay đổi số sao trong 7 ngày qua
  • Tập dữ liệu và điểm chuẩn cho RAG trên các tài liệu nội bộ của công ty.

    545+8Thay đổi số sao trong 7 ngày qua
  • continuous-eval@relari-ai

    Đánh giá dựa trên dữ liệu cho các ứng dụng hỗ trợ LLM

    517+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề