Pular para o conteúdo principal
buildradar
Sign in
Tópico · llm-evaluation

llm-evaluation

Repositórios de código aberto acompanhados marcados com llm-evaluation, ordenados por estrelas.

37 repositórios
  • agent-skills-eval@darkrishabh

    Um executor de testes para habilidades de agentes de IA no estilo agentskills.io

    728+19Variação de estrelas nos últimos 7 dias
  • ClawBench@TIGER-AI-Lab

    Benchmark de código aberto para agentes de IA de navegador em tarefas diárias.

    691+72Variação de estrelas nos últimos 7 dias
  • Awesome-LLM-Eval: uma lista com curadoria de ferramentas, conjuntos de dados/benchmarks, demonstrações, placares, artigos, documentos e modelos, focada principalmente na avaliação de LLMs.

    656-2Variação de estrelas nos últimos 7 dias
  • Artigos incríveis envolvendo LLMs em ciências sociais.

    648+1Variação de estrelas nos últimos 7 dias
  • SkillCorpus@EverMind-AI

    Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.

    646Variação de estrelas nos últimos 7 dias
  • Dataset e benchmark para RAG em documentos internos de empresas.

    548+12Variação de estrelas nos últimos 7 dias
  • continuous-eval@relari-ai

    Avaliação orientada a dados para aplicações baseadas em LLM

    517+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos