llm-evaluation
Repositórios de código aberto acompanhados marcados com llm-evaluation, ordenados por estrelas.
- #31
Um executor de testes para habilidades de agentes de IA no estilo agentskills.io
★ 728+19Variação de estrelas nos últimos 7 dias - #32
Benchmark de código aberto para agentes de IA de navegador em tarefas diárias.
★ 691+72Variação de estrelas nos últimos 7 dias - #33
Awesome-LLM-Eval: uma lista com curadoria de ferramentas, conjuntos de dados/benchmarks, demonstrações, placares, artigos, documentos e modelos, focada principalmente na avaliação de LLMs.
★ 656-2Variação de estrelas nos últimos 7 dias - #34
Artigos incríveis envolvendo LLMs em ciências sociais.
★ 648+1Variação de estrelas nos últimos 7 dias - #35
Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.
★ 646—Variação de estrelas nos últimos 7 dias - #36
Dataset e benchmark para RAG em documentos internos de empresas.
★ 548+12Variação de estrelas nos últimos 7 dias - #37
Avaliação orientada a dados para aplicações baseadas em LLM
★ 517+1Variação de estrelas nos últimos 7 dias