Zum Hauptinhalt springen
buildradar
Sign in
Thema · llm-evaluation

llm-evaluation

Erfasste Open-Source-Repos mit dem Tag llm-evaluation, sortiert nach Sternen.

37 Repos
  • agent-skills-eval@darkrishabh

    Ein Test Runner für AI-Agent-Skills im Stil von agentskills.io.

    724+16Sterne-Änderung der letzten 7 Tage
  • ClawBench@TIGER-AI-Lab

    Open-Source-Benchmark für Browser-KI-Agenten bei alltäglichen Aufgaben.

    664+54Sterne-Änderung der letzten 7 Tage
  • Awesome-LLM-Eval: eine kuratierte Liste von Tools, Datensätzen/Benchmarks, Demos, Bestenlisten, Papers, Dokumenten und Modellen, hauptsächlich zur Evaluierung von LLMs.

    656-2Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Sammlung von Arbeiten zu LLMs in den Sozialwissenschaften.

    648+1Sterne-Änderung der letzten 7 Tage
  • SkillCorpus@EverMind-AI

    Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.

    594Sterne-Änderung der letzten 7 Tage
  • Datensatz und Benchmark für RAG auf internen Unternehmensdokumenten.

    545+8Sterne-Änderung der letzten 7 Tage
  • continuous-eval@relari-ai

    Datengestützte Evaluierung für LLM-basierte Anwendungen

    517+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen