Zum Hauptinhalt springen
buildradar
Sign in
Thema · evaluation-framework

evaluation-framework

Erfasste Open-Source-Repos mit dem Tag evaluation-framework, sortiert nach Sternen.

Repos
10
Sterne gesamt
70.407
Sterne im Schnitt
7.041
Anteil
0,00%

Themen, die häufig gemeinsam mit evaluation-framework am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit evaluation-framework getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • promptfoo@promptfoo

    Testen Sie Ihre Prompts, Agents und RAGs. Red Teaming/Pentesting/Vulnerability-Scanning für KI. Leistungsvergleich von GPT, Claude, Gemini, DeepSeek und mehr. Einfache deklarative Konfigurationen mit Kommandozeile und CI/CD-Integration. Von OpenAI und Anthropic genutzt.

    24.664+215Sterne-Änderung der letzten 7 Tage
  • deepeval@confident-ai

    Das LLM-Evaluierungs-Framework

    17.953+184Sterne-Änderung der letzten 7 Tage
  • lm-evaluation-harness@EleutherAI

    Ein Framework für die Few-Shot-Evaluierung von Sprachmodellen.

    13.827+89Sterne-Änderung der letzten 7 Tage
  • Kiln@Kiln-AI

    KI-Systeme entwickeln, bewerten und optimieren. Beinhaltet Evaluierungen, RAG, Agenten, Fine-Tuning, synthetische Datenerzeugung, Dataset-Management, MCP und mehr.

    5.037+7Sterne-Änderung der letzten 7 Tage
  • lighteval@huggingface

    Lighteval ist Ihr All-in-One-Toolkit zur Evaluierung von LLMs über mehrere Backends hinweg

    2.530+8Sterne-Änderung der letzten 7 Tage
  • EvalAI@Cloud-CV

    :cloud: :rocket: :bar_chart: :chart_with_upwards_trend: Evaluierung des State of the Art in der KI

    2.037-2Sterne-Änderung der letzten 7 Tage
  • future-agi@future-agi

    Open-Source-End-to-End-Plattform zum Evaluieren, Überwachen und Verbessern von LLM- und KI-Agenten-Anwendungen. Tracing · Evals · Simulationen · Datasets · Gateway · Guardrails. Selbst hostbar. Apache 2.0.

    1.873+89Sterne-Änderung der letzten 7 Tage
  • ai-agents-the-definitive-guide@Nicolepcx

    Repository für den ultimativen Leitfaden zu AI Agents

    1.386+422Sterne-Änderung der letzten 7 Tage
  • AgentLab@ServiceNow

    AgentLab: Ein Open-Source-Framework zur Entwicklung, zum Testen und zum Benchmarking von Web-Agenten für verschiedene Aufgaben, ausgelegt auf Skalierbarkeit und Reproduzierbarkeit.

    627+2Sterne-Änderung der letzten 7 Tage
  • continuous-eval@relari-ai

    Datengestützte Evaluierung für LLM-basierte Anwendungen

    517+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen