Zum Hauptinhalt springen
buildradar
Sign in
Thema · agent-evaluation

agent-evaluation

Erfasste Open-Source-Repos mit dem Tag agent-evaluation, sortiert nach Sternen.

Repos
9
Sterne gesamt
32.319
Sterne im Schnitt
3.591
Anteil
0,00%

Themen, die häufig gemeinsam mit agent-evaluation am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit agent-evaluation getaggt wurden.

  • awesome-evals@benchflow-ai

    Eine kuratierte, direkte Sammlung der besten Ressourcen zum Erstellen und Evaluieren von KI-Agenten – Paper, Blogs, Vorträge, Tools, Benchmarks. Gepflegt von BenchFlow.

    864
  • iFixAi@ifixai-ai

    Unabhängige Prüfung von KI-Agenten. Ausgeführt von Menschen oder dem Agenten selbst, um die wichtigste Frage in der KI-Agenten-Wirtschaft zu beantworten: Tut der Agent das, was er tun soll? Mit iFixAi erhalten Sie diese Antwort in weniger als 120 Sekunden.

    12.643+1.247Sterne-Änderung der letzten 7 Tage
  • giskard-oss@Giskard-AI

    🐢 Open-Source-Evaluierungs- und Testbibliothek für LLM-Agenten

    5.801+9Sterne-Änderung der letzten 7 Tage
  • coze-loop@coze-dev

    KI-Agent-Optimierungsplattform der nächsten Generation: Cozeloop adressiert Herausforderungen bei der Entwicklung von KI-Agenten durch die Bereitstellung von Funktionen für das gesamte Lebenszyklusmanagement von der Entwicklung über das Debugging und die Evaluierung bis hin zur Überwachung.

    5.711+5Sterne-Änderung der letzten 7 Tage
  • trulens@truera

    Evaluierung und Tracking für LLM-Experimente und KI-Agenten

    3.530+2Sterne-Änderung der letzten 7 Tage
  • any-agent@mozilla-ai

    Eine einheitliche Schnittstelle zur Nutzung und Evaluierung verschiedener Agent-Frameworks

    1.199+2Sterne-Änderung der letzten 7 Tage
  • intelligent-audit-system@Ricky-7-Yan

    AuditPilot: Auditierbare Enterprise-KI-Agenten für evidenzbasierte Workflows, kontrollierte Werkzeuge, Evaluierungsumgebungen, menschliche Überprüfung und Fehlerbehebung.

    1.166+0Sterne-Änderung der letzten 7 Tage
  • awesome-evals@benchflow-ai

    Eine kuratierte, direkte Sammlung der besten Ressourcen zum Erstellen und Evaluieren von KI-Agenten – Paper, Blogs, Vorträge, Tools, Benchmarks. Gepflegt von BenchFlow.

    864+17Sterne-Änderung der letzten 7 Tage
  • pandaprobe@chirpz-ai

    Open-Source-Agenten-Engineering-Plattform: Traces, Evals und Metrics zum Debuggen und Verbessern Ihrer KI-Agenten. Integriert sich in LangGraph, CrewAI, Claude Agent SDK und mehr.

    783+1Sterne-Änderung der letzten 7 Tage
  • ClawBench@TIGER-AI-Lab

    Open-Source-Benchmark für Browser-KI-Agenten bei alltäglichen Aufgaben.

    657+54Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen