Zum Hauptinhalt springen
buildradar
Sign in
Thema · evaluation-metrics

evaluation-metrics

Erfasste Open-Source-Repos mit dem Tag evaluation-metrics, sortiert nach Sternen.

Repos
12
Sterne gesamt
39.801
Sterne im Schnitt
3.317
Anteil
0,00%

Themen, die häufig gemeinsam mit evaluation-metrics am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit evaluation-metrics getaggt wurden.

  • eval@frontier-harness-eval

    Public results and task definitions for FrontierHarness Eval

    151
  • deepeval@confident-ai

    Das LLM-Evaluierungs-Framework

    18.063+110Sterne-Änderung der letzten 7 Tage
  • agentops@AgentOps-AI

    Python-SDK für KI-Agenten-Monitoring, LLM-Kostenverfolgung, Benchmarking und mehr. Integriert sich in die meisten LLMs und Agenten-Frameworks, einschließlich CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2 und CamelAI

    5.808+3Sterne-Änderung der letzten 7 Tage
  • tiny-universe@datawhalechina

    Leitfaden zum Aufbau von Large Language Models in einer White-Box: Ein komplett selbst entwickelter Tiny-Universe

    5.040+9Sterne-Änderung der letzten 7 Tage
  • lighteval@huggingface

    Lighteval ist Ihr All-in-One-Toolkit zur Evaluierung von LLMs über mehrere Backends hinweg

    2.533+3Sterne-Änderung der letzten 7 Tage
  • evaluation-guidebook@huggingface

    Teilen von praktischen Einblicken und theoretischem Wissen zur LLM-Evaluierung, die wir bei der Verwaltung des Open LLM Leaderboards und der Entwicklung von lighteval gesammelt haben!

    2.143+2Sterne-Änderung der letzten 7 Tage
  • AB3DMOT@xinshuoweng

    (IROS 2020, ECCVW 2020) Offizielle Python-Implementierung für „3D Multi-Object Tracking: A Baseline and New Evaluation Metrics“

    1.846+0Sterne-Änderung der letzten 7 Tage
  • jiwer@jitsi

    Evaluieren Sie Ihr Speech-to-Text-System mit Ähnlichkeitsmaßen wie der Word Error Rate (WER)

    927+1Sterne-Änderung der letzten 7 Tage
  • OCTIS@MIND-Lab

    OCTIS: Topic-Modelle vergleichen ist einfach! Ein Python-Paket zur Optimierung und Evaluierung von Topic-Modellen (angenommen beim EACL2021 Demo Track)

    804+0Sterne-Änderung der letzten 7 Tage
  • COMET@Unbabel

    Ein neurales Framework für die MT-Evaluierung

    778+1Sterne-Änderung der letzten 7 Tage
  • ranx@AmenRa

    ⚡️Eine blitzschnelle Python-Bibliothek für Ranking-Evaluierung, -Vergleich und -Fusion 🐍

    697+4Sterne-Änderung der letzten 7 Tage
  • :chart_with_upwards_trend: Implementierung von acht Evaluierungsmetriken zur Bestimmung der Ähnlichkeit zwischen zwei Bildern: RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM und UIQ.

    647+0Sterne-Änderung der letzten 7 Tage
  • continuous-eval@relari-ai

    Datengestützte Evaluierung für LLM-basierte Anwendungen

    517+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen