evaluation-metrics
Erfasste Open-Source-Repos mit dem Tag evaluation-metrics, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit evaluation-metrics am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit evaluation-metrics getaggt wurden.
- #1★ 18.063+110Sterne-Änderung der letzten 7 Tage
- #2
Python-SDK für KI-Agenten-Monitoring, LLM-Kostenverfolgung, Benchmarking und mehr. Integriert sich in die meisten LLMs und Agenten-Frameworks, einschließlich CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2 und CamelAI
★ 5.808+3Sterne-Änderung der letzten 7 Tage - #3
Leitfaden zum Aufbau von Large Language Models in einer White-Box: Ein komplett selbst entwickelter Tiny-Universe
★ 5.040+9Sterne-Änderung der letzten 7 Tage - #4
Lighteval ist Ihr All-in-One-Toolkit zur Evaluierung von LLMs über mehrere Backends hinweg
★ 2.533+3Sterne-Änderung der letzten 7 Tage - #5
Teilen von praktischen Einblicken und theoretischem Wissen zur LLM-Evaluierung, die wir bei der Verwaltung des Open LLM Leaderboards und der Entwicklung von lighteval gesammelt haben!
★ 2.143+2Sterne-Änderung der letzten 7 Tage - #6
(IROS 2020, ECCVW 2020) Offizielle Python-Implementierung für „3D Multi-Object Tracking: A Baseline and New Evaluation Metrics“
★ 1.846+0Sterne-Änderung der letzten 7 Tage - #7
Evaluieren Sie Ihr Speech-to-Text-System mit Ähnlichkeitsmaßen wie der Word Error Rate (WER)
★ 927+1Sterne-Änderung der letzten 7 Tage - #8
OCTIS: Topic-Modelle vergleichen ist einfach! Ein Python-Paket zur Optimierung und Evaluierung von Topic-Modellen (angenommen beim EACL2021 Demo Track)
★ 804+0Sterne-Änderung der letzten 7 Tage - #9★ 778+1Sterne-Änderung der letzten 7 Tage
- #10
⚡️Eine blitzschnelle Python-Bibliothek für Ranking-Evaluierung, -Vergleich und -Fusion 🐍
★ 697+4Sterne-Änderung der letzten 7 Tage - #11
:chart_with_upwards_trend: Implementierung von acht Evaluierungsmetriken zur Bestimmung der Ähnlichkeit zwischen zwei Bildern: RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM und UIQ.
★ 647+0Sterne-Änderung der letzten 7 Tage - #12
Datengestützte Evaluierung für LLM-basierte Anwendungen
★ 517+1Sterne-Änderung der letzten 7 Tage