Aller au contenu principal
buildradar
Sign in
Sujet · evaluation-metrics

evaluation-metrics

Dépôts open source suivis étiquetés evaluation-metrics, triés par étoiles.

Dépôts
12
Total d'étoiles
39 801
Étoiles en moyenne
3 317
Part
0,00%

Sujets qui apparaissent souvent aux côtés de evaluation-metrics sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés evaluation-metrics.

  • eval@frontier-harness-eval

    Public results and task definitions for FrontierHarness Eval

    151
  • deepeval@confident-ai

    Le framework d'évaluation pour LLM.

    18 063+110Évolution des étoiles sur les 7 derniers jours
  • agentops@AgentOps-AI

    SDK Python pour la surveillance d'agents IA, le suivi des coûts LLM, le benchmarking, et plus encore. S'intègre avec la plupart des LLM et frameworks d'agents, notamment CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2 et CamelAI.

    5 808+3Évolution des étoiles sur les 7 derniers jours
  • tiny-universe@datawhalechina

    Guide de construction de boîte blanche pour grands modèles : un Tiny-Universe entièrement conçu manuellement.

    5 040+9Évolution des étoiles sur les 7 derniers jours
  • lighteval@huggingface

    Lighteval est votre boîte à outils tout-en-un pour évaluer les LLM sur plusieurs backends.

    2 533+3Évolution des étoiles sur les 7 derniers jours
  • evaluation-guidebook@huggingface

    Partage d'aperçus pratiques et de connaissances théoriques sur l'évaluation des LLM, recueillis lors de la gestion de l'Open LLM Leaderboard et de la conception de lighteval.

    2 143+2Évolution des étoiles sur les 7 derniers jours
  • AB3DMOT@xinshuoweng

    (IROS 2020, ECCVW 2020) Implémentation Python officielle pour « 3D Multi-Object Tracking: A Baseline and New Evaluation Metrics ».

    1 846+0Évolution des étoiles sur les 7 derniers jours
  • jiwer@jitsi

    Évaluez votre système de reconnaissance vocale avec des mesures de similarité telles que le taux d'erreur sur les mots (WER).

    927+1Évolution des étoiles sur les 7 derniers jours
  • OCTIS@MIND-Lab

    OCTIS : Comparer des modèles de sujets en toute simplicité ! Un package Python pour optimiser et évaluer les modèles de sujets (accepté à la session démo de l'EACL2021).

    804+0Évolution des étoiles sur les 7 derniers jours
  • COMET@Unbabel

    Un framework neuronal pour l'évaluation de la traduction automatique.

    778+1Évolution des étoiles sur les 7 derniers jours
  • ranx@AmenRa

    ⚡️Une bibliothèque Python ultra-rapide pour l'évaluation, la comparaison et la fusion de classements 🐍

    697+4Évolution des étoiles sur les 7 derniers jours
  • Implémentation de huit métriques d'évaluation pour mesurer la similarité entre deux images. Les huit métriques sont : RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM et UIQ.

    647+0Évolution des étoiles sur les 7 derniers jours
  • continuous-eval@relari-ai

    Évaluation basée sur les données pour les applications propulsées par LLM.

    517+1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets