मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · evaluation-metrics

evaluation-metrics

evaluation-metrics टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
12
कुल स्टार
39,801
औसत स्टार
3,317
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर evaluation-metrics के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और evaluation-metrics टैग वाली रिपॉजिटरी।

  • eval@frontier-harness-eval

    Public results and task definitions for FrontierHarness Eval

    160
  • deepeval@confident-ai

    LLM मूल्यांकन फ्रेमवर्क।

    18,063+110पिछले 7 दिनों में स्टार का बदलाव
  • agentops@AgentOps-AI

    AI एजेंट मॉनिटरिंग, LLM कॉस्ट ट्रैकिंग, बेंचमार्किंग और बहुत कुछ के लिए Python SDK। CrewAI, Agno, OpenAI Agents SDK, Langchain, Autogen, AG2, और CamelAI सहित अधिकांश LLMs और एजेंट फ्रेमवर्क के साथ एकीकृत होता है

    5,808+3पिछले 7 दिनों में स्टार का बदलाव
  • tiny-universe@datawhalechina

    लार्ज मॉडल व्हाइट-बॉक्स बिल्डिंग गाइड: एक पूरी तरह से हैंड-क्रॉफ्टेड Tiny-Universe

    5,040+9पिछले 7 दिनों में स्टार का बदलाव
  • lighteval@huggingface

    Lighteval एकाधिक backends में LLM का मूल्यांकन करने के लिए आपका ऑल-इन-वन टूलकिट है।

    2,533+3पिछले 7 दिनों में स्टार का बदलाव
  • evaluation-guidebook@huggingface

    Open LLM Leaderboard का प्रबंधन करते समय और lighteval को डिज़ाइन करते समय हमने जो व्यावहारिक अंतर्दृष्टि और सैद्धांतिक ज्ञान एकत्र किया है, उन्हें साझा करना!

    2,143+2पिछले 7 दिनों में स्टार का बदलाव
  • AB3DMOT@xinshuoweng

    (IROS 2020, ECCVW 2020) "3D Multi-Object Tracking: A Baseline and New Evaluation Metrics" के लिए आधिकारिक Python कार्यान्वयन

    1,846+0पिछले 7 दिनों में स्टार का बदलाव
  • jiwer@jitsi

    Word Error Rate (WER) जैसे समानता मापदंडों के साथ अपने स्पीच-टू-टेक्स्ट सिस्टम का मूल्यांकन करें।

    928+2पिछले 7 दिनों में स्टार का बदलाव
  • OCTIS@MIND-Lab

    OCTIS: टॉपिक मॉडल की तुलना करना सरल है! टॉपिक मॉडल को अनुकूलित और मूल्यांकित करने के लिए एक python पैकेज (EACL2021 डेमो ट्रैक में स्वीकृत)

    804+0पिछले 7 दिनों में स्टार का बदलाव
  • COMET@Unbabel

    MT मूल्यांकन के लिए एक न्यूरल फ्रेमवर्क

    778+1पिछले 7 दिनों में स्टार का बदलाव
  • ranx@AmenRa

    ⚡️रैंकिंग मूल्यांकन, तुलना और फ्यूजन के लिए एक अत्यंत तेज़ Python लाइब्रेरी 🐍

    697+4पिछले 7 दिनों में स्टार का बदलाव
  • दो छवियों के बीच समानता का आकलन करने के लिए आठ मूल्यांकन मेट्रिक्स का कार्यान्वयन। ये आठ मेट्रिक्स हैं: RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM, और UIQ।

    647+0पिछले 7 दिनों में स्टार का बदलाव
  • continuous-eval@relari-ai

    LLM-पावर्ड एप्लिकेशन्स के लिए डेटा-संचालित मूल्यांकन।

    517+1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस