मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · evaluation-framework

evaluation-framework

evaluation-framework टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
10
कुल स्टार
70,407
औसत स्टार
7,041
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर evaluation-framework के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और evaluation-framework टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • promptfoo@promptfoo

    अपने prompts, agents और RAGs का परीक्षण करें। AI के लिए रेड टीमिंग/पेंटेस्टिंग/वल्नरेबिलिटी स्कैनिंग। GPT, Claude, Gemini, DeepSeek और अन्य के प्रदर्शन की तुलना करें। कमांड लाइन और CI/CD इंटीग्रेशन के साथ सरल घोषणात्मक कॉन्फ़िगरेशन। OpenAI और Anthropic द्वारा उपयोग किया जाता है।

    24,664+215पिछले 7 दिनों में स्टार का बदलाव
  • deepeval@confident-ai

    LLM मूल्यांकन फ्रेमवर्क।

    17,953+184पिछले 7 दिनों में स्टार का बदलाव
  • lm-evaluation-harness@EleutherAI

    लैंग्वेज मॉडल्स के फ्यू-शॉट मूल्यांकन के लिए एक फ्रेमवर्क।

    13,827+89पिछले 7 दिनों में स्टार का बदलाव
  • Kiln@Kiln-AI

    AI सिस्टम बनाएं, मूल्यांकन करें और अनुकूलित करें। इसमें मूल्यांकन, RAG, एजेंट, फाइन-ट्यूनिंग, सिंथेटिक डेटा जनरेशन, डेटासेट प्रबंधन, MCP और बहुत कुछ शामिल है।

    5,040+7पिछले 7 दिनों में स्टार का बदलाव
  • lighteval@huggingface

    Lighteval एकाधिक backends में LLM का मूल्यांकन करने के लिए आपका ऑल-इन-वन टूलकिट है।

    2,533+8पिछले 7 दिनों में स्टार का बदलाव
  • EvalAI@Cloud-CV

    :cloud: :rocket: :bar_chart: :chart_with_upwards_trend: AI में अत्याधुनिक तकनीक का मूल्यांकन

    2,037-2पिछले 7 दिनों में स्टार का बदलाव
  • future-agi@future-agi

    LLM और AI एजेंट एप्लिकेशन के मूल्यांकन, अवलोकन और सुधार के लिए ओपन-सोर्स, एंड-टू-एंड प्लेटफॉर्म। ट्रेसिंग · मूल्यांकन · सिमुलेशन · डेटासेट · गेटवे · गार्डरेल्स। सेल्फ-होस्टेबल। Apache 2.0।

    1,890+89पिछले 7 दिनों में स्टार का बदलाव
  • ai-agents-the-definitive-guide@Nicolepcx

    AI Agents के लिए निश्चित गाइड का रिपॉजिटरी

    1,528+422पिछले 7 दिनों में स्टार का बदलाव
  • AgentLab@ServiceNow

    AgentLab: मापनीयता और पुनरुत्पादकता के लिए डिज़ाइन किए गए विभिन्न कार्यों पर वेब एजेंटों को विकसित करने, परीक्षण करने और बेंचमार्क करने के लिए एक ओपन-सोर्स फ्रेमवर्क।

    627+2पिछले 7 दिनों में स्टार का बदलाव
  • continuous-eval@relari-ai

    LLM-पावर्ड एप्लिकेशन्स के लिए डेटा-संचालित मूल्यांकन।

    517+1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस