evaluation-framework
evaluation-framework टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर evaluation-framework के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और evaluation-framework टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
अपने prompts, agents और RAGs का परीक्षण करें। AI के लिए रेड टीमिंग/पेंटेस्टिंग/वल्नरेबिलिटी स्कैनिंग। GPT, Claude, Gemini, DeepSeek और अन्य के प्रदर्शन की तुलना करें। कमांड लाइन और CI/CD इंटीग्रेशन के साथ सरल घोषणात्मक कॉन्फ़िगरेशन। OpenAI और Anthropic द्वारा उपयोग किया जाता है।
★ 24,664+215पिछले 7 दिनों में स्टार का बदलाव - #2★ 17,953+184पिछले 7 दिनों में स्टार का बदलाव
- #3
लैंग्वेज मॉडल्स के फ्यू-शॉट मूल्यांकन के लिए एक फ्रेमवर्क।
★ 13,827+89पिछले 7 दिनों में स्टार का बदलाव - #4
AI सिस्टम बनाएं, मूल्यांकन करें और अनुकूलित करें। इसमें मूल्यांकन, RAG, एजेंट, फाइन-ट्यूनिंग, सिंथेटिक डेटा जनरेशन, डेटासेट प्रबंधन, MCP और बहुत कुछ शामिल है।
★ 5,040+7पिछले 7 दिनों में स्टार का बदलाव - #5
Lighteval एकाधिक backends में LLM का मूल्यांकन करने के लिए आपका ऑल-इन-वन टूलकिट है।
★ 2,533+8पिछले 7 दिनों में स्टार का बदलाव - #6
:cloud: :rocket: :bar_chart: :chart_with_upwards_trend: AI में अत्याधुनिक तकनीक का मूल्यांकन
★ 2,037-2पिछले 7 दिनों में स्टार का बदलाव - #7
LLM और AI एजेंट एप्लिकेशन के मूल्यांकन, अवलोकन और सुधार के लिए ओपन-सोर्स, एंड-टू-एंड प्लेटफॉर्म। ट्रेसिंग · मूल्यांकन · सिमुलेशन · डेटासेट · गेटवे · गार्डरेल्स। सेल्फ-होस्टेबल। Apache 2.0।
★ 1,890+89पिछले 7 दिनों में स्टार का बदलाव - #8
AI Agents के लिए निश्चित गाइड का रिपॉजिटरी
★ 1,528+422पिछले 7 दिनों में स्टार का बदलाव - #9
AgentLab: मापनीयता और पुनरुत्पादकता के लिए डिज़ाइन किए गए विभिन्न कार्यों पर वेब एजेंटों को विकसित करने, परीक्षण करने और बेंचमार्क करने के लिए एक ओपन-सोर्स फ्रेमवर्क।
★ 627+2पिछले 7 दिनों में स्टार का बदलाव - #10
LLM-पावर्ड एप्लिकेशन्स के लिए डेटा-संचालित मूल्यांकन।
★ 517+1पिछले 7 दिनों में स्टार का बदलाव