मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · benchmark

benchmark

benchmark टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

158 रिपॉजिटरी
  • PointTinyBenchmark@ucas-vg

    UCAS-VG का पॉइंट-आधारित और छोटा ऑब्जेक्ट डिटेक्शन और लोकलाइजेशन कोड सेट।

    694+0पिछले 7 दिनों में स्टार का बदलाव
  • long-form-factuality@google-deepmind

    लार्ज लैंग्वेज मॉडल में लॉन्ग-फॉर्म तथ्यात्मकता की बेंचमार्किंग। हमारे पेपर "लॉन्ग-फॉर्म फैक्चुअलिटी इन लार्ज लैंग्वेज मॉडल्स" के लिए मूल कोड।

    693+2पिछले 7 दिनों में स्टार का बदलाव
  • Julia भाषा के लिए एक बेंचमार्किंग फ्रेमवर्क।

    683+1पिछले 7 दिनों में स्टार का बदलाव
  • VLM2Vec@TIGER-AI-Lab

    इस रिपॉजिटरी में "VLM2Vec / MMEB" [ICLR 2025], "VLM2Vec-V2 / MMEB-V2" [TMLR 2026], और "MMEB-V3" [COLM 2026] के लिए कोड शामिल है

    682+2पिछले 7 दिनों में स्टार का बदलाव
  • openmixup@Westlake-AI

    CAIRI सुपरवाइज्ड, सेमी- और सेल्फ-सुपरवाइज्ड विजुअल रिप्रेजेंटेशन लर्निंग टूलबॉक्स और बेंचमार्क

    658+0पिछले 7 दिनों में स्टार का बदलाव
  • ClawBench@TIGER-AI-Lab

    दैनिक कार्यों पर ब्राउज़र AI एजेंटों के लिए ओपन-सोर्स बेंचमार्क।

    657+40पिछले 7 दिनों में स्टार का बदलाव
  • Awesome-LLM-Eval: मुख्य रूप से LLM मूल्यांकन के लिए टूल, डेटासेट/बेंचमार्क, डेमो, लीडरबोर्ड, पेपर, डॉक्स और मॉडल की एक क्यूरेटेड सूची।

    656-2पिछले 7 दिनों में स्टार का बदलाव
  • BenchMARL@facebookresearch

    BenchMARL मल्टी-एजेंट रीइंफोर्समेंट लर्निंग (MARL) की बेंचमार्किंग के लिए एक लाइब्रेरी है। BenchMARL इसकी दो मुख्य अवधारणाओं: पुनरुत्पादकता और मानकीकरण पर व्यवस्थित रूप से आधारित रहते हुए विभिन्न MARL एल्गोरिदम, कार्यों और मॉडलों की तुरंत तुलना करने की अनुमति देता है।

    656+0पिछले 7 दिनों में स्टार का बदलाव
  • AICGSecEval@Tencent

    A.S.E (AICGSecEval) एक रिपॉजिटरी-स्तरीय AI-जनरेटेड कोड सुरक्षा मूल्यांकन बेंचमार्क है, जिसे Tencent Wukong Code Security Team द्वारा विकसित किया गया है।

    655+2पिछले 7 दिनों में स्टार का बदलाव
  • datasets@benedekrozemberczki

    नेटवर्क साइंस और मशीन लर्निंग रिसर्च के लिए मेरे द्वारा एकत्रित किए गए बहुत अच्छे डेटासेट का एक रिपॉजिटरी।

    655+0पिछले 7 दिनों में स्टार का बदलाव
  • indonlu@IndoNLP

    Indonesian भाषा के लिए अब तक का सबसे बड़ा नेचुरल लैंग्वेज प्रोसेसिंग बेंचमार्क। हम कई डाउनस्ट्रीम टास्क, प्री-ट्रेंड IndoBERT मॉडल और स्टार्टर कोड प्रदान करते हैं! (AACL-IJCNLP 2020)

    655+1पिछले 7 दिनों में स्टार का बदलाव
  • Kotlin मल्टीप्लैटफॉर्म बेंचमार्किंग टूलकिट

    644+0पिछले 7 दिनों में स्टार का बदलाव
  • TrustLLM@HowieHwong

    [ICML 2024] TrustLLM: लार्ज लैंग्वेज मॉडल में विश्वसनीयता

    632+2पिछले 7 दिनों में स्टार का बदलाव
  • AgentLab@ServiceNow

    AgentLab: मापनीयता और पुनरुत्पादकता के लिए डिज़ाइन किए गए विभिन्न कार्यों पर वेब एजेंटों को विकसित करने, परीक्षण करने और बेंचमार्क करने के लिए एक ओपन-सोर्स फ्रेमवर्क।

    628+0पिछले 7 दिनों में स्टार का बदलाव
  • rspec-benchmark@piotrmurach

    RSpec के लिए परफॉरमेंस टेस्टिंग मैचर्स।

    618+0पिछले 7 दिनों में स्टार का बदलाव
  • NIID-Bench@Xtra-Computing

    फेडरेटेड लर्निंग बेंचमार्क - नॉन-IID डेटा साइलो पर फेडरेटेड लर्निंग: एक प्रयोगात्मक अध्ययन (ICDE 2022)

    618+0पिछले 7 दिनों में स्टार का बदलाव
  • TextClassificationBenchmark@FreedomIntelligence

    PyTorch में टेक्स्ट क्लासिफिकेशन का एक बेंचमार्क

    608+0पिछले 7 दिनों में स्टार का बदलाव
  • KLUE@KLUE-benchmark

    📖 कोरियन NLU बेंचमार्क

    604+0पिछले 7 दिनों में स्टार का बदलाव
  • globalping@jsdelivr

    पिंग, ट्रेसरूट और DNS रिज़ॉल्व जैसे नेटवर्क परीक्षण चलाने के लिए प्रोब्स का एक वैश्विक नेटवर्क।

    597+3पिछले 7 दिनों में स्टार का बदलाव
  • विज़ुअल ऑब्जेक्ट ट्रैकिंग

    596+2पिछले 7 दिनों में स्टार का बदलाव
  • rewrk@lnx-search

    HTTP/1 और HTTP/2 बेंचमार्क का समर्थन करने वाला एक अधिक आधुनिक HTTP फ्रेमवर्क बेंचमार्कर।

    588+1पिछले 7 दिनों में स्टार का बदलाव
  • CL-bench@Tencent-Hunyuan

    CL-bench: कॉन्टेक्स्ट लर्निंग के लिए एक बेंचमार्क

    580+2पिछले 7 दिनों में स्टार का बदलाव
  • ParseBench@run-llama

    ParseBench - AI एजेंटों के लिए एक दस्तावेज़ पार्सिंग बेंचमार्क

    563+6पिछले 7 दिनों में स्टार का बदलाव
  • alpaca@p-ranav

    C++17 में लिखी गई सीरियलाइजेशन लाइब्रेरी - बिना किसी मैक्रो या बॉयलरप्लेट कोड के C++ स्ट्रक्ट्स को कॉम्पैक्ट बाइट-ऐरे में पैक करें।

    560+0पिछले 7 दिनों में स्टार का बदलाव
  • SkillCorpus@EverMind-AI

    Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.

    559पिछले 7 दिनों में स्टार का बदलाव
  • कुछ प्रोग्रामिंग भाषाओं (JavaScript, Kotlin, Rust, Swift, Nim, Python, Go, Haskell, D, C++, Java, C#, Object Pascal, Ada, Lua, Ruby) का सरल प्रदर्शन तुलना

    557+0पिछले 7 दिनों में स्टार का बदलाव
  • Leaderboard@SpeechColab

    SpeechIO लीडरबोर्ड: ऑटोमैटिक स्पीच रिकग्निशन के लिए एक बड़ा, मजबूत और व्यापक बेंचमार्किंग प्लेटफ़ॉर्म।

    553+3पिछले 7 दिनों में स्टार का बदलाव
  • Meta Agents Research Environments एक व्यापक प्लेटफॉर्म है जिसे गतिशील और यथार्थवादी परिदृश्यों में AI एजेंटों का मूल्यांकन करने के लिए डिज़ाइन किया गया है। स्थिर बेंचमार्क के विपरीत, यह प्लेटफॉर्म ऐसे विकसित वातावरण पेश करता है जहाँ एजेंटों को नई जानकारी उपलब्ध होने पर अपनी रणनीतियों को अनुकूलित करना पड़ता है, जो वास्तविक दुनिया की चुनौतियों को दर्शाता है।

    550+3पिछले 7 दिनों में स्टार का बदलाव
  • कंपनी के आंतरिक दस्तावेजों पर RAG के लिए डेटासेट और बेंचमार्क।

    542+9पिछले 7 दिनों में स्टार का बदलाव
  • NBench@petabridge

    .NET एप्लिकेशन के लिए प्रदर्शन बेंचमार्किंग और टेस्टिंग फ्रेमवर्क।

    540+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस