मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · benchmark

benchmark

benchmark टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
158
कुल स्टार
3,37,451
औसत स्टार
2,136
हिस्सा
0.02%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर benchmark के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और benchmark टैग वाली रिपॉजिटरी।

  • DeepSeek V4 × J-Space क्षमता प्राप्ति रिपोर्ट — बेंचमार्क साक्ष्य कि J-Space DeepSeek V4 पर क्षमता-प्राप्ति हानि को कम करता है।

    1,026
  • SkillCorpus@EverMind-AI

    Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.

    594
  • HarnessEval-W@MirroS-Lab

    HarnessEval-W: Agentifying the Evaluation of Visual Worlds

    256
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • hyperfine@sharkdp

    एक कमांड-लाइन बेंचमार्किंग टूल।

    28,796+37पिछले 7 दिनों में स्टार का बदलाव
  • बेंचमार्किंग के लिए शक्तिशाली .NET लाइब्रेरी

    11,486+1पिछले 7 दिनों में स्टार का बदलाव
  • oha@hatoo

    Ohayou (おはよう), HTTP लोड जेनरेटर, rakyll/hey से प्रेरित और tui एनिमेशन के साथ।

    10,523+6पिछले 7 दिनों में स्टार का बदलाव
  • benchmark@google

    एक माइक्रोबेंचमार्क सपोर्ट लाइब्रेरी

    10,382+7पिछले 7 दिनों में स्टार का बदलाव
  • mmpose@open-mmlab

    OpenMMLab पोज़ एस्टिमेशन टूलबॉक्स और बेंचमार्क।

    7,867+7पिछले 7 दिनों में स्टार का बदलाव
  • opencompass@open-compass

    OpenCompass एक LLM evaluation platform है, जो 100+ से अधिक datasets पर विभिन्न प्रकार के models (Llama3, Mistral, InternLM2, GPT-4, LLaMa2, Qwen, GLM, Claude, आदि) का समर्थन करता है।

    7,388+14पिछले 7 दिनों में स्टार का बदलाव
  • ecs@spiritLHLS

    VPS फ्यूजन मॉन्स्टर सर्वर मूल्यांकन प्रोजेक्ट, बिना पर्यावरण निर्भरता वाले Go संस्करण का उपयोग करने की अधिक अनुशंसा की जाती है: https://github.com/oneclickvirt/ecs

    7,179+24पिछले 7 दिनों में स्टार का बदलाव
  • web-frameworks@the-benchmarker

    सबसे तेज़ वेब फ्रेमवर्क कौन सा है? दुबारा सोचें।

    7,084-1पिछले 7 दिनों में स्टार का बदलाव
  • sysbench@akopytov

    स्क्रिप्टेबल डेटाबेस और सिस्टम परफॉर्मेंस बेंचमार्क

    6,783+1पिछले 7 दिनों में स्टार का बदलाव
  • YABS - fio, iperf3 और Geekbench का उपयोग करके Linux सर्वर प्रदर्शन का अनुमान लगाने के लिए एक सरल bash स्क्रिप्ट

    6,664+10पिछले 7 दिनों में स्टार का बदलाव
  • SWE-bench@SWE-bench

    SWE-bench: क्या Language Models वास्तविक दुनिया के Github मुद्दों को हल कर सकते हैं?

    5,765+31पिछले 7 दिनों में स्टार का बदलाव
  • ann-benchmarks@erikbern

    Python में अनुमानित निकटतम पड़ोसी (approximate nearest neighbor) लाइब्रेरी के बेंचमार्क

    5,725+5पिछले 7 दिनों में स्टार का बदलाव
  • dperf@baidu

    dperf: DPDK पर आधारित उच्च-प्रदर्शन नेटवर्क लोड परीक्षण टूल

    5,601+0पिछले 7 दिनों में स्टार का बदलाव
  • criterion.rs@bheisler

    Rust के लिए सांख्यिकी-संचालित बेंचमार्किंग लाइब्रेरी

    5,522-1पिछले 7 दिनों में स्टार का बदलाव
  • across@teddysun

    महान दीवार के पार हम दुनिया के हर कोने तक पहुँच सकते हैं

    5,371+1पिछले 7 दिनों में स्टार का बदलाव
  • FluidX3D@ProjectPhysX

    सबसे तेज़ और सबसे अधिक मेमोरी कुशल लैटिस बोल्ट्ज़मैन CFD सॉफ़्टवेयर, जो OpenCL के माध्यम से सभी GPU और CPU पर चलता है। गैर-व्यावसायिक उपयोग के लिए निःशुल्क।

    5,257+3पिछले 7 दिनों में स्टार का बदलाव
  • mmaction2@open-mmlab

    OpenMMLab का अगली पीढ़ी का वीडियो अंडरस्टैंडिंग टूलबॉक्स और बेंचमार्क

    5,150+3पिछले 7 दिनों में स्टार का बदलाव
  • Chronos@Kodezi

    Kodezi Chronos एक डिबगिंग-प्रथम भाषा मॉडल है जो SWE-bench Lite (80.33%) पर अत्याधुनिक परिणाम प्राप्त करता है और 67% वास्तविक दुनिया की सुधार सटीकता प्रदान करता है, जो GPT-4 से छह गुना से अधिक बेहतर है। इसे एडैप्टिव ग्राफ-गाided रिट्रीवल और पर्सिस्टेंट डिबग मेमोरी के साथ बनाया गया है। मॉडल Q1 2026 में Kodezi OS के माध्यम से उपलब्ध होगा।

    4,935+7पिछले 7 दिनों में स्टार का बदलाव
  • lmms-eval@EvolvingLMMs-Lab

    टेक्स्ट, इमेज, वीडियो और ऑडियो कार्यों के लिए वन-फॉर-ऑल मल्टीमॉडल मूल्यांकन टूलकिट।

    4,390+7पिछले 7 दिनों में स्टार का बदलाव
  • evo@MichaelGrupp

    ओडोमेट्री और SLAM के मूल्यांकन के लिए Python पैकेज

    4,311+1पिछले 7 दिनों में स्टार का बदलाव
  • CLUE@CLUEbenchmark

    Chinese Language Understanding Evaluation Benchmark: डेटासेट, बेसलाइन, प्री-ट्रेन किए गए मॉडल, कॉर्पस और लीडरबोर्ड

    4,278-1पिछले 7 दिनों में स्टार का बदलाव
  • coost@idealvin

    C++11 में एक छोटा boost लाइब्रेरी।

    4,210-1पिछले 7 दिनों में स्टार का बदलाव
  • Baichuan2@baichuan-inc

    Baichuan Intelligent Technology द्वारा विकसित बड़े भाषा मॉडल की एक श्रृंखला

    4,083+0पिछले 7 दिनों में स्टार का बदलाव
  • HTTP(S) बेंचमार्क टूल्स, टेस्टिंग/डिबगिंग, और restAPI (RESTful)

    3,769+2पिछले 7 दिनों में स्टार का बदलाव
  • XcodeBenchmark@devMEremenko

    XcodeBenchmark iMac, MacBook और Mac Pro पर एक बड़े कोडबेस के संकलन समय को मापता है

    3,663+0पिछले 7 दिनों में स्टार का बदलाव
  • FlashRAG@RUC-NLPIR

    ⚡FlashRAG: कुशल RAG अनुसंधान के लिए एक Python टूलकिट (WWW2025 संसाधन)

    3,562+0पिछले 7 दिनों में स्टार का बदलाव
  • mteb@embeddings-benchmark

    MTEB: भाषाओं और तौर-तरीकों में एम्बेडिंग का अत्याधुनिक मूल्यांकन

    3,414+5पिछले 7 दिनों में स्टार का बदलाव
  • phoronix-test-suite@phoronix-test-suite

    Phoronix Test Suite ओपन-सोर्स, क्रॉस-प्लेटफ़ॉर्म स्वचालित परीक्षण/बेंचमार्किंग सॉफ़्टवेयर।

    3,122+4पिछले 7 दिनों में स्टार का बदलाव
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: वास्तविक कंप्यूटर वातावरण में ओपन-एंडेड कार्यों के लिए मल्टीमॉडल एजेंट्स का मूल्यांकन

    3,118+6पिछले 7 दिनों में स्टार का बदलाव
  • Primes@PlummersSoftwareLLC

    उनकी गति - और उनके प्रोग्रामर की चतुराई की तुलना करने के लिए 100+ प्रोग्रामिंग भाषाओं में अभाज्य संख्या (Prime number) प्रोजेक्ट्स

    3,019+3पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस