跳到主要內容
buildradar
Sign in
主題 · benchmark

benchmark

標記 benchmark 主題、收錄中的開源專案,依星數排序。

共 158 個專案
  • RoboTwin@RoboTwin-Platform

    [ICML 2026] RoboTwin 2.0 官方程式碼儲存庫

    2,800+12近 7 天星數變化
  • java-sec-code@JoyChou93

    基於 springboot 與 spring security 的 Java web 常見漏洞與安全程式碼

    2,675+1近 7 天星數變化
  • CPU-X@TheTumultuousUnicornOfDarkness

    CPU-X 是一套免費軟體,可收集 CPU、主機板等相關資訊

    2,647+0近 7 天星數變化
  • tsung@processone

    Tsung 是一個高效能的基準測試框架,支援 HTTP、XMPP、LDAP 等多種協定

    2,629+0近 7 天星數變化
  • little-coder@itayinbarr

    針對較小 LLMs 優化的測試框架

    2,528+16近 7 天星數變化
  • mitata@evanwashere

    熱愛你的效能測試工具 ❤️

    2,525+4近 7 天星數變化
  • InternVideo@OpenGVLab

    [ECCV2024] 用於多模態理解的影片基礎模型與資料

    2,374+5近 7 天星數變化
  • tinybench@tinylibs

    🔎 一個簡單、微小且輕量級的效能基准測試庫!

    2,362+0近 7 天星數變化
  • ecs@oneclickvirt

    VPS 融合怪伺服器測評專案 Go 版本,旨在成為最全面的伺服器測評專案,使用 Go 實作,無任何環境相依性。

    2,329+13近 7 天星數變化
  • beir@beir-cellar

    一個資訊檢索的異質基準測試。簡單易用,可在 15 個以上不同的 IR 資料集上評估您的模型。

    2,283+5近 7 天星數變化
  • LIBERO@Lifelong-Robot-Learning

    終身機器人學習中的知識轉移效能評測

    2,264+14近 7 天星數變化
  • cista@felixguendling

    Cista 是一個簡單、高效能、零拷貝的 C++ 序列化與反射函式庫。

    2,247+1近 7 天星數變化
  • 📰 關於基於 LLM 的長上下文建模必讀論文與部落格 🔥

    2,164-1近 7 天星數變化
  • :zap: Go web 框架基準測試

    2,135+1近 7 天星數變化
  • 對多個允許將網頁應用程式「轉換」為桌面應用程式的框架進行客觀比較。

    1,989+0近 7 天星數變化
  • logparser@logpai

    用於日誌解析的機器學習工具包 [ICSE'19, DSN'16]

    1,987+0近 7 天星數變化
  • tapnet@google-deepmind

    追蹤任意點 (TAP)

    1,973+2近 7 天星數變化
  • tau2-bench@sierra-research

    τ-Bench:真實世界領域中工具-代理-使用者互動的基准測試

    1,938+30近 7 天星數變化
  • less_slow.cpp@ashvardanian

    在 C++ 20、C、CUDA、PTX 與組合語言中探索「較不慢」的編碼實踐,從數值與 SIMD 到協同程式、範圍、例外處理、網路與使用者空間 IO

    1,923-1近 7 天星數變化
  • evalplus@evalplus

    LLM 合成程式碼的嚴格評估 - NeurIPS 2023 & COLM 2024

    1,806+1近 7 天星數變化
  • training@mlcommons

    MLPerf® 訓練基準的參考實作

    1,771-1近 7 天星數變化
  • VBench@Vchitect

    [CVPR2024 Highlight] VBench - 我們評估影片生成

    1,757+7近 7 天星數變化
  • skillsbench@benchflow-ai

    SkillsBench 用於評估技能的運作效果以及 agent 使用技能的效率。

    1,742+11近 7 天星數變化
  • nanobench@martinus

    適用於 C++11/14/17/20 的簡單、快速、準確之單標頭檔微基准測試功能

    1,733+1近 7 天星數變化
  • hotpath-rs@pawurb

    快速找出 Rust 中的效能瓶頸——適用於 CPU、記憶體、SQL、HTTP、I/O 與非同步程式碼的單一效能分析器。

    1,707+7近 7 天星數變化
  • BEHAVIOR-1K@StanfordVL

    BEHAVIOR-1K:一個加速具身 AI 研究的平台。加入我們的 Discord 以獲得支援:https://discord.gg/bccR5vGFEx

    1,677+8近 7 天星數變化
  • inference@mlcommons

    MLPerf® 推理基準測試的參考實作

    1,624+2近 7 天星數變化
  • 綜述論文 "A Survey on Evaluation of Large Language Models" 的官方 GitHub 頁面。

    1,608-1近 7 天星數變化
  • ADR@uber

    ADR 透過可觀測性、安全性基準測試與威脅偵測來保護企業 AI 代理。已部署於 Uber。

    1,527+21近 7 天星數變化
  • py-motmetrics@cheind

    :bar_chart: 在 Python 中對多個物件追蹤器 (MOT) 進行效能評測

    1,487+0近 7 天星數變化
← 返回主題列表