跳到主要內容
buildradar
Sign in
主題 · benchmark

benchmark

標記 benchmark 主題、收錄中的開源專案,依星數排序。

共 158 個專案
  • llm-colosseum@OpenGenerativeAI

    透過遊玩《快打旋風 3》來對 LLM 進行基準測試!評估 LLM 品質的新方法

    1,483-1近 7 天星數變化
  • pytest-benchmark@ionelmc

    用於程式碼效能評測的 pytest fixture

    1,448+0近 7 天星數變化
  • divan@nvzqz

    適用於 Rust 專案的快速且簡單的效能評測工具

    1,444+2近 7 天星數變化
  • MedMNIST@MedMNIST

    [pip install medmnist] 用於 2D 與 3D 生物醫學影像分類的 18 個標準化資料集

    1,399+0近 7 天星數變化
  • C# Expression Trees 的快速編譯器與輕量級 LightExpression 替代方案。包含表達式的診斷與程式碼生成工具。

    1,375+1近 7 天星數變化
  • smac@oxwhirl

    SMAC:星海爭霸多代理人挑戰賽

    1,367+1近 7 天星數變化
  • SLM-Lab@kengz

    基於 PyTorch 的模組化深度強化學習框架。《Foundations of Deep Reinforcement Learning》一書的配套函式庫。

    1,362+0近 7 天星數變化
  • System-2 推理的最新進展

    1,353+0近 7 天星數變化
  • kg-gen@stair-lab

    [NeurIPS '25] 從任意文字產生知識圖譜

    1,266+6近 7 天星數變化
  • github-action-benchmark@benchmark-action

    用於持續基準測試以維持效能的 GitHub Action

    1,251+1近 7 天星數變化
  • boomer@myzhan

    使用 golang 編寫的更好用的 locust 負載產生器。

    1,237+0近 7 天星數變化
  • LongBench@THUDM

    LongBench v2 與 LongBench (ACL 25'&24')

    1,232+2近 7 天星數變化
  • KernelBench@ScalingIntelligence

    KernelBench:LLMs 能寫出 GPU Kernels 嗎? - 基準測試 + 包含 Torch -> CUDA(以及更多 DSL)的工具包

    1,227+13近 7 天星數變化
  • PDEBench@pdebench

    PDEBench:用於科學機器學習的廣泛基準測試集

    1,192+1近 7 天星數變化
  • bench-scripts@haydenjames

    Linux 伺服器效能評測腳本合集。

    1,190+0近 7 天星數變化
  • flow@flow-project

    用於交通控制中強化學習的運算框架

    1,188+0近 7 天星數變化
  • VectorDBBench@zilliztech

    向量資料庫效能評測基準

    1,173+7近 7 天星數變化
  • omnisafe@PKU-Alignment

    JMLR:OmniSafe 是用於加速 SafeRL 研究的基礎設施框架。

    1,150+1近 7 天星數變化
  • OpenSTL@chengtan9907

    OpenSTL:時空預測學習的綜合基準測試

    1,143+6近 7 天星數變化
  • primesieve@kimwalisch

    🚀 快速質數產生器

    1,114+2近 7 天星數變化
  • ClickBench@ClickHouse

    ClickBench:分析型資料庫的基準測試工具

    1,094+3近 7 天星數變化
  • lzbench@inikep

    lzbench 是一個開源壓縮器的記憶體效能測試工具

    1,083+3近 7 天星數變化
  • NoSQL Redis 與 Memcache 流量生成與效能評測工具。

    1,053+4近 7 天星數變化
  • opencv_zoo@opencv

    用於 OpenCV DNN 的模型庫與效能評測

    1,046+7近 7 天星數變化
  • benchmark@pytorch

    TorchBench 是一個用於評估 PyTorch 效能的開源效能測試集合。

    1,042-2近 7 天星數變化
  • pyperformance@python

    Python 效能效能基準測試套件

    1,029+1近 7 天星數變化
  • ADBench@Minqi824

    NeurIPS 2022「ADBench: Anomaly Detection Benchmark」官方實作。

    1,023+2近 7 天星數變化
  • DeepSeek V4 × J-Space 能力實現報告 — 基準測試證據顯示 J-Space 降低了 DeepSeek V4 (Flash/Pro) 的能力實現損失。

    1,022-4近 7 天星數變化
  • asv@airspeed-velocity

    Airspeed Velocity:一個簡單的 Python 效能評測工具,具備網頁版報告功能。

    1,018+3近 7 天星數變化
  • moses@molecularsets

    分子集合(MOSES):分子生成模型的基準測試平台

    988+1近 7 天星數變化
← 返回主題列表