主題 · benchmark
benchmark
標記 benchmark 主題、收錄中的開源專案,依星數排序。
共 158 個專案
- #91
基於 MMSegmentation 的單目深度估計工具箱。
★ 971+0近 7 天星數變化 - #92★ 952+0近 7 天星數變化
- #93
各種 gRPC 效能測試
★ 939+1近 7 天星數變化 - #94★ 933+0近 7 天星數變化
- #95★ 924+0近 7 天星數變化
- #96
從任何位置測量 Amazon S3 的效能。
★ 910-1近 7 天星數變化 - #97★ 900+1近 7 天星數變化
- #98★ 895+2近 7 天星數變化
- #99
Windows、macOS 與 Android 儲存裝置(HDD、SSD、RAM)速度測試與效能效能評測應用程式
★ 870+2近 7 天星數變化 - #100★ 864+0近 7 天星數變化
- #101★ 834+4近 7 天星數變化
- #102
自然智慧仍然是一個相當不錯的點子。
★ 833+0近 7 天星數變化 - #103
📊 具備執行時期驗證與 TypeScript 支援的套件效能比較基準
★ 830+2近 7 天星數變化 - #104
DeepResearch Bench:深度研究代理的綜合基準測試
★ 827+10近 7 天星數變化 - #105
ClawProBench 是一個即時優先的基準測試工具,用於評估 OpenClaw 執行環境中的 LLM 代理,具備確定性評分與重複試驗的可靠性。
★ 823+0近 7 天星數變化 - #106★ 816+3近 7 天星數變化
- #107★ 808+31近 7 天星數變化
- #108
電腦語言效能基準遊戲的又一個實作
★ 800-1近 7 天星數變化 - #109★ 796+0近 7 天星數變化
- #110
MobileGym:用於 Mobile GUI Agent 研究的可驗證高並行模擬平台 · 瀏覽器裡運行的安卓模擬器 · Browser-hosted Android Simulator · 可驗證評估 · 可擴展的線上 RL 訓練
★ 787+10近 7 天星數變化 - #111
RobustBench:標準化的對抗性強健性基準 [NeurIPS 2021 Benchmarks and Datasets Track]
★ 782+0近 7 天星數變化 - #112★ 782+3近 7 天星數變化
- #113★ 780+0近 7 天星數變化
- #114
一個包含模擬軟體公司任務的 Agent 評測基準
★ 776+4近 7 天星數變化 - #115
golang HTTP 壓力測試工具,支援單機與分散式、http/1、http/2 與 http/3。
★ 771+0近 7 天星數變化 - #116
[EMNLP 2024 & AAAI 2026] 一個強大的大型模型壓縮工具包,包含 LLM、VLM 及影片生成模型。
★ 747+4近 7 天星數變化 - #117
另一個針對某些 Python 框架的基準測試
★ 721+0近 7 天星數變化 - #118
熱門微服務框架上 Hello World 吞吐量、延遲與傳輸的原始效能測試數據
★ 715+0近 7 天星數變化 - #119★ 704+1近 7 天星數變化
- #120
遊玩桌上遊戲《外交風雲》(Diplomacy)的前沿模型。
★ 699+1近 7 天星數變化