主題 · benchmark
benchmark
標記 benchmark 主題、收錄中的開源專案,依星數排序。
共 158 個專案
- #31★ 2,800+12近 7 天星數變化
- #32
基於 springboot 與 spring security 的 Java web 常見漏洞與安全程式碼
★ 2,675+1近 7 天星數變化 - #33★ 2,647+0近 7 天星數變化
- #34★ 2,629+0近 7 天星數變化
- #35
針對較小 LLMs 優化的測試框架
★ 2,528+16近 7 天星數變化 - #36★ 2,525+4近 7 天星數變化
- #37
[ECCV2024] 用於多模態理解的影片基礎模型與資料
★ 2,374+5近 7 天星數變化 - #38★ 2,362+0近 7 天星數變化
- #39★ 2,329+13近 7 天星數變化
- #40★ 2,283+5近 7 天星數變化
- #41★ 2,264+14近 7 天星數變化
- #42★ 2,247+1近 7 天星數變化
- #43
📰 關於基於 LLM 的長上下文建模必讀論文與部落格 🔥
★ 2,164-1近 7 天星數變化 - #44
:zap: Go web 框架基準測試
★ 2,135+1近 7 天星數變化 - #45
對多個允許將網頁應用程式「轉換」為桌面應用程式的框架進行客觀比較。
★ 1,989+0近 7 天星數變化 - #46★ 1,987+0近 7 天星數變化
- #47★ 1,973+2近 7 天星數變化
- #48
τ-Bench:真實世界領域中工具-代理-使用者互動的基准測試
★ 1,938+30近 7 天星數變化 - #49
在 C++ 20、C、CUDA、PTX 與組合語言中探索「較不慢」的編碼實踐,從數值與 SIMD 到協同程式、範圍、例外處理、網路與使用者空間 IO
★ 1,923-1近 7 天星數變化 - #50★ 1,806+1近 7 天星數變化
- #51★ 1,771-1近 7 天星數變化
- #52★ 1,757+7近 7 天星數變化
- #53
SkillsBench 用於評估技能的運作效果以及 agent 使用技能的效率。
★ 1,742+11近 7 天星數變化 - #54★ 1,733+1近 7 天星數變化
- #55
快速找出 Rust 中的效能瓶頸——適用於 CPU、記憶體、SQL、HTTP、I/O 與非同步程式碼的單一效能分析器。
★ 1,707+7近 7 天星數變化 - #56
BEHAVIOR-1K:一個加速具身 AI 研究的平台。加入我們的 Discord 以獲得支援:https://discord.gg/bccR5vGFEx
★ 1,677+8近 7 天星數變化 - #57★ 1,624+2近 7 天星數變化
- #58
綜述論文 "A Survey on Evaluation of Large Language Models" 的官方 GitHub 頁面。
★ 1,608-1近 7 天星數變化 - #59★ 1,527+21近 7 天星數變化
- #60
:bar_chart: 在 Python 中對多個物件追蹤器 (MOT) 進行效能評測
★ 1,487+0近 7 天星數變化