跳到主要内容
buildradar
登录
主题 · benchmark

benchmark

标记 benchmark 主题、收录中的开源项目,按星标数排序。

共 158 个项目
  • 基于 MMSegmentation 的单目深度估计工具箱。

    971+0近 7 天星标变化
  • blazehttp@chaitin

    BlazeHTTP 是一款简单易用的 WAF 防护效果测试工具。

    952-1近 7 天星标变化
  • grpc_bench@LesnyRumcajs

    各种 gRPC 性能测试

    939+1近 7 天星标变化
  • agoo@ohler55

    一个适用于 Ruby 的高性能 HTTP 服务器

    933+0近 7 天星标变化
  • nvbench@NVIDIA

    CUDA Kernel 性能评测库

    924+0近 7 天星标变化
  • s3-benchmark@dvassallo

    从任何位置测量 Amazon S3 的性能。

    910+0近 7 天星标变化
  • rl4co@ai4co

    一个用于组合优化(CO)强化学习(RL)全方位功能的 PyTorch 库

    900+0近 7 天星标变化
  • bencher@bencherdev

    🐰 Bencher - 持续性能评测

    895+1近 7 天星标变化
  • Windows、macOS 与 Android 存储设备(HDD、SSD、RAM)速度测试与效能效能评测应用程序

    870+0近 7 天星标变化
  • Celero@DigitalInBlue

    C++ 性能评测编写函数库/框架

    864+1近 7 天星标变化
  • OpenCUA@xlang-ai

    [NeurIPS 2025 Spotlight] OpenCUA:电脑使用代理的开放基础

    834+2近 7 天星标变化
  • human-learn@koaning

    自然智慧仍然是一个相当不错的点子。

    833+0近 7 天星标变化
  • 📊 具备运行时验证与 TypeScript 支持的软件包性能比较基准

    830-1近 7 天星标变化
  • deep_research_bench@Ayanami0730

    DeepResearch Bench:深度研究代理的综合基准测试

    827+5近 7 天星标变化
  • ClawProBench@suyoumo

    ClawProBench 是一个实时优先的基准测试工具,用于评估 OpenClaw 运行环境中的 LLM 代理,具备确定性评分与重复试验的可靠性。

    823+0近 7 天星标变化
  • warp@minio

    S3 性能评测工具

    816+0近 7 天星标变化
  • agentdojo@ethz-spylab

    用于评估 LLM Agent 攻击与防御的动态环境。

    808+19近 7 天星标变化
  • 计算机语言性能基准游戏的又一个实现

    800-1近 7 天星标变化
  • sbt-jmh@sbt

    "不信任任何人,对一切进行基准测试。" - 用于 JMH (Java Microbenchmark Harness) 的 sbt 插件

    796+0近 7 天星标变化
  • mobilegym@Purewhiter

    MobileGym:用于 Mobile GUI Agent 研究的可验证高并发模拟平台 · 浏览器里运行的安卓模拟器 · Browser-hosted Android Simulator · 可验证评估 · 可扩展的线上 RL 训练

    787+5近 7 天星标变化
  • robustbench@RobustBench

    RobustBench:标准化的对抗性鲁棒性基准 [NeurIPS 2021 Benchmarks and Datasets Track]

    782+0近 7 天星标变化
  • HammerDB@TPC-Council

    HammerDB:业界标准的开源数据库性能测试工具

    782+2近 7 天星标变化
  • r3f-perf@utsuboco

    轻松监控您的 ThreeJS 性能。

    780+0近 7 天星标变化
  • TheAgentCompany@TheAgentCompany

    一个包含模拟软件公司任务的 Agent 评测基准

    776+1近 7 天星标变化
  • http_bench@linkxzhou

    golang HTTP 压力测试工具,支持单机与分布式、http/1、http/2 与 http/3。

    771+0近 7 天星标变化
  • LightCompress@ModelTC

    [EMNLP 2024 & AAAI 2026] 一个强大的大型模型压缩工具包,包含 LLM、VLM 及视频生成模型。

    747+3近 7 天星标变化
  • 另一个针对某些 Python 框架的基准测试

    721+0近 7 天星标变化
  • 热门微服务框架上 Hello World 吞吐量、延迟与传输的原始性能测试数据

    715+0近 7 天星标变化
  • caliper@hyperledger-caliper

    用于衡量多个区块链解决方案性能的区块链基准测试框架 https://wiki.hyperledger.org/display/caliper

    704+0近 7 天星标变化
  • AI_Diplomacy@GoodStartLabs

    游玩桌上游戏《外交风云》(Diplomacy)的前沿模型。

    699-1近 7 天星标变化
← 返回主题列表