跳到主要内容
buildradar
登录
主题 · benchmark

benchmark

标记 benchmark 主题、收录中的开源项目,按星标数排序。

共 158 个项目
  • RoboTwin@RoboTwin-Platform

    [ICML 2026] RoboTwin 2.0 官方代码仓库

    2,800+0近 7 天星标变化
  • java-sec-code@JoyChou93

    基于 springboot 与 spring security 的 Java web 常见漏洞与安全代码

    2,675+0近 7 天星标变化
  • CPU-X@TheTumultuousUnicornOfDarkness

    CPU-X 是一套免费软件,可收集 CPU、主板等相关信息

    2,647+0近 7 天星标变化
  • tsung@processone

    Tsung 是一个高性能的基准测试框架,支持 HTTP、XMPP、LDAP 等多种协议

    2,629+0近 7 天星标变化
  • little-coder@itayinbarr

    针对较小 LLMs 优化的测试框架

    2,528+0近 7 天星标变化
  • mitata@evanwashere

    热爱你的性能测试工具 ❤️

    2,525+0近 7 天星标变化
  • InternVideo@OpenGVLab

    [ECCV2024] 用于多模态理解的视频基础模型与数据

    2,374+0近 7 天星标变化
  • tinybench@tinylibs

    🔎 一个简单、微小且轻量级的性能基准测试库!

    2,362+0近 7 天星标变化
  • ecs@oneclickvirt

    VPS 融合怪服务器测评项目 GO 版本,旨在成为最全面的服务器测评项目,使用 Go 实现,无需任何环境依赖。

    2,329+0近 7 天星标变化
  • beir@beir-cellar

    一个信息检索的异构基准测试。简单易用,可在 15 个以上不同的 IR 数据集上评估您的模型。

    2,283+0近 7 天星标变化
  • LIBERO@Lifelong-Robot-Learning

    终身机器人学习中的知识迁移性能评测

    2,264+0近 7 天星标变化
  • cista@felixguendling

    Cista 是一个简单、高性能、零拷贝的 C++ 序列化与反射库。

    2,247+0近 7 天星标变化
  • 📰 关于基于 LLM 的长上下文建模必读论文与博客 🔥

    2,164+0近 7 天星标变化
  • :zap: Go web 框架基准测试

    2,135+0近 7 天星标变化
  • 对多个允许将网页应用程序“转换”为桌面应用程序的框架进行客观比较。

    1,989+0近 7 天星标变化
  • logparser@logpai

    用于日志解析的机器学习工具包 [ICSE'19, DSN'16]

    1,987+0近 7 天星标变化
  • tapnet@google-deepmind

    追踪任意点 (TAP)

    1,973+0近 7 天星标变化
  • tau2-bench@sierra-research

    τ-Bench:真实世界领域中工具-代理-用户交互的基准测试

    1,938+0近 7 天星标变化
  • less_slow.cpp@ashvardanian

    在 C++ 20、C、CUDA、PTX 与汇编语言中探索“较不慢”的编码实践,从数值与 SIMD 到协程、范围、异常处理、网络与用户空间 IO

    1,923+0近 7 天星标变化
  • evalplus@evalplus

    LLM 合成代码的严格评估 - NeurIPS 2023 & COLM 2024

    1,806+0近 7 天星标变化
  • training@mlcommons

    MLPerf® 训练基准的参考实现

    1,771+0近 7 天星标变化
  • VBench@Vchitect

    [CVPR2024 Highlight] VBench - 我们评估视频生成

    1,757+0近 7 天星标变化
  • skillsbench@benchflow-ai

    SkillsBench 用于评估技能的运作效果以及 agent 使用技能的效率。

    1,742+0近 7 天星标变化
  • nanobench@martinus

    适用于 C++11/14/17/20 的简单、快速、精确的单头文件微基准测试功能

    1,733+0近 7 天星标变化
  • hotpath-rs@pawurb

    快速找出 Rust 中的性能瓶颈——适用于 CPU、内存、SQL、HTTP、I/O 与异步代码的单一性能分析器。

    1,707+0近 7 天星标变化
  • BEHAVIOR-1K@StanfordVL

    BEHAVIOR-1K:一个加速具身 AI 研究的平台。加入我们的 Discord 以获得支持:https://discord.gg/bccR5vGFEx

    1,677+0近 7 天星标变化
  • inference@mlcommons

    MLPerf® 推理基准测试的参考实现

    1,624+0近 7 天星标变化
  • 综述论文 "A Survey on Evaluation of Large Language Models" 的官方 GitHub 页面。

    1,608+0近 7 天星标变化
  • ADR@uber

    ADR 通过可观测性、安全性基准测试与威胁检测来保护企业 AI 代理。已部署于 Uber。

    1,527+0近 7 天星标变化
  • py-motmetrics@cheind

    :bar_chart: 在 Python 中对多个对象跟踪器 (MOT) 进行性能评测

    1,487+0近 7 天星标变化
← 返回主题列表