メインコンテンツへスキップ
buildradar
Sign in
トピック · benchmark

benchmark

benchmark がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

158 件のリポジトリ
  • RoboTwin@RoboTwin-Platform

    [ICML 2026] RoboTwin 2.0 公式コードリポジトリ

    2,800+12直近 7 日のスター増減
  • java-sec-code@JoyChou93

    SpringBoot および Spring Security をベースにした Java Web の共通脆弱性とセキュリティコード

    2,675+1直近 7 日のスター増減
  • CPU-X@TheTumultuousUnicornOfDarkness

    CPU、マザーボードなどの情報を収集するフリーソフトウェア、CPU-X

    2,647+0直近 7 日のスター増減
  • tsung@processone

    Tsung は、HTTP、XMPP、LDAP など様々なプロトコルに対応した高性能なベンチマークフレームワークです。

    2,629+0直近 7 日のスター増減
  • little-coder@itayinbarr

    小型LLM向けに最適化されたハーネス

    2,528+16直近 7 日のスター増減
  • mitata@evanwashere

    あなたに愛されるベンチマークツール ❤️

    2,525+4直近 7 日のスター増減
  • InternVideo@OpenGVLab

    [ECCV2024] マルチモーダル理解のためのビデオ基盤モデルとデータ

    2,374+5直近 7 日のスター増減
  • tinybench@tinylibs

    🔎 シンプルで極小かつ軽量なベンチマークライブラリ!

    2,362+0直近 7 日のスター増減
  • ecs@oneclickvirt

    VPS 融合怪サーバーテスト GO バージョン。最も包括的なサーバーテストプロジェクトを目指し、環境依存関係なしで Go で実装されています。

    2,329+13直近 7 日のスター増減
  • beir@beir-cellar

    情報検索(IR)のための異種混合ベンチマーク。使いやすく、15以上の多様なIRデータセットでモデルを評価可能

    2,283+5直近 7 日のスター増減
  • LIBERO@Lifelong-Robot-Learning

    生涯ロボット学習における知識伝達のベンチマーク

    2,264+14直近 7 日のスター増減
  • cista@felixguendling

    Cista は、シンプルで高性能な、ゼロコピーの C++ シリアライゼーションおよびリフレクションライブラリです。

    2,247+1直近 7 日のスター増減
  • 📰 LLM ベースの長文脈モデリングに関する必読論文とブログ 🔥

    2,164-1直近 7 日のスター増減
  • :zap: Go web framework benchmark

    2,135+1直近 7 日のスター増減
  • Webアプリをデスクトップアプリに「変換」できる複数のフレームワークの客観的な比較。

    1,989+0直近 7 日のスター増減
  • logparser@logpai

    ログ解析のための機械学習ツールキット [ICSE'19, DSN'16]

    1,987+0直近 7 日のスター増減
  • tapnet@google-deepmind

    任意のポイントの追跡 (TAP)

    1,973+2直近 7 日のスター増減
  • tau2-bench@sierra-research

    τ-Bench: 実世界のドメインにおけるツール・エージェント・ユーザーのインタラクションのためのベンチマーク。

    1,938+30直近 7 日のスター増減
  • less_slow.cpp@ashvardanian

    C++ 20、C、CUDA、PTX、アセンブリにおける「Less Slow」コーディング手法の実践。数値計算や SIMD からコルーチン、レンジ、例外処理、ネットワーク、ユーザー空間 IO まで

    1,923-1直近 7 日のスター増減
  • evalplus@evalplus

    LLMが生成したコードの厳密な評価 - NeurIPS 2023 & COLM 2024

    1,806+1直近 7 日のスター増減
  • training@mlcommons

    MLPerf® トレーニングベンチマークのリファレンス実装

    1,771-1直近 7 日のスター増減
  • VBench@Vchitect

    [CVPR2024 Highlight] VBench - 動画生成の評価

    1,757+7直近 7 日のスター増減
  • skillsbench@benchflow-ai

    SkillsBenchは、スキルの機能性とエージェントによるスキル活用の効果を評価します。

    1,742+11直近 7 日のスター増減
  • nanobench@martinus

    C++11/14/17/20 向けのシンプルで高速、正確なシングルヘッダーのマイクロベンチマーク機能

    1,733+1直近 7 日のスター増減
  • hotpath-rs@pawurb

    Rust のボトルネックを素早く発見するツール。CPU、メモリ、SQL、HTTP、I/O、非同期コードに対応する単一のプロファイラです。

    1,707+7直近 7 日のスター増減
  • BEHAVIOR-1K@StanfordVL

    BEHAVIOR-1K: Embodied AI研究を加速するためのプラットフォーム。サポートのためにDiscordに参加してください: https://discord.gg/bccR5vGFEx

    1,677+8直近 7 日のスター増減
  • inference@mlcommons

    MLPerf®推論ベンチマークのリファレンス実装

    1,624+2直近 7 日のスター増減
  • サーベイ論文「A Survey on Evaluation of Large Language Models」の公式GitHubページ

    1,608-1直近 7 日のスター増減
  • ADR@uber

    ADR は、可観覧性、セキュリティベンチマーク、脅威検知を通じてエンタープライズ AI エージェントを保護します。Uber で導入されています。

    1,527+21直近 7 日のスター増減
  • py-motmetrics@cheind

    :bar_chart: Pythonで複数の多目的追跡(MOT)をベンチマークする

    1,487+0直近 7 日のスター増減
← トピック一覧に戻る