メインコンテンツへスキップ
buildradar
Sign in
トピック · benchmark

benchmark

benchmark がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
158
総スター数
338,554
平均スター数
2,143
シェア
0.02%

benchmark と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、benchmark がタグ付けされたリポジトリ。

  • DeepSeek V4 × J-Space 能力実現レポート — J-Space が DeepSeek V4 (Flash/Pro) における能力実現の損失を軽減することを示すベンチマーク証拠。

    1,035
  • HarnessEval-W@MirroS-Lab

    HarnessEval-W: Agentifying the Evaluation of Visual Worlds

    256
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • hyperfine@sharkdp

    コマンドラインベンチマークツール。

    28,759+60直近 7 日のスター増減
  • ベンチマーク用の強力な.NETライブラリ

    11,485+6直近 7 日のスター増減
  • oha@hatoo

    Ohayou(おはよう)、tuiアニメーションをフィーチャーしたHTTPロードジェネレータ(rakyll/heyにインスパイア)

    10,517+17直近 7 日のスター増減
  • benchmark@google

    マイクロベンチマークサポートライブラリ

    10,375+13直近 7 日のスター増減
  • mmpose@open-mmlab

    OpenMMLab ポーズ推定ツールボックスおよびベンチマーク。

    7,860+20直近 7 日のスター増減
  • opencompass@open-compass

    OpenCompassはLLM評価プラットフォームであり、100以上のデータセットで幅広いモデル(Llama3, Mistral, InternLM2, GPT-4, LLaMa2, Qwen, GLM, Claudeなど)をサポートしています。

    7,374+48直近 7 日のスター増減
  • ecs@spiritLHLS

    VPS Fusion Monster Server テストスクリプト。環境依存のないGoバージョンを推奨。より推奨されるのは環境依存のないGoバージョンを使用すること: https://github.com/oneclickvirt/ecs

    7,155+16直近 7 日のスター増減
  • web-frameworks@the-benchmarker

    最速のウェブフレームワークはどれですか?

    7,085-1直近 7 日のスター増減
  • sysbench@akopytov

    スクリプタブルデータベースおよびシステムパフォーマンスベンチマーク。

    6,782+3直近 7 日のスター増減
  • YABS - fio、iperf3、& Geekbenchを使用してLinuxサーバーのパフォーマンスを推定するシンプルなbashスクリプト

    6,654+20直近 7 日のスター増減
  • SWE-bench@SWE-bench

    SWE-bench: 言語モデルは実世界のGithubのIssueを解決できるか?

    5,734+54直近 7 日のスター増減
  • ann-benchmarks@erikbern

    Pythonにおける近似最近傍ライブラリのベンチマーク

    5,720+5直近 7 日のスター増減
  • dperf@baidu

    dperf: DPDKベースの高性能ネットワーク負荷テストツール

    5,601+5直近 7 日のスター増減
  • criterion.rs@bheisler

    Rust向けの統計駆動型ベンチマークライブラリ

    5,523+5直近 7 日のスター増減
  • across@teddysun

    万里の長城を越えれば、世界のあらゆる角地に到達できる。

    5,370+2直近 7 日のスター増減
  • FluidX3D@ProjectPhysX

    OpenCL経由で全てのGPUおよびCPU上で動作する、最速かつ最もメモリ効率の高いLattice Boltzmann CFDソフトウェア。非商用利用は無料。

    5,254+13直近 7 日のスター増減
  • mmaction2@open-mmlab

    OpenMMLabの次世代ビデオ理解ツールボックスおよびベンチマーク。

    5,147+5直近 7 日のスター増減
  • Chronos@Kodezi

    Kodezi Chronosは、デバッグを最優先した言語モデルであり、SWE-bench Liteで最先端の結果(80.33%)と実世界での修正精度67%を達成。GPT-4の6倍以上の性能。Adaptive Graph-Guided RetrievalとPersistent Debug Memoryを搭載。2026年第1四半期にKodezi OS経由で利用可能。

    4,928+12直近 7 日のスター増減
  • lmms-eval@EvolvingLMMs-Lab

    テキスト、画像、ビデオ、オーディオタスクを網羅するオールインワンのマルチモーダル評価ツールキット

    4,383+11直近 7 日のスター増減
  • evo@MichaelGrupp

    オドメトリとSLAMの評価のためのPythonパッケージ。

    4,310+7直近 7 日のスター増減
  • CLUE@CLUEbenchmark

    中文言語理解評価ベンチマーク (Chinese Language Understanding Evaluation Benchmark): データセット、ベースライン、事前学習モデル、コーパス、リーダーボード

    4,279+0直近 7 日のスター増減
  • coost@idealvin

    C++11の小さなboostライブラリ。

    4,211-1直近 7 日のスター増減
  • Baichuan2@baichuan-inc

    Baichuan Intelligent Technologyが開発した一連の大規模言語モデル

    4,083-1直近 7 日のスター増減
  • HTTP(S)ベンチマークツール、テスト/デバッグ、およびrestAPI (RESTful)

    3,767+3直近 7 日のスター増減
  • XcodeBenchmark@devMEremenko

    iMac、MacBook、Mac Proにおける大規模コードベースのコンパイル時間を測定するXcodeBenchmark。

    3,663+4直近 7 日のスター増減
  • FlashRAG@RUC-NLPIR

    ⚡FlashRAG: 効率的な RAG 研究のための Python ツールキット (WWW2025 Resource)

    3,562+13直近 7 日のスター増減
  • mteb@embeddings-benchmark

    MTEB:言語およびモダリティを横断した埋め込みの最先端評価

    3,409+9直近 7 日のスター増減
  • phoronix-test-suite@phoronix-test-suite

    Phoronix Test Suiteは、オープンソースのクロスプラットフォーム自動テスト・ベンチマークソフトウェアです。

    3,118+5直近 7 日のスター増減
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: 実コンピュータ環境におけるオープンエンドなタスクのためのマルチモーダルエージェントのベンチマーク

    3,112+11直近 7 日のスター増減
  • Primes@PlummersSoftwareLLC

    100 以上のプログラミング言語による素数計算プロジェクト。速度とプログラマーの機知を比較します。

    3,016-1直近 7 日のスター増減
← トピック一覧に戻る