Lompat ke konten utama
buildradar
Sign in
Topik · benchmark

benchmark

Repositori open source terpantau bertanda benchmark, diurutkan berdasarkan bintang.

158 repositori
  • llm-colosseum@OpenGenerativeAI

    Menguji LLM dengan bertarung di Street Fighter 3! Cara baru untuk mengevaluasi kualitas LLM

    1.483+0Perubahan bintang dalam 7 hari terakhir
  • pytest-benchmark@ionelmc

    Fixture pytest untuk melakukan benchmarking kode

    1.448+0Perubahan bintang dalam 7 hari terakhir
  • divan@nvzqz

    Benchmarking yang cepat dan sederhana untuk proyek Rust.

    1.444+1Perubahan bintang dalam 7 hari terakhir
  • MedMNIST@MedMNIST

    [pip install medmnist] 18 Dataset Standar untuk Klasifikasi Citra Biomedis 2D dan 3D

    1.399+0Perubahan bintang dalam 7 hari terakhir
  • Kompiler cepat untuk C# Expression Trees dan alternatif ringan LightExpression. Alat diagnostik dan pembuatan kode untuk ekspresi.

    1.375+1Perubahan bintang dalam 7 hari terakhir
  • smac@oxwhirl

    SMAC: Tantangan Multi-Agen StarCraft

    1.367+1Perubahan bintang dalam 7 hari terakhir
  • SLM-Lab@kengz

    Kerangka kerja Deep Reinforcement Learning modular di PyTorch. Pustaka pendamping buku "Foundations of Deep Reinforcement Learning".

    1.362+0Perubahan bintang dalam 7 hari terakhir
  • Kemajuan Terbaru dalam Penalaran System-2

    1.353+0Perubahan bintang dalam 7 hari terakhir
  • kg-gen@stair-lab

    [NeurIPS '25] Pembuatan Knowledge Graph dari Teks Apa Pun

    1.266+6Perubahan bintang dalam 7 hari terakhir
  • github-action-benchmark@benchmark-action

    GitHub Action untuk benchmarking berkelanjutan guna menjaga performa

    1.251+0Perubahan bintang dalam 7 hari terakhir
  • boomer@myzhan

    Generator beban yang lebih baik untuk locust, ditulis dalam golang.

    1.237+0Perubahan bintang dalam 7 hari terakhir
  • LongBench@THUDM

    LongBench v2 dan LongBench (ACL 25'&24')

    1.232+1Perubahan bintang dalam 7 hari terakhir
  • KernelBench@ScalingIntelligence

    KernelBench: Apakah LLM Dapat Menulis Kernel GPU? - Tolok Ukur + Toolkit dengan Torch -> CUDA (+ lebih banyak DSL)

    1.227+7Perubahan bintang dalam 7 hari terakhir
  • PDEBench@pdebench

    PDEBench: Tolok Ukur Ekstensif untuk Pembelajaran Mesin Ilmiah

    1.192+0Perubahan bintang dalam 7 hari terakhir
  • bench-scripts@haydenjames

    Kompilasi skrip tolok ukur (benchmarking) server Linux.

    1.190+0Perubahan bintang dalam 7 hari terakhir
  • flow@flow-project

    Kerangka kerja komputasi untuk reinforcement learning dalam kontrol lalu lintas

    1.188+0Perubahan bintang dalam 7 hari terakhir
  • VectorDBBench@zilliztech

    Benchmark untuk database vektor.

    1.173+2Perubahan bintang dalam 7 hari terakhir
  • omnisafe@PKU-Alignment

    JMLR: OmniSafe adalah kerangka kerja infrastruktur untuk mempercepat riset SafeRL.

    1.150+1Perubahan bintang dalam 7 hari terakhir
  • OpenSTL@chengtan9907

    OpenSTL: Tolok Ukur Komprehensif dari Spatio-Temporal Predictive Learning

    1.143+5Perubahan bintang dalam 7 hari terakhir
  • primesieve@kimwalisch

    🚀 Generator bilangan prima cepat

    1.114+1Perubahan bintang dalam 7 hari terakhir
  • ClickBench@ClickHouse

    ClickBench: sebuah benchmark untuk database analitik.

    1.100+2Perubahan bintang dalam 7 hari terakhir
  • lzbench@inikep

    lzbench adalah tolok ukur dalam memori (in-memory benchmark) untuk kompresor sumber terbuka

    1.084+4Perubahan bintang dalam 7 hari terakhir
  • Alat pembuatan trafik dan benchmarking untuk NoSQL Redis dan Memcache.

    1.053+5Perubahan bintang dalam 7 hari terakhir
  • opencv_zoo@opencv

    Model Zoo untuk OpenCV DNN dan Benchmark.

    1.046+8Perubahan bintang dalam 7 hari terakhir
  • benchmark@pytorch

    TorchBench adalah kumpulan tolok ukur sumber terbuka yang digunakan untuk mengevaluasi kinerja PyTorch.

    1.042-1Perubahan bintang dalam 7 hari terakhir
  • pyperformance@python

    Suite Benchmark Performa Python

    1.029+1Perubahan bintang dalam 7 hari terakhir
  • Laporan realisasi kapabilitas DeepSeek V4 × J-Space — bukti benchmark bahwa J-Space mengurangi loss realisasi kapabilitas pada DeepSeek V4.

    1.026-11Perubahan bintang dalam 7 hari terakhir
  • ADBench@Minqi824

    Implementasi resmi dari "ADBench: Anomaly Detection Benchmark", NeurIPS 2022.

    1.023+2Perubahan bintang dalam 7 hari terakhir
  • asv@airspeed-velocity

    Airspeed Velocity: Alat benchmarking Python sederhana dengan pelaporan berbasis web.

    1.018+4Perubahan bintang dalam 7 hari terakhir
  • moses@molecularsets

    Molecular Sets (MOSES): Platform Pembanding untuk Model Pembuatan Molekul

    988+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik