benchmark
Repositori open source terpantau bertanda benchmark, diurutkan berdasarkan bintang.
- #91
Kotak Alat Estimasi Kedalaman Monokuler berbasis MMSegmentation.
★ 971+0Perubahan bintang dalam 7 hari terakhir - #92
BlazeHTTP adalah alat pengujian efektivitas perlindungan WAF yang mudah digunakan.
★ 952+0Perubahan bintang dalam 7 hari terakhir - #93
Berbagai benchmark gRPC
★ 939+1Perubahan bintang dalam 7 hari terakhir - #94★ 933+0Perubahan bintang dalam 7 hari terakhir
- #95★ 925+1Perubahan bintang dalam 7 hari terakhir
- #96
Ukur performa Amazon S3 dari lokasi mana pun.
★ 910-1Perubahan bintang dalam 7 hari terakhir - #97
Pustaka PyTorch untuk segala hal tentang Reinforcement Learning (RL) untuk Combinatorial Optimization (CO)
★ 900+1Perubahan bintang dalam 7 hari terakhir - #98★ 894+2Perubahan bintang dalam 7 hari terakhir
- #99
Aplikasi pengujian kecepatan / benchmarking performa penyimpanan Windows, macOS, dan Android (HDD, SSD, RAM)
★ 871+2Perubahan bintang dalam 7 hari terakhir - #100★ 863+0Perubahan bintang dalam 7 hari terakhir
- #101
Kecerdasan Alami tetap merupakan ide yang cukup bagus.
★ 833+0Perubahan bintang dalam 7 hari terakhir - #102★ 833+4Perubahan bintang dalam 7 hari terakhir
- #103
📊 Perbandingan Tolok Ukur Paket dengan Validasi Runtime dan Dukungan TypeScript
★ 830+2Perubahan bintang dalam 7 hari terakhir - #104
DeepResearch Bench: Tolok ukur komprehensif untuk agen riset mendalam
★ 826+9Perubahan bintang dalam 7 hari terakhir - #105
ClawProBench adalah harness benchmark live-first untuk mengevaluasi agen LLM di runtime OpenClaw dengan penilaian deterministik dan keandalan uji coba berulang.
★ 823+0Perubahan bintang dalam 7 hari terakhir - #106★ 817+3Perubahan bintang dalam 7 hari terakhir
- #107★ 806+29Perubahan bintang dalam 7 hari terakhir
- #108
Satu lagi implementasi untuk game benchmark bahasa pemrograman
★ 800-1Perubahan bintang dalam 7 hari terakhir - #109
"Jangan percaya siapa pun, uji semuanya." - plugin sbt untuk JMH (Java Microbenchmark Harness)
★ 796+0Perubahan bintang dalam 7 hari terakhir - #110
MobileGym: Platform Simulasi yang Dapat Verifikasi dan Sangat Pararel untuk Penelitian Agen GUI Seluler · Simulator Android yang berjalan di browser · Simulator Android Berbasis Browser · Evaluasi yang Dapat Verifikasi · Pelatihan RL Online yang Dapat Skala
★ 786+10Perubahan bintang dalam 7 hari terakhir - #111
RobustBench: tolok ukur ketahanan adversarial yang terstandarisasi [NeurIPS 2021 Benchmarks and Datasets Track]
★ 782+0Perubahan bintang dalam 7 hari terakhir - #112★ 782+3Perubahan bintang dalam 7 hari terakhir
- #113★ 780+0Perubahan bintang dalam 7 hari terakhir
- #114
Tolok ukur agen dengan tugas-tugas dalam perusahaan perangkat lunak simulasi.
★ 775+4Perubahan bintang dalam 7 hari terakhir - #115
Alat uji stres HTTP golang, mendukung tunggal dan terdistribusi, http/1, http/2, dan http/3.
★ 771+0Perubahan bintang dalam 7 hari terakhir - #116
[EMNLP 2024 & AAAI 2026] Toolkit canggih untuk mengompresi model besar termasuk LLM, VLM, dan model generatif video.
★ 747+4Perubahan bintang dalam 7 hari terakhir - #117
Tolok ukur lain untuk beberapa framework python
★ 721+0Perubahan bintang dalam 7 hari terakhir - #118
Benchmark mentah tentang throughput, latensi, dan transfer Hello World pada kerangka kerja microservices populer
★ 715+0Perubahan bintang dalam 7 hari terakhir - #119
Kerangka kerja benchmark blockchain untuk mengukur kinerja berbagai solusi blockchain https://wiki.hyperledger.org/display/caliper
★ 705+1Perubahan bintang dalam 7 hari terakhir - #120
Model Perintis yang memainkan permainan papan Diplomacy.
★ 699+1Perubahan bintang dalam 7 hari terakhir