Lompat ke konten utama
buildradar
Sign in
Topik · benchmark

benchmark

Repositori open source terpantau bertanda benchmark, diurutkan berdasarkan bintang.

Repositori
158
Total bintang
338.554
Rata-rata bintang
2.143
Porsi
0,02%

Topik yang sering muncul berdampingan dengan benchmark di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda benchmark.

  • Laporan realisasi kapabilitas DeepSeek V4 × J-Space — bukti benchmark bahwa J-Space mengurangi loss realisasi kapabilitas pada DeepSeek V4.

    1.035
  • HarnessEval-W@MirroS-Lab

    HarnessEval-W: Agentifying the Evaluation of Visual Worlds

    256
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • hyperfine@sharkdp

    Alat benchmarking berbasis baris perintah.

    28.759+60Perubahan bintang dalam 7 hari terakhir
  • Pustaka .NET yang canggih untuk benchmarking

    11.485+6Perubahan bintang dalam 7 hari terakhir
  • oha@hatoo

    Ohayou(おはよう), generator beban HTTP, terinspirasi oleh rakyll/hey dengan animasi tui.

    10.517+17Perubahan bintang dalam 7 hari terakhir
  • benchmark@google

    Pustaka pendukung microbenchmark

    10.375+13Perubahan bintang dalam 7 hari terakhir
  • mmpose@open-mmlab

    OpenMMLab Pose Estimation Toolbox dan Benchmark.

    7.860+20Perubahan bintang dalam 7 hari terakhir
  • opencompass@open-compass

    OpenCompass adalah platform evaluasi LLM, mendukung berbagai model (Llama3, Mistral, InternLM2, GPT-4, LLaMa2, Qwen, GLM, Claude, dll.) pada 100+ dataset.

    7.374+48Perubahan bintang dalam 7 hari terakhir
  • ecs@spiritLHLS

    Proyek pengujian server VPS Fusion Monster — Lebih disarankan menggunakan versi Go tanpa dependensi lingkungan.

    7.155+16Perubahan bintang dalam 7 hari terakhir
  • web-frameworks@the-benchmarker

    Kerangka kerja web manakah yang tercepat?

    7.085-1Perubahan bintang dalam 7 hari terakhir
  • sysbench@akopytov

    Benchmark performa sistem dan basis data yang dapat diskrip

    6.782+3Perubahan bintang dalam 7 hari terakhir
  • YABS - skrip bash sederhana untuk memperkirakan performa server Linux menggunakan fio, iperf3, & Geekbench

    6.654+20Perubahan bintang dalam 7 hari terakhir
  • SWE-bench@SWE-bench

    SWE-bench: Bisakah Language Model menyelesaikan masalah Github di dunia nyata?

    5.734+54Perubahan bintang dalam 7 hari terakhir
  • ann-benchmarks@erikbern

    Benchmark pustaka tetangga terdekat perkiraan (approximate nearest neighbor) dengan Python

    5.720+5Perubahan bintang dalam 7 hari terakhir
  • dperf@baidu

    dperf: Alat pengujian beban jaringan berkinerja tinggi berbasis DPDK.

    5.601+5Perubahan bintang dalam 7 hari terakhir
  • criterion.rs@bheisler

    Pustaka benchmarking berbasis statistik untuk Rust

    5.523+5Perubahan bintang dalam 7 hari terakhir
  • across@teddysun

    Melintasi Tembok Besar, kita dapat menjangkau setiap sudut dunia

    5.370+2Perubahan bintang dalam 7 hari terakhir
  • FluidX3D@ProjectPhysX

    Perangkat lunak CFD lattice Boltzmann tercepat dan paling efisien memori, berjalan di semua GPU dan CPU melalui OpenCL. Gratis untuk penggunaan non-komersial.

    5.254+13Perubahan bintang dalam 7 hari terakhir
  • mmaction2@open-mmlab

    Toolbox dan benchmark pemahaman video generasi berikutnya dari OpenMMLab

    5.147+5Perubahan bintang dalam 7 hari terakhir
  • Chronos@Kodezi

    Kodezi Chronos adalah model bahasa yang mengutamakan debugging, mencapai hasil mutakhir pada SWE-bench Lite (80,33%) dan akurasi perbaikan dunia nyata sebesar 67%, lebih dari enam kali lebih baik daripada GPT-4. Dibangun dengan Adaptive Graph-Guided Retrieval dan Persistent Debug Memory. Model akan tersedia pada Q1 2026 melalui Kodezi OS.

    4.928+12Perubahan bintang dalam 7 hari terakhir
  • lmms-eval@EvolvingLMMs-Lab

    Toolkit evaluasi multimodal serbaguna untuk tugas teks, gambar, video, dan audio.

    4.383+11Perubahan bintang dalam 7 hari terakhir
  • evo@MichaelGrupp

    Paket Python untuk evaluasi odometri dan SLAM

    4.310+7Perubahan bintang dalam 7 hari terakhir
  • CLUE@CLUEbenchmark

    Benchmark Evaluasi Pemahaman Bahasa Mandarin: dataset, baseline, model pra-latih, korpus, dan papan peringkat

    4.279+0Perubahan bintang dalam 7 hari terakhir
  • coost@idealvin

    Sebuah pustaka boost kecil di C++11.

    4.211-1Perubahan bintang dalam 7 hari terakhir
  • Baichuan2@baichuan-inc

    Serangkaian model bahasa besar yang dikembangkan oleh Baichuan Intelligent Technology

    4.083-1Perubahan bintang dalam 7 hari terakhir
  • Alat tolok ukur HTTP(S), pengujian/debugging, & restAPI (RESTful)

    3.767+3Perubahan bintang dalam 7 hari terakhir
  • XcodeBenchmark@devMEremenko

    XcodeBenchmark mengukur waktu kompilasi basis kode besar pada iMac, MacBook, dan Mac Pro

    3.663+4Perubahan bintang dalam 7 hari terakhir
  • FlashRAG@RUC-NLPIR

    FlashRAG: Toolkit Python untuk penelitian RAG yang efisien (Sumber daya WWW2025)

    3.562+13Perubahan bintang dalam 7 hari terakhir
  • mteb@embeddings-benchmark

    MTEB: Evaluasi mutakhir untuk embedding lintas bahasa dan modalitas

    3.409+9Perubahan bintang dalam 7 hari terakhir
  • phoronix-test-suite@phoronix-test-suite

    Perangkat lunak pengujian/benchmarking otomatis lintas platform sumber terbuka Phoronix Test Suite.

    3.118+5Perubahan bintang dalam 7 hari terakhir
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: Benchmarking agen multimodal untuk tugas terbuka di lingkungan komputer nyata.

    3.112+11Perubahan bintang dalam 7 hari terakhir
  • Primes@PlummersSoftwareLLC

    Proyek bilangan prima dalam 100+ bahasa pemrograman untuk membandingkan kecepatan dan kecerdasan pemrogramnya.

    3.016-1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik