Zum Hauptinhalt springen
buildradar
Sign in
Thema · benchmark

benchmark

Erfasste Open-Source-Repos mit dem Tag benchmark, sortiert nach Sternen.

158 Repos
  • llm-colosseum@OpenGenerativeAI

    Benchmarken von LLMs durch Kämpfe in Street Fighter 3! Die neue Art, die Qualität eines LLMs zu bewerten

    1.483+0Sterne-Änderung der letzten 7 Tage
  • pytest-benchmark@ionelmc

    pytest-Fixture für das Benchmarken von Code

    1.448+0Sterne-Änderung der letzten 7 Tage
  • divan@nvzqz

    Schnelles und einfaches Benchmarking für Rust-Projekte

    1.444+1Sterne-Änderung der letzten 7 Tage
  • MedMNIST@MedMNIST

    [pip install medmnist] 18 standardisierte Datensätze für die 2D- und 3D-Biomedizinische Bildklassifizierung

    1.399+0Sterne-Änderung der letzten 7 Tage
  • Schneller Compiler für C#-Expression-Trees und die leichtgewichtige LightExpression-Alternative. Diagnose- und Codegenerierungstools für Expressions.

    1.375+1Sterne-Änderung der letzten 7 Tage
  • smac@oxwhirl

    SMAC: Die StarCraft Multi-Agent Challenge

    1.367+1Sterne-Änderung der letzten 7 Tage
  • SLM-Lab@kengz

    Modulares Deep-Reinforcement-Learning-Framework in PyTorch. Begleitbibliothek zum Buch "Foundations of Deep Reinforcement Learning".

    1.362+0Sterne-Änderung der letzten 7 Tage
  • Neueste Fortschritte beim System-2-Reasoning.

    1.353+0Sterne-Änderung der letzten 7 Tage
  • kg-gen@stair-lab

    [NeurIPS '25] Wissensgraphen-Generierung aus beliebigen Texten

    1.266+6Sterne-Änderung der letzten 7 Tage
  • github-action-benchmark@benchmark-action

    GitHub Action für kontinuierliches Benchmarking zur Leistungssicherung

    1.251+0Sterne-Änderung der letzten 7 Tage
  • boomer@myzhan

    Ein besserer Lastgenerator für Locust, geschrieben in Golang.

    1.237+0Sterne-Änderung der letzten 7 Tage
  • LongBench@THUDM

    LongBench v2 und LongBench (ACL 25'&24')

    1.232+1Sterne-Änderung der letzten 7 Tage
  • KernelBench@ScalingIntelligence

    KernelBench: Können LLMs GPU-Kernel schreiben? – Benchmark + Toolkit mit Torch -> CUDA (+ weitere DSLs)

    1.227+7Sterne-Änderung der letzten 7 Tage
  • PDEBench@pdebench

    PDEBench: Ein umfangreicher Benchmark für wissenschaftliches maschinelles Lernen

    1.192+0Sterne-Änderung der letzten 7 Tage
  • bench-scripts@haydenjames

    Eine Sammlung von Benchmarking-Skripten für Linux-Server.

    1.190+0Sterne-Änderung der letzten 7 Tage
  • flow@flow-project

    Rechenrahmen für Reinforcement Learning in der Verkehrssteuerung

    1.188+0Sterne-Änderung der letzten 7 Tage
  • VectorDBBench@zilliztech

    Benchmark für Vektordatenbanken

    1.173+2Sterne-Änderung der letzten 7 Tage
  • omnisafe@PKU-Alignment

    JMLR: OmniSafe ist ein Infrastruktur-Framework zur Beschleunigung der SafeRL-Forschung.

    1.150+1Sterne-Änderung der letzten 7 Tage
  • OpenSTL@chengtan9907

    OpenSTL: Ein umfassender Benchmark für räumlich-zeitliches prädiktives Lernen

    1.143+5Sterne-Änderung der letzten 7 Tage
  • primesieve@kimwalisch

    🚀 Schneller Primzahlengenerator

    1.114+1Sterne-Änderung der letzten 7 Tage
  • ClickBench@ClickHouse

    ClickBench: Ein Benchmark für analytische Datenbanken

    1.100+8Sterne-Änderung der letzten 7 Tage
  • lzbench@inikep

    lzbench ist ein In-Memory-Benchmark von Open-Source-Kompressionstools

    1.084+5Sterne-Änderung der letzten 7 Tage
  • NoSQL Redis- und Memcache-Traffic-Generierungs- und Benchmarking-Tool.

    1.053+5Sterne-Änderung der letzten 7 Tage
  • opencv_zoo@opencv

    Model Zoo für OpenCV DNN und Benchmarks.

    1.046+8Sterne-Änderung der letzten 7 Tage
  • benchmark@pytorch

    TorchBench ist eine Sammlung von Open-Source-Benchmarks zur Bewertung der PyTorch-Leistung.

    1.042-1Sterne-Änderung der letzten 7 Tage
  • pyperformance@python

    Python-Performance-Benchmark-Suite

    1.029+1Sterne-Änderung der letzten 7 Tage
  • DeepSeek V4 × J-Space-Fähigkeitsrealisierungsbericht — Benchmark-Belege dafür, dass J-Space den Fähigkeitsrealisierungsverlust bei DeepSeek V4 (Flash/Pro) reduziert.

    1.026-8Sterne-Änderung der letzten 7 Tage
  • ADBench@Minqi824

    Offizielle Implementierung von "ADBench: Anomaly Detection Benchmark", NeurIPS 2022.

    1.023+2Sterne-Änderung der letzten 7 Tage
  • asv@airspeed-velocity

    Airspeed Velocity: Ein einfaches Python-Benchmarking-Tool mit webbasiertem Reporting

    1.018+4Sterne-Änderung der letzten 7 Tage
  • moses@molecularsets

    Molecular Sets (MOSES): Eine Benchmark-Plattform für Modelle zur molekularen Generierung

    988+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen