Zum Hauptinhalt springen
buildradar
Sign in
Thema · benchmark

benchmark

Erfasste Open-Source-Repos mit dem Tag benchmark, sortiert nach Sternen.

Repos
158
Sterne gesamt
338.554
Sterne im Schnitt
2.143
Anteil
0,02%

Themen, die häufig gemeinsam mit benchmark am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit benchmark getaggt wurden.

  • DeepSeek V4 × J-Space-Fähigkeitsrealisierungsbericht — Benchmark-Belege dafür, dass J-Space den Fähigkeitsrealisierungsverlust bei DeepSeek V4 (Flash/Pro) reduziert.

    1.036
  • HarnessEval-W@MirroS-Lab

    HarnessEval-W: Agentifying the Evaluation of Visual Worlds

    256
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • hyperfine@sharkdp

    Ein Kommandozeilen-Benchmarking-Tool

    28.759+60Sterne-Änderung der letzten 7 Tage
  • Leistungsstarke .NET-Bibliothek für Benchmarking

    11.485+6Sterne-Änderung der letzten 7 Tage
  • oha@hatoo

    Ohayou (おはよう), HTTP-Lastgenerator, inspiriert von rakyll/hey mit TUI-Animation.

    10.517+17Sterne-Änderung der letzten 7 Tage
  • benchmark@google

    Eine Microbenchmark-Support-Bibliothek

    10.375+13Sterne-Änderung der letzten 7 Tage
  • mmpose@open-mmlab

    OpenMMLab Pose Estimation Toolbox und Benchmark.

    7.860+20Sterne-Änderung der letzten 7 Tage
  • opencompass@open-compass

    OpenCompass ist eine LLM-Evaluierungsplattform, die eine Vielzahl von Modellen (Llama3, Mistral, InternLM2, GPT-4, LLaMa2, Qwen, GLM, Claude usw.) auf über 100 Datensätzen unterstützt.

    7.374+48Sterne-Änderung der letzten 7 Tage
  • ecs@spiritLHLS

    VPS-Server-Benchmark-Projekt. Die umgebungsunabhängige Go-Version wird empfohlen: https://github.com/oneclickvirt/ecs

    7.155+16Sterne-Änderung der letzten 7 Tage
  • web-frameworks@the-benchmarker

    Welches ist das schnellste Web-Framework?

    7.085-1Sterne-Änderung der letzten 7 Tage
  • sysbench@akopytov

    Skriptbare Datenbank und System-Performance-Benchmark.

    6.782+3Sterne-Änderung der letzten 7 Tage
  • YABS – ein einfaches Bash-Skript zur Messung der Linux-Server-Leistung mit fio, iperf3 und Geekbench

    6.654+20Sterne-Änderung der letzten 7 Tage
  • SWE-bench@SWE-bench

    SWE-bench: Können Sprachmodelle reale GitHub-Issues lösen?

    5.734+54Sterne-Änderung der letzten 7 Tage
  • ann-benchmarks@erikbern

    Benchmarks von Bibliotheken für approximative nächste Nachbarn in Python

    5.720+5Sterne-Änderung der letzten 7 Tage
  • dperf@baidu

    dperf: Hochleistungs-Netzwerklasttest-Tool basierend auf DPDK

    5.601+5Sterne-Änderung der letzten 7 Tage
  • criterion.rs@bheisler

    Statistik-gestützte Benchmark-Bibliothek für Rust

    5.523+5Sterne-Änderung der letzten 7 Tage
  • across@teddysun

    Über die Große Mauer können wir jeden Winkel der Welt erreichen

    5.370+2Sterne-Änderung der letzten 7 Tage
  • FluidX3D@ProjectPhysX

    Die schnellste und speichereffizienteste Lattice-Boltzmann-CFD-Software, läuft auf allen GPUs und CPUs via OpenCL. Kostenlos für nicht-kommerzielle Nutzung.

    5.254+13Sterne-Änderung der letzten 7 Tage
  • mmaction2@open-mmlab

    OpenMMLabs Videoverständnis-Toolbox und Benchmark der nächsten Generation

    5.147+5Sterne-Änderung der letzten 7 Tage
  • Chronos@Kodezi

    Kodezi Chronos ist ein auf Debugging ausgerichtetes Sprachmodell, das branchenführende Ergebnisse auf SWE-bench Lite (80,33 %) und 67 % reale Fehlerbehebungsgenauigkeit erreicht, was mehr als sechsmal besser ist als GPT-4. Entwickelt mit Adaptive Graph-Guided Retrieval und Persistent Debug Memory. Modell verfügbar Q1 2026 über Kodezi OS.

    4.928+12Sterne-Änderung der letzten 7 Tage
  • lmms-eval@EvolvingLMMs-Lab

    All-in-One Multimodales Evaluierungs-Toolkit für Text-, Bild-, Video- und Audio-Aufgaben

    4.383+11Sterne-Änderung der letzten 7 Tage
  • evo@MichaelGrupp

    Python-Paket zur Evaluierung von Odometrie und SLAM

    4.310+7Sterne-Änderung der letzten 7 Tage
  • CLUE@CLUEbenchmark

    Chinesischer Sprachverständnis-Evaluierungsbenchmark: Datensätze, Baselines, vortrainierte Modelle, Korpora und Bestenliste

    4.279+0Sterne-Änderung der letzten 7 Tage
  • coost@idealvin

    Eine winzige Boost-Bibliothek in C++11.

    4.211-1Sterne-Änderung der letzten 7 Tage
  • Baichuan2@baichuan-inc

    Eine Reihe von Large Language Models, entwickelt von Baichuan Intelligent Technology

    4.083-1Sterne-Änderung der letzten 7 Tage
  • HTTP(S)-Benchmark-Tools, Testen/Debugging & REST-API (RESTful)

    3.767+3Sterne-Änderung der letzten 7 Tage
  • XcodeBenchmark@devMEremenko

    XcodeBenchmark misst die Kompilierungszeit einer großen Codebasis auf iMac, MacBook und Mac Pro

    3.663+4Sterne-Änderung der letzten 7 Tage
  • FlashRAG@RUC-NLPIR

    ⚡FlashRAG: Ein Python-Toolkit für effiziente RAG-Forschung (WWW2025 Resource)

    3.562+13Sterne-Änderung der letzten 7 Tage
  • mteb@embeddings-benchmark

    MTEB: State-of-the-Art-Evaluierung von Embeddings über Sprachen und Modalitäten hinweg

    3.409+9Sterne-Änderung der letzten 7 Tage
  • phoronix-test-suite@phoronix-test-suite

    Die Phoronix Test Suite: eine Open-Source- und plattformübergreifende Software für automatisierte Tests und Benchmarking.

    3.118+5Sterne-Änderung der letzten 7 Tage
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: Benchmarking multimodaler Agents für offene Aufgaben in echten Computerumgebungen

    3.112+11Sterne-Änderung der letzten 7 Tage
  • Primes@PlummersSoftwareLLC

    Primzahlen-Projekte in über 100 Programmiersprachen zum Vergleich ihrer Geschwindigkeit und des Scharfsinns ihrer Programmierer

    3.016-1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen