benchmark
Erfasste Open-Source-Repos mit dem Tag benchmark, sortiert nach Sternen.
- #91
Monokulare Tiefenschätzungs-Toolbox basierend auf MMSegmentation.
★ 971+0Sterne-Änderung der letzten 7 Tage - #92
BlazeHTTP ist ein einfach zu bedienendes Tool zum Testen der Wirksamkeit von WAF-Schutz.
★ 952+0Sterne-Änderung der letzten 7 Tage - #93
Verschiedene gRPC-Benchmarks
★ 939+1Sterne-Änderung der letzten 7 Tage - #94★ 933+0Sterne-Änderung der letzten 7 Tage
- #95★ 925+1Sterne-Änderung der letzten 7 Tage
- #96
Messen Sie die Leistung von Amazon S3 von jedem Standort aus.
★ 910-1Sterne-Änderung der letzten 7 Tage - #97
Eine PyTorch-Bibliothek für alles rund um Reinforcement Learning (RL) für Combinatorial Optimization (CO)
★ 900+1Sterne-Änderung der letzten 7 Tage - #98★ 894+2Sterne-Änderung der letzten 7 Tage
- #99
App für Geschwindigkeitstests und Performance-Benchmarking von Speichern (HDD, SSD, RAM) unter Windows, macOS und Android.
★ 871+1Sterne-Änderung der letzten 7 Tage - #100★ 863+0Sterne-Änderung der letzten 7 Tage
- #101
Natürliche Intelligenz ist nach wie vor eine ziemlich gute Idee.
★ 833+0Sterne-Änderung der letzten 7 Tage - #102★ 833+4Sterne-Änderung der letzten 7 Tage
- #103
Benchmark-Vergleich von Paketen mit Laufzeitvalidierung und TypeScript-Unterstützung
★ 830+3Sterne-Änderung der letzten 7 Tage - #104
DeepResearch Bench: Ein umfassender Benchmark für Deep Research Agents
★ 826+7Sterne-Änderung der letzten 7 Tage - #105
ClawProBench ist ein Live-First-Benchmark-Harness zur Evaluierung von LLM-Agenten in der OpenClaw-Laufzeitumgebung mit deterministischer Bewertung und Zuverlässigkeit bei wiederholten Durchläufen.
★ 823+0Sterne-Änderung der letzten 7 Tage - #106★ 817+2Sterne-Änderung der letzten 7 Tage
- #107
Eine dynamische Umgebung zur Evaluierung von Angriffen und Verteidigungen für LLM-Agenten.
★ 806+27Sterne-Änderung der letzten 7 Tage - #108
Eine weitere Implementierung des Computer Language Benchmarks Game
★ 800-1Sterne-Änderung der letzten 7 Tage - #109★ 796+0Sterne-Änderung der letzten 7 Tage
- #110
MobileGym: Eine verifizierbare und hochparallele Simulationsplattform für die Forschung zu mobilen GUI-Agenten · Im Browser laufender Android-Emulator · Browser-hosted Android Simulator · Verifizierbare Evaluierung · Skalierbares Online-RL-Training
★ 786+9Sterne-Änderung der letzten 7 Tage - #111
RobustBench: Ein standardisierter Benchmark für neuronale Robustheit [NeurIPS 2021 Benchmarks and Datasets Track]
★ 782+0Sterne-Änderung der letzten 7 Tage - #112★ 782+2Sterne-Änderung der letzten 7 Tage
- #113★ 780+0Sterne-Änderung der letzten 7 Tage
- #114
Ein Agenten-Benchmark mit Aufgaben in einem simulierten Softwareunternehmen.
★ 775+4Sterne-Änderung der letzten 7 Tage - #115
Golang-HTTP-Stresstest-Tool, unterstützt Einzel- und verteilte Modi, HTTP/1, HTTP/2 und HTTP/3.
★ 771+0Sterne-Änderung der letzten 7 Tage - #116
[EMNLP 2024 & AAAI 2026] Ein leistungsstarkes Toolkit zur Komprimierung großer Modelle einschließlich LLMs, VLMs und Video-Generierungsmodellen.
★ 747+4Sterne-Änderung der letzten 7 Tage - #117
Ein weiterer Benchmark für einige Python-Frameworks
★ 721+0Sterne-Änderung der letzten 7 Tage - #118
Rohe Benchmarks zu Durchsatz, Latenz und Übertragung von Hello World bei gängigen Microservices-Frameworks
★ 715+0Sterne-Änderung der letzten 7 Tage - #119
Ein Blockchain-Benchmark-Framework zur Messung der Leistung verschiedener Blockchain-Lösungen https://wiki.hyperledger.org/display/caliper
★ 705+1Sterne-Änderung der letzten 7 Tage - #120
Frontier Models spielen das Brettspiel Diplomacy.
★ 699+1Sterne-Änderung der letzten 7 Tage