benchmark
Erfasste Open-Source-Repos mit dem Tag benchmark, sortiert nach Sternen.
- #31★ 2.800+12Sterne-Änderung der letzten 7 Tage
- #32
Häufige Java-Web-Schwachstellen und Sicherheitscode basierend auf Spring Boot und Spring Security
★ 2.675+1Sterne-Änderung der letzten 7 Tage - #33
CPU-X ist eine freie Software, die Informationen über CPU, Mainboard und mehr sammelt
★ 2.647+0Sterne-Änderung der letzten 7 Tage - #34
Tsung ist ein leistungsstarkes Benchmark-Framework für verschiedene Protokolle wie HTTP, XMPP, LDAP usw.
★ 2.629+0Sterne-Änderung der letzten 7 Tage - #35
Ein für kleinere LLMs optimiertes Testumfeld
★ 2.528+16Sterne-Änderung der letzten 7 Tage - #36★ 2.525+4Sterne-Änderung der letzten 7 Tage
- #37
[ECCV2024] Video Foundation Models & Data für multimodales Verständnis
★ 2.374+5Sterne-Änderung der letzten 7 Tage - #38★ 2.362+0Sterne-Änderung der letzten 7 Tage
- #39
VPS Fusion Monster Server Test GO Version. Ziel ist das umfassendste Servertestprojekt, implementiert in Go ohne Umgebungsimplementierungen.
★ 2.329+13Sterne-Änderung der letzten 7 Tage - #40
Ein heterogener Benchmark für Information Retrieval. Einfach zu bedienen, evaluiert Ihre Modelle über 15+ verschiedene IR-Datensätze hinweg.
★ 2.283+5Sterne-Änderung der letzten 7 Tage - #41★ 2.264+14Sterne-Änderung der letzten 7 Tage
- #42
Cista ist eine einfache, hochperformante Zero-Copy-C++-Serialisierungs- und Reflexionsbibliothek.
★ 2.247+1Sterne-Änderung der letzten 7 Tage - #43
📰 Lesenswerte Paper und Blogs zur LLM-basierten Langkontext-Modellierung 🔥
★ 2.164-1Sterne-Änderung der letzten 7 Tage - #44
:zap: Go Web-Framework Benchmark
★ 2.135+1Sterne-Änderung der letzten 7 Tage - #45
Ein objektiver Vergleich mehrerer Frameworks, mit denen sich Web-Apps in Desktop-Anwendungen „transformieren“ lassen.
★ 1.989+0Sterne-Änderung der letzten 7 Tage - #46★ 1.987+0Sterne-Änderung der letzten 7 Tage
- #47★ 1.973+2Sterne-Änderung der letzten 7 Tage
- #48
τ-Bench: Ein Benchmark für die Interaktion zwischen Tool, Agent und Benutzer in realen Domänen
★ 1.938+30Sterne-Änderung der letzten 7 Tage - #49
Experimentieren mit „Less Slow“-Programmierpraktiken in C++ 20, C, CUDA, PTX & Assembly, von Numerik & SIMD bis hin zu Coroutines, Ranges, Ausnahmebehandlung, Netzwerken und User-Space-IO
★ 1.923-1Sterne-Änderung der letzten 7 Tage - #50★ 1.806+1Sterne-Änderung der letzten 7 Tage
- #51★ 1.771-1Sterne-Änderung der letzten 7 Tage
- #52★ 1.757+7Sterne-Änderung der letzten 7 Tage
- #53
SkillsBench bewertet, wie gut Fähigkeiten funktionieren und wie effektiv Agenten bei deren Nutzung sind.
★ 1.742+11Sterne-Änderung der letzten 7 Tage - #54
Einfache, schnelle und präzise Single-Header-Mikrobenchmark-Funktionalität für C++11/14/17/20.
★ 1.733+1Sterne-Änderung der letzten 7 Tage - #55
Engpässe in Rust schnell finden – ein Profiler für CPU, Speicher, SQL, HTTP, I/O und asynchronen Code.
★ 1.707+7Sterne-Änderung der letzten 7 Tage - #56
BEHAVIOR-1K: Eine Plattform zur Beschleunigung der Embodied-AI-Forschung. Treten Sie unserem Discord für Support bei: https://discord.gg/bccR5vGFEx
★ 1.677+8Sterne-Änderung der letzten 7 Tage - #57★ 1.624+2Sterne-Änderung der letzten 7 Tage
- #58
Die offizielle GitHub-Seite für das Survey-Paper „A Survey on Evaluation of Large Language Models“.
★ 1.608-1Sterne-Änderung der letzten 7 Tage - #59
ADR sichert Enterprise-KI-Agenten durch Observability, Sicherheits-Benchmarking und Bedkennung ab. Im Einsatz bei Uber.
★ 1.527+21Sterne-Änderung der letzten 7 Tage - #60
:bar_chart: Benchmark für mehrere Object Tracker (MOT) in Python
★ 1.487+0Sterne-Änderung der letzten 7 Tage