benchmark
Dépôts open source suivis étiquetés benchmark, triés par étoiles.
- #31★ 2 800+12Évolution des étoiles sur les 7 derniers jours
- #32
Vulnérabilités courantes des applications web Java et code de sécurité basé sur Spring Boot et Spring Security
★ 2 675+1Évolution des étoiles sur les 7 derniers jours - #33
CPU-X est un logiciel libre qui collecte des informations sur le processeur, la carte mère et plus encore
★ 2 647+0Évolution des étoiles sur les 7 derniers jours - #34
Tsung est un framework de benchmark haute performance pour divers protocoles, dont HTTP, XMPP, LDAP, etc.
★ 2 629+0Évolution des étoiles sur les 7 derniers jours - #35
Un harnais optimisé pour les LLM plus petits.
★ 2 528+16Évolution des étoiles sur les 7 derniers jours - #36★ 2 525+4Évolution des étoiles sur les 7 derniers jours
- #37
[ECCV2024] Modèles de fondation vidéo et données pour la compréhension multimodale.
★ 2 374+5Évolution des étoiles sur les 7 derniers jours - #38★ 2 362+0Évolution des étoiles sur les 7 derniers jours
- #39
Projet de test de serveurs VPS en version Go, visant à être l'outil de test le plus complet, sans dépendances d'environnement.
★ 2 329+13Évolution des étoiles sur les 7 derniers jours - #40
Un benchmark hétérogène pour la recherche d'information, permettant d'évaluer facilement vos modèles sur plus de 15 jeux de données IR divers.
★ 2 283+5Évolution des étoiles sur les 7 derniers jours - #41
Évaluation comparative du transfert de connaissances dans l'apprentissage robotique continu
★ 2 264+14Évolution des étoiles sur les 7 derniers jours - #42
Cista est une bibliothèque de sérialisation et de réflexion C++ simple, haute performance et sans copie (zero-copy).
★ 2 247+1Évolution des étoiles sur les 7 derniers jours - #43
Articles et blogs incontournables sur la modélisation de contexte long basée sur les LLM
★ 2 164-1Évolution des étoiles sur les 7 derniers jours - #44
Benchmark de frameworks web Go.
★ 2 135+1Évolution des étoiles sur les 7 derniers jours - #45
Une comparaison objective de plusieurs frameworks permettant de transformer des applications web en applications de bureau.
★ 1 989+0Évolution des étoiles sur les 7 derniers jours - #46
Une boîte à outils d'apprentissage automatique pour l'analyse de logs [ICSE'19, DSN'16].
★ 1 987+0Évolution des étoiles sur les 7 derniers jours - #47★ 1 973+2Évolution des étoiles sur les 7 derniers jours
- #48
τ-Bench : un benchmark pour l'interaction outil-agent-utilisateur dans des domaines réels
★ 1 938+30Évolution des étoiles sur les 7 derniers jours - #49
Expérimentation de pratiques de codage « moins lentes » en C++ 20, C, CUDA, PTX et assembleur, allant du numérique et SIMD aux coroutines, ranges, gestion des exceptions, réseaux et entrées/sorties en espace utilisateur.
★ 1 923-1Évolution des étoiles sur les 7 derniers jours - #50★ 1 806+1Évolution des étoiles sur les 7 derniers jours
- #51★ 1 771-1Évolution des étoiles sur les 7 derniers jours
- #52★ 1 757+7Évolution des étoiles sur les 7 derniers jours
- #53
SkillsBench évalue la pertinence des compétences et l'efficacité des agents à les utiliser.
★ 1 742+11Évolution des étoiles sur les 7 derniers jours - #54
Fonctionnalité de micro-benchmarking simple, rapide et précise, sous forme d'en-tête unique pour C++11/14/17/20.
★ 1 733+1Évolution des étoiles sur les 7 derniers jours - #55
Identifiez rapidement les goulots d'étranglement en Rust - un profileur unique pour le CPU, la mémoire, SQL, HTTP, les E/S et le code asynchrone.
★ 1 707+7Évolution des étoiles sur les 7 derniers jours - #56
BEHAVIOR-1K : une plateforme pour accélérer la recherche en IA incarnée. Rejoignez notre Discord pour obtenir de l'aide : https://discord.gg/bccR5vGFEx
★ 1 677+8Évolution des étoiles sur les 7 derniers jours - #57★ 1 624+2Évolution des étoiles sur les 7 derniers jours
- #58
Page GitHub officielle de l'article de synthèse A Survey on Evaluation of Large Language Models
★ 1 608-1Évolution des étoiles sur les 7 derniers jours - #59
ADR sécurise les agents d'IA en entreprise via l'observabilité, l'analyse comparative de sécurité et la détection des menaces. Déployé chez Uber.
★ 1 527+21Évolution des étoiles sur les 7 derniers jours - #60
Benchmark de suivi d'objets multiples (MOT) en Python
★ 1 487+0Évolution des étoiles sur les 7 derniers jours