Aller au contenu principal
buildradar
Sign in
Sujet · benchmark

benchmark

Dépôts open source suivis étiquetés benchmark, triés par étoiles.

158 dépôts
  • RoboTwin@RoboTwin-Platform

    [ICML 2026] Dépôt de code officiel de RoboTwin 2.0.

    2 800+12Évolution des étoiles sur les 7 derniers jours
  • java-sec-code@JoyChou93

    Vulnérabilités courantes des applications web Java et code de sécurité basé sur Spring Boot et Spring Security

    2 675+1Évolution des étoiles sur les 7 derniers jours
  • CPU-X@TheTumultuousUnicornOfDarkness

    CPU-X est un logiciel libre qui collecte des informations sur le processeur, la carte mère et plus encore

    2 647+0Évolution des étoiles sur les 7 derniers jours
  • tsung@processone

    Tsung est un framework de benchmark haute performance pour divers protocoles, dont HTTP, XMPP, LDAP, etc.

    2 629+0Évolution des étoiles sur les 7 derniers jours
  • little-coder@itayinbarr

    Un harnais optimisé pour les LLM plus petits.

    2 528+16Évolution des étoiles sur les 7 derniers jours
  • mitata@evanwashere

    Outil de benchmarking conçu pour faciliter votre travail.

    2 525+4Évolution des étoiles sur les 7 derniers jours
  • InternVideo@OpenGVLab

    [ECCV2024] Modèles de fondation vidéo et données pour la compréhension multimodale.

    2 374+5Évolution des étoiles sur les 7 derniers jours
  • tinybench@tinylibs

    Une bibliothèque de benchmarking simple, minuscule et légère !

    2 362+0Évolution des étoiles sur les 7 derniers jours
  • ecs@oneclickvirt

    Projet de test de serveurs VPS en version Go, visant à être l'outil de test le plus complet, sans dépendances d'environnement.

    2 329+13Évolution des étoiles sur les 7 derniers jours
  • beir@beir-cellar

    Un benchmark hétérogène pour la recherche d'information, permettant d'évaluer facilement vos modèles sur plus de 15 jeux de données IR divers.

    2 283+5Évolution des étoiles sur les 7 derniers jours
  • LIBERO@Lifelong-Robot-Learning

    Évaluation comparative du transfert de connaissances dans l'apprentissage robotique continu

    2 264+14Évolution des étoiles sur les 7 derniers jours
  • cista@felixguendling

    Cista est une bibliothèque de sérialisation et de réflexion C++ simple, haute performance et sans copie (zero-copy).

    2 247+1Évolution des étoiles sur les 7 derniers jours
  • Articles et blogs incontournables sur la modélisation de contexte long basée sur les LLM

    2 164-1Évolution des étoiles sur les 7 derniers jours
  • Benchmark de frameworks web Go.

    2 135+1Évolution des étoiles sur les 7 derniers jours
  • Une comparaison objective de plusieurs frameworks permettant de transformer des applications web en applications de bureau.

    1 989+0Évolution des étoiles sur les 7 derniers jours
  • logparser@logpai

    Une boîte à outils d'apprentissage automatique pour l'analyse de logs [ICSE'19, DSN'16].

    1 987+0Évolution des étoiles sur les 7 derniers jours
  • tapnet@google-deepmind

    Suivi de n'importe quel point (TAP)

    1 973+2Évolution des étoiles sur les 7 derniers jours
  • tau2-bench@sierra-research

    τ-Bench : un benchmark pour l'interaction outil-agent-utilisateur dans des domaines réels

    1 938+30Évolution des étoiles sur les 7 derniers jours
  • less_slow.cpp@ashvardanian

    Expérimentation de pratiques de codage « moins lentes » en C++ 20, C, CUDA, PTX et assembleur, allant du numérique et SIMD aux coroutines, ranges, gestion des exceptions, réseaux et entrées/sorties en espace utilisateur.

    1 923-1Évolution des étoiles sur les 7 derniers jours
  • evalplus@evalplus

    Évaluation rigoureuse du code synthétisé par LLM - NeurIPS 2023 & COLM 2024.

    1 806+1Évolution des étoiles sur les 7 derniers jours
  • training@mlcommons

    Implémentations de référence des benchmarks d'entraînement MLPerf.

    1 771-1Évolution des étoiles sur les 7 derniers jours
  • VBench@Vchitect

    [CVPR2024 Highlight] VBench - Évaluation de la génération vidéo

    1 757+7Évolution des étoiles sur les 7 derniers jours
  • skillsbench@benchflow-ai

    SkillsBench évalue la pertinence des compétences et l'efficacité des agents à les utiliser.

    1 742+11Évolution des étoiles sur les 7 derniers jours
  • nanobench@martinus

    Fonctionnalité de micro-benchmarking simple, rapide et précise, sous forme d'en-tête unique pour C++11/14/17/20.

    1 733+1Évolution des étoiles sur les 7 derniers jours
  • hotpath-rs@pawurb

    Identifiez rapidement les goulots d'étranglement en Rust - un profileur unique pour le CPU, la mémoire, SQL, HTTP, les E/S et le code asynchrone.

    1 707+7Évolution des étoiles sur les 7 derniers jours
  • BEHAVIOR-1K@StanfordVL

    BEHAVIOR-1K : une plateforme pour accélérer la recherche en IA incarnée. Rejoignez notre Discord pour obtenir de l'aide : https://discord.gg/bccR5vGFEx

    1 677+8Évolution des étoiles sur les 7 derniers jours
  • inference@mlcommons

    Implémentations de référence des benchmarks d'inférence MLPerf®

    1 624+2Évolution des étoiles sur les 7 derniers jours
  • Page GitHub officielle de l'article de synthèse A Survey on Evaluation of Large Language Models

    1 608-1Évolution des étoiles sur les 7 derniers jours
  • ADR@uber

    ADR sécurise les agents d'IA en entreprise via l'observabilité, l'analyse comparative de sécurité et la détection des menaces. Déployé chez Uber.

    1 527+21Évolution des étoiles sur les 7 derniers jours
  • py-motmetrics@cheind

    Benchmark de suivi d'objets multiples (MOT) en Python

    1 487+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets