Saltar al contenido principal
buildradar
Sign in
Tema · benchmark

benchmark

Repositorios de código abierto monitorizados etiquetados con benchmark, ordenados por estrellas.

158 repositorios
  • RoboTwin@RoboTwin-Platform

    [ICML 2026] Repositorio de código oficial de RoboTwin 2.0

    2800+12Variación de estrellas de los últimos 7 días
  • java-sec-code@JoyChou93

    Vulnerabilidades comunes web en Java y código de seguridad basado en Spring Boot y Spring Security

    2675+1Variación de estrellas de los últimos 7 días
  • CPU-X@TheTumultuousUnicornOfDarkness

    CPU-X es un software libre que recopila información sobre la CPU, la placa base y más.

    2647+0Variación de estrellas de los últimos 7 días
  • tsung@processone

    Tsung es un marco de benchmarking de alto rendimiento para varios protocolos, incluidos HTTP, XMPP, LDAP, etc.

    2629+0Variación de estrellas de los últimos 7 días
  • little-coder@itayinbarr

    Un arnés optimizado para LLMs más pequeños

    2528+16Variación de estrellas de los últimos 7 días
  • mitata@evanwashere

    Herramienta de pruebas de rendimiento que te quiere ❤️

    2525+4Variación de estrellas de los últimos 7 días
  • InternVideo@OpenGVLab

    [ECCV2024] Modelos base de video y datos para comprensión multimodal

    2374+5Variación de estrellas de los últimos 7 días
  • tinybench@tinylibs

    🔎 Una biblioteca de benchmarking simple, diminuta y ligera

    2362+0Variación de estrellas de los últimos 7 días
  • ecs@oneclickvirt

    Versión en Go del proyecto de pruebas de servidores VPS Fusion Monster. Su objetivo es ser el proyecto de pruebas de servidores más completo, implementado en Go y sin dependencias de entorno.

    2329+13Variación de estrellas de los últimos 7 días
  • beir@beir-cellar

    Un benchmark heterogéneo para recuperación de información. Fácil de usar, evalúa tus modelos en más de 15 conjuntos de datos de IR diversos.

    2283+5Variación de estrellas de los últimos 7 días
  • LIBERO@Lifelong-Robot-Learning

    Evaluación comparativa de transferencia de conocimiento en el aprendizaje robótico continuo

    2264+14Variación de estrellas de los últimos 7 días
  • cista@felixguendling

    Cista es una biblioteca de serialización y reflexión en C++ simple, de alto rendimiento y sin copia (zero-copy).

    2247+1Variación de estrellas de los últimos 7 días
  • 📰 Artículos y blogs de lectura imprescindible sobre modelado de contexto largo basado en LLM 🔥

    2164-1Variación de estrellas de los últimos 7 días
  • Benchmark de frameworks web en Go

    2135+1Variación de estrellas de los últimos 7 días
  • Una comparación objetiva de varios frameworks que nos permiten "transformar" nuestras aplicaciones web en aplicaciones de escritorio.

    1989+0Variación de estrellas de los últimos 7 días
  • logparser@logpai

    Un conjunto de herramientas de machine learning para el análisis de logs [ICSE'19, DSN'16]

    1987+0Variación de estrellas de los últimos 7 días
  • tapnet@google-deepmind

    Rastreo de cualquier punto (TAP)

    1973+2Variación de estrellas de los últimos 7 días
  • tau2-bench@sierra-research

    τ-Bench: Un benchmark para la interacción entre herramienta, agente y usuario en dominios del mundo real

    1938+30Variación de estrellas de los últimos 7 días
  • less_slow.cpp@ashvardanian

    Exploración de prácticas de codificación "menos lentas" en C++ 20, C, CUDA, PTX y ensamblador, desde numerics y SIMD hasta corrutinas, rangos, manejo de excepciones, redes y E/S en espacio de usuario.

    1923-1Variación de estrellas de los últimos 7 días
  • evalplus@evalplus

    Evaluación rigurosa de código sintetizado por LLM - NeurIPS 2023 y COLM 2024

    1806+1Variación de estrellas de los últimos 7 días
  • training@mlcommons

    Implementaciones de referencia de los benchmarks de entrenamiento de MLPerf®.

    1771-1Variación de estrellas de los últimos 7 días
  • VBench@Vchitect

    [CVPR2024 Highlight] VBench: Evaluamos la generación de video

    1757+7Variación de estrellas de los últimos 7 días
  • skillsbench@benchflow-ai

    SkillsBench evalúa qué tan bien funcionan las habilidades y qué tan efectivos son los agentes al utilizarlas.

    1742+11Variación de estrellas de los últimos 7 días
  • nanobench@martinus

    Funcionalidad de microbenchmarking simple, rápida y precisa de cabecera única para C++11/14/17/20

    1733+1Variación de estrellas de los últimos 7 días
  • hotpath-rs@pawurb

    Encuentra rápidamente cuellos de botella en Rust: un profiler para CPU, memoria, SQL, HTTP, E/S y código asíncrono.

    1707+7Variación de estrellas de los últimos 7 días
  • BEHAVIOR-1K@StanfordVL

    BEHAVIOR-1K: una plataforma para acelerar la investigación en IA incorporada.

    1677+8Variación de estrellas de los últimos 7 días
  • inference@mlcommons

    Implementaciones de referencia para los benchmarks de inferencia de MLPerf®.

    1624+2Variación de estrellas de los últimos 7 días
  • La página oficial de GitHub para el artículo de revisión "A Survey on Evaluation of Large Language Models".

    1608-1Variación de estrellas de los últimos 7 días
  • ADR@uber

    ADR asegura agentes de IA empresariales mediante observabilidad, evaluación comparativa de seguridad y detección de amenazas. Implementado en Uber.

    1527+21Variación de estrellas de los últimos 7 días
  • py-motmetrics@cheind

    :bar_chart: Evalúa múltiples rastreadores de objetos (MOT) en Python

    1487+0Variación de estrellas de los últimos 7 días
← Volver a temas