Saltar al contenido principal
buildradar
Sign in
Tema · benchmark

benchmark

Repositorios de código abierto monitorizados etiquetados con benchmark, ordenados por estrellas.

158 repositorios
  • llm-colosseum@OpenGenerativeAI

    ¡Evalúa LLMs haciéndolos pelear en Street Fighter 3! La nueva forma de evaluar la calidad de un LLM.

    1483-1Variación de estrellas de los últimos 7 días
  • pytest-benchmark@ionelmc

    Fixture de pytest para realizar pruebas de rendimiento de código

    1448+0Variación de estrellas de los últimos 7 días
  • divan@nvzqz

    Benchmarking rápido y sencillo para proyectos en Rust

    1444+2Variación de estrellas de los últimos 7 días
  • MedMNIST@MedMNIST

    [pip install medmnist] 18 conjuntos de datos estandarizados para la clasificación de imágenes biomédicas 2D y 3D

    1399+0Variación de estrellas de los últimos 7 días
  • Compilador rápido para árboles de expresión de C# y la alternativa ligera LightExpression. Herramientas de diagnóstico y generación de código para expresiones.

    1375+1Variación de estrellas de los últimos 7 días
  • smac@oxwhirl

    SMAC: El desafío multiagente de StarCraft.

    1367+1Variación de estrellas de los últimos 7 días
  • SLM-Lab@kengz

    Framework modular de aprendizaje por refuerzo profundo en PyTorch. Biblioteca complementaria del libro "Foundations of Deep Reinforcement Learning"

    1362+0Variación de estrellas de los últimos 7 días
  • Últimos avances en razonamiento System-2

    1353+0Variación de estrellas de los últimos 7 días
  • kg-gen@stair-lab

    [NeurIPS '25] Generación de grafos de conocimiento a partir de cualquier texto

    1266+6Variación de estrellas de los últimos 7 días
  • github-action-benchmark@benchmark-action

    GitHub Action para benchmarking continuo con el fin de mantener el rendimiento

    1251+1Variación de estrellas de los últimos 7 días
  • boomer@myzhan

    Un mejor generador de carga para locust, escrito en golang.

    1237+0Variación de estrellas de los últimos 7 días
  • LongBench@THUDM

    LongBench v2 y LongBench (ACL 25' y 24')

    1232+2Variación de estrellas de los últimos 7 días
  • KernelBench@ScalingIntelligence

    KernelBench: ¿Pueden los LLMs escribir kernels de GPU? - Benchmark + Kit de herramientas con Torch -> CUDA (+ más DSLs)

    1227+13Variación de estrellas de los últimos 7 días
  • PDEBench@pdebench

    PDEBench: Un benchmark extenso para el aprendizaje automático científico.

    1192+1Variación de estrellas de los últimos 7 días
  • bench-scripts@haydenjames

    Una compilación de scripts de evaluación comparativa (benchmarking) para servidores Linux.

    1190+0Variación de estrellas de los últimos 7 días
  • flow@flow-project

    Framework computacional para el aprendizaje por refuerzo en el control de tráfico

    1188+0Variación de estrellas de los últimos 7 días
  • VectorDBBench@zilliztech

    Banco de pruebas para bases de datos vectoriales.

    1173+7Variación de estrellas de los últimos 7 días
  • omnisafe@PKU-Alignment

    JMLR: OmniSafe es un marco de infraestructura para acelerar la investigación en SafeRL.

    1150+1Variación de estrellas de los últimos 7 días
  • OpenSTL@chengtan9907

    OpenSTL: Un benchmark integral de aprendizaje predictivo espacio-temporal

    1143+6Variación de estrellas de los últimos 7 días
  • primesieve@kimwalisch

    Generador rápido de números primos.

    1114+2Variación de estrellas de los últimos 7 días
  • ClickBench@ClickHouse

    ClickBench: una prueba de rendimiento para bases de datos analíticas

    1094+3Variación de estrellas de los últimos 7 días
  • lzbench@inikep

    lzbench es un benchmark en memoria de compresores de código abierto

    1083+3Variación de estrellas de los últimos 7 días
  • Herramienta de generación de tráfico y evaluación comparativa para NoSQL Redis y Memcache.

    1053+4Variación de estrellas de los últimos 7 días
  • opencv_zoo@opencv

    Model Zoo para OpenCV DNN y benchmarks.

    1046+7Variación de estrellas de los últimos 7 días
  • benchmark@pytorch

    TorchBench es una colección de benchmarks de código abierto utilizados para evaluar el rendimiento de PyTorch.

    1042-2Variación de estrellas de los últimos 7 días
  • pyperformance@python

    Suite de pruebas de rendimiento para Python.

    1029+1Variación de estrellas de los últimos 7 días
  • ADBench@Minqi824

    Implementación oficial de "ADBench: Anomaly Detection Benchmark", NeurIPS 2022.

    1023+2Variación de estrellas de los últimos 7 días
  • Informe de realización de capacidades de DeepSeek V4 × J-Space: evidencia de benchmark de que J-Space reduce la pérdida de realización de capacidades en DeepSeek V4 (Flash/Pro).

    1021-4Variación de estrellas de los últimos 7 días
  • asv@airspeed-velocity

    Airspeed Velocity: Una sencilla herramienta de benchmarking en Python con informes basados en web

    1018+3Variación de estrellas de los últimos 7 días
  • moses@molecularsets

    Molecular Sets (MOSES): Una plataforma de evaluación comparativa para modelos de generación molecular

    988+1Variación de estrellas de los últimos 7 días
← Volver a temas