Saltar al contenido principal
buildradar
Sign in
Tema · benchmark

benchmark

Repositorios de código abierto monitorizados etiquetados con benchmark, ordenados por estrellas.

Repositorios
158
Estrellas totales
338.554
Estrellas de media
2143
Proporción
0,02%

Temas que aparecen con frecuencia junto a benchmark en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con benchmark.

  • Informe de realización de capacidades de DeepSeek V4 × J-Space: evidencia de benchmark de que J-Space reduce la pérdida de realización de capacidades en DeepSeek V4 (Flash/Pro).

    1035
  • HarnessEval-W@MirroS-Lab

    HarnessEval-W: Agentifying the Evaluation of Visual Worlds

    256
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • hyperfine@sharkdp

    Una herramienta de benchmarking de línea de comandos

    28.759+60Variación de estrellas de los últimos 7 días
  • Potente biblioteca .NET para pruebas de rendimiento

    11.485+6Variación de estrellas de los últimos 7 días
  • oha@hatoo

    Ohayou (おはよう), generador de carga HTTP, inspirado en rakyll/hey con animación TUI.

    10.517+17Variación de estrellas de los últimos 7 días
  • benchmark@google

    Una biblioteca de soporte para microbenchmarks

    10.375+13Variación de estrellas de los últimos 7 días
  • mmpose@open-mmlab

    Caja de herramientas y evaluación comparativa de estimación de pose de OpenMMLab.

    7860+20Variación de estrellas de los últimos 7 días
  • opencompass@open-compass

    OpenCompass es una plataforma de evaluación de LLM, que admite una amplia gama de modelos (Llama3, Mistral, InternLM2, GPT-4, LLaMa2, Qwen, GLM, Claude, etc.) en más de 100 conjuntos de datos.

    7374+48Variación de estrellas de los últimos 7 días
  • ecs@spiritLHLS

    Proyecto de evaluación de servidores VPS Fusion Monster. Se recomienda utilizar la versión en Go sin dependencias de entorno: https://github.com/oneclickvirt/ecs

    7155+16Variación de estrellas de los últimos 7 días
  • web-frameworks@the-benchmarker

    ¿Cuál es el framework web más rápido?

    7085-1Variación de estrellas de los últimos 7 días
  • sysbench@akopytov

    Prueba de rendimiento de bases de datos y sistemas mediante scripts

    6782+3Variación de estrellas de los últimos 7 días
  • YABS - Un script de bash simple para estimar el rendimiento de un servidor Linux usando fio, iperf3 y Geekbench

    6654+20Variación de estrellas de los últimos 7 días
  • SWE-bench@SWE-bench

    SWE-bench: ¿Pueden los modelos de lenguaje resolver problemas reales de GitHub?

    5734+54Variación de estrellas de los últimos 7 días
  • ann-benchmarks@erikbern

    Benchmarks de librerías de vecinos más cercanos aproximados en Python.

    5720+5Variación de estrellas de los últimos 7 días
  • dperf@baidu

    dperf: Herramienta de prueba de carga de red de alto rendimiento basada en DPDK

    5601+5Variación de estrellas de los últimos 7 días
  • criterion.rs@bheisler

    Biblioteca de benchmarking basada en estadísticas para Rust

    5523+5Variación de estrellas de los últimos 7 días
  • across@teddysun

    A través de la Gran Muralla podemos llegar a todos los rincones del mundo

    5370+2Variación de estrellas de los últimos 7 días
  • FluidX3D@ProjectPhysX

    El software CFD de celosía de Boltzmann más rápido y eficiente en memoria, que se ejecuta en todas las GPU y CPU mediante OpenCL. Gratuito para uso no comercial.

    5254+13Variación de estrellas de los últimos 7 días
  • mmaction2@open-mmlab

    Caja de herramientas y banco de pruebas de próxima generación para la comprensión de video de OpenMMLab

    5147+5Variación de estrellas de los últimos 7 días
  • Chronos@Kodezi

    Kodezi Chronos es un modelo de lenguaje centrado en la depuración que logra resultados de vanguardia en SWE-bench Lite (80.33%) y un 67% de precisión en correcciones del mundo real, más de seis veces mejor que GPT-4. Construido con Recuperación Guiada por Grafos Adaptativos y Memoria de Depuración Persistente. Modelo disponible en el primer trimestre de 2026 a través de Kodezi OS.

    4928+12Variación de estrellas de los últimos 7 días
  • lmms-eval@EvolvingLMMs-Lab

    Kit de herramientas de evaluación multimodal todo en uno para tareas de texto, imagen, video y audio

    4383+11Variación de estrellas de los últimos 7 días
  • evo@MichaelGrupp

    Paquete de Python para la evaluación de odometría y SLAM

    4310+7Variación de estrellas de los últimos 7 días
  • CLUE@CLUEbenchmark

    Evaluación comparativa de comprensión del idioma chino (Chinese Language Understanding Evaluation Benchmark): conjuntos de datos, líneas de base, modelos preentrenados, corpus y tabla de clasificación

    4279+0Variación de estrellas de los últimos 7 días
  • coost@idealvin

    Una pequeña biblioteca boost en C++11.

    4211-1Variación de estrellas de los últimos 7 días
  • Baichuan2@baichuan-inc

    Una serie de modelos de lenguaje grandes desarrollados por Baichuan Intelligent Technology

    4083-1Variación de estrellas de los últimos 7 días
  • Herramientas de evaluación comparativa HTTP(S), pruebas/depuración y API REST (RESTful)

    3767+3Variación de estrellas de los últimos 7 días
  • XcodeBenchmark@devMEremenko

    XcodeBenchmark mide el tiempo de compilación de una base de código grande en iMac, MacBook y Mac Pro

    3663+4Variación de estrellas de los últimos 7 días
  • FlashRAG@RUC-NLPIR

    ⚡FlashRAG: Un kit de herramientas en Python para la investigación eficiente de RAG (Recurso WWW2025)

    3562+13Variación de estrellas de los últimos 7 días
  • mteb@embeddings-benchmark

    MTEB: Evaluación de vanguardia de incrustaciones en varios idiomas y modalidades.

    3409+9Variación de estrellas de los últimos 7 días
  • phoronix-test-suite@phoronix-test-suite

    Software de pruebas y benchmarking automatizado, multiplataforma y de código abierto Phoronix Test Suite.

    3118+5Variación de estrellas de los últimos 7 días
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: Evaluación comparativa de agentes multimodales para tareas abiertas en entornos informáticos reales

    3112+11Variación de estrellas de los últimos 7 días
  • Primes@PlummersSoftwareLLC

    Proyectos de números primos en más de 100 lenguajes de programación, para comparar su velocidad y el ingenio de sus programadores

    3016-1Variación de estrellas de los últimos 7 días
← Volver a temas