benchmark
Repositorios de código abierto monitorizados etiquetados con benchmark, ordenados por estrellas.
- #31★ 2800+12Variación de estrellas de los últimos 7 días
- #32
Vulnerabilidades comunes web en Java y código de seguridad basado en Spring Boot y Spring Security
★ 2675+1Variación de estrellas de los últimos 7 días - #33
CPU-X es un software libre que recopila información sobre la CPU, la placa base y más.
★ 2647+0Variación de estrellas de los últimos 7 días - #34
Tsung es un marco de benchmarking de alto rendimiento para varios protocolos, incluidos HTTP, XMPP, LDAP, etc.
★ 2629+0Variación de estrellas de los últimos 7 días - #35
Un arnés optimizado para LLMs más pequeños
★ 2528+16Variación de estrellas de los últimos 7 días - #36★ 2525+4Variación de estrellas de los últimos 7 días
- #37
[ECCV2024] Modelos base de video y datos para comprensión multimodal
★ 2374+5Variación de estrellas de los últimos 7 días - #38★ 2362+0Variación de estrellas de los últimos 7 días
- #39
Versión en Go del proyecto de pruebas de servidores VPS Fusion Monster. Su objetivo es ser el proyecto de pruebas de servidores más completo, implementado en Go y sin dependencias de entorno.
★ 2329+13Variación de estrellas de los últimos 7 días - #40
Un benchmark heterogéneo para recuperación de información. Fácil de usar, evalúa tus modelos en más de 15 conjuntos de datos de IR diversos.
★ 2283+5Variación de estrellas de los últimos 7 días - #41
Evaluación comparativa de transferencia de conocimiento en el aprendizaje robótico continuo
★ 2264+14Variación de estrellas de los últimos 7 días - #42
Cista es una biblioteca de serialización y reflexión en C++ simple, de alto rendimiento y sin copia (zero-copy).
★ 2247+1Variación de estrellas de los últimos 7 días - #43
📰 Artículos y blogs de lectura imprescindible sobre modelado de contexto largo basado en LLM 🔥
★ 2164-1Variación de estrellas de los últimos 7 días - #44
Benchmark de frameworks web en Go
★ 2135+1Variación de estrellas de los últimos 7 días - #45
Una comparación objetiva de varios frameworks que nos permiten "transformar" nuestras aplicaciones web en aplicaciones de escritorio.
★ 1989+0Variación de estrellas de los últimos 7 días - #46
Un conjunto de herramientas de machine learning para el análisis de logs [ICSE'19, DSN'16]
★ 1987+0Variación de estrellas de los últimos 7 días - #47★ 1973+2Variación de estrellas de los últimos 7 días
- #48
τ-Bench: Un benchmark para la interacción entre herramienta, agente y usuario en dominios del mundo real
★ 1938+30Variación de estrellas de los últimos 7 días - #49
Exploración de prácticas de codificación "menos lentas" en C++ 20, C, CUDA, PTX y ensamblador, desde numerics y SIMD hasta corrutinas, rangos, manejo de excepciones, redes y E/S en espacio de usuario.
★ 1923-1Variación de estrellas de los últimos 7 días - #50★ 1806+1Variación de estrellas de los últimos 7 días
- #51★ 1771-1Variación de estrellas de los últimos 7 días
- #52★ 1757+7Variación de estrellas de los últimos 7 días
- #53
SkillsBench evalúa qué tan bien funcionan las habilidades y qué tan efectivos son los agentes al utilizarlas.
★ 1742+11Variación de estrellas de los últimos 7 días - #54
Funcionalidad de microbenchmarking simple, rápida y precisa de cabecera única para C++11/14/17/20
★ 1733+1Variación de estrellas de los últimos 7 días - #55
Encuentra rápidamente cuellos de botella en Rust: un profiler para CPU, memoria, SQL, HTTP, E/S y código asíncrono.
★ 1707+7Variación de estrellas de los últimos 7 días - #56
BEHAVIOR-1K: una plataforma para acelerar la investigación en IA incorporada.
★ 1677+8Variación de estrellas de los últimos 7 días - #57★ 1624+2Variación de estrellas de los últimos 7 días
- #58
La página oficial de GitHub para el artículo de revisión "A Survey on Evaluation of Large Language Models".
★ 1608-1Variación de estrellas de los últimos 7 días - #59
ADR asegura agentes de IA empresariales mediante observabilidad, evaluación comparativa de seguridad y detección de amenazas. Implementado en Uber.
★ 1527+21Variación de estrellas de los últimos 7 días - #60
:bar_chart: Evalúa múltiples rastreadores de objetos (MOT) en Python
★ 1487+0Variación de estrellas de los últimos 7 días