benchmark
Repositórios de código aberto acompanhados marcados com benchmark, ordenados por estrelas.
- #31★ 2.800+12Variação de estrelas nos últimos 7 dias
- #32
Vulnerabilidades comuns em aplicações web Java e código de segurança baseado em Spring Boot e Spring Security
★ 2.675+1Variação de estrelas nos últimos 7 dias - #33
CPU-X é um software livre que coleta informações sobre CPU, placa-mãe e muito mais
★ 2.647+0Variação de estrelas nos últimos 7 dias - #34
Tsung é um framework de benchmark de alto desempenho para vários protocolos, incluindo HTTP, XMPP, LDAP, etc.
★ 2.629+0Variação de estrelas nos últimos 7 dias - #35
Um harness otimizado para LLMs menores.
★ 2.528+16Variação de estrelas nos últimos 7 dias - #36★ 2.525+4Variação de estrelas nos últimos 7 dias
- #37
[ECCV2024] Modelos de fundação de vídeo e dados para compreensão multimodal
★ 2.374+5Variação de estrelas nos últimos 7 dias - #38★ 2.362+0Variação de estrelas nos últimos 7 dias
- #39
Projeto de teste de servidor VPS Fusion Monster versão GO. Visa ser o projeto de teste de servidor mais abrangente, implementado em Go sem dependências de ambiente.
★ 2.329+13Variação de estrelas nos últimos 7 dias - #40
Um Benchmark Heterogêneo para Recuperação de Informação. Fácil de usar, avalie seus modelos em mais de 15 datasets de RI diversos.
★ 2.283+5Variação de estrelas nos últimos 7 dias - #41
Benchmark de transferência de conhecimento em aprendizado contínuo de robôs
★ 2.264+14Variação de estrelas nos últimos 7 dias - #42
Cista é uma biblioteca de serialização e reflexão em C++ simples, de alto desempenho e zero-copy.
★ 2.247+1Variação de estrelas nos últimos 7 dias - #43
📰 Artigos e blogs essenciais sobre modelagem de contexto longo baseada em LLM 🔥
★ 2.164-1Variação de estrelas nos últimos 7 dias - #44
:zap: Benchmark de frameworks web em Go
★ 2.135+1Variação de estrelas nos últimos 7 dias - #45
Uma comparação objetiva de vários frameworks que nos permitem "transformar" nossos aplicativos web em aplicativos de desktop.
★ 1.989+0Variação de estrelas nos últimos 7 dias - #46
Um kit de ferramentas de aprendizado de máquina para análise de logs [ICSE'19, DSN'16]
★ 1.987+0Variação de estrelas nos últimos 7 dias - #47★ 1.973+2Variação de estrelas nos últimos 7 dias
- #48
τ-Bench: Um benchmark para interação entre ferramenta, agente e usuário em domínios do mundo real.
★ 1.938+30Variação de estrelas nos últimos 7 dias - #49
Explorando práticas de codificação "Less Slow" em C++ 20, C, CUDA, PTX e Assembly, desde numéricos e SIMD até corrotinas, ranges, tratamento de exceções, rede e E/S em espaço de usuário.
★ 1.923-1Variação de estrelas nos últimos 7 dias - #50★ 1.806+1Variação de estrelas nos últimos 7 dias
- #51★ 1.771-1Variação de estrelas nos últimos 7 dias
- #52★ 1.757+7Variação de estrelas nos últimos 7 dias
- #53
SkillsBench avalia o funcionamento das habilidades e a eficácia dos agentes ao utilizá-las.
★ 1.742+11Variação de estrelas nos últimos 7 dias - #54
Funcionalidade de microbenchmarking simples, rápida e precisa em cabeçalho único para C++11/14/17/20.
★ 1.733+1Variação de estrelas nos últimos 7 dias - #55
Encontre gargalos rapidamente em Rust - um profiler para CPU, memória, SQL, HTTP, I/O e código assíncrono.
★ 1.707+7Variação de estrelas nos últimos 7 dias - #56
BEHAVIOR-1K: uma plataforma para acelerar a pesquisa em Embodied AI. Junte-se ao nosso Discord para suporte: https://discord.gg/bccR5vGFEx
★ 1.677+8Variação de estrelas nos últimos 7 dias - #57★ 1.624+2Variação de estrelas nos últimos 7 dias
- #58
A página oficial do GitHub para o artigo de revisão "A Survey on Evaluation of Large Language Models".
★ 1.608-1Variação de estrelas nos últimos 7 dias - #59
O ADR protege agentes de IA corporativos por meio de observabilidade, benchmarking de segurança e detecção de ameaças. Implantado no Uber.
★ 1.527+21Variação de estrelas nos últimos 7 dias - #60
Benchmark de múltiplos rastreadores de objetos (MOT) em Python.
★ 1.487+0Variação de estrelas nos últimos 7 dias