benchmark
Repositórios de código aberto acompanhados marcados com benchmark, ordenados por estrelas.
- #91
Caixa de ferramentas de estimativa de profundidade monocular baseada no MMSegmentation.
★ 971+0Variação de estrelas nos últimos 7 dias - #92
BlazeHTTP é uma ferramenta simples e fácil de usar para testar a eficácia de proteção de WAF
★ 952+1Variação de estrelas nos últimos 7 dias - #93
Vários benchmarks de gRPC
★ 939+0Variação de estrelas nos últimos 7 dias - #94★ 933+0Variação de estrelas nos últimos 7 dias
- #95★ 925+1Variação de estrelas nos últimos 7 dias
- #96
Meça o desempenho do Amazon S3 a partir de qualquer local.
★ 910-1Variação de estrelas nos últimos 7 dias - #97
Uma biblioteca PyTorch para tudo relacionado a Aprendizado por Reforço (RL) em Otimização Combinatória (CO)
★ 900+1Variação de estrelas nos últimos 7 dias - #98★ 894+4Variação de estrelas nos últimos 7 dias
- #99
Aplicativo de teste de velocidade e benchmark de desempenho de armazenamento (HDD, SSD, RAM) para Windows, macOS e Android
★ 870+1Variação de estrelas nos últimos 7 dias - #100★ 863+0Variação de estrelas nos últimos 7 dias
- #101
Inteligência Natural ainda é uma excelente ideia.
★ 833+0Variação de estrelas nos últimos 7 dias - #102
[Destaque NeurIPS 2025] OpenCUA: Fundações abertas para agentes de uso de computador
★ 833+6Variação de estrelas nos últimos 7 dias - #103
📊 Comparação de benchmark de pacotes com validação em tempo de execução e suporte a TypeScript
★ 831+3Variação de estrelas nos últimos 7 dias - #104
DeepResearch Bench: Um benchmark abrangente para agentes de pesquisa profunda
★ 824+5Variação de estrelas nos últimos 7 dias - #105
ClawProBench é um harness de benchmark voltado para o tempo de execução (live-first) para avaliar agentes de LLM no runtime OpenClaw, com avaliação determinística e confiabilidade de testes repetidos.
★ 823+1Variação de estrelas nos últimos 7 dias - #106★ 816+4Variação de estrelas nos últimos 7 dias
- #107★ 804+17Variação de estrelas nos últimos 7 dias
- #108
Mais uma implementação do computer language benchmarks game
★ 800+1Variação de estrelas nos últimos 7 dias - #109★ 796+0Variação de estrelas nos últimos 7 dias
- #110
MobileGym: Uma plataforma de simulação verificável e altamente paralela para pesquisa de agentes de GUI móveis · Simulador Android executado no navegador · Simulador Android hospedado no navegador · Avaliação Verificável · Treinamento RL online escalável
★ 785+6Variação de estrelas nos últimos 7 dias - #111
RobustBench: um benchmark padronizado de robustez adversarial [NeurIPS 2021 Benchmarks and Datasets Track]
★ 782+0Variação de estrelas nos últimos 7 dias - #112★ 781+2Variação de estrelas nos últimos 7 dias
- #113★ 780+0Variação de estrelas nos últimos 7 dias
- #114
Um benchmark de agentes com tarefas em uma empresa de software simulada.
★ 775+5Variação de estrelas nos últimos 7 dias - #115
Ferramenta de teste de estresse HTTP em golang, suporta testes individuais e distribuídos, http/1, http/2 e http/3.
★ 771+0Variação de estrelas nos últimos 7 dias - #116
[EMNLP 2024 & AAAI 2026] Um poderoso kit de ferramentas para compressão de grandes modelos, incluindo LLMs, VLMs e modelos gerativos de vídeo.
★ 747+1Variação de estrelas nos últimos 7 dias - #117
Outro benchmark para alguns frameworks Python
★ 721-1Variação de estrelas nos últimos 7 dias - #118
Benchmarks brutos de vazão, latência e transferência de Hello World em frameworks de microsserviços populares
★ 715+0Variação de estrelas nos últimos 7 dias - #119
Um framework de benchmark de blockchain para medir o desempenho de várias soluções de blockchain https://wiki.hyperledger.org/display/caliper
★ 705+0Variação de estrelas nos últimos 7 dias - #120
Frontier Models jogando o jogo de tabuleiro Diplomacy.
★ 699+2Variação de estrelas nos últimos 7 dias