Pular para o conteúdo principal
buildradar
Sign in
Tópico · benchmark

benchmark

Repositórios de código aberto acompanhados marcados com benchmark, ordenados por estrelas.

158 repositórios
  • llm-colosseum@OpenGenerativeAI

    Avalie LLMs lutando em Street Fighter 3! A nova maneira de avaliar a qualidade de um LLM.

    1.483+0Variação de estrelas nos últimos 7 dias
  • pytest-benchmark@ionelmc

    Fixture do pytest para benchmarking de código

    1.448+0Variação de estrelas nos últimos 7 dias
  • divan@nvzqz

    Benchmarking rápido e simples para projetos Rust

    1.444+1Variação de estrelas nos últimos 7 dias
  • MedMNIST@MedMNIST

    [pip install medmnist] 18 conjuntos de dados padronizados para classificação de imagens biomédicas 2D e 3D.

    1.399+0Variação de estrelas nos últimos 7 dias
  • Compilador rápido para Expression Trees em C# e a alternativa leve LightExpression. Ferramentas de diagnóstico e geração de código para expressões.

    1.375+1Variação de estrelas nos últimos 7 dias
  • smac@oxwhirl

    SMAC: O Desafio Multi-Agente de StarCraft.

    1.367+1Variação de estrelas nos últimos 7 dias
  • SLM-Lab@kengz

    Framework modular de Deep Reinforcement Learning em PyTorch. Biblioteca complementar do livro "Foundations of Deep Reinforcement Learning".

    1.362+0Variação de estrelas nos últimos 7 dias
  • Últimos avanços no raciocínio System-2

    1.353+0Variação de estrelas nos últimos 7 dias
  • kg-gen@stair-lab

    [NeurIPS '25] Geração de grafos de conhecimento a partir de qualquer texto

    1.266+6Variação de estrelas nos últimos 7 dias
  • github-action-benchmark@benchmark-action

    GitHub Action para benchmarking contínuo visando manter o desempenho

    1.251+0Variação de estrelas nos últimos 7 dias
  • boomer@myzhan

    Um gerador de carga melhor para o locust, escrito em golang.

    1.237+0Variação de estrelas nos últimos 7 dias
  • LongBench@THUDM

    LongBench v2 e LongBench (ACL 25' e 24').

    1.232+1Variação de estrelas nos últimos 7 dias
  • KernelBench@ScalingIntelligence

    KernelBench: LLMs conseguem escrever kernels de GPU? - Benchmark + Toolkit com Torch -> CUDA (+ mais DSLs)

    1.227+7Variação de estrelas nos últimos 7 dias
  • PDEBench@pdebench

    PDEBench: Um benchmark abrangente para aprendizado de máquina científico.

    1.192+0Variação de estrelas nos últimos 7 dias
  • bench-scripts@haydenjames

    Uma compilação de scripts de benchmarking para servidores Linux.

    1.190+0Variação de estrelas nos últimos 7 dias
  • flow@flow-project

    Estrutura computacional para aprendizagem por reforço no controle de tráfego

    1.188+0Variação de estrelas nos últimos 7 dias
  • VectorDBBench@zilliztech

    Benchmark para bancos de dados vetoriais.

    1.173+2Variação de estrelas nos últimos 7 dias
  • omnisafe@PKU-Alignment

    JMLR: OmniSafe é um framework de infraestrutura para acelerar a pesquisa em SafeRL.

    1.150+1Variação de estrelas nos últimos 7 dias
  • OpenSTL@chengtan9907

    OpenSTL: Um benchmark abrangente de aprendizado preditivo espaço-temporal

    1.143+5Variação de estrelas nos últimos 7 dias
  • primesieve@kimwalisch

    Gerador de números primos rápido

    1.114+1Variação de estrelas nos últimos 7 dias
  • ClickBench@ClickHouse

    ClickBench: um benchmark para bancos de dados analíticos.

    1.100+8Variação de estrelas nos últimos 7 dias
  • lzbench@inikep

    lzbench é um benchmark em memória de compressores de código aberto.

    1.084+5Variação de estrelas nos últimos 7 dias
  • Ferramenta de geração de tráfego e benchmarking para NoSQL Redis e Memcache.

    1.053+5Variação de estrelas nos últimos 7 dias
  • opencv_zoo@opencv

    Model Zoo para OpenCV DNN e benchmarks.

    1.046+8Variação de estrelas nos últimos 7 dias
  • benchmark@pytorch

    TorchBench é uma coleção de benchmarks de código aberto usados para avaliar o desempenho do PyTorch.

    1.042-1Variação de estrelas nos últimos 7 dias
  • pyperformance@python

    Suíte de testes de desempenho para Python

    1.029+1Variação de estrelas nos últimos 7 dias
  • Relatório de realização de capacidade do DeepSeek V4 × J-Space — evidência de benchmark de que o J-Space reduz a perda de realização de capacidade no DeepSeek V4 (Flash/Pro).

    1.026-8Variação de estrelas nos últimos 7 dias
  • ADBench@Minqi824

    Implementação oficial de "ADBench: Anomaly Detection Benchmark", NeurIPS 2022.

    1.023+2Variação de estrelas nos últimos 7 dias
  • asv@airspeed-velocity

    Airspeed Velocity: Uma ferramenta simples de benchmarking em Python com relatórios baseados na web

    1.018+4Variação de estrelas nos últimos 7 dias
  • moses@molecularsets

    Molecular Sets (MOSES): Uma plataforma de benchmark para modelos de geração molecular

    988+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos