benchmark
Repositórios de código aberto acompanhados marcados com benchmark, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de benchmark no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com benchmark.
- #1
Relatório de realização de capacidade do DeepSeek V4 × J-Space — evidência de benchmark de que o J-Space reduz a perda de realização de capacidade no DeepSeek V4 (Flash/Pro).
★ 1.034 - #2
HarnessEval-W: Agentifying the Evaluation of Visual Worlds
★ 256 - #3
Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.
★ 160
- #1★ 28.759+60Variação de estrelas nos últimos 7 dias
- #2
Biblioteca .NET poderosa para benchmarking
★ 11.485+6Variação de estrelas nos últimos 7 dias - #3★ 10.517+17Variação de estrelas nos últimos 7 dias
- #4★ 10.375+13Variação de estrelas nos últimos 7 dias
- #5★ 7.860+20Variação de estrelas nos últimos 7 dias
- #6
OpenCompass é uma plataforma de avaliação de LLM, suportando uma ampla gama de modelos (Llama3, Mistral, InternLM2, GPT-4, LLaMa2, Qwen, GLM, Claude, etc.) em mais de 100 conjuntos de dados.
★ 7.374+48Variação de estrelas nos últimos 7 dias - #7
Projeto de teste de servidor VPS. Recomenda-se o uso da versão em Go sem dependências de ambiente: https://github.com/oneclickvirt/ecs
★ 7.155+16Variação de estrelas nos últimos 7 dias - #8
Qual é o framework web mais rápido?
★ 7.085-1Variação de estrelas nos últimos 7 dias - #9★ 6.782+3Variação de estrelas nos últimos 7 dias
- #10
YABS - um script bash simples para estimar o desempenho de servidores Linux usando fio, iperf3 e Geekbench.
★ 6.654+20Variação de estrelas nos últimos 7 dias - #11★ 5.734+54Variação de estrelas nos últimos 7 dias
- #12
Benchmarks de bibliotecas de vizinhos mais próximos aproximados em Python
★ 5.720+5Variação de estrelas nos últimos 7 dias - #13★ 5.601+5Variação de estrelas nos últimos 7 dias
- #14
Biblioteca de benchmarking baseada em estatísticas para Rust
★ 5.523+5Variação de estrelas nos últimos 7 dias - #15★ 5.370+2Variação de estrelas nos últimos 7 dias
- #16
O software de CFD lattice Boltzmann mais rápido e eficiente em memória, executado em todas as GPUs e CPUs via OpenCL. Gratuito para uso não comercial.
★ 5.254+13Variação de estrelas nos últimos 7 dias - #17
Caixa de ferramentas e benchmark de compreensão de vídeo de próxima geração da OpenMMLab
★ 5.147+5Variação de estrelas nos últimos 7 dias - #18
Kodezi Chronos é um modelo de linguagem focado em depuração que alcança resultados de ponta no SWE-bench Lite (80,33%) e 67% de precisão em correções no mundo real, mais de seis vezes melhor que o GPT-4. Construído com Adaptive Graph-Guided Retrieval e Persistent Debug Memory. Modelo disponível no primeiro trimestre de 2026 via Kodezi OS.
★ 4.928+12Variação de estrelas nos últimos 7 dias - #19
Toolkit de avaliação multimodal tudo-em-um para tarefas de texto, imagem, vídeo e áudio.
★ 4.383+11Variação de estrelas nos últimos 7 dias - #20★ 4.310+7Variação de estrelas nos últimos 7 dias
- #21
Benchmark de Avaliação de Compreensão da Língua Chinesa (CLUE): datasets, baselines, modelos pré-treinados, corpus e placar de líderes
★ 4.279+0Variação de estrelas nos últimos 7 dias - #22★ 4.211-1Variação de estrelas nos últimos 7 dias
- #23
Uma série de modelos de linguagem de grande escala desenvolvidos pela Baichuan Intelligent Technology
★ 4.083-1Variação de estrelas nos últimos 7 dias - #24
Ferramentas de benchmark HTTP(S), teste/depuração e restAPI (RESTful)
★ 3.767+3Variação de estrelas nos últimos 7 dias - #25
O XcodeBenchmark mede o tempo de compilação de uma grande base de código em iMac, MacBook e Mac Pro
★ 3.663+4Variação de estrelas nos últimos 7 dias - #26
⚡FlashRAG: Um kit de ferramentas Python para pesquisa eficiente em RAG (Recurso WWW2025).
★ 3.562+13Variação de estrelas nos últimos 7 dias - #27
MTEB: Avaliação de ponta para embeddings em diversos idiomas e modalidades.
★ 3.409+9Variação de estrelas nos últimos 7 dias - #28
Phoronix Test Suite, um software de código aberto multiplataforma para testes e benchmarking automatizados.
★ 3.118+5Variação de estrelas nos últimos 7 dias - #29
[NeurIPS 2024] OSWorld: Benchmarking de agentes multimodais para tarefas abertas em ambientes computacionais reais.
★ 3.112+11Variação de estrelas nos últimos 7 dias - #30
Projetos de números primos em mais de 100 linguagens de programação, para comparar sua velocidade e a engenhosidade de seus programadores.
★ 3.016-1Variação de estrelas nos últimos 7 dias