본문으로 건너뛰기
buildradar
Sign in
토픽 · benchmark

benchmark

benchmark 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
158
총 스타
338,554
평균 스타
2,143
비중
0.02%

같은 리포지토리에 benchmark 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 benchmark 태그가 달린 리포지토리예요.

  • DeepSeek V4 × J-Space 역량 실현 보고서 — J-Space가 DeepSeek V4(Flash/Pro)에서 역량 실현 손실을 줄여준다는 벤치마크 증거

    1,034
  • HarnessEval-W@MirroS-Lab

    HarnessEval-W: Agentifying the Evaluation of Visual Worlds

    256
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • hyperfine@sharkdp

    명령줄 벤치마킹 도구

    28,759+60최근 7일 스타 변화
  • 벤치마킹을 위한 강력한 .NET 라이브러리

    11,485+6최근 7일 스타 변화
  • oha@hatoo

    rakyll/hey에서 영감을 받고 TUI 애니메이션이 포함된 HTTP 부하 생성기, Ohayou(おはよう)입니다.

    10,517+17최근 7일 스타 변화
  • benchmark@google

    마이크로 벤치마크 지원 라이브러리

    10,375+13최근 7일 스타 변화
  • mmpose@open-mmlab

    OpenMMLab 포즈 추정 툴박스 및 벤치마크

    7,860+20최근 7일 스타 변화
  • opencompass@open-compass

    OpenCompass는 100개 이상의 데이터셋을 바탕으로 Llama3, Mistral, InternLM2, GPT-4, LLaMa2, Qwen, GLM, Claude 등 다양한 모델을 지원하는 LLM 평가 플랫폼입니다.

    7,374+48최근 7일 스타 변화
  • ecs@spiritLHLS

    VPS 융합 괴물 서버 평가 프로젝트. 환경 의존성이 없는 Go 버전을 사용하는 것을 더욱 권장합니다: https://github.com/oneclickvirt/ecs

    7,155+16최근 7일 스타 변화
  • web-frameworks@the-benchmarker

    가장 빠른 웹 프레임워크는 무엇인가요?

    7,085-1최근 7일 스타 변화
  • sysbench@akopytov

    스크립트 가능한 데이터베이스 및 시스템 성능 벤치마크

    6,782+3최근 7일 스타 변화
  • YABS - fio, iperf3, Geekbench를 사용하여 Linux 서버 성능을 측정하는 간단한 bash 스크립트

    6,654+20최근 7일 스타 변화
  • SWE-bench@SWE-bench

    SWE-bench: LLM이 실제 Github 이슈를 해결할 수 있는가?

    5,734+54최근 7일 스타 변화
  • ann-benchmarks@erikbern

    Python용 근사 근접 이웃(approximate nearest neighbor) 라이브러리 벤치마크

    5,720+5최근 7일 스타 변화
  • dperf@baidu

    dperf: DPDK 기반 고성능 네트워크 부하 테스트 도구

    5,601+5최근 7일 스타 변화
  • criterion.rs@bheisler

    Rust를 위한 통계 기반 벤치마킹 라이브러리

    5,523+5최근 7일 스타 변화
  • across@teddysun

    만리장성 너머로 세계의 모든 구석에 닿을 수 있습니다

    5,370+2최근 7일 스타 변화
  • FluidX3D@ProjectPhysX

    OpenCL을 통해 모든 GPU 및 CPU에서 실행되는 가장 빠르고 메모리 효율적인 격자 볼츠만 CFD 소프트웨어. 비상업적 용도로 무료.

    5,254+13최근 7일 스타 변화
  • mmaction2@open-mmlab

    OpenMMLab의 차세대 비디오 이해 툴박스 및 벤치마크

    5,147+5최근 7일 스타 변화
  • Chronos@Kodezi

    Kodezi Chronos는 SWE-bench Lite에서 80.33%의 최고 수준 성능과 67%의 실제 버그 수정 정확도를 달성한 디버깅 중심 언어 모델로, GPT-4보다 6배 이상 뛰어납니다. 적응형 그래프 가이드 검색 및 지속형 디버그 메모리로 구축되었습니다. 모델은 2026년 1분기 Kodezi OS를 통해 제공됩니다.

    4,928+12최근 7일 스타 변화
  • lmms-eval@EvolvingLMMs-Lab

    텍스트, 이미지, 비디오, 오디오 작업을 아우르는 올인원 멀티모달 평가 툴킷

    4,383+11최근 7일 스타 변화
  • evo@MichaelGrupp

    오도메트리 및 SLAM 평가를 위한 Python 패키지

    4,310+7최근 7일 스타 변화
  • CLUE@CLUEbenchmark

    중국어 언어 이해 평가 벤치마크: 데이터셋, 베이스라인, 사전 학습된 모델, 코퍼스 및 리더보드

    4,279+0최근 7일 스타 변화
  • coost@idealvin

    C++11 기반의 초소형 boost 라이브러리.

    4,211-1최근 7일 스타 변화
  • Baichuan2@baichuan-inc

    Baichuan Intelligent Technology에서 개발한 대형 언어 모델 시리즈

    4,083-1최근 7일 스타 변화
  • HTTP(S) 벤치마크 도구, 테스트/디버깅 및 RESTful API

    3,767+3최근 7일 스타 변화
  • XcodeBenchmark@devMEremenko

    XcodeBenchmark는 iMac, MacBook, Mac Pro에서 대규모 코드베이스의 컴파일 시간을 측정합니다.

    3,663+4최근 7일 스타 변화
  • FlashRAG@RUC-NLPIR

    ⚡FlashRAG: 효율적인 RAG 연구를 위한 Python 툴킷 (WWW2025 리소스)

    3,562+13최근 7일 스타 변화
  • mteb@embeddings-benchmark

    MTEB: 다양한 언어와 모달리티에 걸친 임베딩의 최첨단 평가

    3,409+9최근 7일 스타 변화
  • phoronix-test-suite@phoronix-test-suite

    Phoronix Test Suite 오픈소스 크로스플랫폼 자동화 테스트 및 벤치마킹 소프트웨어.

    3,118+5최근 7일 스타 변화
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: 실제 컴퓨터 환경의 개방형 작업을 위한 멀티모달 에이전트 벤치마킹

    3,112+11최근 7일 스타 변화
  • Primes@PlummersSoftwareLLC

    속도와 프로그래머의 재치를 비교하기 위해 100개 이상의 프로그래밍 언어로 구현한 소수(Prime number) 프로젝트입니다.

    3,016-1최근 7일 스타 변화
← 토픽 목록으로