benchmark
benchmark 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 benchmark 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 benchmark 태그가 달린 리포지토리예요.
- #1
DeepSeek V4 × J-Space 역량 실현 보고서 — J-Space가 DeepSeek V4(Flash/Pro)에서 역량 실현 손실을 줄여준다는 벤치마크 증거
★ 1,034 - #2
HarnessEval-W: Agentifying the Evaluation of Visual Worlds
★ 256 - #3
Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.
★ 160
- #1★ 28,759+60최근 7일 스타 변화
- #2
벤치마킹을 위한 강력한 .NET 라이브러리
★ 11,485+6최근 7일 스타 변화 - #3★ 10,517+17최근 7일 스타 변화
- #4★ 10,375+13최근 7일 스타 변화
- #5★ 7,860+20최근 7일 스타 변화
- #6
OpenCompass는 100개 이상의 데이터셋을 바탕으로 Llama3, Mistral, InternLM2, GPT-4, LLaMa2, Qwen, GLM, Claude 등 다양한 모델을 지원하는 LLM 평가 플랫폼입니다.
★ 7,374+48최근 7일 스타 변화 - #7
VPS 융합 괴물 서버 평가 프로젝트. 환경 의존성이 없는 Go 버전을 사용하는 것을 더욱 권장합니다: https://github.com/oneclickvirt/ecs
★ 7,155+16최근 7일 스타 변화 - #8
가장 빠른 웹 프레임워크는 무엇인가요?
★ 7,085-1최근 7일 스타 변화 - #9★ 6,782+3최근 7일 스타 변화
- #10
YABS - fio, iperf3, Geekbench를 사용하여 Linux 서버 성능을 측정하는 간단한 bash 스크립트
★ 6,654+20최근 7일 스타 변화 - #11★ 5,734+54최근 7일 스타 변화
- #12
Python용 근사 근접 이웃(approximate nearest neighbor) 라이브러리 벤치마크
★ 5,720+5최근 7일 스타 변화 - #13★ 5,601+5최근 7일 스타 변화
- #14
Rust를 위한 통계 기반 벤치마킹 라이브러리
★ 5,523+5최근 7일 스타 변화 - #15★ 5,370+2최근 7일 스타 변화
- #16★ 5,254+13최근 7일 스타 변화
- #17★ 5,147+5최근 7일 스타 변화
- #18
Kodezi Chronos는 SWE-bench Lite에서 80.33%의 최고 수준 성능과 67%의 실제 버그 수정 정확도를 달성한 디버깅 중심 언어 모델로, GPT-4보다 6배 이상 뛰어납니다. 적응형 그래프 가이드 검색 및 지속형 디버그 메모리로 구축되었습니다. 모델은 2026년 1분기 Kodezi OS를 통해 제공됩니다.
★ 4,928+12최근 7일 스타 변화 - #19★ 4,383+11최근 7일 스타 변화
- #20★ 4,310+7최근 7일 스타 변화
- #21★ 4,279+0최근 7일 스타 변화
- #22★ 4,211-1최근 7일 스타 변화
- #23★ 4,083-1최근 7일 스타 변화
- #24
HTTP(S) 벤치마크 도구, 테스트/디버깅 및 RESTful API
★ 3,767+3최근 7일 스타 변화 - #25
XcodeBenchmark는 iMac, MacBook, Mac Pro에서 대규모 코드베이스의 컴파일 시간을 측정합니다.
★ 3,663+4최근 7일 스타 변화 - #26★ 3,562+13최근 7일 스타 변화
- #27★ 3,409+9최근 7일 스타 변화
- #28
Phoronix Test Suite 오픈소스 크로스플랫폼 자동화 테스트 및 벤치마킹 소프트웨어.
★ 3,118+5최근 7일 스타 변화 - #29★ 3,112+11최근 7일 스타 변화
- #30★ 3,016-1최근 7일 스타 변화