Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · benchmark

benchmark

Các kho mã nguồn mở đang theo dõi được gắn thẻ benchmark, sắp xếp theo số sao.

Kho mã
158
Tổng số sao
338.554
Số sao trung bình
2.143
Tỷ trọng
0,02%

Những chủ đề thường xuất hiện cùng benchmark trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ benchmark.

  • Báo cáo hiện thực hóa năng lực DeepSeek V4 × J-Space — bằng chứng chuẩn mực cho thấy J-Space làm giảm tổn thất hiện thực hóa năng lực trên DeepSeek V4.

    1.034
  • HarnessEval-W@MirroS-Lab

    HarnessEval-W: Agentifying the Evaluation of Visual Worlds

    256
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • hyperfine@sharkdp

    Công cụ đo hiệu năng dòng lệnh

    28.759+60Thay đổi số sao trong 7 ngày qua
  • Thư viện .NET mạnh mẽ dùng để đo hiệu năng (benchmarking)

    11.485+6Thay đổi số sao trong 7 ngày qua
  • oha@hatoo

    Ohayou (おはよう), trình tạo tải HTTP, lấy cảm hứng từ rakyll/hey với hiệu ứng hoạt hình TUI.

    10.517+17Thay đổi số sao trong 7 ngày qua
  • benchmark@google

    Thư viện hỗ trợ vi chuẩn mực (microbenchmark)

    10.375+13Thay đổi số sao trong 7 ngày qua
  • mmpose@open-mmlab

    Bộ công cụ và benchmark ước lượng tư thế từ OpenMMLab.

    7.860+20Thay đổi số sao trong 7 ngày qua
  • opencompass@open-compass

    OpenCompass là một nền tảng đánh giá LLM, hỗ trợ nhiều loại mô hình (Llama3, Mistral, InternLM2, GPT-4, LLaMa2, Qwen, GLM, Claude, v.v.) trên hơn 100+ tập dataset.

    7.374+48Thay đổi số sao trong 7 ngày qua
  • ecs@spiritLHLS

    Dự án đánh giá máy chủ VPS Fusion Monster, khuyên dùng phiên bản Go không phụ thuộc môi trường hơn

    7.155+16Thay đổi số sao trong 7 ngày qua
  • web-frameworks@the-benchmarker

    Web framework nào là nhanh nhất?

    7.085-1Thay đổi số sao trong 7 ngày qua
  • sysbench@akopytov

    Công cụ đo hiệu năng cơ sở dữ liệu và hệ thống có thể lập script

    6.782+3Thay đổi số sao trong 7 ngày qua
  • YABS - một tập lệnh bash đơn giản để đánh giá hiệu năng máy chủ Linux sử dụng fio, iperf3 & Geekbench

    6.654+20Thay đổi số sao trong 7 ngày qua
  • SWE-bench@SWE-bench

    SWE-bench: Mô hình ngôn ngữ có thể giải quyết các issue GitHub thực tế hay không?

    5.734+54Thay đổi số sao trong 7 ngày qua
  • ann-benchmarks@erikbern

    Benchmarks các thư viện tìm kiếm láng giềng gần nhất xấp xỉ trong Python.

    5.720+5Thay đổi số sao trong 7 ngày qua
  • dperf@baidu

    dperf: Công cụ kiểm thử tải mạng hiệu năng cao dựa trên DPDK

    5.601+5Thay đổi số sao trong 7 ngày qua
  • criterion.rs@bheisler

    Thư viện benchmark dựa trên thống kê dành cho Rust

    5.523+5Thay đổi số sao trong 7 ngày qua
  • across@teddysun

    Vượt qua Vạn Lý Trường Thành, chúng ta có thể chạm tới mọi ngóc ngách trên thế giới

    5.370+2Thay đổi số sao trong 7 ngày qua
  • FluidX3D@ProjectPhysX

    Phần mềm CFD lattice Boltzmann nhanh nhất và tiết kiệm bộ nhớ nhất, chạy trên mọi GPU và CPU thông qua OpenCL. Miễn phí cho mục đích phi thương mại.

    5.254+13Thay đổi số sao trong 7 ngày qua
  • mmaction2@open-mmlab

    Bộ công cụ và benchmark hiểu video thế hệ mới của OpenMMLab

    5.147+5Thay đổi số sao trong 7 ngày qua
  • Chronos@Kodezi

    Kodezi Chronos là một mô hình ngôn ngữ chuyên gỡ lỗi, đạt kết quả tối tân trên SWE-bench Lite (80.33%) và độ chính xác sửa lỗi thực tế 67%, gấp hơn sáu lần so với GPT-4. Được xây dựng với Adaptive Graph-Guided Retrieval và Persistent Debug Memory. Mô hình sẽ ra mắt vào Quý 1 năm 2026 thông qua Kodezi OS.

    4.928+12Thay đổi số sao trong 7 ngày qua
  • lmms-eval@EvolvingLMMs-Lab

    Bộ công cụ đánh giá đa phương thức toàn diện cho các tác vụ Văn bản, Hình ảnh, Video và Âm thanh

    4.383+11Thay đổi số sao trong 7 ngày qua
  • evo@MichaelGrupp

    Gói Python để đánh giá odometry và SLAM

    4.310+7Thay đổi số sao trong 7 ngày qua
  • CLUE@CLUEbenchmark

    Tiêu chuẩn đánh giá hiểu ngôn ngữ tiếng Trung (Chinese Language Understanding Evaluation Benchmark): bộ dữ liệu, baseline, mô hình tiền huấn luyện, ngữ liệu và bảng xếp hạng

    4.279+0Thay đổi số sao trong 7 ngày qua
  • coost@idealvin

    Một thư viện boost nhỏ gọn bằng C++11.

    4.211-1Thay đổi số sao trong 7 ngày qua
  • Baichuan2@baichuan-inc

    Một loạt các mô hình ngôn ngữ lớn được phát triển bởi Baichuan Intelligent Technology

    4.083-1Thay đổi số sao trong 7 ngày qua
  • Công cụ benchmark HTTP(S), kiểm tra/gỡ lỗi và RESTful API

    3.767+3Thay đổi số sao trong 7 ngày qua
  • XcodeBenchmark@devMEremenko

    XcodeBenchmark đo lường thời gian biên dịch của một cơ sở mã lớn trên iMac, MacBook và Mac Pro

    3.663+4Thay đổi số sao trong 7 ngày qua
  • FlashRAG@RUC-NLPIR

    ⚡ FlashRAG: Bộ công cụ Python dành cho nghiên cứu RAG hiệu quả (Tài nguyên WWW2025)

    3.562+13Thay đổi số sao trong 7 ngày qua
  • mteb@embeddings-benchmark

    MTEB: Đánh giá tiên tiến về các embedding qua các ngôn ngữ và phương thức

    3.409+9Thay đổi số sao trong 7 ngày qua
  • phoronix-test-suite@phoronix-test-suite

    Phần mềm kiểm thử/đánh giá hiệu năng tự động mã nguồn mở, đa nền tảng Phoronix Test Suite.

    3.118+5Thay đổi số sao trong 7 ngày qua
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: Đánh giá chuẩn các tác nhân đa phương thức cho các tác vụ mở trong môi trường máy tính thực tế

    3.112+11Thay đổi số sao trong 7 ngày qua
  • Primes@PlummersSoftwareLLC

    Các dự án số nguyên tố bằng hơn 100 ngôn ngữ lập trình, nhằm so sánh tốc độ và sự thông minh của lập trình viên

    3.016-1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề