Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · benchmark

benchmark

Các kho mã nguồn mở đang theo dõi được gắn thẻ benchmark, sắp xếp theo số sao.

158 kho mã
  • llm-colosseum@OpenGenerativeAI

    Đánh giá LLM bằng cách cho chúng đấu trong Street Fighter 3! Phương pháp mới để đánh giá chất lượng của LLM.

    1.483+0Thay đổi số sao trong 7 ngày qua
  • pytest-benchmark@ionelmc

    pytest fixture để đo hiệu năng mã nguồn

    1.448+0Thay đổi số sao trong 7 ngày qua
  • divan@nvzqz

    Công cụ đo hiệu năng nhanh chóng và đơn giản cho các dự án Rust

    1.444+1Thay đổi số sao trong 7 ngày qua
  • MedMNIST@MedMNIST

    [pip install medmnist] 18 Tập dữ liệu chuẩn hóa cho phân loại hình ảnh y生物 học 2D và 3D

    1.399+0Thay đổi số sao trong 7 ngày qua
  • Trình biên dịch nhanh cho C# Expression Trees và giải pháp thay thế nhẹ LightExpression. Công cụ chẩn đoán và tạo mã cho các biểu thức.

    1.375+1Thay đổi số sao trong 7 ngày qua
  • smac@oxwhirl

    SMAC: Thử thách đa tác nhân StarCraft.

    1.367+1Thay đổi số sao trong 7 ngày qua
  • SLM-Lab@kengz

    Framework Deep Reinforcement Learning mô-đun trong PyTorch. Thư viện đi kèm của cuốn sách "Foundations of Deep Reinforcement Learning".

    1.362+0Thay đổi số sao trong 7 ngày qua
  • Những Tiến Bộ Mới Nhất về Suy Luận Hệ Thống-2

    1.353+0Thay đổi số sao trong 7 ngày qua
  • kg-gen@stair-lab

    [NeurIPS '25] Tạo biểu đồ tri thức từ bất kỳ văn bản nào

    1.266+6Thay đổi số sao trong 7 ngày qua
  • github-action-benchmark@benchmark-action

    GitHub Action để benchmark liên tục nhằm duy trì hiệu năng

    1.251+0Thay đổi số sao trong 7 ngày qua
  • boomer@myzhan

    Một trình tạo tải tốt hơn cho locust, được viết bằng golang.

    1.237+0Thay đổi số sao trong 7 ngày qua
  • LongBench@THUDM

    LongBench v2 và LongBench (ACL 25'&24')

    1.232+1Thay đổi số sao trong 7 ngày qua
  • KernelBench@ScalingIntelligence

    KernelBench: LLM có thể viết GPU Kernel không? - Bộ công cụ và benchmark với Torch -> CUDA (+ nhiều DSL khác)

    1.227+7Thay đổi số sao trong 7 ngày qua
  • PDEBench@pdebench

    PDEBench: Một bộ chuẩn đánh giá toàn diện cho học máy khoa học

    1.192+0Thay đổi số sao trong 7 ngày qua
  • bench-scripts@haydenjames

    Bộ sưu tập các tập lệnh đo hiệu năng máy chủ Linux.

    1.190+0Thay đổi số sao trong 7 ngày qua
  • flow@flow-project

    Khung tính toán học tăng cường trong điều khiển giao thông

    1.188+0Thay đổi số sao trong 7 ngày qua
  • VectorDBBench@zilliztech

    Điểm chuẩn (Benchmark) cho cơ sở dữ liệu vector

    1.173+2Thay đổi số sao trong 7 ngày qua
  • omnisafe@PKU-Alignment

    JMLR: OmniSafe là một framework cơ sở hạ tầng nhằm đẩy nhanh nghiên cứu về SafeRL.

    1.150+1Thay đổi số sao trong 7 ngày qua
  • OpenSTL@chengtan9907

    OpenSTL: Bộ chuẩn mực toàn diện về học tập dự đoán không gian - thời gian

    1.143+5Thay đổi số sao trong 7 ngày qua
  • primesieve@kimwalisch

    🚀 Trình tạo số nguyên tố nhanh

    1.114+1Thay đổi số sao trong 7 ngày qua
  • ClickBench@ClickHouse

    ClickBench: Điểm chuẩn dành cho các cơ sở dữ liệu phân tích

    1.101+8Thay đổi số sao trong 7 ngày qua
  • lzbench@inikep

    lzbench là công cụ đo hiệu năng trong bộ nhớ của các trình nén mã nguồn mở

    1.084+5Thay đổi số sao trong 7 ngày qua
  • Công cụ tạo lưu lượng truy cập và đánh giá hiệu năng cho NoSQL Redis và Memcache.

    1.053+5Thay đổi số sao trong 7 ngày qua
  • opencv_zoo@opencv

    Model Zoo cho OpenCV DNN và các bài kiểm tra chuẩn (Benchmarks).

    1.046+8Thay đổi số sao trong 7 ngày qua
  • benchmark@pytorch

    TorchBench là tập hợp các benchmark mã nguồn mở được sử dụng để đánh giá hiệu năng của PyTorch.

    1.042-1Thay đổi số sao trong 7 ngày qua
  • pyperformance@python

    Bộ công cụ đánh giá hiệu năng Python

    1.030+1Thay đổi số sao trong 7 ngày qua
  • Báo cáo hiện thực hóa năng lực DeepSeek V4 × J-Space — bằng chứng chuẩn mực cho thấy J-Space làm giảm tổn thất hiện thực hóa năng lực trên DeepSeek V4.

    1.026-8Thay đổi số sao trong 7 ngày qua
  • ADBench@Minqi824

    Mã nguồn chính thức của "ADBench: Anomaly Detection Benchmark", NeurIPS 2022.

    1.023+2Thay đổi số sao trong 7 ngày qua
  • asv@airspeed-velocity

    Airspeed Velocity: Một công cụ đo hiệu năng Python đơn giản với báo cáo dựa trên web

    1.018+4Thay đổi số sao trong 7 ngày qua
  • moses@molecularsets

    Molecular Sets (MOSES): Nền tảng đánh giá cho các mô hình tạo phân tử

    988+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề