benchmark
Các kho mã nguồn mở đang theo dõi được gắn thẻ benchmark, sắp xếp theo số sao.
- #31★ 2.800+12Thay đổi số sao trong 7 ngày qua
- #32
Các lỗ hổng phổ biến và mã bảo mật trong Java web dựa trên Spring Boot và Spring Security
★ 2.675+1Thay đổi số sao trong 7 ngày qua - #33
CPU-X là phần mềm tự do thu thập thông tin về CPU, bo mạch chủ và nhiều thông tin khác
★ 2.647+0Thay đổi số sao trong 7 ngày qua - #34
Tsung là một framework kiểm thử hiệu năng cao cho nhiều giao thức khác nhau bao gồm HTTP, XMPP, LDAP, v.v.
★ 2.629+0Thay đổi số sao trong 7 ngày qua - #35
Một bộ khung được tối ưu hóa cho các LLM nhỏ hơn
★ 2.528+16Thay đổi số sao trong 7 ngày qua - #36★ 2.525+4Thay đổi số sao trong 7 ngày qua
- #37
[ECCV2024] Video Foundation Models & Data dành cho thấu hiểu đa phương thức
★ 2.374+5Thay đổi số sao trong 7 ngày qua - #38★ 2.362+0Thay đổi số sao trong 7 ngày qua
- #39
Dự án kiểm tra máy chủ VPS Fusion Monster phiên bản Go, hướng tới việc trở thành dự án kiểm tra máy chủ toàn diện nhất, được viết bằng Go và không có phụ thuộc môi trường.
★ 2.329+13Thay đổi số sao trong 7 ngày qua - #40
Một điểm chuẩn dị thể cho Truy xuất thông tin. Dễ sử dụng, đánh giá các mô hình của bạn trên hơn 15 tập dữ liệu IR đa dạng.
★ 2.283+5Thay đổi số sao trong 7 ngày qua - #41★ 2.264+14Thay đổi số sao trong 7 ngày qua
- #42
Cista là một thư viện tuần tự hóa và phản chiếu C++ đơn giản, hiệu năng cao, không sao chép dữ liệu
★ 2.247+1Thay đổi số sao trong 7 ngày qua - #43
📰 Các bài báo và blog không thể bỏ qua về Mô hình Ngữ cảnh Dài dựa trên LLM 🔥
★ 2.164-1Thay đổi số sao trong 7 ngày qua - #44
:zap: Điểm chuẩn framework web Go
★ 2.135+1Thay đổi số sao trong 7 ngày qua - #45
Bản so sánh khách quan giữa nhiều framework cho phép biến đổi ứng dụng web thành ứng dụng desktop.
★ 1.989+0Thay đổi số sao trong 7 ngày qua - #46
Bộ công cụ học máy dùng để phân tích cú pháp nhật ký (log parsing) [ICSE'19, DSN'16]
★ 1.987+0Thay đổi số sao trong 7 ngày qua - #47★ 1.973+2Thay đổi số sao trong 7 ngày qua
- #48
τ-Bench: Một bộ benchmark cho tương tác Công cụ-Tác nhân-Người dùng trong các miền thực tế
★ 1.938+30Thay đổi số sao trong 7 ngày qua - #49
Thử nghiệm các phương pháp lập trình "Ít chậm hơn" trong C++ 20, C, CUDA, PTX, & Assembly, từ số học & SIMD đến coroutine, ranges, xử lý ngoại lệ, mạng và IO không gian người dùng
★ 1.923-1Thay đổi số sao trong 7 ngày qua - #50★ 1.806+1Thay đổi số sao trong 7 ngày qua
- #51★ 1.771-1Thay đổi số sao trong 7 ngày qua
- #52★ 1.757+7Thay đổi số sao trong 7 ngày qua
- #53
SkillsBench đánh giá mức độ hoạt động của các kỹ năng và hiệu quả sử dụng của các agent.
★ 1.742+11Thay đổi số sao trong 7 ngày qua - #54
Tính năng microbenchmarking một header đơn giản, nhanh chóng và chính xác cho C++11/14/17/20
★ 1.733+1Thay đổi số sao trong 7 ngày qua - #55
Nhanh chóng tìm ra điểm nghẽn trong Rust - một công cụ phân tích hiệu năng (profiler) duy nhất cho CPU, bộ nhớ, SQL, HTTP, I/O và mã bất đồng bộ.
★ 1.707+7Thay đổi số sao trong 7 ngày qua - #56
BEHAVIOR-1K: một nền tảng tăng tốc nghiên cứu AI có hiện thân (Embodied AI). Tham gia Discord của chúng tôi để được hỗ trợ: https://discord.gg/bccR5vGFEx
★ 1.677+8Thay đổi số sao trong 7 ngày qua - #57★ 1.624+2Thay đổi số sao trong 7 ngày qua
- #58
Trang GitHub chính thức cho bài báo khảo sát "A Survey on Evaluation of Large Language Models".
★ 1.608-1Thay đổi số sao trong 7 ngày qua - #59
ADR bảo mật các tác nhân AI doanh nghiệp thông qua khả năng quan sát, chuẩn hóa bảo mật và phát hiện mốiis đe dọa. Được triển khai tại Uber.
★ 1.527+21Thay đổi số sao trong 7 ngày qua - #60
:bar_chart: Đánh giá hiệu năng nhiều bộ theo dõi đối tượng (MOT) bằng Python
★ 1.487+0Thay đổi số sao trong 7 ngày qua