mit-han-lab
Các kho mã nguồn mở đang theo dõi của mit-han-lab, sắp xếp theo số sao.
- #1
[ICLR 2024] Mô hình ngôn ngữ trực tuyến hiệu quả với Attention Sinks
★ 7.268+0Thay đổi số sao trong 7 ngày qua - #2
[Giải thưởng Bài báo xuất sắc nhất MLSys 2024] AWQ: Lượng tử hóa trọng số nhận biết kích hoạt để nén và tăng tốc LLM
★ 3.624+1Thay đổi số sao trong 7 ngày qua - #3
Các mô hình nền tảng thị giác hiệu quả dành cho việc tạo và nhận diện độ phân giải cao
★ 3.356+1Thay đổi số sao trong 7 ngày qua - #4
[ICCV 2019] TSM: Mô-đun dịch chuyển thời gian để hiểu video hiệu quả
★ 2.222+1Thay đổi số sao trong 7 ngày qua - #5
[ICML 2023] SmoothQuant: Lượng tử hóa sau huấn luyện chính xác và hiệu quả cho các Mô hình Ngôn ngữ Lớn
★ 1.681+2Thay đổi số sao trong 7 ngày qua - #6
Khung công tác dựa trên PyTorch dành cho Mô phỏng Cổ điển Lượng tử, Học máy Lượng tử, Mạng nơ-ron Lượng tử, Mạch lượng tử tham số hóa với hỗ trợ triển khai dễ dàng trên máy tính lượng tử thực tế.
★ 1.663+0Thay đổi số sao trong 7 ngày qua - #7
[MICRO'23, MLSys'22] TorchSparse: Framework huấn luyện và suy luận hiệu quả cho phép tính chập thưa (Sparse Convolution) trên GPU.
★ 1.472+0Thay đổi số sao trong 7 ngày qua - #8
[ICLR 2019] ProxylessNAS: Tìm kiếm kiến trúc nơ-ron trực tiếp trên tác vụ mục tiêu và phần cứng
★ 1.447+0Thay đổi số sao trong 7 ngày qua - #9
[NeurIPS 2020] Tăng cường khả dụng vi phân cho việc huấn luyện GAN hiệu quả dữ liệu
★ 1.308+0Thay đổi số sao trong 7 ngày qua - #10
[CVPR 2020] Nén GAN: Kiến trúc hiệu quả cho các Conditional GAN tương tác
★ 1.115+0Thay đổi số sao trong 7 ngày qua - #11
StreamingVLM: Hiểu thời gian thực cho các luồng video vô hạn.
★ 1.076+3Thay đổi số sao trong 7 ngày qua - #12
TinyChatEngine: Thư viện suy luận LLM trên thiết bị
★ 961+0Thay đổi số sao trong 7 ngày qua - #13
[NeurIPS 2020] MCUNet: Deep Learning nhỏ gọn trên thiết bị IoT; [NeurIPS 2021] MCUNetV2: Suy luận dựa trên bản patch tiết kiệm bộ nhớ cho Deep Learning nhỏ gọn; [NeurIPS 2022] MCUNetV3: Huấn luyện trên thiết bị với bộ nhớ dưới 256KB
★ 957+3Thay đổi số sao trong 7 ngày qua - #14★ 949+67Thay đổi số sao trong 7 ngày qua
- #15
[MLSys'25] QServe: Lượng tử hóa W4A8KV4 và đồng thiết kế hệ thống để phục vụ LLM hiệu quả; [MLSys'25] LServe: Phục vụ LLM chuỗi dài hiệu quả với Unified Sparse Attention
★ 856+2Thay đổi số sao trong 7 ngày qua - #16
[CVPR 2024 Highlight] DistriFusion: Suy luận song song phân tán cho các mô hình khuếch tán độ phân giải cao.
★ 728+0Thay đổi số sao trong 7 ngày qua - #17
[IJCV] FastComposer: Tạo hình ảnh đa chủ thể không cần tinh chỉnh với cơ chế Localized Attention
★ 714-1Thay đổi số sao trong 7 ngày qua - #18
[NeurIPS 2020] MCUNet: Deep Learning nhỏ gọn trên thiết bị IoT; [NeurIPS 2021] MCUNetV2: Suy luận dựa trên bản vá tiết kiệm bộ nhớ cho Deep Learning nhỏ gọn
★ 713+1Thay đổi số sao trong 7 ngày qua - #19★ 649+2Thay đổi số sao trong 7 ngày qua
- #20
[NeurIPS 2025] Radial Attention: Cơ chế chú ý thưa O(nlogn) với sự suy giảm năng lượng cho tạo video dài
★ 607-1Thay đổi số sao trong 7 ngày qua - #21
Kernel sparse attention hỗ trợ các mẫu sparse hỗn hợp.
★ 549+1Thay đổi số sao trong 7 ngày qua - #22
[ICLR 2025] DuoAttention: Suy luận LLM ngữ cảnh dài hiệu quả với các đầu truy xuất và streaming.
★ 539+0Thay đổi số sao trong 7 ngày qua - #23
Huấn luyện trên thiết bị với bộ nhớ dưới 256KB [NeurIPS'22]
★ 524+0Thay đổi số sao trong 7 ngày qua