mit-han-lab
Repositori open source terpantau milik mit-han-lab, diurutkan berdasarkan bintang.
- #1
[ICLR 2024] Model Bahasa Streaming Efisien dengan Sink Perhatian
★ 7.268+0Perubahan bintang dalam 7 hari terakhir - #2
[Penghargaan Makalah Terbaik MLSys 2024] AWQ: Kuantisasi Bobot berbasis Aktivasi untuk Kompresi dan Akselerasi LLM
★ 3.624+3Perubahan bintang dalam 7 hari terakhir - #3
Model fondasi visi yang efisien untuk generasi dan persepsi resolusi tinggi.
★ 3.356+2Perubahan bintang dalam 7 hari terakhir - #4
[ICCV 2019] TSM: Temporal Shift Module untuk Pemahaman Video yang Efisien
★ 2.222+1Perubahan bintang dalam 7 hari terakhir - #5
[ICML 2023] SmoothQuant: Kuantisasi Pasca-Pelatihan yang Akurat dan Efisien untuk Large Language Models
★ 1.681+4Perubahan bintang dalam 7 hari terakhir - #6
Kerangka kerja berbasis PyTorch untuk Simulasi Kuantum Klasik, Pembelajaran Mesin Kuantum, Jaringan Saraf Kuantum, Sirkuit Kuantum Terparameterisasi dengan dukungan untuk penerapan yang mudah pada komputer kuantum nyata.
★ 1.663+1Perubahan bintang dalam 7 hari terakhir - #7
[MICRO'23, MLSys'22] TorchSparse: Kerangka Kerja Pelatihan dan Inferensi yang Efisien untuk Konvolusi Jarang pada GPU.
★ 1.472+0Perubahan bintang dalam 7 hari terakhir - #8
[ICLR 2019] ProxylessNAS: Pencarian Arsitektur Neural Langsung pada Tugas Target dan Perangkat Keras
★ 1.447+0Perubahan bintang dalam 7 hari terakhir - #9
[NeurIPS 2020] Augmentasi Diferensial untuk Pelatihan GAN yang Efisien Data
★ 1.308+0Perubahan bintang dalam 7 hari terakhir - #10
[CVPR 2020] Kompresi GAN: Arsitektur Efisien untuk GAN Kondisional Interaktif
★ 1.115+0Perubahan bintang dalam 7 hari terakhir - #11
StreamingVLM: Pemahaman Real-Time untuk Aliran Video Tanpa Batas
★ 1.076+3Perubahan bintang dalam 7 hari terakhir - #12
TinyChatEngine: Pustaka Inferensi LLM Pada Perangkat
★ 961+0Perubahan bintang dalam 7 hari terakhir - #13
[NeurIPS 2020] MCUNet: Deep Learning Kecil pada Perangkat IoT; [NeurIPS 2021] MCUNetV2: Inferensi Berbasis Patch yang Efisien Memori untuk Deep Learning Kecil; [NeurIPS 2022] MCUNetV3: Pelatihan di Perangkat di Bawah Memori 256KB
★ 957+1Perubahan bintang dalam 7 hari terakhir - #14★ 949+56Perubahan bintang dalam 7 hari terakhir
- #15
[MLSys'25] QServe: Kuantisasi W4A8KV4 dan Desain Bersama Sistem untuk Layanan LLM yang Efisien; [MLSys'25] LServe: Layanan LLM Sekuens Panjang yang Efisien dengan Perhatian Jarang Terpadu
★ 856+0Perubahan bintang dalam 7 hari terakhir - #16
[CVPR 2024 Highlight] DistriFusion: Inferensi paralel terdistribusi untuk model difusi resolusi tinggi
★ 728+1Perubahan bintang dalam 7 hari terakhir - #17
[IJCV] FastComposer: Pembuatan Gambar Multi-Subjek Tanpa Penyetelan dengan Perhatian Terlokalisasi
★ 714+0Perubahan bintang dalam 7 hari terakhir - #18
[NeurIPS 2020] MCUNet: Tiny Deep Learning on IoT Devices; [NeurIPS 2021] MCUNetV2: Memory-Efficient Patch-based Inference for Tiny Deep Learning
★ 712+1Perubahan bintang dalam 7 hari terakhir - #19★ 649+2Perubahan bintang dalam 7 hari terakhir
- #20
[NeurIPS 2025] Radial Attention: O(nlogn) Sparse Attention dengan Energy Decay untuk Pembuatan Video Berdurasi Panjang
★ 607-1Perubahan bintang dalam 7 hari terakhir - #21
Kernel sparse attention yang mendukung pola sparse campuran.
★ 549+1Perubahan bintang dalam 7 hari terakhir - #22
[ICLR 2025] DuoAttention: Inferensi LLM konteks panjang yang efisien dengan kepala Retrieval dan Streaming.
★ 539+0Perubahan bintang dalam 7 hari terakhir - #23
Pelatihan Pada Perangkat di Bawah Memori 256KB [NeurIPS'22]
★ 524+0Perubahan bintang dalam 7 hari terakhir