Lompat ke konten utama
buildradar
Sign in
Pemilik · mit-han-lab

mit-han-lab

Repositori open source terpantau milik mit-han-lab, diurutkan berdasarkan bintang.

23 repositori
  • streaming-llm@mit-han-lab

    [ICLR 2024] Model Bahasa Streaming Efisien dengan Sink Perhatian

    7.268+0Perubahan bintang dalam 7 hari terakhir
  • llm-awq@mit-han-lab

    [Penghargaan Makalah Terbaik MLSys 2024] AWQ: Kuantisasi Bobot berbasis Aktivasi untuk Kompresi dan Akselerasi LLM

    3.624+3Perubahan bintang dalam 7 hari terakhir
  • efficientvit@mit-han-lab

    Model fondasi visi yang efisien untuk generasi dan persepsi resolusi tinggi.

    3.356+2Perubahan bintang dalam 7 hari terakhir
  • temporal-shift-module@mit-han-lab

    [ICCV 2019] TSM: Temporal Shift Module untuk Pemahaman Video yang Efisien

    2.222+1Perubahan bintang dalam 7 hari terakhir
  • smoothquant@mit-han-lab

    [ICML 2023] SmoothQuant: Kuantisasi Pasca-Pelatihan yang Akurat dan Efisien untuk Large Language Models

    1.681+4Perubahan bintang dalam 7 hari terakhir
  • torchquantum@mit-han-lab

    Kerangka kerja berbasis PyTorch untuk Simulasi Kuantum Klasik, Pembelajaran Mesin Kuantum, Jaringan Saraf Kuantum, Sirkuit Kuantum Terparameterisasi dengan dukungan untuk penerapan yang mudah pada komputer kuantum nyata.

    1.663+1Perubahan bintang dalam 7 hari terakhir
  • torchsparse@mit-han-lab

    [MICRO'23, MLSys'22] TorchSparse: Kerangka Kerja Pelatihan dan Inferensi yang Efisien untuk Konvolusi Jarang pada GPU.

    1.472+0Perubahan bintang dalam 7 hari terakhir
  • proxylessnas@mit-han-lab

    [ICLR 2019] ProxylessNAS: Pencarian Arsitektur Neural Langsung pada Tugas Target dan Perangkat Keras

    1.447+0Perubahan bintang dalam 7 hari terakhir
  • data-efficient-gans@mit-han-lab

    [NeurIPS 2020] Augmentasi Diferensial untuk Pelatihan GAN yang Efisien Data

    1.308+0Perubahan bintang dalam 7 hari terakhir
  • gan-compression@mit-han-lab

    [CVPR 2020] Kompresi GAN: Arsitektur Efisien untuk GAN Kondisional Interaktif

    1.115+0Perubahan bintang dalam 7 hari terakhir
  • streaming-vlm@mit-han-lab

    StreamingVLM: Pemahaman Real-Time untuk Aliran Video Tanpa Batas

    1.076+3Perubahan bintang dalam 7 hari terakhir
  • TinyChatEngine@mit-han-lab

    TinyChatEngine: Pustaka Inferensi LLM Pada Perangkat

    961+0Perubahan bintang dalam 7 hari terakhir
  • tinyengine@mit-han-lab

    [NeurIPS 2020] MCUNet: Deep Learning Kecil pada Perangkat IoT; [NeurIPS 2021] MCUNetV2: Inferensi Berbasis Patch yang Efisien Memori untuk Deep Learning Kecil; [NeurIPS 2022] MCUNetV3: Pelatihan di Perangkat di Bawah Memori 256KB

    957+1Perubahan bintang dalam 7 hari terakhir
  • 949+56Perubahan bintang dalam 7 hari terakhir
  • omniserve@mit-han-lab

    [MLSys'25] QServe: Kuantisasi W4A8KV4 dan Desain Bersama Sistem untuk Layanan LLM yang Efisien; [MLSys'25] LServe: Layanan LLM Sekuens Panjang yang Efisien dengan Perhatian Jarang Terpadu

    856+0Perubahan bintang dalam 7 hari terakhir
  • distrifuser@mit-han-lab

    [CVPR 2024 Highlight] DistriFusion: Inferensi paralel terdistribusi untuk model difusi resolusi tinggi

    728+1Perubahan bintang dalam 7 hari terakhir
  • fastcomposer@mit-han-lab

    [IJCV] FastComposer: Pembuatan Gambar Multi-Subjek Tanpa Penyetelan dengan Perhatian Terlokalisasi

    714+0Perubahan bintang dalam 7 hari terakhir
  • mcunet@mit-han-lab

    [NeurIPS 2020] MCUNet: Tiny Deep Learning on IoT Devices; [NeurIPS 2021] MCUNetV2: Memory-Efficient Patch-based Inference for Tiny Deep Learning

    712+1Perubahan bintang dalam 7 hari terakhir
  • hart@mit-han-lab

    HART: Pembuatan Visual yang Efisien dengan Hybrid Autoregressive Transformer

    649+2Perubahan bintang dalam 7 hari terakhir
  • radial-attention@mit-han-lab

    [NeurIPS 2025] Radial Attention: O(nlogn) Sparse Attention dengan Energy Decay untuk Pembuatan Video Berdurasi Panjang

    607-1Perubahan bintang dalam 7 hari terakhir
  • Kernel sparse attention yang mendukung pola sparse campuran.

    549+1Perubahan bintang dalam 7 hari terakhir
  • duo-attention@mit-han-lab

    [ICLR 2025] DuoAttention: Inferensi LLM konteks panjang yang efisien dengan kepala Retrieval dan Streaming.

    539+0Perubahan bintang dalam 7 hari terakhir
  • tiny-training@mit-han-lab

    Pelatihan Pada Perangkat di Bawah Memori 256KB [NeurIPS'22]

    524+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke peringkat pemilik