mit-han-lab
mit-han-lab की ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #1
[ICLR 2024] अटेंशन सिंक के साथ कुशल स्ट्रीमिंग भाषा मॉडल
★ 7,268+0पिछले 7 दिनों में स्टार का बदलाव - #2
[MLSys 2024 बेस्ट पेपर अवार्ड] AWQ: LLM संपीड़न और त्वरण के लिए एक्टिवेशन-अवेयर वेट क्वांटाइजेशन
★ 3,624+1पिछले 7 दिनों में स्टार का बदलाव - #3
उच्च-रिज़ॉल्यूशन जेनरेशन और परसेप्शन के लिए कुशल विजन फाउंडेशन मॉडल।
★ 3,356+1पिछले 7 दिनों में स्टार का बदलाव - #4
[ICCV 2019] TSM: कुशल वीडियो समझ के लिए टेम्पोरल शिफ्ट मॉड्यूल
★ 2,222+1पिछले 7 दिनों में स्टार का बदलाव - #5
[ICML 2023] SmoothQuant: बड़े भाषा मॉडल के लिए सटीक और कुशल पोस्ट-ट्रेनिंग क्वांटाइजेशन
★ 1,681+2पिछले 7 दिनों में स्टार का बदलाव - #6
Quantum Classical Simulation, Quantum Machine Learning, Quantum Neural Networks, Parameterized Quantum Circuits के लिए एक PyTorch-आधारित फ्रेमवर्क, जो वास्तविक क्वांटम कंप्यूटरों पर आसान परिनियोजन का समर्थन करता है।
★ 1,663+0पिछले 7 दिनों में स्टार का बदलाव - #7
[MICRO'23, MLSys'22] TorchSparse: GPU पर स्पार्स कनवॉल्यूशन के लिए कुशल प्रशिक्षण और अनुमान फ्रेमवर्क।
★ 1,472+0पिछले 7 दिनों में स्टार का बदलाव - #8
[ICLR 2019] ProxylessNAS: टारगेट टास्क और हार्डवेयर पर डायरेक्ट न्यूरल आर्किटेक्चर सर्च
★ 1,447+0पिछले 7 दिनों में स्टार का बदलाव - #9
[NeurIPS 2020] डेटा-कुशल GAN ट्रेनिंग के लिए डिफ़रेंशिएबल ऑगस्टमेंशन
★ 1,308+0पिछले 7 दिनों में स्टार का बदलाव - #10
[CVPR 2020] GAN कॉम्प्रेशन: इंटरैक्टिव कंडीशनल GANs के लिए कुशल आर्किटेक्चर
★ 1,115+0पिछले 7 दिनों में स्टार का बदलाव - #11
StreamingVLM: अनंत वीडियो स्ट्रीम के लिए रियल-टाइम समझ
★ 1,076+3पिछले 7 दिनों में स्टार का बदलाव - #12
TinyChatEngine: ऑन-डिवाइस LLM इन्फेरेंस लाइब्रेरी
★ 961+0पिछले 7 दिनों में स्टार का बदलाव - #13
[NeurIPS 2020] MCUNet: IoT डिवाइस पर टाइनी डीप लर्निंग; [NeurIPS 2021] MCUNetV2: टाइनी डीप लर्निंग के लिए मेमोरी-कुशल पैच-आधारित इन्फरेंस; [NeurIPS 2022] MCUNetV3: 256KB मेमोरी के तहत ऑन-डिवाइस ट्रेनिंग
★ 957+3पिछले 7 दिनों में स्टार का बदलाव - #14★ 955+73पिछले 7 दिनों में स्टार का बदलाव
- #15
[MLSys'25] QServe: कुशल LLM सर्विंग के लिए W4A8KV4 क्वांटाइजेशन और सिस्टम को-डिज़ाइन; [MLSys'25] LServe: एकीकृत स्पार्स अटेंशन के साथ कुशल लॉन्ग-सीक्वेंस LLM सर्विंग।
★ 856+2पिछले 7 दिनों में स्टार का बदलाव - #16
[CVPR 2024 हाइलाइट] DistriFusion: उच्च-रिज़ॉल्यूशन डिफ्यूजन मॉडल के लिए वितरित समानांतर अनुमान।
★ 728+0पिछले 7 दिनों में स्टार का बदलाव - #17
[IJCV] FastComposer: लोकलाइज्ड अटेंशन के साथ ट्यूनिंग-फ्री मल्टी-सब्जेक्ट इमेज जनरेशन
★ 714-1पिछले 7 दिनों में स्टार का बदलाव - #18
[NeurIPS 2020] MCUNet: IoT उपकरणों पर छोटा डीप लर्निंग; [NeurIPS 2021] MCUNetV2: छोटे डीप लर्निंग के लिए मेमोरी-कुशल पैच-आधारित इन्फरेंस।
★ 713+2पिछले 7 दिनों में स्टार का बदलाव - #19★ 649+2पिछले 7 दिनों में स्टार का बदलाव
- #20
[NeurIPS 2025] Radial Attention: लॉन्ग वीडियो जनरेशन के लिए एनर्जी डिके के साथ O(nlogn) स्पार्स अटेंशन
★ 607-1पिछले 7 दिनों में स्टार का बदलाव - #21
मिक्स स्पार्स पैटर्न को सपोर्ट करने वाला एक स्पार्स अटेंशन कर्नल
★ 549+1पिछले 7 दिनों में स्टार का बदलाव - #22
[ICLR 2025] DuoAttention: रिट्रीवल और स्ट्रीमिंग हेड्स के साथ कुशल लॉन्ग-कॉन्टेक्स्ट LLM इन्फरेंस।
★ 540+0पिछले 7 दिनों में स्टार का बदलाव - #23
256KB से कम मेमोरी में ऑन-डिवाइस ट्रेनिंग [NeurIPS'22]
★ 524+0पिछले 7 दिनों में स्टार का बदलाव