mit-han-lab
mit-han-lab의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #1
[ICLR 2024] Attention Sinks를 활용한 효율적인 스트리밍 언어 모델
★ 7,268+0최근 7일 스타 변화 - #2★ 3,624+1최근 7일 스타 변화
- #3
고해상도 생성 및 인식을 위한 효율적인 비전 파운데이션 모델
★ 3,356+1최근 7일 스타 변화 - #4
[ICCV 2019] 효율적인 비디오 이해를 위한 TSM: Temporal Shift Module
★ 2,222+1최근 7일 스타 변화 - #5
[ICML 2023] SmoothQuant: 대형 언어 모델을 위한 정확하고 효율적인 사후 학습 양자화
★ 1,681+2최근 7일 스타 변화 - #6
실제 양자 컴퓨터에 쉽게 배포할 수 있는 기능을 지원하는, 퀀텀 클래식 시뮬레이션, 양자 머신러닝, 양자 신경망, 매개변수화된 양자 회로를 위한 PyTorch 기반 프레임워크입니다.
★ 1,663+0최근 7일 스타 변화 - #7
[MICRO'23, MLSys'22] TorchSparse: GPU에서의 희소 합성곱을 위한 효율적인 학습 및 추론 프레임워크
★ 1,472+0최근 7일 스타 변화 - #8
[ICLR 2019] ProxylessNAS: 타겟 태스크 및 하드웨어를 위한 직접 신경망 아키텍처 검색
★ 1,447+0최근 7일 스타 변화 - #9
[NeurIPS 2020] 데이터 효율적인 GAN 학습을 위한 미분 가능 증강(Differentiable Augmentation)
★ 1,308+0최근 7일 스타 변화 - #10
[CVPR 2020] GAN 압축: 대화형 조건부 GAN을 위한 효율적인 아키텍처
★ 1,115+0최근 7일 스타 변화 - #11
StreamingVLM: 무한 비디오 스트림을 위한 실시간 이해
★ 1,076+3최근 7일 스타 변화 - #12
TinyChatEngine: 온디바이스 LLM 추론 라이브러리
★ 961+0최근 7일 스타 변화 - #13
[NeurIPS 2020] MCUNet: IoT 기기를 위한 소형 딥러닝; [NeurIPS 2021] MCUNetV2: 소형 딥러닝을 위한 메모리 효율적인 패치 기반 추론; [NeurIPS 2022] MCUNetV3: 256KB 메모리 하에서의 온디바이스 학습
★ 957+3최근 7일 스타 변화 - #14★ 949+67최근 7일 스타 변화
- #15
[MLSys'25] QServe: 효율적인 LLM 서빙을 위한 W4A8KV4 양자화 및 시스템 공동 설계; [MLSys'25] LServe: 통합 희소 어텐션을 통한 효율적인 긴 시퀀스 LLM 서빙
★ 856+2최근 7일 스타 변화 - #16
[CVPR 2024 Highlight] DistriFusion: 고해상도 디퓨전 모델을 위한 분산 병렬 추론
★ 728+0최근 7일 스타 변화 - #17
[IJCV] FastComposer: 로컬 어텐션을 활용한 튜닝 프리 다중 피사체 이미지 생성
★ 714-1최근 7일 스타 변화 - #18
[NeurIPS 2020] MCUNet: IoT 기기를 위한 Tiny Deep Learning; [NeurIPS 2021] MCUNetV2: Tiny Deep Learning을 위한 메모리 효율적인 패치 기반 추론
★ 713+1최근 7일 스타 변화 - #19★ 649+2최근 7일 스타 변화
- #20
[NeurIPS 2025] Radial Attention: 긴 영상 생성을 위한 에너지 감쇠 기반의 O(nlogn) 희소 어텐션
★ 607-1최근 7일 스타 변화 - #21
혼합 희소 패턴을 지원하는 희소 어텐션 커널
★ 549+1최근 7일 스타 변화 - #22
[ICLR 2025] DuoAttention: Retrieval 및 Streaming 헤드를 통한 효율적인 긴 문맥 LLM 추론
★ 539+0최근 7일 스타 변화 - #23
256KB 미만 메모리 환경에서의 온디바이스 학습 [NeurIPS'22]
★ 524+0최근 7일 스타 변화