jjang-ai/vmlx
@jjang-aivMLX - JANGTQ Uber 압축 MLX 모델 - L2 디스크 캐시(재시작 시 유지) + L1 페이지드(초고속 ttft) + 하이브리드 SSM 스케줄러 + 연속 배치 등!
스타
842
포크
84
언어
Python
라이선스
Apache-2.0
마지막 푸시
2일 전
관련 인텔 (0)
아직 관련 인텔이 없습니다
이 저장소는 radar가 추적하는 어떤 소스에도 아직 등장하지 않았습니다. 수집기는 예약에 따라 실행됩니다——이 저장소를 다루게 되면 다시 확인하세요.