turboderp-org/exllamav3
@turboderp-orgThư viện lượng tử hóa và suy luận được tối ưu hóa để chạy LLM cục bộ trên các GPU phổ thông hiện đại
Sao
1.267
Fork
146
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
1 tuần trước
Intel liên quan (0)
Chưa có intel liên quan
Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.