Chuyển tới nội dung chính
buildradar
Sign in

zhihu/ZhiLight

@zhihu

Một công cụ tăng tốc suy luận LLM được tối ưu hóa cao cho Llama và các biến thể của nó.

Sao
908
Fork
104
Ngôn ngữ
C++
Giấy phép
Apache-2.0
Push gần nhất
6 tháng trước
C++llmcudagptllm-inferencepytorchllamainference-enginedeepseek-r1llm-servingmodel-serving

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.