noonghunna 收錄中的開源專案,依星數排序。
在 RTX 3090/4090/5090 CUDA GPU 上部署 LLM 的社群配置集。支援多引擎(vLLM、llama.cpp、ik_llama)且與模型無關。目前提供適用於 1 張與 2 張顯示卡的 Qwen3.6-27B、Qwen3.6 35B、Gemma 4 26B、Gemma 4 31B 設定。