Các kho mã nguồn mở đang theo dõi của noonghunna, sắp xếp theo số sao.
Các công thức cộng đồng để phục vụ LLM trên GPU CUDA RTX 3090/4090/5090. Đa engine (vLLM, llama.cpp, ik_llama) và không phụ thuộc mô hình. Hiện đang cung cấp cấu hình Qwen3.6-27B, Qwen3.6 35B, Gemma 4 26B, Gemma 4 31B cho 1 và 2 card.