noonghunna/club-3090
@noonghunnaCommunity-Rezepte zum Bereitstellen von LLMs auf RTX 3090/4090/5090 CUDA-GPUs. Multi-Engine (vLLM, llama.cpp, ik_llama) und modellagnostisch. Enthält derzeit Konfigurationen für Qwen3.6-27B, Qwen3.6 35B, Gemma 4 26B und Gemma 4 31B für 1×- und 2×-Karten.
Sterne
2.224
Forks
140
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 4 Stunden
Verwandte Intel (0)
Noch keine verwandte Intel
Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.