Dépôts open source suivis de local-inference-lab, triés par étoiles.
Wiki RTX 6000 Pro : exécution de grands modèles de langage (Qwen3.5-397B, Kimi-K2.5, GLM-5) sur des GPU PCIe sans NVLink.