Aller au contenu principal
buildradar
Se connecter

noonghunna/club-3090

@noonghunna

Recettes communautaires pour déployer des LLM sur des GPU CUDA RTX 3090/4090/5090. Multi-moteur (vLLM, llama.cpp, ik_llama) et agnostique au modèle. Inclut actuellement des configurations pour Qwen3.6-27B, Qwen3.6-35B, Gemma 4-26B et Gemma 4-31B pour 1 ou 2 cartes.

Étoiles
2 166
Bifurcations
134
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 1 semaine
Python

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.