RahulSChand/gpu_poor
@RahulSChandCalcul du nombre de jetons par seconde et des besoins en mémoire GPU pour tout LLM. Prend en charge la quantification llama.cpp/ggml/bnb/QLoRA.
Étoiles
1 406
Bifurcations
88
Langage
JavaScript
Licence
—
Dernier push
il y a 2 ans
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.