Aller au contenu principal
buildradar
Sign in

RahulSChand/gpu_poor

@RahulSChand

Calcul du nombre de jetons par seconde et des besoins en mémoire GPU pour tout LLM. Prend en charge la quantification llama.cpp/ggml/bnb/QLoRA.

Étoiles
1 406
Bifurcations
88
Langage
JavaScript
Licence
Dernier push
il y a 2 ans
JavaScriptllmlanguage-modelpytorchgpuquantizationllamallama2huggingfaceggmlllamacpp

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.