Erfasste Open-Source-Repos von RahulSChand, sortiert nach Sternen.
Berechnet Token/s und GPU-Speicherbedarf für beliebige LLMs. Unterstützt llama.cpp/ggml/bnb/QLoRA-Quantisierung.