Zum Hauptinhalt springen
buildradar
Sign in

jmaczan/tiny-vllm

@jmaczan

Baue deine eigene performante LLM-Inferenz-Engine in C++ und CUDA – eine kleinere Version von vLLM

Sterne
1.094
Forks
85
Sprache
C++
Lizenz
Apache-2.0
Letzter Push
vor 2 Wochen
C++cppaillmcudallm-inferencevllmhpcinferencecourseattentionbatchingpagedattentiontiny-vllm

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.