jmaczan/tiny-vllm
@jmaczanBaue deine eigene performante LLM-Inferenz-Engine in C++ und CUDA – eine kleinere Version von vLLM
Sterne
1.094
Forks
85
Sprache
C++
Lizenz
Apache-2.0
Letzter Push
vor 2 Wochen
Verwandte Intel (0)
Noch keine verwandte Intel
Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.