Zum Hauptinhalt springen
buildradar
Sign in

1CatAI/1Cat-vLLM

@1CatAI

vLLM-Fork für Tesla V100 (SM70) mit AWQ 4-Bit-Unterstützung, CUDA 12.8 Build-Flow und validiertem Qwen3.5 27B/35B-Deployment auf Multi-GPU-V100.

Sterne
931
Forks
184
Sprache
Python
Lizenz
Apache-2.0
Letzter Push
vor 7 Stunden
Python

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.