Zum Hauptinhalt springen
buildradar
Anmelden

zengxiao-he/tessera

@zengxiao-he

Vom Lehrer zu den Kacheln – eine von Grund auf neu entwickelte LLM-Destillations- und Serving-Engine: mit benutzerdefinierten Triton/CUDA-Kernels, FSDP-Destillation, Paged-KV Continuous Batching, spekulativem Decoding, einem Rust-Gateway, einem JAX-Oracle und Tools zur Interpretierbarkeit.

Sterne
566
Forks
9
Sprache
Python
Lizenz
NOASSERTION
Letzter Push
vor 3 Monaten
Pythonrustllmcudapytorchjaxquantizationknowledge-distillationtritoninference-enginefsdpkv-cacheflash-attentionmechanistic-interpretabilityml-systemspaged-attentionspeculative-decoding

Noch keine verwandte Intel

Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.