Saltar al contenido principal
buildradar
Sign in

patchy631/time-to-first-token

@patchy631

Una hoja de ruta de 10 semanas, 30 minutos al día, para la inferencia y optimización de LLM. Incluye vLLM, SGLang, cuantización, decodificación especulativa y benchmarking.

Estrellas
882
Bifurcaciones
103
Lenguaje
HTML
Licencia
Apache-2.0
Último push
hace 4 semanas
HTMLllmllm-inferencevllmmlopsroadmaplearning-resourcessglang

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.