WeDLM:最快的扩散语言模型,具备标准因果注意力和原生 KV 缓存兼容性,相较于 vLLM 优化的基准能带来实质的速度提升。
radar 追踪的来源里还没有出现过这个 repo。收集器按计划运行——等它覆盖到这个 repo 再回来看看。