Tencent/WeDLM
@TencentWeDLM : le modèle de diffusion le plus rapide avec attention causale standard et compatibilité native du cache KV, offrant des gains de vitesse réels par rapport aux bases optimisées vLLM
Étoiles
654
Bifurcations
47
Langage
Python
Licence
NOASSERTION
Dernier push
il y a 6 mois
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.