Aller au contenu principal
buildradar
Sign in

NVlabs/Fast-dLLM

@NVlabs

Implémentation officielle de "Fast-dLLM : Accélération sans entraînement des LLM de diffusion par l'activation du cache KV et du décodage parallèle"

Étoiles
1 084
Bifurcations
144
Langage
Python
Licence
Apache-2.0
Dernier push
il y a 3 mois
Python

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.