qiufengqijun/mini_qwen
@qiufengqijunProjet d'entraînement de grands modèles de langage à partir de zéro, incluant pré-entraînement, fine-tuning et optimisation directe des préférences (DPO), avec un modèle de 1B de paramètres supportant le chinois et l'anglais.
Étoiles
873
Bifurcations
112
Langage
Python
Licence
—
Dernier push
il y a 2 ans
Intel associée (0)
Aucune intel associée pour le moment
Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.