Aller au contenu principal
buildradar
Se connecter

qiufengqijun/mini_qwen

@qiufengqijun

Projet d'entraînement de grands modèles de langage à partir de zéro, incluant pré-entraînement, fine-tuning et optimisation directe des préférences (DPO), avec un modèle de 1B de paramètres supportant le chinois et l'anglais.

Étoiles
873
Bifurcations
112
Langage
Python
Licence
Dernier push
il y a 2 ans
Python

Aucune intel associée pour le moment

Ce dépôt n'est encore apparu dans aucune des sources que le radar suit. Le collecteur suit un calendrier — revenez une fois qu'il couvre ce dépôt.