qiufengqijun/mini_qwen
@qiufengqijunEste é um projeto para treinar um Large Language Model do zero, incluindo pré-treinamento, ajuste fino e otimização direta de preferência, com um modelo de 1B de parâmetros que suporta chinês e inglês.
Estrelas
873
Bifurcações
112
Linguagem
Python
Licença
—
Último push
há 2 anos
Intel relacionado (0)
Ainda não há intel relacionado
Este repo ainda não apareceu em nenhuma das fontes que o radar rastreia. O coletor roda em um cronograma — volte quando ele cobrir este repo.